码农知识堂 - 1000bd
  •   Python
  •   PHP
  •   JS/TS
  •   JAVA
  •   C/C++
  •   C#
  •   GO
  •   Kotlin
  •   Swift
  • Prefix-Tuning: Optimizing Continuous Prompts for Generation


    文章目录

    • In-context Learning
    • Prefix-tuning
    • Related Work
    • Prefix-tuning-intuition
    • Fine-tuning
    • Result(table-to-text)
    • Application:Personalization

    参考
    Prefix-Tuning: Optimizing Continuous Prompts for Generation 作者小姐姐的讲解

    In-context Learning

    在这里插入图片描述
    优点

    • 只需为不同任务写下不同的提示,不需要进行任何特定于任务的训练

    缺点

    • 但不能利用非常大的数据集,如GPT-3有一个有界的上下文窗口,只能处理有限数量的token,所以当我们有一个比上下文窗口长的训练集时,上下文学习不能充分利用该训练集

    • 我们必须手动提出提示,这些手动编写的提示可能不是最佳的

    • GPT-3不能很好的推广到较小的模型

    Prefix-tuning

    在这里插入图片描述

    • 冻结预训练语言模型,只优化前缀,对每个任务只存储这个非常小的前缀。随任务数量增加,开销非常小

    • 前缀可训练。不必手动指定

    • 上下文学习是一个独特的框架,仅适用于大模型。前缀学习可将prompt推广到较小模型

    Related Work

    在这里插入图片描述

    • Tuning the top k layers
      调整top k层是大型微调模型常见做法。通常k等于1或2。调整参数量为20%是因为还要调整包含很多参数的语言模型头

    • Adapter-tuning (也称轻量化微调)
      为下游任务调整语言模型的另一种参数有效方法,冻结预训练参数,并在LM的每一层之间添加了一些可训练的mlp层

    Prefix-tuning-intuition

    在这里插入图片描述
    优化为离散指令
    在这里插入图片描述优化为连续词嵌入
    在这里插入图片描述
    优化所有层的前缀激活
    在这里插入图片描述

    Fine-tuning

    在这里插入图片描述
    连接x和y以获得z,通过Autoregresive LM,在每个时间步计算激活向量 h i h_i hi​,因此 h i h_i hi​通过做上下文的激活和时间布 i i i的输入来计算
    目标为每次生成 y y y中的每个标记的对数概率之和

    在这里插入图片描述
    任务:
    table-to-text任务:输入 X X X 表示一个线性的表格,输出 Y Y Y 表示一个短文本;

    • 自回归模型:在某一时刻 i i i,Transformer的每一层的隐状态向量拼接起来之后用于预测下一个词;

    • 整体采用encoder-to-decoder架构;

    可以将token优化为连续词嵌入,而不是优化离散标记,其效果将向上传播到所有 Transformer 激活层,然后向右传播到后续标记。 这比需要匹配真实单词嵌入的离散提示更具表现力。 同时,这不如干预所有激活层的表现力,这避免了长期依赖并包括更多可调参数。 因此,Prefix-Tuning优化了前缀部分对应的所有层参数。

    • 添加一个prefix,自回归模型表示为 z = [ p r e f i x ; x ; y ] z=[prefix;x;y] z=[prefix;x;y],encoder decoder模型表示为 z = [ p r e f i x ; x ; p r e f i x ′ ; y ] ; z=[prefix;x;prefix′ ;y]; z=[prefix;x;prefix′;y];

    • 输入部分 p r e f i x , x , y prefix, x, y prefix,x,y的position id分别记作 P i d x , X i d x 和 Y i d x P_{idx},X_{idx}和Y_{idx} Pidx​,Xidx​和Yidx​

    • prefix-tuning初始化一个可训练的矩阵,记作 P θ ∈ R ∣ P i d x ∣ × d i m ( h i ) P_\theta\in\mathbb{R}^{|P_{idx}|\times dim(h_i)} Pθ​∈R∣Pidx​∣×dim(hi​)
      它的维度是前缀×激活向量的维度

    • h i h_i hi​用于存储prefix parameters:

      • 处于前缀部分token,参数选择设计的训练矩阵

      • 而其他部分的token,参数则固定且为预训练语言模型的参数。

    Result(table-to-text)

    在这里插入图片描述
    table-to-text
    prefix的性能比adapt和fine-tuneing更好
    在这里插入图片描述

    在这里插入图片描述

    在这里插入图片描述
    在这里插入图片描述

    在这里插入图片描述

    在这里插入图片描述

    Application:Personalization

    在这里插入图片描述

    在这里插入图片描述

  • 相关阅读:
    vue和小程序的异同之处
    解决Oracle SQL语句性能问题——SQL语句改写(in、not in、exists及not exists)
    【智能家居入门2】(MQTT协议、微信小程序、STM32、ONENET云平台)
    手把手教你使用Java生成助记词、私钥、地址|Java区块链钱包生成助记词、地址
    获奖名单出炉 ,鲲鹏应用创新大赛2023全国总决赛圆满落幕
    koa实战 (三):JWT --Token 登录验证
    Android studio run 手机或者模拟器安装失败,但是生成了debug.apk
    Python 集合13 update()方法—更新为并集
    App测试时常用的adb命令你都掌握了哪些呢?
    pip 换阿里源
  • 原文地址:https://blog.csdn.net/qq_43130927/article/details/125988590
  • 最新文章
  • Agent出现LLM因为历史工具调用消息而误解工具调用方式的问题
    [实例] SPI接口的ADC芯片全通道纯硬件驱动——基于HAL库和TLA2518芯片
    龙芯2k0300 - 智能车走马观碑组目标检测算法
    深度学习进阶(二十)Transformer-XL
    10 个示例快速入门 Go-Spring|v1.3.0 正式发布
    PyTorch KernelAgent 源码解读 ---(1)--- 原理
    洛谷-P16434 [APIO 2026 中国赛区] 蛋糕 题解
    有关认知感受的论文(娱乐)
    Llamaindex框架
    本地大模型推理实战
  • 热门文章
  • 十款代码表白小特效 一个比一个浪漫 赶紧收藏起来吧!!!
    奉劝各位学弟学妹们,该打造你的技术影响力了!
    五年了,我在 CSDN 的两个一百万。
    Java俄罗斯方块,老程序员花了一个周末,连接中学年代!
    面试官都震惊,你这网络基础可以啊!
    你真的会用百度吗?我不信 — 那些不为人知的搜索引擎语法
    心情不好的时候,用 Python 画棵樱花树送给自己吧
    通宵一晚做出来的一款类似CS的第一人称射击游戏Demo!原来做游戏也不是很难,连憨憨学妹都学会了!
    13 万字 C 语言从入门到精通保姆级教程2021 年版
    10行代码集2000张美女图,Python爬虫120例,再上征途
小工具 小游戏
Copyright © 2022 侵权请联系2656653265@qq.com    京ICP备2022015340号-1

京公网安备 11010502049817号