微软&佐治亚理工学院 | AdaLoRA：自适应预算分配以实现参数有效的微调

2,291次阅读

本文提出了一种参数高效的微调方法–AdaLoRA，它根据重要性评分自适应地分配参数预算。在AdaLoRA中，以奇异值分解的形式对权重矩阵的增量更新进行参数化。然后，根据新的重要性指标，通过操纵奇异值，在增量矩阵之间动态地分配参数预算。这种方法有效地提高了模型性能和参数效率。我们对自然语言处理、问题回答和自然语言生成任务进行了广泛的实验。结果表明，AdaLoRA的性能优于现有的方法。

Adaptive Budget Allocation for Parameter-Efficient Fine-Tuning

Qingru Zhang, Minshuo Chen, Alexander Bukharin, Pengcheng He, Yu Cheng, Weizhu Chen, Tuo Zhao

[Georgia Institute of Technology & Princeton University & Microsoft Azure AI]

在下游任务中对大型预训练语言模型进行微调已经成为NLP的一个重要范式。然而，通常的做法是对预训练模型中的所有参数进行微调，当有大量的下游任务时，这种做法就变得令人望而却步。因此，许多微调方法被提出来，以参数有效的方式学习预训练权重的增量更新，例如低等级增量。这些方法通常将增量更新的预算平均分配到所有预训练的权重矩阵上，而忽略了不同权重参数的不同重要性。
因此，微调性能是次优的。为了弥补这一差距，提出了AdaLoRA，它根据权重矩阵的重要性得分，在权重矩阵之间自适应地分配参数预算。特别是，AdaLoRA以奇异值分解的形式对增量更新进行参数化。这种新颖的方法使得能够有效地修剪不重要的更新的奇异值，这主要是为了减少它们的参数预算，但规避密集的精确SVD计算。
在自然语言处理、问题回答和自然语言生成方面用几个预训练的模型进行了广泛的实验，以验证AdaLoRA的有效性。结果表明，AdaLoRA比基线有明显的改进，特别是在低预算的情况下。

代码：https://github.com/QingruZhang/AdaLoRA

https://arxiv.org/pdf/2303.10512.pdf

微软&佐治亚理工学院 | AdaLoRA：自适应预算分配以实现参数有效的微调

正文完

可以使用微信扫码关注公众号（ID：xzluomor）

AI AR

发表至：智源

2023年3月21日

奥特曼YC演讲：套壳ChatGPT者死，我行不代表你行

关于英伟达黄仁勋专访的几点思考

厦大联合字节提出DLIP | 一个简单又高效的视觉-语言预训练蒸馏框架

奥特曼挖走iPhone设计师，联手乔纳森造AI硬件

TechCrunch：微软开始向Edge推出Bing Image Creator，由OpenAI的DALL-E提供支持，可通过Bing Chat访问，让用户根据文本提示创建图片

星巴克和高德地图推出的合作项目，让咖啡可以“沿街取”了

评论（没有评论）

2023 年 3 月
一	二	三	四	五	六	日
	1	2	3	4	5
6	7	8	9	10	11	12
13	14	15	16	17	18	19
20	21	22	23	24	25	26
27	28	29	30	31

文心AIGC

人工智能ChatGPT，AIGC指利用人工智能技术来生成内容，其中包括文字、语音、代码、图像、视频、机器人动作等等。被认为是继PGC、UGC之后的新型内容创作方式。AIGC作为元宇宙的新方向，近几年迭代速度呈现指数级爆发，谷歌、Meta、百度等平台型巨头持续布局

文章搜索

最新评论

ufabet มีเกมให้เลือกเล่นมากมาย: เกมเดิมพันหลากหลาย ครบทุกค่ายดัง

tornado crypto mixer Discover the power of privacy with TornadoCash! Learn how this decentralized mixer ensures your transactions remain confidential.

ดูบอลสด Very well presented. Every quote was awesome and thanks for sharing the content. Keep sharing and keep motivating others.

ดูบอลสด Pretty! This has been a really wonderful post. Many thanks for providing these details.

ดูบอลสด Hi there to all, for the reason that I am genuinely keen of reading this website’s post to be updated on a regular basis. It carries pleasant stuff.

Obrazy Sztuka Nowoczesna Thank you for this wonderful contribution to the topic. Your ability to explain complex ideas simply is admirable.

ufabet Hi there to all, for the reason that I am genuinely keen of reading this website’s post to be updated on a regular basis. It carries pleasant stuff.

ufabet You’re so awesome! I don’t believe I have read a single thing like that before. So great to find someone with some original thoughts on this topic. Really.. thank you for starting this up. This website is something that is needed on the internet, someone with a little originality!

ufabet Very well presented. Every quote was awesome and thanks for sharing the content. Keep sharing and keep motivating others.

经典留声机

经典流行从来都不冲突

在这里，听见你曾经的故事

新浪微博：主播小D

小红书：小D就是我

抖音号：52915017

Search Episodes

薛之谦：从“人歌分离”到“深情解构者”的音乐涅槃之路（上）

2025年6月30日

主播小D

你一定听过这些经典合唱–第一篇

2025年1月20日

主播小D

缅怀一代歌王罗文的经典之声–第二篇

2024年12月30日

主播小D

缅怀一代歌王罗文的经典之声–第一篇

2024年12月27日

主播小D

在这里，听琼瑶，岁月长歌–第二篇

2024年12月24日

主播小D

在这里，听琼瑶，岁月长歌–第一篇

2024年12月21日

主播小D

你总能在这些歌里找到你的回忆–第一百零三篇

2024年12月18日

主播小D

你总能在这些歌里找到你的回忆–第一百零四篇

2024年12月13日

主播小D

《这些歌都发行在2001年–第三篇》

2024年12月10日

主播小D

《这些歌都发行在2001年–第二篇》

2024年12月7日

主播小D

Search Results placeholder

2023 年 3 月
一	二	三	四	五	六	日
	1	2	3	4	5
6	7	8	9	10	11	12
13	14	15	16	17	18	19
20	21	22	23	24	25	26
27	28	29	30	31