Llama 3开源之王：1048k上下文LoRA模型及其应用

AI资讯
5月6日
编辑

量子位

释放双眼，带上耳机，听听看~！

探讨Llama 3开源社区的最新进展：1048k上下文LoRA模型的研发和应用，以及其在文本检索中的性能评估。同时介绍了LoRA模型的合并代码和开发者Eric Hartford的贡献。

堂堂开源之王Llama 3，原版上下文窗口居然只有……8k，让到嘴边的一句“真香”又咽回去了。

在32k起步，100k寻常的今天，这是故意要给开源社区留做贡献的空间吗？

开源社区当然不会放过这个机会：

现在只需58行代码，任何Llama 3 70b的微调版本都能自动扩展到1048k（一百万）上下文。

Llama 3开源之王：1048k上下文LoRA模型及其应用

背后是一个LoRA，从扩展好上下文的Llama 3 70B Instruct微调版本中提取出来，文件只有800mb。

接下来使用Mergekit，就可以与其他同架构模型一起运行或直接合并到模型中。

Llama 3开源之王：1048k上下文LoRA模型及其应用

所使用的1048k上下文微调版本，刚刚在流行的大海捞针测试中达到全绿（100%准确率）的成绩。

Llama 3开源之王：1048k上下文LoRA模型及其应用

不得不说，开源的进步速度是指数级的。

Llama 3开源之王：1048k上下文LoRA模型及其应用

1048k上下文LoRA怎么炼成的

首先1048k上下文版Llama 3微调模型来自Gradient AI，一个企业AI解决方案初创公司。

Llama 3开源之王：1048k上下文LoRA模型及其应用

而对应的LoRA来自开发者Eric Hartford，通过比较微调模型与原版的差异，提取出参数的变化。

他先制作了524k上下文版，随后又更新了1048k版本。

Llama 3开源之王：1048k上下文LoRA模型及其应用

首先，Gradient团队先在原版Llama 3 70B Instruct的基础上继续训练，得到Llama-3-70B-Instruct-Gradient-1048k。

具体方法如下：

调整位置编码：用NTK-aware插值初始化RoPE theta的最佳调度，进行优化，防止扩展长度后丢失高频信息
渐进式训练：使用UC伯克利Pieter Abbeel团队提出的Blockwise RingAttention方法扩展模型的上下文长度

值得注意的是，团队通过自定义网络拓扑在Ring Attention之上分层并行化，更好地利用大型GPU集群来应对设备之间传递许多KV blocks带来的网络瓶颈。

最终使模型的训练速度提高了33倍。

Llama 3开源之王：1048k上下文LoRA模型及其应用

长文本检索性能评估中，只在最难的版本中，当“针”藏在文本中间部分时容易出错。

Llama 3开源之王：1048k上下文LoRA模型及其应用

Llama 3开源之王：1048k上下文LoRA模型及其应用

有了扩展好上下文的微调模型之后，使用开源工具Mergekit比较微调模型和基础模型，提取参数的差异成为LoRA。

同样使用Mergekit，就可以把提取好的LoRA合并到其他同架构模型中了。

合并代码也由Eric Hartford开源在GitHub上，只有58行。

Llama 3开源之王：1048k上下文LoRA模型及其应用

目前尚不清楚这种LoRA合并是否适用于在中文上微调的Llama 3。

不过可以看到，中文开发者社区已经关注到了这一进展。

Llama 3开源之王：1048k上下文LoRA模型及其应用

524k版本LoRA：https://huggingface.co/cognitivecomputations/Llama-3-70B-Gradient-524k-adapter

1048k版本LoRA：https://huggingface.co/cognitivecomputations/Llama-3-70B-Gradient-1048k-adapter

合并代码：https://gist.github.com/ehartford/731e3f7079db234fa1b79a01e09859ac

本网站的内容主要来自互联网上的各种资源，仅供参考和信息分享之用，不代表本网站拥有相关版权或知识产权。如您认为内容侵犯您的权益，请联系我们，我们将尽快采取行动，包括删除或更正。

LoRA模型开源社区微调版本

AI Agent的6种不同类型及应用场景分析

2024-5-6 14:13:41

Rabbit公司曾主打NFT游戏，如今转型AI终端引发争议

2024-5-6 14:32:28

❯

解锁会员权限

个人中心

购物车

优惠劵

今日签到

有新私信私信列表

搜索

幸运之星正在降临...

点击领取今天的签到奖励！

恭喜！您今天获得了{{mission.data.mission.credit}}积分

今日签到

连续签到

{{item.credit}}

连续{{item.count}}天

查看所有

我的优惠劵

_￥_优惠劵

使用时效：无法使用

使用时效：
之前

使用时效：永久有效

优惠劵ID：
×

限制以下商品使用：限制以下商品分类使用：不限制使用：

[{{ct.name}}]

所有商品和商品类型均可使用

没有优惠劵可用!

购物车

×

删除

购物车空空如也!

清空购物车前往结算

您有新的私信

没有新私信

写新私信查看全部