轻量版ChatGPT训练方法开源！仅用3天围绕LLaMA打造，号称训练速度比OpenAI快15倍

作者：量子位发布时间：2023-03-05

萧箫发自凹非寺

量子位 | 公众号 QbitAI

基于Meta模型打造的轻量版ChatGPT，这就来啦？

Meta宣布推出LLaMA才三天，业界就出现了把它打造成ChatGPT的开源训练方法，号称比ChatGPT训练速度 最高快15倍。

LLaMA是Meta推出的超快超小型GPT-3，参数量只有后者的10%，只需要单张GPU就能运行。

把它变成ChatGPT的方法名叫ChatLLaMA，基于RLHF （基于人类反馈的强化学习）进行训练，在网上很快掀起了一阵热度。

所以，Meta的开源版ChatGPT真的要来了？

先等等，事情倒也没那么简单。

把LLaMA训练成ChatGPT的“开源方法”

点进ChatLLaMA项目主页来看，会发现它实际上集成了四个部分——

DeepSpeed、RLHF方法、LLaMA和基于LangChain agent生成的数据集。

其中， DeepSpeed是一个开源深度学习训练优化库，包含名叫Zero的现存优化技术，用于提升大模型训练能力，具体指帮模型提升训练速度、降低成本、提升模型可用性等。

RLHF则会采用奖励模型来对预训练模型进行微调。奖励模型即先用多个模型生成问题问答，再依靠人工对问答进行排序，让它学会打分；随后，基于奖励学习给模型生成的回答进行打分，通过强化学习的方式增强模型能力。

LangChain是一个大语言模型应用开发库，希望将各种大语言模型整合起来，结合其他知识来源或计算能力创建一个实用的应用程序。LangChain agent则会像思维链一样放出GPT-3思考的全过程，将操作记录下来。

这时候你会发现，最关键的依旧是 LLaMA的模型权重。它从哪里来？

嘿嘿，自己去找Meta申请吧，ChatLLaMA并不提供。（虽然Meta声称开源LLaMA，但依旧需要申请）

所以本质上来说，ChatLLaMA 并不是一个开源ChatGPT项目，而只是一种基于LLaMA的训练方法，其库内集成的几个项目原本也都是开源的。

实际上，ChatLLaMA也并非由Meta打造，而是来自一个叫做Nebuly AI的初创AI企业。

Nebuly AI做了一个叫做Nebullvm的开源库，里面集成了一系列即插即用的优化模块，用于提升AI系统性能。

例如这是Nebullvm目前包含的一些模块，包括基于DeepMind开源的AlphaTensor算法打造的OpenAlphaTensor、自动感知硬件并对其进行加速的优化模块……

ChatLLaMA也在这一系列模块中，但要注意的是它的开源license也是不可商用的。

所以“国产自研ChatGPT”想要直接拿去用，可能还没那么简单（doge）。

看完这个项目后，有网友表示，要是有人真搞到LLaMA的模型权重（代码）就好了……

但也有网友指出，“比ChatGPT训练方法快15倍”这种说法是一个纯纯的误导：

所谓的快15倍只是因为LLaMA模型本身很小，甚至能在单个GPU上运行，但应该不是因为这个项目所做的任何事情吧？

这位网友还推荐了一个比库中效果更好的RLHF训练方法，名叫trlx，训练速度要比通常的RLHF方法快上3~4倍：

你拿到LLaMA的代码了吗？觉得这个训练方法如何？

ChatLLaMA地址：

https://github.com/nebuly-ai/nebullvm/tree/main/apps/accelerate/chatllama

— 完—

「中国AIGC产业峰会」启动

邀您共襄盛举

「中国AIGC产业峰会」即将在今年3月举办，峰会将邀请AIGC产业相关领域的专家学者，共同探讨生成新世界的过去、现在和未来。

峰会上还将发布 《中国AIGC产业全景报告暨AIGC 50》，全面立体描绘我国当前AIGC产业的竞争力图谱。点击链接或下方图片查看大会详情：

寻找中国版ChatGPT，量子位邀你共同参与中国AIGC产业峰会

点这里 👇关注我，记得标星哦～

一键三连「分享」、「点赞」和「在看」

科技前沿进展日日相见 ~

近期资讯

热锻316不锈钢六角螺母用GR模具钢拉毛磨损，用高硬度8566模具钢

老板咨询，热锻316不锈钢六角螺母，用什么模具钢好？产品要求不断面、无拉毛，目前模芯用的GR模具钢，硬度HRC60，打1-2万件就拉毛了。【誉辉模具钢黄子鹏日记第897篇】不锈钢热锻温度有1000多度，模具表面急速冷热交替，就容易产生细小的热疲劳裂纹。热锻六角螺母一般是2-3工序成型，先镦粗制坯，然后锻压成型、径向填充出六角，对模芯内壁的摩擦比较严重，会加速热裂纹的扩张，严重的会有深度龟裂、掉块的问题，对模具钢的高温强度和冷热疲劳抗性要求比较高。GR模具钢是一款国产热作模具钢，出自上海材料研究所。GR模具

誉辉模具钢黄子鹏 2024-12-29

冬季出行烦恼多？看看ID. 与众的对策

在新能源渗透率已经过半的2024年，能拦着北方用户买传统动力的要素不多，冬季寒冷的天气就是一个——电池充放电性能大幅劣化、掉电快续航低等等都是很现实的问题。在这些麻烦面前，选择“超配”路线的ID. 与众是怎么应对的呢？欲善其事，必利其器缓解冬季纯电出行焦虑的方案或许有很多，但最基础的出发点是一致的，那就是尽量争取更多的可用电量。原因无他——现有的锂电池在低温下都会面临放电容量大幅下降、充放电性能受限等问题，不留出充足的可用电量，无忧出行自然无从谈起。 [图片] 为了从某种程度上缓解这个困扰，ID.

玩电8 2024-12-29

上市6周交付突破5000台！豹8不愧“华系998”国货旗舰新首选豹8大卖引爆

精彩车市 2024-12-29

谷歌优化快速提高排名的5大技巧分享

第一章节：精准关键词策略 1.1关键词研究与选择：找到目标受众常用的搜索查询。 1.2关键词布局：合理安排关键词在标题、描述、正文中的位置。第二章节：优化网站体验 2.1提高页面加载速度：确保网页快速加载，减少跳出率。 2.2移动端优化：优化移动用户的浏览体验，适应移动优先索引。第三章节：内容质量为王 3.1创造高质量内容：生产原创、有价值、符合用户意图的内容。 3.2定期更新内容：保持网站活跃，定期更新有助于提高网站权重。第四章节：建立权威的反向链接 4.1获取高质量外链：通过各种方式获取其他权

搜索一号 2024-12-29

超高性价比智能手表排行榜：2025年必买手表清单

前言对于许多普通消费者来说,智能手表无疑是一个不错的科技配件选择。它们不仅可以提供丰富的智能功能,还能成为时尚的穿戴单品。但问题在于,市面上高端智能手表往往价格不菲,这对于很多人来说无疑是一大负担。不过,请不要放弃智能手表这个选择。事实上,在众多品牌和型号中,我们依然能找到一些性能卓越、价格却相当亲民的超高性价比产品。这些手表不仅外观时尚,功能也相当齐全,完全能满足大众的日常需求。接下来,让我为大家盘点一下2025年最值得关注的高性价比智能手表,看看都有哪些明星产品值得购入。榜单推荐 No.1：——览邦W

bili_86176276645 2024-12-29

小学语文句子能力类型题的口诀初探

写字习惯：腰背直，肩放平，一尺一拳一寸盈；脚放平，身坐正，胸有成竹写字成。

阅镜自之 2024-12-29

选型软件——气立可

软件下载 [名称]：chelic_offlineCD_042020_v11 [大小]：1.08GB [操作系统]：32/64位 [插件类型]：气缸选型软件 [安装环境]：Windows7及以上 [百度网盘下载链接] 链接： https://pan.baidu.com/s/1s9CLCuqe4tO-9LKa4ImK8w?pwd=upzd 提取码：upzd 点击关注，私信回复“解压密码”，即可获取安装包密码软件简介 chelic_offlineCD_042020_v11是气立可公司研发的模型下载软件，可以在

速成机械 2024-12-29

ORR最新J. Am. Chem. Soc.

[图片] [图片] [图片] 【要点1】通过热还原无氧原子的有机金属Pt和Gd配合物，成功制备了负载在中空介孔碳球（HMCS）上的Pt2Gd合金纳米粒子，避免了氧化物副产物的形成。HMCS有效抑制了粒径增长，Pt2Gd具有均匀的粒径分布，平均粒径约5.9 nm；【要点2】在ORR工作条件下，Pt2Gd合金纳米粒子形成了稳定的Pt2Gd核-Pt壳结构，这是其高活性和耐久性的关键原因；【要点3】 Pt2Gd/HMCS在ORR中表现出优异的活性（质量比活性是Pt/HMCS的2.4倍）和卓越的耐久性（经过

量化计算科技有限公司 2024-12-29

轻量版ChatGPT训练方法开源！仅用3天围绕LLaMA打造，号称训练速度比OpenAI快15倍

推荐体验

相关资讯

轻量版ChatGPT训练方法开源！围绕LLaMA打造，号称训练快15倍

喝杯咖啡就能训练大模型？微软开源项目将训练速度提升15倍

微软开源Deep Speed Chat 可将训练速度提升15倍以上

微软开源“傻瓜式”类ChatGPT模型训练工具，速度提升15倍

微软开源“傻瓜式”类ChatGPT模型训练工具，成本大大降低，速度提升15倍

近期资讯

热锻316不锈钢六角螺母用GR模具钢拉毛磨损，用高硬度8566模具钢

冬季出行烦恼多？看看ID. 与众的对策

上市6周交付突破5000台！豹8不愧“华系998”国货旗舰新首选豹8大卖引爆

谷歌优化快速提高排名的5大技巧分享

超高性价比智能手表排行榜：2025年必买手表清单

小学语文句子能力类型题的口诀初探

选型软件——气立可

ORR最新J. Am. Chem. Soc.

基准目标的意义与价值：公差仿真尺寸链计算实战案例国产DTAS3D

高中化学21天晨读晚背计划…

推荐体验

AIGC重要产品

AI对话：类ChatGPT产品体验

好用的AI绘画工具

火热的AIGC产品

AIGC近期要闻

大公司发布的大模型产品都有哪些？

政府对AIGC的扶持政策

AIGC对就业的影响：我们会失业吗？

AIGC产业影响

AIGC对内容创作的影响

AIGC对绘画设计领域的影响

AIGC对各行各业的影响