当前位置：首页|资讯|GPT-4

GPT-4参数最新爆料！1.76万亿参数，8个2200亿MoE模型，深信不疑

作者：一起学chatGPT一起学ai发布时间：2023-06-21

家人们，GPT-4的参数可能还真不止1万亿！近来，美国知名骇客George Hotz在接受采访时透露，GPT-4由8个220B模型组成。这么算来，8 x 220B = 1.76万亿。就连PyTorch的创建者Soumith Chintala对此也深信不疑。GPT-4：8 x 220B专家模型用不同的数据/任务分布和16-iter推理进行训练。如果真是这样的话，GPT-4的训练可能更加有效。

1.76万亿「八头蛇」？

在GPT-4还未放出之前，GPT-3有1750亿个参数，一众网友猜测GPT-4岂不是要逆天，最起码1万亿。

而George在接受Latent Space的采访时，对GPT4架构的描述着实让人震惊。他的部分原话如下：

GPT-4每个head都有2200亿参数，是一个8路的混合模型。所以，混合模型是当你想不出办法的时候才会做的。OpenAI训练了相同模型8次，他们有一些小技巧。他们实际上进行了16次推断。

他特别强调，OpenAI做了8个混合专家模型，任何人可以花8倍资金都能训练出来。也就是说，人们能够训练更小模型更长时间，微调后，就能找到这些技巧。OpenAI曾经发表类似关于让计算量不变的情况下，让训练更好的算法，比较像BatchNorm和NoBatchNorm。

一起看看George Hotz具体的介绍视频：

网友热评

就像George所说，这是8个较小的模型，如果有足够资金训练8个混合模型，这是一个微不足道的解决方案。

所以，GPT-4是GPT-3的10倍，而1月份的所有小圈圈大圈圈的meme实际上是......真的？！

网友得知秘诀后，打算自己也要训练一个LLaMA集合体与GPT-4竞争。

还有网友称，这有点像LLM-Blender。

我早就听到了稍微可信的传言，说GPT-4将是MoE，但从未得到证实。MoE和大约1万亿个参数不会让我感到惊讶，这听起来极为合理。

还有网友进行深度分析：老实说，我预计这将是人工智能架构的下一阶段。我们已经看到特定任务模型在任务中的表现比一般模型好得多。因此，将许多特定任务模型组合在一起将是下一个合乎逻辑的步骤。这几乎使升级系统变得容易得多，一次只能处理一个模型。话虽如此，OpenAI以一种未来可能会，也可能不会的方式做到了这一点。显然，组合系统可能会有更多的小模型，而不是几个更大的模型。

如果这是真的，这是否意味着每个220B模型也有32K的上下文长度？

推荐体验

相关资讯

GPT-4参数最新爆料，1.76万亿参数，8个2200亿MoE模型，PyTorch创始人深信不疑

1.76万亿「八头蛇」？

新智元 2023-06-21

George Hotz 爆料 GPT-4 由 8 个 MoE 模型组成

据报道，美国知名骇客George Hotz在接受采访时透露，GPT-4由8个220B模型组成。就连PyTorch的创建者Soumith Chintala对此也深信不疑。GPT-4：8 x 220B专家

Metaverse漫游 2023-06-26

GPT-4是8x2200亿参数的混合模型？这个小道消息今天传疯了

GeorgeHotz：除了苹果之外，大部分公司保密的原因都不是在隐藏什么黑科技，而是在隐藏一些‍「不那么酷」的东西。「GPT-4的参数量高达100万亿。」相信很多人还记得这个年初刷屏的「重磅」消息和一张被病毒式传播的图表。

机器之心Pro 2023-06-21

黑客 George Hotz 爆料 GPT-4 由 8 个 MoE 模型组成，真的吗？

用MoE完全意料之中，也是未来必经的方向之一。出乎意料的是在GPT-4阶段OpenAI就在尝试MoE了，这可能预示着算力比想象中更紧张。为何MoE之类是必经方向呢？因为从第一性原理思考，类GPT-3

蓬域科技 2023-06-25

亚马逊大模型Olympus曝光！2万亿参数秒杀GPT-4

11月8日，媒体报道称，亚马逊正在训练他的第二个大语言模型——内部代号为“Olympus”，很有可能在今年12月份上线。这一名为Olympus大语言模型规模达到2万亿（2000B）参数，超过GPT-4的参数规模（此前报道称GPT-4的参数约为1万亿）。

亚马逊 GPT-4 大语言模型

鞭牛士 2023-11-11

近期资讯

资深机长解读韩国737客机失事原因：机长竟然没放起落架！

快科技12月29日消息，29日上午9时7分许，由泰国曼谷起飞的济州航空7C2216号航班在位于全罗南道的务安机场降落时坠落，和机场围栏等发生碰撞后起火爆炸，机上有175名乘客和6名机组人员，共计181人

2024-12-29

雷克萨斯行驶中起火烧成壳！女车主：起火后全车车标被扣走

快科技12月29日消息，日前，有雷克萨斯女车主发布视频维权称，自己的车辆质保期内行驶中起火，事故发生后全车车标被扣走，4S店对起火一事不管不问。女车主介绍，这辆混动雷克萨斯UX 260H是去年

2024-12-29

宁德时代回应减产磷酸铁锂电池：消息不实需求依旧旺盛

快科技12月29日消息，宁德时代近日对网上关于其计划减少磷酸铁锂产量的传言进行了辟谣，称这些传闻不属实。公司表示，目前新能源市场需求旺盛，宁德时代与供应商保持着良好的合作关系，共同推

2024-12-29

雷军挖了个95后天才少女“AI小萝莉”：开出千万年薪

快科技12月29日消息，小米在大模型赛场，频频按下快进键。先是，“雷军亲自重金挖人，开出千万年薪”的风传。据国内媒体报道，雷军开出千万年薪招揽了一位95后AI天才少女—&

2024-12-29

曝苹果、谷歌、三星表带暗藏高危致癌物威胁免疫系统健康

快科技12月29日消息，近日，《环境科学与技术快报》杂志发布了一项重要研究，揭示了流行智能手表表带中隐藏的健康风险。该研究特别关注了智能手表常用的氟橡胶表带材料。由于氟橡胶具有出色的

2024-12-29

韩国载有181人客机失事起火：机型为波音737-800 机龄15年

快科技12月29日消息，综合央视等报道，当地时间今日上午9时7分左右，一架韩国济州航空飞机在全罗南道的务安国际机场降落过程中偏离跑道，撞上机场围墙后起火。视频发生事故的飞机是从泰国曼

2024-12-29

鸿蒙 ArkUI实现地图找房

常用的地图找房功能，是在地图上添加区域、商圈、房源等一些自定义 marker，然后配上自己应用的一些筛选逻辑构成，在这里使用鸿蒙 ArkUI 简单实现下怎么添加区域/商圈、房源等 Marker.

儿歌八万首 2024-12-28

韩国载181人客机起火爆炸：179人遇难 2人生还

快科技12月29日消息，据央视最新报道，韩国全罗南道消防厅在务安机场，对济州航空7C2216航班乘客家属表示，事故客机上除2人幸存以外，其余人员全部遇难。此前消息称有3名获救人员，但其中1人已

2024-12-29

今晚开播：比亚迪王传福与科大讯飞刘庆峰同台科晚盛典

快科技12月29日消息，央视官方今日宣布，由总台社教节目中心精心筹备的首届《中国科技创新盛典》将于12月29日晚22:30在CCTV-1首播，并于12月30日晚20:30在CCTV-10重播。作为科技企业的杰出代表

2024-12-29

手心输入法更新：自动下载360是三年前遗留

快科技12月29日消息，手心输入法在前不久时隔六年后发布了Windows端v3.1版更新，不过此次更新却引发了用户热议。根据用户反馈，新版本似乎会自动下载360弹窗过滤器，这一行为与手心输入法此前

2024-12-29

推荐体验

AIGC重要产品

AI对话：类ChatGPT产品体验

好用的AI绘画工具

火热的AIGC产品

AIGC近期要闻

大公司发布的大模型产品都有哪些？

政府对AIGC的扶持政策

AIGC对就业的影响：我们会失业吗？

AIGC产业影响

AIGC对内容创作的影响

AIGC对绘画设计领域的影响

AIGC对各行各业的影响

意见反馈

Copyright © 2026 aigcdaily.cn 北京智识时代科技有限公司版权所有京ICP备2023006237号-1