首页 > 社会万象

GPT-4参数最新爆料!1.76万亿参数,8个2200亿MoE模型,PyTorch创始人深信不疑

来源:清一色财经 时间:2023-06-23 00:40:49

GPT-4远不止1万亿,甚至,还是8个2200亿参数组成的混合专家模型。

家人们,GPT-4的参数可能还真不止1万亿!


(资料图)

近来,美国知名骇客George Hotz在接受采访时透露,GPT-4由8个220B模型组成。

这么算来,8 x 220B = 1.76万亿。

就连PyTorch的创建者Soumith Chintala对此也深信不疑。

GPT-4:8 x 220B专家模型用不同的数据/任务分布和16-iter推理进行训练。

如果真是这样的话,GPT-4的训练可能更加有效。

1.76万亿「八头蛇」?

在GPT-4还未放出之前,GPT-3有1750亿个参数,一众网友猜测GPT-4岂不是要逆天,最起码1万亿。

而George在接受Latent Space的采访时,对GPT4架构的描述着实让人震惊。

他的部分原话如下:

GPT-4每个head都有2200亿参数,是一个8路的混合模型。所以,混合模型是当你想不出办法的时候才会做的。OpenAI训练了相同模型8次,他们有一些小技巧。他们实际上进行了16次推断。

他特别强调,OpenAI做了8个混合专家模型,任何人可以花8倍资金都能训练出来。

也就是说,人们能够训练更小模型更长时间,微调后,就能找到这些技巧。

OpenAI曾经发表类似关于让计算量不变的情况下,让训练更好的算法,比较像BatchNorm和NoBatchNorm。

网友热评

就像George所说,这是8个较小的模型,如果有足够资金训练8个混合模型,这是一个微不足道的解决方案。

所以,GPT-4是GPT-3的10倍,而1月份的所有小圈圈大圈圈的meme实际上是……真的?!

网友得知秘诀后,打算自己也要训练一个LLaMA集合体与GPT-4竞争。

还有网友称,这有点像LLM-Blender。

我早就听到了稍微可信的传言,说GPT-4将是MoE,但从未得到证实。MoE和大约1万亿个参数不会让我感到惊讶,这听起来极为合理。

还有网友进行深度分析:

老实说,我预计这将是人工智能架构的下一阶段。我们已经看到特定任务模型在任务中的表现比一般模型好得多。

因此,将许多特定任务模型组合在一起将是下一个合乎逻辑的步骤。这几乎使升级系统变得容易得多,一次只能处理一个模型。

话虽如此,OpenAI以一种未来可能会,也可能不会的方式做到了这一点。显然,组合系统可能会有更多的小模型,而不是几个更大的模型。

如果这是真的,这是否意味着每个220B模型也有32K的上下文长度?

网友下了功夫,给它命名为「九头蛇」。

相关稿件

GPT-4参数最新爆料!1.76万亿参数,8个2200亿MoE模型,PyTorch创始人深信不疑

刘诗诗《白日提灯》筹拍,男主之争愈演愈烈,潘粤明或也有望入局

苹果公布新技术:彻底解决玻璃划痕问题|天天微资讯

【环球新要闻】2023年新能源城市排名:江苏居首

【生活】北京发放新一轮消费券 每人最多可领1600元

这次霍霍白羊座了,达墨白羊座4T固态硬盘测试

当前讯息:江西省上高县发布暴雨橙色预警

宁夏:到2025年底实现基本养老服务制度基本健全 环球播报

安全就是幸福 衡东经开区开展2023年“安全生产月”集中培训活动-环球快播报

商务部回应“日本诉中国不锈钢反倾销措施世贸争端案专家组报告”

全球今亮点!端午假期怎么过?吃什么?去哪玩?大数据中找答案

北京乃至京津冀地区,怎么就热成了全国第一?_环球报资讯

歙县1宗商住、1宗商服用地均以底价成交

最新快讯!吉林敦化市总工会多点发力为职工生活向高品质跃升赋能

浩云科技(300448)6月21日主力资金净卖出807.01万元

【党建提升年】延寿县委巡察办党支部:粽叶飘香迎端午 志愿爱心送温暖_最新消息

报告:北上深广为中国房地产开发投资吸引力四强城市 环球最资讯

当前快看:7月份生肖猴:如何保持身心愉悦,迎接好运势?别犯这些错误!

世界快消息!内蒙古自治区达拉特旗发布高温黄色预警

端午假期阿拉善天气如何?“剧透”来啦!_天天资讯

天天快看:炎亚纶与多位男性激吻照曝光,疑似同时与四人交往

消息称特斯拉将收购德国无线充电公司 Wiferion

三亚今日10时起发放一批旅游消费券与离岛免税购物消费券 全球最新

环球头条:包粽子、制香囊 山西太原侨界“云端”庆端午

快资讯:离大谱!曝陈萌曾被前夫家暴,至今脸上有疤,大衣哥手握百万欠条

今头条!端午最美风景线!

中广电广播电影电视设计研究院副院长 潘国林

粽香溢出幸福味道,红安县北门社区陪独居老人过端午

河北高考成绩公布时间确定!这些方式可查询→

200万粉丝大V称车“烂”、“差”,还说买车用户“有病”!知名车企“怒怼”:永久删除并道歉