豆包智商拉满 国产大模型将超越5万亿规模:需百万显卡算力
国产大模型突破5万亿参数!字节跳动计划训练超大模型,豆包智商拉满,需百万显卡算力,性能直逼GPT-5。揭秘国产AI新突破,点击了解详情。
国产大模型中,Qwen3.8 Max、Kimi K3参数量已经到了2.4万亿、2.8万亿的级别,再下一步就是5万亿参数量了,这一次可能是字节率先行动。
晚点latepost刚刚报道称,字节正在讨论训练一个超过5万亿参数量的大模型,会是国内已知规模最大的大模型了。
不过这个计划还在早期阶段,不一定会最终发布。

5万亿参数量的规模也被认为是GPT-5.6或者Opus 5级别的,通常来说参数量越大,大模型的性能就越强,OpenAI及Anthropic就是靠着更高的参数量来实现性能领先的优势,据悉他们内部已经在训练甚至完成10万亿参数量大模型的准备了。
但是超高参数量也意味着超高的投入,尤其是算力资源,5万亿参数需要大量AI显卡才行,让DeepSeek算了下,以H100的算力为基准,训练这样的大模型需要10万颗H100训练347天,或者100万张显卡训练35天时间。

百万卡也到了GW级别的算力规模,要求是非常高的,字节也不可能一下子就投入这么多算力,合理的做法是20-30万张显卡训练3-4个月,再算上准备及后训练等,至少要半年时间,甚至一年之后才可能训练出来。
在算力资源上,目前最充裕的还是OpenAI,SemiAnalysis之前测算他们有200万张显卡的算力,Anthropic也有62万张显卡的算力,DeepSeek只有6万张,而且很多还是之前略显落后的H20、H800显卡。
以字节的财力满足5万亿参数大模型训练是没问题的,而且有了这样的大模型,豆包的能力做到GPT-5.6/Opus 5级别是没问题的,智商可以拉满,不用再被网友调侃了。
现在要看的就是字节是否真的准备推进这个大模型的训练了,他们要考虑的可能还是商业上的回报。
- IT早报 0827:工信部官宣鸿蒙成世界第三大手机操作系统;苹果 iPhone 18 发布会定档 9 月 10 日;华为惠普签署专利交叉许可;特斯拉否认撤 FSD 上海数据中心... 2026-08-27
- 10万国产卡支持!智谱发布轻量级旗舰模型对标DeepSeek 2026-08-27
- 英伟达 RTX 3060 12GB 复产后价格暴涨 45%,比性能更强的 RTX 5050 8GB 还贵 60% 2026-08-26
- 阿里通义 Qwen3.8-Flash(Next)发布开源:125B 参数 MoE 模型,训练成本仅为前代 1/9 2026-08-26
- 八十万AI总教头NVIDIA凌晨交卷:事关AI泡沫涨跌 黄仁勋一肚子委屈 2026-08-26
- 1当年的九阴味回来了!《九阴真经:武侠》首个实机PV曝光
- 2六界·六业·六道!暗黑like新游《TARAE: The Unbound》首曝
- 3再用封号!《魔兽》紧急公告插件违法,悬赏10万征集新插件
- 4鸟嘴医生+美女侦探,《白银之城》新PV曝光全新多人模式
- 5熊族梦落地!《激战3》首发熊族“克丹”背景故事解析!
- 6翘臀女主超燃战斗!《昭和米国物语》科隆展新预告发布
- 7抢跑半月!《永恒之塔2》9月17日规模测,10月5日全球上线
- 8全职高手那么火,为何没有游戏公司把《荣耀》做出来?
- 9《暗黑破坏神2》重制版新赛季热度暴跌,问题和出路在哪?
- 10“吃鸡”改"肉鸽"?蓝洞PC端游新作《PUBG: DEDNET》首曝

