查看: 115|回复: 1

字节要冲 5 万亿参数:豆包的智商有望拉满,代价是百万显卡级别算力

80

主题

0

回帖

240

积分

中级会员

积分
240
发表于 2026-8-7 11:45:23 | 显示全部楼层 |阅读模式
AI总结
AI总结中
国产大模型参数量正在从万亿级别继续上探。Qwen3.8Max、Kimi K3已经把规模顶到2.4万亿和2.8万亿,再往下一站就是5万亿。这一次,率先行动的可能是字节。晚点 LatePost 报道称,字节正在讨论训练一个超过5万亿参数量的大模型,将成为国内已知规模最大的模型。不过计划还在早期阶段,最终不一定会发布。



5万亿参数是什么量级?它被视为 GPT-5.6或 Opus5级别。参数量越大,大模型性能通常越强,OpenAI 与 Anthropic 正是靠着更高参数量维持领先——消息称这两家内部已在训练甚至完成10万亿参数大模型的准备。但超高参数也意味着超高算力投入。以 H100为基准算账,训练5万亿参数大模型需要10万颗 H100跑347天,或者100万张显卡跑35天。百万卡已经跨进 GW 级算力规模,门槛极高。字节不可能一次梭哈投入这么多算力,更合理的姿势是用20到30万张显卡训练3到4个月,再叠加准备和后训练等环节,至少要半年,甚至一年之后才可能成型。

算力储备上,目前最充裕的仍是 OpenAI,SemiAnalysis 测算其握有约200万张显卡;Anthropic 约62万张;DeepSeek 只有约6万张,且不少还是相对落后的 H20、H800。以字节的财力,喂饱一个5万亿参数大模型不在话下。有了它,豆包的能力做到 GPT-5.6或 Opus5级别没什么悬念,智商能真正拉满,不用再被网友调侃。现在唯一的悬念只剩商业回报——这笔天文数字的投入,能不能在落地端换来对等的收益。

Source URL: https://news.aibase.com/zh/news/30189

0

主题

-1

回帖

-2

积分

限制会员

积分
-2
发表于 2026-8-12 01:05:33 来自手机 | 显示全部楼层

PuddlePanda 发表于 2026-8-7 11:45
字节要冲 5 万亿参数:豆包的智商有望拉满,代价是百万显卡级别算力国产大模型参数量正在从万亿级别继续上 ...
字节计划冲击5万亿参数大模型彰显魄力,虽挑战大但潜力无限。若成功,豆包能力跃升,有望推动行业发展,值得期待!
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

Archiver|手机版|小黑屋|BOSS中文网 Stonespider

相关侵权、举报、投诉及建议等,请发 E-mail:admin#boss.im

Powered by Discuz! X5.1 Licensed © 2001-2026 Discuz! Team.|浙ICP备2022024777号-14

返回顶部