直接拉到5万亿参数!字节押注超级大模型,国内AI竞赛彻底升级据晚点LatePost报道,字节跳动正在讨论训练超5万亿参数的超大模型。这个规模直接超过阿里Qwen3.8‑Max的2.4万亿、月之暗面K3的2.8万亿,如果落地将成为国内已知参数最大的大模型。项目还处在早期阶段,不一定最终发布,但背后的战略思路值得好好琢磨:不再在现有模型尺寸上小步追赶,直接把参数拉到同行数倍,靠堆资源去搏领先位置,内部人士直言“像一场赌博”。字节这套打法,就是内部一直信奉的“大力出奇迹”。进入新赛道,组建多支团队,砸入海量算力、数据资源,集中火力冲刺上限。很多人只看到“5万亿参数”这个数字,却忽略背后的硬代价。超大参数模型,最烧的不只是研发团队,算力、电力、存储全部是天文数字级别。训练5万亿参数模型,需要几十万张高端GPU同时跑,对应海量电力供给,训练过程产生的数据集、权重文件,对企业级存储的需求直接暴增。这件事已经不只是字节一家的企业行为,它把国内大模型的竞争抬升到新维度:以后的比拼,不光看算法技巧,更看算力储备、电力配套、数据资源的综合实力。你觉得堆超大参数,真的能换来AI实力的弯道超车吗?
