众力资讯网

月之暗面凌晨甩出Kimi K3把窗户纸捅破,2.8万亿参数登顶全球开源天花板,前

月之暗面凌晨甩出Kimi K3把窗户纸捅破,2.8万亿参数登顶全球开源天花板,前端编程1679分摁住Claude Fable 5和GPT-5.6 Sol,DeepSeek时刻又来了

麻烦看官老爷们右上角点击一下“关注”,方便您进行讨论和分享,感谢您的支持!
 
2026年7月17日凌晨那份从月之暗面手里推出来的通稿,把整个硅谷都逼得从睡意里抬眼再看一遍,新一代大模型Kimi K3就此毫无预警地闯进全球视野正中央。
 
参数规模一口气冲到2.8万亿这条硬指标,直接把它顶成全球首个开源的3万亿级别大模型,月之暗面官方给出的定性是迄今能力最强的模型压根不算过誉。
 
2.8万亿听起来抽象,月之暗面自家打的比方相当接地气,参数就像人脑里的神经连接,近3万亿意味着这颗数字大脑能装下更多知识懂得更深答得更准。
 
过去十二个月里居然有整整九个月开源模型规模上限纪录都是Kimi自己一次次刷新的,这一回K3直接跨过两万亿门槛把开源天花板顶到了前所未有的高位。
 
光堆参数从来算不上真本事,真正让全球同行坐直身子的是这颗大脑能不能扛得起干活,K3这次在实战成绩单上摊出来的每一档分数,才是让圈子集体沉默的那一环。
 
第三方评测平台Arena AI旗下的Frontend Code Arena前端编程榜单上,K3一举拿下1679分登顶全球第一名的位置,把整张榜单彻底洗成了中国色调。
 
同一张榜单上Claude Fable 5停在1631分的位置,GPT-5.6 Sol也只勉强摸到1618分的高度,两大巨头齐刷刷被K3摁在身位之下这份分寸感相当扎心。
 
另一份Artificial Analysis Intelligence Index综合评测的账本里,K3拿下57分稳稳咬住全球第三的宝座,身前只剩Claude Fable 5和GPT-5.6 Sol两位老对手。
 
更耐人寻味的是GPT-5.5和Claude Opus 4.8这些前不久还被追着跑的名字,眼下已经稳稳被K3甩在身后,这条位次曲线放三年前压根无人敢想。
 
真正让人后背发凉的还不是静态跑分,而是K3能一口气连续自主运行整整四十八个小时,把一款芯片的完整设计加优化加验证从零到底一个人独立扛下来。
 
这场硬核实操基于开源EDA工具和45nm工艺库,最后不仅实现了时序收敛,还打出超过每秒8700token的仿真解码吞吐,数字直接甩到全球同行桌面上。
 
另一份案例是拿五十六段原始素材从头剪出一支完整品牌视频,选片加动作匹配加逐帧卡点加音频处理加多轮反复修改整套流程一手包办压根没让人插手。
 
更炸裂的场景发生在科研赛道,一项资深研究人员通常要花一到两周才能啃下来的活儿,K3只用了大约两个小时就把I-Love-Q普适关系整套复现流程跑完。
 
它自己读透并交叉验证了二十多篇论文,搭起完整的数值计算流水线,评估了三百多种状态方程,还揪出已发表公式里藏着的不一致,最终吐出三千多行Python代码。
 
这三份案例说白了就是把一个道理捅破窗户纸,K3压根不是那种只会写诗聊天的乖巧对话机器人,而是能被当成数字员工使唤的长程Agent真枪实弹上阵。
 
底层技术上K3用的是MoE混合专家架构,总共养了整整八百九十六个专家,每个token实际只唤醒其中十六个开工,别的专家在大部分时间里都在休眠。
 
自研的Kimi Delta Attention把长上下文拆成已总结的历史加新来的变化两段,历史部分压成紧凑的记忆状态,新token只盯着变化的那一小截去反复琢磨。
 
落到百万token的超长上下文场景里,解码速度最高一口气抬到了原先的6.3倍,注意力残差再把训练效率往上顶了约百分之二十五而额外成本还不到百分之二。
 
更值得反复品味的是这颗3万亿级怪兽居然选择彻底开源,全球任何角落的开发者都能拿到权重自己部署自己改造,这跟美国头部把最强模型捂着只卖API形成刺眼对比。
 
从年初的DeepSeek到眼下的Kimi K3,国产大模型的位置正从全面跟跑一路走向全面并跑加部分领跑,下一个让硅谷睡不着觉的中国AI时刻大概率已经在路上了。