众力资讯网

我有一种预感:第二个震惊硅谷的 “梁文峰”,已经出现了! 谁能想到,DeepS

我有一种预感:第二个震惊硅谷的 “梁文峰”,已经出现了!

谁能想到,DeepSeek 之后,第二个让华尔街集体冒冷汗的中国人,竟然是一个几个月前还被嘲笑 “掉队” 的 90 后。

他叫杨植麟。

7 月 16 日,杨植麟创办的月之暗面突然扔出 Kimi K3,直接把模型往桌上一拍:2.8 万亿参数,原生多模态,100 万 token 上下文,还要开放模型权重。

这次不是营销噱头,是真把硅谷攥在手里的蛋糕,又狠狠往下切了一大块。

先给非技术圈的朋友掰扯明白,Kimi K3 这组参数到底是什么水平。

之前把硅谷砸得晕头转向的 DeepSeek V4,参数规模是 1.6 万亿,已经是当时全球开源模型的天花板;这次杨植麟直接把纪录拉高了快一倍,干到了 2.8 万亿,成了实打实的全球最大参数开源模型。

更厉害的是它用的 MoE 混合专家架构,896 个专家模块每次只激活 16 个,看着参数体量吓人,实际推理成本却控制得很克制,不是那种只能看不能用的 “纸面怪兽”。

再配上 100 万 token 的超长上下文,相当于一次性就能装下整部长篇小说、一整套项目代码库,做科研、啃文档、写复杂代码的人,光看这个数字就该懂有多香。

但在我看来,最狠的从来不是参数,而是 “开放模型权重” 这五个字。

这也是我一直觉得国产 AI 最聪明的破局路数 —— 你跟硅谷巨头比闭源生态、比用户体量,短期肯定拼不过人家积累了几十年的家底;但你把顶级技术直接开源普惠,等于直接掀了人家的定价桌子。

硅谷玩了这么多年的规矩,就是顶尖技术攥在手里,靠 API 按字收费,躺着赚全世界的钱。

你想用最好的 AI?行,价格我说了算,还得看我愿不愿意给你用。

可现在呢?中国的创业公司把同级别的大模型完整权重放出来,谁都能下载、微调、二次开发,小团队甚至个人开发者,不用砸几十亿训练模型,也能用上顶级 AI 底座。

这一下就把 AI 的门槛从 “亿级” 打到了 “万级”,以后硅谷再想靠技术垄断收天价溢价,没那么容易了。

也难怪马斯克反应这么快,当天就跑出来留言 “Impressive”,转头又放话要对标,变脸速度比翻书还快 —— 说白了就是真的疼了。

说起来杨植麟也不是什么凭空冒出来的黑马。

92 年出生的广东汕头人,中学拿信息学奥赛一等奖保送清华,从热能工程转去计算机系,后来去卡内基梅隆读博,是 Transformer-XL、XLNet 这两个经典 NLP 架构的核心发明人,早年在谷歌大脑、Meta AI 都做过核心研发,在全球 AI 圈早就是数得上号的技术大牛。

换句话说,人家当年在硅谷的时候,就是做底层架构的好手,现在回国创业,根本不是跟着硅谷的路子亦步亦趋抄作业,而是带着自己的技术积累,在走一条不一样的路。

有意思的是,杨植麟和梁文峰简直像一个模子刻出来的 “硅谷克星”:都低调到近乎神秘,不爱开发布会、不接受采访、不站在聚光灯下讲故事;

都死磕底层技术,不玩概念炒作、不搞流量内卷;最后都精准踩中硅谷的命门 —— 用极致的技术 + 开源的模式,打破对方的垄断。

如果说梁文峰是第一个捅破窗户纸的人,那杨植麟就是直接把门踹开的那个。

有人可能会说,不就是个参数大点的模型吗,至于吹得这么神?我倒觉得这事的分量,远不止一个模型本身。

这几年我们听了太多 “中国 AI 只会堆算力、只会模仿” 的风凉话,可从 DeepSeek 的极致成本控制,到月之暗面的注意力残差架构、超大参数开源,我们早就不是追在硅谷尾灯后面跑的追随者了,开始在技术路线上拿出自己的答案。

更难得的是这份定力。现在的创业圈有多浮躁?成立半年就想冲估值,一年就琢磨着 IPO,老板天天上综艺讲鸡汤,心思全花在怎么给投资人讲故事上。

可杨植麟呢?在全网嘲笑他 “掉队” 的日子里,直接砍掉了市场投放,把几乎所有资金和人力都砸进了技术研发,甚至公开说 “不以 IPO 为短期目标”。

在人人都想赚快钱的时代,愿意沉下心跟技术死磕的人,本来就该赢。

当然,客观说 Kimi K3 还不是全球第一,综合能力比起 GPT 和 Claude 的顶级闭源模型还有差距,官方自己也坦然承认了这一点。

但开源模型的可怕之处就在于,它不是一个团队在战斗。

一旦权重全面开放,全世界的开发者都能在上面迭代优化,这种社区式的成长速度,是闭源模型比不了的。

长期来看,谁的后劲更足,真的不好说。

我越来越觉得,梁文峰不是偶然,杨植麟也不会是最后一个。中国的 AI 产业早就过了跟风模仿的阶段,一批年轻的技术人正在用自己的方式改写行业规则。

硅谷躺着垄断 AI 时代的好日子,恐怕真的要进入倒计时了。而这个 92 年的年轻人,和他名为 “登月” 的野心,才刚刚开始让世界侧目。

评论列表

高兴
高兴
2026-07-22 22:59
杨植麟创办的月之暗面突然扔出KimiK3,直接把模型往桌上一拍:2.8万亿参数,原生多模态,100万token上下文,还要开放模型权重。重重点赞👍👍👍👍👍👍👍👍👍👍👍