标签: 杨植麟
美国科技圈最近重新掀起了一场关于人才流失的大讨论。Kimi-K3创始人杨植麟,本
美国科技圈最近重新掀起了一场关于人才流失的大讨论。Kimi-K3创始人杨植麟,本科出身清华姚班,后在美国卡内基梅隆大学完成博士研究,曾经拥有留在美国发展的绝佳条件,可他最终选择回国创业。这背后到底是一个年轻人的职业选择,还是美国科技人才吸引模式正在出现裂缝?答案可能比很多人想象得更复杂。美国过去靠高校、资本和移民体系吸引全球人才,如今却发现,顶尖人才并不一定会永久停留。杨植麟的故事之所以受到关注,是因为他的经历几乎符合美国过去最理想的人才引进路径。顶尖本科教育、美国名校博士背景、人工智能领域研究经历,这样的人才曾经是硅谷企业争夺的核心对象。谷歌、Meta、苹果等企业长期依靠全球优秀工程师保持技术领先,而大量海外科研人员也把美国视为实现科技梦想的首选地点。但人工智能时代正在改变这种逻辑。过去,一个优秀研究人员进入美国大厂,拿到高薪职位,就被认为拥有了成功人生。现在,对于一些真正具备创业能力的人来说,问题已经变成了另一个方向:自己能不能决定技术路线,能不能打造属于自己的产品,能不能站在产业浪潮的中心,而不是成为庞大体系中的一个技术环节。美国人才政策的问题,也在这场讨论中再次被摆上台面。H1B签证长期以来帮助美国吸纳大量海外技术人员,但其申请机制、等待时间以及后续身份转换问题,让不少外国人才始终处于不确定状态。对于普通工程师而言,这种压力可能还能承受,但对于有能力改变产业格局的创业者来说,他们会重新计算自己的选择。事实上,美国过去几十年形成了一套强大的科技循环:全球人才进入美国高校,进入科研机构,再进入企业,推动技术突破。这个体系曾经帮助美国掌握互联网、移动通信、生物科技等多个领域优势。但随着中国科技产业快速成长,全球人才竞争已经从“谁拥有最好的实验室”转向“谁能最快把技术变成现实”。Kimi-K3受到关注,恰恰说明人工智能竞争正在进入新的阶段。大模型不只是论文竞赛,也不是单纯比拼参数规模,更重要的是谁能找到大量应用场景,让技术快速迭代。中国庞大的市场规模、丰富的产业需求和快速变化的应用环境,为AI创业者提供了独特条件。美国拥有世界顶级基础研究能力,这一点短期内不会改变。硅谷依旧聚集着大量资本和尖端企业,但美国科技体系也面临新的挑战:大型科技公司越来越强调稳定商业模式,内部流程越来越复杂,一些年轻研究者想推动新的方向,需要付出更高成本。相比之下,中国近年来不断完善人工智能产业链,从算力基础设施到应用生态,从企业创新到产业数字化,都形成了更适合快速试错的环境。对于创业者而言,技术成果能否迅速进入市场,已经成为衡量创新能力的重要因素,而中国市场恰好提供了这样的条件。杨植麟选择回国,并不是简单的“离开美国”。更准确地说,这是全球科技人才流动趋势变化的一个缩影。过去很多优秀人才把美国视为唯一选择,因为那里拥有资金、平台和机会。但如今,中国等新兴科技力量正在提供另一种路径:不仅可以参与技术研发,也可以直接推动产业落地。这也是美国部分科技人士开始担忧的原因。真正值得警惕的,并不是某一个工程师去了哪里,而是未来一批拥有全球视野的年轻科学家,会不会越来越倾向于选择能够给予他们更大自主权的地方。人工智能竞争已经不是简单的企业竞争,而是创新体系之间的长期较量。一个国家想保持科技领先,不能只依靠过去积累的优势,还需要持续吸引人才、激励创业、创造新的增长空间。如果人才进入之后只能成为体系里的执行者,那么吸引力自然会下降。
#胡锡进提醒杨植麟梁文锋别去美国#知名媒体人发博:老胡要提醒杨植麟、梁文锋,以
#胡锡进提醒杨植麟梁文锋别去美国#知名媒体人发博:老胡要提醒杨植麟、梁文锋,以及月之暗面和深度求索的其他核心成员,从现在起的未来一段时间里不要去美国了,也暂时别去其他五眼联盟国家了。我担心,美国可能会以“盗取知识产权”以及“威胁美国国家安全”的莫须有罪名对他们下手,不仅打击KimiK3和DeepSeek,而且同时震慑在中国从事顶尖AI研究的科学家们。当美国在对外竞争中发生困难时,他们总有通过罗织罪名的非市场竞争方式打击对手的冲动。也许相关行动不会发生,但是防人之心不可无,对美国这样的政治流氓国家,还是要多存一份警惕。这几天,美国AI巨头和政治人物对KimiK3“窃取”美国大模型核心技术的指控甚嚣尘上。比如,特朗普科技顾问迈克尔·克拉齐奥斯最新声称,月之暗面人工智能项目通过所谓的“蒸馏”技术对美国顶尖AI大模型的能力进行了“大规模窃取”。他还声称,月之暗面“很可能”还骗取了访问受限的尖端英伟达服务器的权限,训练其模型。周三,美国财长贝森特也指控称,中国公司通过进行“工业规模的蒸馏攻击”越界窃取美国知识产权。他表示,制裁“将被提上议程”。美国两个顶级AI公司OpenAI和Anthropic对中国大模型的指控更是不遗余力,完全是不肯接受中国大模型在能力上迅速追上来的歇斯底里。欲加之罪,何患无辞。美国那些闭源大模型试图建立垄断性AI霸权,KimiK3在DeepSeek之后又一次击碎了他们的野心和幻象,他们现在比政客更想用非科学和非市场手段打击中国竞争者,堵住他们影响力的溃堤。中国不是小国,我们的力量、生态,以及捍卫主权的决心,足以对抗美国的各种攻击性野心。2018年,华为的孟晚舟被抓,后来加拿大被迫释放她,就是中国实力和决心在特殊斗争领域的展现。我相信,那一役对五眼联盟都是一个教训。尽管如此,老胡个人还是要提醒杨植麟和梁文锋,当他们成为与美国公司竞争顶级科技能力的旗手时,多一分自我保护的防备无疑是必要的。最后我要再强调一遍,除了美国,五眼联盟其他成员国家都暂时别去了。
老胡要提醒杨植麟、梁文锋,以及月之暗面和深度求索的其他核心成员,从现在起的未来一
老胡要提醒杨植麟、梁文锋,以及月之暗面和深度求索的其他核心成员,从现在起的未来一段时间里不要去美国了,也暂时别去其他五眼联盟国家了。我担心,美国可能会以“盗取知识产权”的莫须有罪名对他们下手,不仅打击KimiK3和DeepSeek,而且同时震慑在中国从事顶尖AI研究的科学家们。当美国在对外竞争中发生困难时,他们总有通过罗织罪名的非市场竞争方式打击对手的冲动。也许相关行动不会发生,但是防人之心不可无,对美国这样的政治流氓国家,还是要多存一份警惕。这几天,美国AI巨头和政治人物对KimiK3“窃取”美国大模型核心技术的指控甚嚣尘上。比如,特朗普科技顾问迈克尔·克拉齐奥斯最新声称,月之暗面人工智能项目通过所谓的“蒸馏”技术对美国顶尖AI大模型的能力进行了“大规模窃取”。他还声称,月之暗面“很可能”还骗取了访问受限的尖端英伟达服务器的权限,训练其模型。周三,美国财长贝森特也指控称,中国公司通过进行“工业规模的蒸馏攻击”越界窃取美国知识产权。他表示,制裁“将被提上议程”。美国两个顶级AI公司OpenAI和Anthropic对中国大模型的指控更是不遗余力,完全是不肯接受中国大模型在能力上迅速追上来的歇斯底里。欲加之罪,何患无辞。美国那些闭源大模型试图建立垄断性AI霸权,KimiK3在DeepSeek之后又一次击碎了他们的野心和幻象,他们现在比政客更想用非科学和非市场手段打击中国竞争者,堵住他们影响力的溃堤。中国不是小国,我们的力量、生态,以及捍卫主权的决心,足以对抗美国的各种攻击性野心。2018年,华为的孟晚舟被抓,后来加拿大被迫释放她,就是中国实力和决心在特殊斗争领域的展现。我相信,那一役对五眼联盟都是一个教训。尽管如此,老胡个人还是要提醒杨植麟和梁文锋,当他们成为与美国公司竞争顶级科技能力的旗手时,多一分自我保护的防备无疑是必要的。最后我要再强调一遍,除了美国,五眼联盟其他成员国家都暂时别去了。
梁文锋四小时投资人会议实录巧了,海外社交媒体、主流媒体都在认真讨论这个问题,结论
梁文锋四小时投资人会议实录巧了,海外社交媒体、主流媒体都在认真讨论这个问题,结论一致:当下人工智能的中国天才发现中国的创业机会比美国更多!¹这篇文章提供了杨植麟的几条关键信息。原来,杨植麟在卡内基梅隆大学博士答辩以后,他有好几条途径可以留在美国的!apple公司、谷歌、Meta,以及斯坦福大学、MIT的博士后职位,都有机会。划重点:apple的高管甚至妥协了一下,说鉴于杨植麟非常想回国,那么能不能去apple的北京办公室?²杨植麟全都拒绝了,他的博士生导师说他就是想创业。“如果不尝试创办自己的AI公司,他会后悔一辈子”。结果他成功了!“更深层次的原因在于一种格局的改变:中国人工智能生态系统的影响力与日俱增、日益增强”。梁文锋融资会议52句话³这篇文章还引用了一个数据,前几天已经看到:胡佛研究所追踪Deepseek的核心模型论文作者群发现,当前53.5%的作者从未在中国境外学习或工作过。那些有美国学者或工作经验的人中,70%已经回到国内工作!“杨植麟的经历表明,美国对人才的包容度有所下降,而中国对人才的吸引力日益增强”。
杨植麟的月之暗面创造了KimiK3,轰动整个世界。他是近年来第一个放弃了美国机
杨植麟的月之暗面创造了KimiK3,轰动整个世界。他是近年来第一个放弃了美国机会、回中国创业,并且打败了或者强烈震动了所有美国同行的中国年轻人。我们这些年听惯了中国年轻学子们去美国大显身手的故事,而杨植麟是第一个以绝对成就把故事反写回来的人。的确啊,很多清华等名校毕业的中国尖子生进入了美国顶级AI团队,获得了高薪,在很多中国年轻人中间备受艳羡。他们有的参加中国网络视频访谈,讲述在美国的成功故事,成为了偶像。然而,杨植麟一个人的成就足以抹去他们所有人的光环。杨植麟证明了一个中国年轻科学家的创造力可以是无上限的,全世界顶级的,而且中国这块热土、中国的社会生态完全能够承载得起这样的世界级奇迹。老胡深信,杨植麟的故事将成为中美人才流动历史性转折的突出标记。其实在他之前,已经有数以千计,甚至更多曾在美国留学、工作并取得不同成就的中国学者们回国任职。他们在国内大学里建立科学实验室,甚至开宗立派。他们共同创造了中国人才从美国的历史性回流。杨植麟作为他们中间的一位,直接干翻、追平或者极其接近了美国不可一世的AI大模型。他的KimiK3创造了新的“DeepSeek时刻”,严重冲击了美国股市,“月之暗面”成为全球媒体的热词。而且全球创造一流AI成就的负责人里,杨植麟是最年轻的一位。对比一下吧,OpenAI的CEO萨姆·奥尔特曼2023年出头时38岁,Anthropic的创始人达里奥·阿莫迪43岁,而杨植麟只有34岁。杨植麟与DeepSeek创始人梁文锋有着差异很大的履历,他们成为支撑起中国AI强势的双雄。梁文锋一直在国内,他毕业于浙江大学信息与电子工程系,是从量化基金里杀出来的黑马,一举打翻了美国AI霸权的幻象。DeepSeek2025年1月发布之后,迅速在Arena等排行榜上攀升至前列。在关于DeepSeek的消息刚传出后,英伟达股价一日内大跌17%,全世界媒体和业界当时都惊呆了。有不少人把DeepSeek的问世当成美国AI界的“斯普特尼克时刻”。梁文锋打响了挑战美国AI霸权的第一枪,其功勋可圈可点。然而,中国AI人才朝美国流失的势头并未因DeepSeek的成功而逆转,很多中国年轻人继续加入美国AI团队,获得高薪,做“人生赢家”。1992年出生的杨植麟来自广东汕头,2015年,他以清华计算机系第一名的成绩毕业,前往美国卡内基梅隆大学攻读博士学位,导师是曾任苹果AI研究主管的鲁斯兰·萨拉赫丁诺夫。毕业后他先后进入谷歌大脑和MetaAI实验室,作为核心成员参与了Transformer-XL和XLNet两项开创性研究。Transformer是今天所有大模型的底层骨架,相当于AI世界的"发动机"。然而杨植麟在前程一片光明的时刻做出了一个决定:回国创业。他曾对媒体表示,“如果不去亲自创业,我以后一定会后悔终生。”他认为留在硅谷大厂、顶尖研究院,待遇优渥、工作体面,但终究只是高级技术雇员;想完整主导大模型研发、产品落地、公司发展,只有回国创业才能实现。了不起的成功者都有过在普通人看来性价比存疑的冒险选择。杨植麟与很多AI尖子生反着走,眼界、自信和做大事业的雄心一个都不能少。2023年4月,杨植麟在北京创立了“月之暗面”,这家AI初创公司的融资节奏十分迅猛。据媒体报道,成立仅两个月,月之暗面天使轮融资近20亿元人民币,这在整个创投史上都极为罕见。进入2026年,月之暗面融资节奏与估值堪称“狂飙”,到6月30日最新一轮融资,据推测投前估值已经来到315亿美元。月之暗面已经向投资人发出上市议案,最快6个月内登陆港股。从一间办公室到如今315亿美元估值,杨植麟只用了三年零三个月。然而在这三年零三个月里,并非真的一帆风顺。2025年1月,DeepSeekR1发布,其凭借开源、低成本、强推理能力迅速席卷市场,同时也严重冲击了Kimi此前的品牌优势和杨植麟的创业布局。同月上线的KimiK1.5被淹没在DeepSeek铺天盖地的声浪中。杨植麟迅速做出判断:停止大规模投放,放弃继续争夺通用聊天机器人的流量入口,将重心转向开源模型、程序员和企业用户。月之暗面还主动裁员精简,砍掉市场增长部门,只保留算法、研发核心人员,核心团队控制在200人上下,整体人数维持在300人以内。2025年7月,KimiK2发布,在编程领域突出,在权威测试中斩获高分。2026年7月,KimiK3发布,参数达2.8万亿,为全球最大开源模型,一鸣惊人。很多美国人都很惊讶,杨植麟已经到了美国,但又走了,美国为什么没有留住他?有人在网上留言说:“我猜他听从了右翼美国人给的‘离开我们的国家’建议。”也有网友说,“许多人告诉我,在美国做移民越来越难,而中国对创新者来说是一个更有趣的地方。”“我认为深圳成为创新者的首选之地已经有十多年了。”还有网友说,美国可以给杨植麟一个顶级科学家的岗位,却很难给一个刚毕业的外国年轻人足够的资本、算力和决策权,让他迅速组建团队,挑战OpenAI。不管怎么样,杨植麟回国并且在中国创业成功,这是一个重要的风向标。中国这些年不仅把人才送出去学习、实践,而且国内物质及人文的“基础设施建设”实现了大幅进展。中国到了用吸引力、用国家和社会愿景的无形承诺把人才召回来,让他们在我们自己的国度里实现梦想、建功立业的时候。依然会有人才向美国跑的情况,美国的吸引力依然存在,在某些时候和某些方面仍具有优势。而且正常的人才交流永远都是双向的。但是历史真的迈过了一个重要的临界点:中国在美国的人才在批量回归,杨植麟只是他们中的一位。他因为突出的成就成为了他们中的代表者,他用KimiK3做了这个时代的一份宣言。梁文锋和杨植麟有两份不同的履历,一位一直扎根本土,另一位喝了美国的“洋墨水”,他们的不同人生轨迹交汇在中国挑战美国AI霸权的历史性大战中。他们在中国仍然远逊于美国基础算力的情况下,创造性地释放了中国人的智慧和我们社会的各种潜力,打造出DeepSeek和KimiK3的两大奇迹。它们是美国媒体写下中国大模型“抹掉美国AI领先”的两个惊叹号。一定会有第三个、第四个,乃至更多AI惊喜被中国人创造出来。这已经是中国人的现实准备和努力,也已经成为世界广泛的期待。
杨植麟的月之暗面创造了KimiK3,轰动整个世界。他是近年来第一个放弃了美国机
杨植麟的月之暗面创造了KimiK3,轰动整个世界。他是近年来第一个放弃了美国机会、回中国创业,并且打败了或者强烈震动了所有美国同行的中国年轻人。我们这些年听惯了中国年轻学子们去美国大显身手的故事,而杨植麟是第一个以绝对成就把故事反写回来的人。的确啊,很多清华等名校毕业的中国尖子生进入了美国顶级AI团队,获得了高薪,在很多中国年轻人中间备受艳羡。他们有的参加中国网络视频访谈,讲述在美国的成功故事,成为了偶像。然而,杨植麟一个人的成就足以抹去他们所有人的光环。杨植麟证明了一个中国年轻科学家的创造力可以是无上限的,全世界顶级的,而且中国这块热土、中国的社会生态完全能够承载得起这样的世界级奇迹。老胡深信,杨植麟的故事将成为中美人才流动历史性转折的突出标记。其实在他之前,已经有数以千计,甚至更多曾在美国留学、工作并取得不同成就的中国学者们回国任职。他们在国内大学里建立科学实验室,甚至开宗立派。他们共同创造了中国人才从美国的历史性回流。杨植麟作为他们中间的一位,直接干翻、追平或者极其接近了美国不可一世的AI大模型。他的KimiK3创造了新的“DeepSeek时刻”,严重冲击了美国股市,“月之暗面”成为全球媒体的热词。而且全球创造一流AI成就的负责人里,杨植麟是最年轻的一位。对比一下吧,OpenAI的CEO萨姆·奥尔特曼2023年出头时38岁,Anthropic的创始人达里奥·阿莫迪43岁,而杨植麟只有34岁。杨植麟与DeepSeek创始人梁文锋有着差异很大的履历,他们成为支撑起中国AI强势的双雄。梁文锋一直在国内,他毕业于浙江大学信息与电子工程系,是从量化基金里杀出来的黑马,一举打翻了美国AI霸权的幻象。DeepSeek2025年1月发布之后,迅速在Arena等排行榜上攀升至前列。在关于DeepSeek的消息刚传出后,英伟达股价一日内大跌17%,全世界媒体和业界当时都惊呆了。有不少人把DeepSeek的问世当成美国AI界的“斯普特尼克时刻”。梁文锋打响了挑战美国AI霸权的第一枪,其功勋可圈可点。然而,中国AI人才朝美国流失的势头并未因DeepSeek的成功而逆转,很多中国年轻人继续加入美国AI团队,获得高薪,做“人生赢家”。1992年出生的杨植麟来自广东汕头,2015年,他以清华计算机系第一名的成绩毕业,前往美国卡内基梅隆大学攻读博士学位,导师是曾任苹果AI研究主管的鲁斯兰·萨拉赫丁诺夫。毕业后他先后进入谷歌大脑和MetaAI实验室,作为核心成员参与了Transformer-XL和XLNet两项开创性研究。Transformer是今天所有大模型的底层骨架,相当于AI世界的"发动机"。然而杨植麟在前程一片光明的时刻做出了一个决定:回国创业。他曾对媒体表示,“如果不去亲自创业,我以后一定会后悔终生。”他认为留在硅谷大厂、顶尖研究院,待遇优渥、工作体面,但终究只是高级技术雇员;想完整主导大模型研发、产品落地、公司发展,只有回国创业才能实现。了不起的成功者都有过在普通人看来性价比存疑的冒险选择。杨植麟与很多AI尖子生反着走,眼界、自信和做大事业的雄心一个都不能少。2023年4月,杨植麟在北京创立了“月之暗面”,这家AI初创公司的融资节奏十分迅猛。据媒体报道,成立仅两个月,月之暗面天使轮融资近20亿元人民币,这在整个创投史上都极为罕见。进入2026年,月之暗面融资节奏与估值堪称“狂飙”,到6月30日最新一轮融资,据推测投前估值已经来到315亿美元。月之暗面已经向投资人发出上市议案,最快6个月内登陆港股。从一间办公室到如今315亿美元估值,杨植麟只用了三年零三个月。然而在这三年零三个月里,并非真的一帆风顺。2025年1月,DeepSeekR1发布,其凭借开源、低成本、强推理能力迅速席卷市场,同时也严重冲击了Kimi此前的品牌优势和杨植麟的创业布局。同月上线的KimiK1.5被淹没在DeepSeek铺天盖地的声浪中。杨植麟迅速做出判断:停止大规模投放,放弃继续争夺通用聊天机器人的流量入口,将重心转向开源模型、程序员和企业用户。月之暗面还主动裁员精简,砍掉市场增长部门,只保留算法、研发核心人员,核心团队控制在200人上下,整体人数维持在300人以内。2025年7月,KimiK2发布,在编程领域突出,在权威测试中斩获高分。2026年7月,KimiK3发布,参数达2.8万亿,为全球最大开源模型,一鸣惊人。很多美国人都很惊讶,杨植麟已经到了美国,但又走了,美国为什么没有留住他?有人在网上留言说:“我猜他听从了右翼美国人给的‘离开我们的国家’建议。”也有网友说,“许多人告诉我,在美国做移民越来越难,而中国对创新者来说是一个更有趣的地方。”“我认为深圳成为创新者的首选之地已经有十多年了。”还有网友说,美国可以给杨植麟一个顶级科学家的岗位,却很难给一个刚毕业的外国年轻人足够的资本、算力和决策权,让他迅速组建团队,挑战OpenAI。不管怎么样,杨植麟回国并且在中国创业成功,这是一个重要的风向标。中国这些年不仅把人才送出去学习、实践,而且国内物质及人文的“基础设施建设”实现了大幅进展。中国到了用吸引力、用国家和社会愿景的无形承诺把人才召回来,让他们在我们自己的国度里实现梦想、建功立业的时候。依然会有人才向美国跑的情况,美国的吸引力依然存在,在某些时候和某些方面仍具有优势。而且正常的人才交流永远都是双向的。但是历史真的迈过了一个重要的临界点:中国在美国的人才在批量回归,杨植麟只是他们中的一位。他因为突出的成就成为了他们中的代表者,他用KimiK3做了这个时代的一份宣言。梁文锋和杨植麟有两份不同的履历,一位一直扎根本土,另一位喝了美国的“洋墨水”,他们的不同人生轨迹交汇在中国挑战美国AI霸权的历史性大战中。他们在中国仍然远逊于美国基础算力的情况下,创造性地释放了中国人的智慧和我们社会的各种潜力,打造出DeepSeek和KimiK3的两大奇迹。它们是美国媒体写下中国大模型“抹掉美国AI领先”的两个惊叹号。一定会有第三个、第四个,乃至更多AI惊喜被中国人创造出来。这已经是中国人的现实准备和努力,也已经成为世界广泛的期待。
继DeepSeek之后,又一位让硅谷、华尔街高度关注的华人AI新锐,悄然崛起。谁
继DeepSeek之后,又一位让硅谷、华尔街高度关注的华人AI新锐,悄然崛起。谁也没想到,这位搅动全球AI赛道格局的核心人物,数月前还深陷舆论争议,被不少人认定创业进度滞后、逐渐掉队。这位逆风翻盘的90后AI创业者,正是月之暗面的创始人杨植麟。熟悉AI行业的人都清楚,近两年国内AI赛道新人辈出、竞争白热化,很多热门创业者都是一路高光、热度不减。反观杨植麟,很长一段时间里都显得格外低调,甚至屡屡被行业唱衰。不少业内声音都在讨论,早早深耕NLP领域、手握顶尖学术成果的他,会不会在新一轮大模型竞赛中彻底掉队。毕竟同期入局的同行,早已陆续推出多款爆款产品、拿下海量市场份额,而他的团队始终保持着慢节奏的研发状态,曝光度和话题度都远不及竞品。谁能想到,看似沉寂的蛰伏,只是蓄力突围的铺垫。沉寂许久的月之暗面,在2026年7月17日抛出了一枚重磅行业炸弹,杨植麟带着全新的KimiK3大模型强势回归,瞬间引爆全球科技圈。这款模型拥有2.8万亿参数,是目前全球首个实现开源的3万亿级别大模型,一经发布就刷新了多项行业纪录,直接登顶前端代码竞技榜单,综合实力跻身全球第一梯队,足以对标GPT、Claude等海外顶尖闭源模型。为什么KimiK3的问世,能让海外科技圈格外重视?当下全球AI领域,高端大模型的核心技术大多掌握在海外巨头手中,且多数顶尖模型均为闭源状态,行业壁垒极高。而杨植麟团队推出的KimiK3,不仅实现了性能的跨越式突破,还做到了极致的性价比,单任务运行成本远低于海外同类产品。更关键的是,团队选择完全开源核心技术,让全球开发者都能免费使用、迭代优化,这种打破行业垄断的操作,直接改变了全球开源大模型的竞争格局。很多人好奇,看似突然爆红的背后,杨植麟到底凭什么逆势翻盘?其实他从来都不是行业新人,而是实打实的AI领域资深研究者。作为清华学霸、卡内基梅隆大学博士,他早年间就在机器学习、自然语言处理领域站稳脚跟,曾连续两年入选全球顶级会议第一作者榜单,还参与研发了Transformer-XL、XLNet等多项底层核心技术。手握硬核学术底蕴,又放弃硅谷高薪邀约回国创业,这份积累,成了他如今突围的最大底气。创业路上的杨植麟,一直有着自己的节奏和坚持。2023年创立月之暗面以来,他没有跟风追逐短期流量和热度,而是聚焦技术深耕打磨产品。从早期的Kimi智能助手,到如今的KimiK3大模型,团队一步步突破超长上下文、视觉理解等核心能力,产品上线后半年月活就突破千万,公司估值也稳步攀升。即便中途遭遇行业质疑、舆论唱衰,团队也始终沉心研发,没有盲目跟风内卷。AI赛道从来不缺风口和黑马,但能顶住争议、耐住寂寞深耕技术的创业者寥寥无几。从被嘲掉队的争议者,到惊艳硅谷的行业新锐,杨植麟的逆袭不是偶然,而是长期技术沉淀和沉稳布局的结果。如今国内AI行业竞争愈发激烈,越来越多华人创业者正在打破海外技术壁垒,在全球科技舞台站稳脚跟,未来这条赛道还会诞生多少惊喜,值得持续关注。(信源:从摇滚主唱到AI新贵:杨植麟与月之暗面KIMI-K3的崛起_ZAKER新闻)
我有一种预感:第二个震惊硅谷的“梁文峰”,已经出现了!谁能想到,DeepSe
我有一种预感:第二个震惊硅谷的“梁文峰”,已经出现了!谁能想到,DeepSeek之后,第二个让华尔街集体冒冷汗的中国人,竟然是一个几个月前还被嘲笑“掉队”的90后。他叫杨植麟。7月16日,杨植麟创办的月之暗面推出新一代模型KimiK3,没有长时间预热,也没有密集营销,而是直接把模型能力摆到市场面前。2.8万亿参数、原生多模态、百万级token上下文,以及开放模型权重,这些标签一经公布,就迅速引发全球AI圈关注。最开始,外界并没有太重视。因为过去几年,全球AI竞争越来越激烈,各家公司都在强调参数、速度和能力,不少人认为中国企业更多是在追赶,很难真正进入第一梯队。但测试结果出来后,质疑声开始减少。KimiK3在多个公开评测中表现亮眼,尤其是在代码生成、复杂推理和智能体任务方面,展现出了接近甚至挑战部分顶级闭源模型的能力。更让市场意外的是,模型上线后用户大量涌入,月之暗面一度因为服务器压力调整服务节奏。这意味着,用户关注的不是概念,而是真正愿意使用。随后,资本市场也开始重新审视中国AI企业的竞争力。当然,美股AI板块的波动,并不能简单归因于KimiK3一次发布。芯片行业调整、企业财报压力以及国际局势变化,都影响了市场情绪。但真正让华尔街警惕的,并不是某一天股票跌了多少,而是他们发现,DeepSeek带来的冲击可能并不是偶然。如果说梁文峰让全球看到,中国团队可以用更低成本打造高性能模型,那么杨植麟则进一步证明,中国开源模型也可以进入全球人工智能竞争的核心区域。一次突破,可以被认为是特殊情况。但连续出现新的挑战者,就意味着产业格局正在发生变化。过去很长时间,人工智能领域的核心话语权主要集中在美国科技巨头手中。谷歌、微软、OpenAI、Meta等公司凭借资金、算力和人才优势,占据了行业领先位置。很多人默认,最先进的AI一定诞生于硅谷。而如今,一个又一个中国团队正在改变这种认知。实际上,杨植麟并不是突然出现的。1992年出生的他,早年就展现出很强的计算机研究能力。本科期间,他进入清华大学学习计算机相关专业,毕业后前往卡内基梅隆大学深造,并参与过Transformer-XL、XLNet等重要自然语言处理研究。这些经历,让他很早就在全球AI学术圈留下了名字。2023年,31岁的杨植麟创办月之暗面。一年后,Kimi凭借超长文本处理能力迅速走红,成为国内AI应用领域的重要产品之一。不过,创业从来不是一路顺风。2025年,DeepSeek爆火,大量关注集中到这家公司身上;与此同时,国内大厂也纷纷布局AI应用。一边是强大的竞争对手,一边是市场压力,Kimi一度陷入争议。外界甚至开始认为,月之暗面已经掉队。但杨植麟没有选择继续进行大规模营销,而是把更多资源投入到底层模型研发。这其实是一场赌博。因为短期来看,减少市场投入可能意味着用户增长放缓,甚至承受外界质疑。但长期来看,大模型行业最终比拼的不是宣传声量,而是谁真正拥有技术能力。事实证明,这个选择带来了回报。从KimiK2到KimiK3,月之暗面逐渐重新回到公众视野。它证明了一件事:AI行业竞争不是一场简单的资金竞赛,而是一场技术、人才和长期投入的较量。所以,为什么有人把杨植麟称为第二个“梁文峰”?并不是因为两个人完全一样,也不是因为一次产品发布就能决定行业格局。真正相似的地方,是他们都打破了一种固有认知。过去很多人认为,中国AI企业只能跟随美国企业脚步。但DeepSeek和Kimi接连出现后,越来越多人开始意识到,中国团队已经具备独立创新能力。未来人工智能竞争,不会只是美国公司的内部竞争,也不会只有少数巨头定义方向。更多来自不同国家、不同团队的挑战者,都可能改变行业走向。严格来说,杨植麟并没有凭一己之力改变整个硅谷,更不能简单把市场涨跌归因于一个模型。但他确实让很多人重新认识了中国AI的发展速度。真正让竞争者感到压力的,从来不是某一个天才的出现。而是当一个优秀的人出现之后,背后还有更多正在成长的团队。今天是DeepSeek,今天也是Kimi。未来,下一个改变人工智能格局的人,或许正在某个实验室里写代码。而这,才是全球科技竞争真正开始加速的信号。
美国人终于开始反思了! Kimi-K3创始人杨植麟,明明是美国卡内基梅隆大
美国人终于开始反思了!Kimi-K3创始人杨植麟,明明是美国卡内基梅隆大学的博士,为什么偏偏没留下来?最近KimiK3一发布,海外科技圈直接炸了锅。2.8万亿参数、原生多模态、百万级上下文,连完整权重都计划公开,每一步都踩在全球AI赛道的聚光灯上。聊着聊着,美国人的话题就拐了弯,开始翻旧账:这么厉害的一个人,当年明明在卡内基梅隆读的博士,怎么就没留下来?很多人第一反应就是H1B签证。毕竟这几年美国移民政策收紧,应届生抽签中签率一年比一年低,不少留学生毕业就被迫回国,这个逻辑听起来特别顺理成章。但这个说法刚冒出来没两天,就被杨植麟的博士导师亲手戳破了。这位导师不是别人,正是苹果前全球AI负责人RussSalakhutdinov。他直接在社交平台表态:跟签证一点关系都没有。当年苹果高层主动找过杨植麟,想招他进核心团队,甚至退一步说,不想待在美国本土,去北京分部也行。等于说,留美的路、拿身份的通道、高薪岗位,人家早就给他铺得明明白白。别说H1B抽签,真要留,绿卡排期都能走最快的特殊人才通道。问题从来不是“能不能留下”,是“他根本不想只留下打工”。他2015年进CMU读博,正常计算机领域的博士要熬六七年,他只用了4年就顺利毕业。读博期间就搞出了Transformer-XL、XLNet,其中XLNet在20项任务上直接超过了谷歌的BERT,在当时的NLP领域相当于掀了一次桌子。他还在谷歌大脑、MetaAI实验室都待过,跟行业最顶尖的人一起做研究。这种履历扔到硅谷,任何一家科技巨头都会抢着要。进去就是资深科学家,年薪加股票轻轻松松百万美元往上,熬几年混个技术总监,这辈子衣食无忧,是标准的“人生赢家”路径。但这条路的上限也明明白白摆在那。你技术再强,也只是庞大公司里的一个环节。你可以决定一个算法怎么优化,但决定不了公司给你批多少算力、投多少资金、把这个技术放到什么战略位置。产品、商业、战略,全是别人说了算。而他从一开始,就没想过只当一个打工的科学家。2016年,他人还在美国上课赶论文,就已经和清华的同学一起,在北京开了第一家公司循环智能,做企业级NLP服务。等于说,博士学位还没拿到手,他的创业版图就已经在国内铺开了。所以2019年博士毕业的时候,拒绝苹果的offer回国,根本不是什么临时决定,是早就写好的人生剧本。美国能给的,是一份顶级打工人的offer;但杨植麟想要的,是一家自己说了算的、世界级的AI公司。而这件事,在美国反而更难做成。大模型创业不是做个小应用,烧钱烧算力都是天文数字。美国的风险资本再有钱,也不会轻易把几亿美金砸给一个没有本土创业背景的外国人。但回国就不一样了。国内AI产业那几年正处在爆发前夜,资本、人才、政策、市场,所有要素都在快速聚拢。杨植麟有CMU博士的学术背书,有国内清华的校友网络,对本土市场的理解更是天然优势。他要组队,国内有大批计算机专业的优秀工程师,执行力和性价比都拉满;他要融资,国内的产业资本和财务资本都在盯着AI赛道的优质团队,给钱给资源都很干脆;他要落地应用,中国的互联网场景和企业需求,比任何一个国家都丰富。这些东西加起来,就是创业的杠杆。同样的技术能力,在国内能撬动十倍、百倍的资源,跑出更快的速度。2023年月之暗面成立,到Kimi凭借长文本能力一炮而红,再到现在KimiK3站到全球第一梯队,只用了三年多时间。这个速度,放在硅谷的创业环境里,根本不可能实现。在硅谷的科技公司里,印度高管一抓一大把,华人能做到顶层的少之又少。不是能力不够,是这套体系的信任链,本来就不对你完全敞开。以前大家觉得,哪怕有天花板,好歹平台高、薪水厚,值得忍一忍。但现在不一样了。当中国的AI产业能提供同样高的技术平台,甚至更广阔的创业空间,更高效的资源落地速度的时候,那张曾经被无数人视为金饭碗的美国签证,分量自然就轻了。美国人现在反思“为什么没留住杨植麟”,其实问错了问题。他们该问的不是“为什么H1B没留住他”,而是“为什么我们的体系,只能给顶尖人才提供打工的选项,却留不住想创造规则的人”。杨植麟不是第一个,也不会是最后一个。当越来越多的顶尖人才发现,回国不是退而求其次的选择,而是能实现更大野心的最优解的时候,所谓的“人才回流”,就不是什么意外,而是时代的必然。KimiK3只是一个开始。真正值得关注的,从来不是一个人有没有留在美国,而是一片土壤,能不能长出更多改变世界的公司。
我有一种预感:第二个震惊硅谷的“梁文峰”,已经出现了!没人能想到,DeepSe
我有一种预感:第二个震惊硅谷的“梁文峰”,已经出现了!没人能想到,DeepSeek之后,第二个让华尔街整个科技部门、交易部门集体冒冷汗的中国人,是几个月前还被全行业嘲笑“掉队”的90后杨植麟。去年整个国内大模型圈都在追热点冲跑分、赶场开商业化发布会的时候,杨植麟连公开露面的次数都屈指可数,不少投资人私下聚餐吐槽,说他拿了几十亿融资不跟着行业节奏走,放着快钱不赚,摆明了要被第一梯队甩在后面,甚至有行业媒体把他列进了“初代大模型创业者掉队名单”里。7月16号,杨植麟创办的月之暗面没有任何提前预热,没有租几千人的场馆搞造势活动,没有联系几十家媒体提前发通稿,就靠官方账号发了一条一百多字的公告,直接把KimiK3的全部信息摆到台面上。2.8万亿参数,原生多模态,100万token上下文,直接开放全部模型权重。很多人对这些数字没概念,这里给大家算个实账,100万token等于70多万汉字,普通人正常速度看完70万字要花3天,KimiK3全部扫完只需要1秒,你把整套20本的《资治通鉴》全塞进去,问它任何一个边角的人物官职、事件时间,它能精准报出来,连注释的出处都不会错。做工程的人把整个项目的几百页图纸、几千份施工日志全部传进去,当天就能出完整的风险排查和优化方案,不用再组织十几个人的团队翻半个月资料。整个行业里摸爬滚打超过5年的人都清楚,之前硅谷那边定了明规矩,核心参数超过1万亿的大模型,绝对不会对外放全量权重,最多给你个功能阉割的接口,收你十倍百倍的使用费,国内不少做应用开发的小团队,之前每年要花几十万甚至上百万买海外模型的授权,稍微碰点核心功能就被人家卡接口,动不动就停服涨价。之前国内有团队想自己做同量级的大模型,要么付不起海外机构的专利费,要么刚摸到门槛就被断了高端算力供应,卡了快两年没突破。杨植麟团队这一次直接把2.8万亿参数的全量权重放开,等于把之前硅谷攥在手里卖天价的核心技术,直接递到所有国内从业者手里。过去18个月,杨植麟团队的核心技术岗,平均每人每周在公司睡4晚,楼下24小时便利店的泡面他们包了三分之一的月销量。去年年底最紧张的时候,为了抢最后5%的模型精度,整个团队连续72小时没出机房,有人发烧到38度多,就在工位旁边支个行军床,挂着水还盯着参数仪表盘。这些事他们从来没对外说过半个字,去年拿的几个行业技术奖,领奖人都派的是普通一线工程师,杨植麟自己躲在机房调代码,连领奖台都没上。现在很多人默认,年轻人创业就得搞流量,开直播赚快钱,拿几个亿融资就该天天上热搜,买豪宅买跑车才算成功,杨植麟他们这帮人走的是完全相反的路,不蹭热点,不炒概念,甚至连对外的曝光都尽量压到最低,闷头把卡脖子的事干成了。华尔街那边现在慌的根本不是又多了个大模型竞品,是他们之前靠技术垄断收全世界“数字税”的日子,从这一刻开始就到头了。现在国内任何一个普通的小开发工作室,哪怕只有两三个人,想做个本地的政务便民系统,做个乡村的农技推广小程序,做个小工厂的生产流程优化工具,都不用再每年花几十万买海外的模型授权,直接拿KimiK3的权重适配一下就能用,成本直接降到之前的二十分之一。这些实打实的好处,没有任何造势宣传,没有任何道德绑架,就这么悄无声息落到了普通人手里。他们没拿这个事给自己买热搜,没拿这个事去要特殊的政策倾斜,甚至连发布会都懒得开,直接把东西往所有人面前一放,所有人都能用。这才是现在最缺的那批人,不图虚名,不赚快钱,啃最硬的骨头,把自己熬了几百个日夜攒出来的成果,直接交到全行业手里,没想着靠这个垄断市场,没想着靠这个坐地起价,最后惠及的是国内成千上万根本没能力碰大模型技术的普通从业者。
Kimi创始人杨植麟回国创业引发美国人热议!其实这事之所以对美国人冲击,原因就是
Kimi创始人杨植麟回国创业引发美国人热议!其实这事之所以对美国人冲击,原因就是我以前关于美国人对谷爱凌破防的时候就说过的,美国需要持续不断的移民输入,才能维持自身的科技水平和资产价格,因此必须打造人间天堂、世界灯塔的国设来吸引新移民;然后如果有人见识过天堂又走了,就会直接冲击这套叙事,国设崩塌,对美国是非常糟糕的事。相反,我们自唐宋以后就是移民净输出国,移民去海外,哪怕是精英级别人才移民出去,对我们并没有什么所谓。从我们角度说,我觉得最大意义是,杨植麟是广东汕头高考状元,就和广东湛江理科状元梁文锋一样,是能够证明我们现有的教育和选拔人才的制度是正确的,能挑选出天才培养,让他们能充分发挥自己的潜能,为生产力发展做出贡献。在此之外还可以加上今年两位菲尔兹奖得主,一位竞赛生、一位通过高考进入中国最顶级大学,说明我们不管是高考选拔机制,还是高考之外的渠道,都是能识别选拔出真正人才的。现在中文互联网上竟还有一些跪久了的春登和大殖子不能接受这个现实,还在那各种可笑的古旧言论,比如有人说美国是更自由、开放以及对个性、前卫更加容忍的社会,什么“美国的开放社会能激发东亚人创造力”这种荒唐可笑的说法,这是暗示创始人的美国教育经历是月之暗面的成功关键因素了。按这种逻辑,近些年美国哪个亚裔创建了人工智能企业,拿出了堪比最前沿(gpt5.6或fable)的开源模型?甚至我们都可以不限定创始人的族裔:美国为何需要用比我们高出数量级的资本投入,才能让模型水平打平,怎么没有美国人创造出来经济节省的办法?人工智能之外的其他产业我甚至都不提了。另外,这个成功故事也是除了人才教育选拔机制外,我们经济和社会制度和道路正确性的证明,就像《经济学人》发表的一篇关于中国新一代科技富豪的报道所指出的,像杨植麟这一代的创业成功者不再是(像00和10年代那样)出身房地产,这方面可以对比一下世界上其他任何一个国家,哪个国家还有这样情况?一个理科高考状元,通过在人类最前沿的高新科技创业成功,发展出最先进的技术,成为顶级富豪(而不是靠地产/油气矿产/继承祖父辈),还有什么比这个更能说明这是一个公平、有活力、健康和具有远见的社会呢?
我有一种预感:第二个震惊硅谷的“梁文峰”,已经出现了!谁能想到,DeepSe
我有一种预感:第二个震惊硅谷的“梁文峰”,已经出现了!谁能想到,DeepSeek之后,第二个让华尔街集体冒冷汗的中国人,竟然是一个几个月前还被嘲笑“掉队”的90后。他叫杨植麟。7月16日,杨植麟创办的月之暗面突然扔出KimiK3。没有铺天盖地预热,也没有开几十场发布会,直接把模型往桌上一拍:2.8万亿参数,原生多模态,100万token上下文,还要开放模型权重。硅谷一开始以为,这又是一款中国公司用“参数大”制造噱头的模型。毕竟过去两年,见过太多把参数吹上天、一跑分就露馅的“大力出奇迹”选手。华尔街那帮分析师,甚至懒得调整财报模型,只当是又一轮国产大模型的常规刷榜。但三天之后,风向变了。起因是开源社区有人拿KimiK3跑了一轮“硬核”测试——不是那种精心调过提示词的刷分题,而是丢进去一份满是公式、图表和手写批注的百页技术文档,让它直接提取关键数据并重绘逻辑框架。结果不仅准确率高得离谱,更让海外开发者倒吸凉气的是推理成本:处理同样体量的任务,KimiK3的消耗只有Claude3.7的十分之一出头。硅谷技术论坛开始有人翻出杨植麟的履历——清华学霸,卡内基梅隆博士,Transformer作者之一,曾参与XLNet和Transformer-XL的核心研发。换句话说,这位被国内媒体一度贴上“掉队”标签的90后,十年前就在啃Transformer底层架构,如今不过是在自己最熟悉的战场上打了一场翻身仗。真正让华尔街后背发凉的,不是参数大小,而是KimiK3背后那套“非主流”的技术路线。过去业内默认一条铁律:大模型想变强,就得堆算力、堆显卡。谁囤的H100多,谁就能笑到最后。硅谷巨头们疯狂扩建数据中心,本质上是在赌——“算力即护城河”。但杨植麟偏偏没走这条路。KimiK3采用的是MoE架构,全称是混合专家模型。听起来唬人,其实原理不难懂:好比一家大公司,过去每来一个问题,全公司几千号人都要放下手里的活一起讨论(这就是传统密集模型的“全员参战”)。而MoE架构呢?来了问题,先由一个“路由系统”判断该找哪几位专家,然后只让这几个专家开会决策。其他人该干嘛干嘛。这带来的结果是:KimiK3虽然总参数高达2.8万亿,但每次推理实际激活的参数量只有约360亿到420亿。也就是说,它用“调动少数精锐”的方式,实现了接近“全军出击”的效果,而电费(算力成本)却省了一大截。如果说DeepSeek之前靠“性价比”让硅谷第一次感受到中国AI的工程能力,那KimiK3就是把这套逻辑推向了极致:不需要囤积天价显卡,也能做出顶级模型。华尔街突然意识到,他们押注的“算力军备竞赛”叙事,可能要被改写了。更让硅谷睡不着觉的,是杨植麟宣布开放模型权重。开源在AI圈不稀奇,但把这种体量、这种效率的模型权重直接开放,在海外头部玩家那里几乎不可想象。OpenAI靠闭源筑起商业壁垒,谷歌、Anthropic死死攥着模型细节,生怕被人抄了后路。而月之暗面这一手,等于直接告诉全世界:技术图纸我公开了,你们随便研究。这背后透着一股自信——我们的护城河不是模型权重,而是工程迭代速度和成本控制能力。你拿去用,但你想复制我的迭代效率?没那么容易。杨植麟本人倒是淡定。有媒体问他怎么看待“掉队”说法,他只回了一句:“我们的目标从来不是跑赢谁,而是跑到AGI的终点。”这种话从别人嘴里说出来像口号,但从一个搞了十几年底层架构的人口中说出,更像是在陈述工作计划。当然,质疑声也有。有人担心开源导致核心技术外流,有人质疑2.8万亿参数的训练稳定性,还有人翻出之前Kimi在某些评测中表现平平的记录。但无论如何,KimiK3用实打实的低成本高效果,向世界证明了一件事:中国AI不只靠工程师红利和廉价算力,而是在底层架构上找到了自己的解题思路。
我有一种预感:第二个震惊硅谷的“梁文峰”,已经出现了!谁能想到,DeepS
我有一种预感:第二个震惊硅谷的“梁文峰”,已经出现了!谁能想到,DeepSeek之后,第二个让华尔街集体冒冷汗的中国人,竟然是一个几个月前还被嘲笑“掉队”的90后。他叫杨植麟。7月16日,杨植麟创办的月之暗面突然扔出KimiK3,直接把模型往桌上一拍:2.8万亿参数,原生多模态,100万token上下文,还要开放模型权重。这次不是营销噱头,是真把硅谷攥在手里的蛋糕,又狠狠往下切了一大块。先给非技术圈的朋友掰扯明白,KimiK3这组参数到底是什么水平。之前把硅谷砸得晕头转向的DeepSeekV4,参数规模是1.6万亿,已经是当时全球开源模型的天花板;这次杨植麟直接把纪录拉高了快一倍,干到了2.8万亿,成了实打实的全球最大参数开源模型。更厉害的是它用的MoE混合专家架构,896个专家模块每次只激活16个,看着参数体量吓人,实际推理成本却控制得很克制,不是那种只能看不能用的“纸面怪兽”。再配上100万token的超长上下文,相当于一次性就能装下整部长篇小说、一整套项目代码库,做科研、啃文档、写复杂代码的人,光看这个数字就该懂有多香。但在我看来,最狠的从来不是参数,而是“开放模型权重”这五个字。这也是我一直觉得国产AI最聪明的破局路数——你跟硅谷巨头比闭源生态、比用户体量,短期肯定拼不过人家积累了几十年的家底;但你把顶级技术直接开源普惠,等于直接掀了人家的定价桌子。硅谷玩了这么多年的规矩,就是顶尖技术攥在手里,靠API按字收费,躺着赚全世界的钱。你想用最好的AI?行,价格我说了算,还得看我愿不愿意给你用。可现在呢?中国的创业公司把同级别的大模型完整权重放出来,谁都能下载、微调、二次开发,小团队甚至个人开发者,不用砸几十亿训练模型,也能用上顶级AI底座。这一下就把AI的门槛从“亿级”打到了“万级”,以后硅谷再想靠技术垄断收天价溢价,没那么容易了。也难怪马斯克反应这么快,当天就跑出来留言“Impressive”,转头又放话要对标,变脸速度比翻书还快——说白了就是真的疼了。说起来杨植麟也不是什么凭空冒出来的黑马。92年出生的广东汕头人,中学拿信息学奥赛一等奖保送清华,从热能工程转去计算机系,后来去卡内基梅隆读博,是Transformer-XL、XLNet这两个经典NLP架构的核心发明人,早年在谷歌大脑、MetaAI都做过核心研发,在全球AI圈早就是数得上号的技术大牛。换句话说,人家当年在硅谷的时候,就是做底层架构的好手,现在回国创业,根本不是跟着硅谷的路子亦步亦趋抄作业,而是带着自己的技术积累,在走一条不一样的路。有意思的是,杨植麟和梁文峰简直像一个模子刻出来的“硅谷克星”:都低调到近乎神秘,不爱开发布会、不接受采访、不站在聚光灯下讲故事;都死磕底层技术,不玩概念炒作、不搞流量内卷;最后都精准踩中硅谷的命门——用极致的技术+开源的模式,打破对方的垄断。如果说梁文峰是第一个捅破窗户纸的人,那杨植麟就是直接把门踹开的那个。有人可能会说,不就是个参数大点的模型吗,至于吹得这么神?我倒觉得这事的分量,远不止一个模型本身。这几年我们听了太多“中国AI只会堆算力、只会模仿”的风凉话,可从DeepSeek的极致成本控制,到月之暗面的注意力残差架构、超大参数开源,我们早就不是追在硅谷尾灯后面跑的追随者了,开始在技术路线上拿出自己的答案。更难得的是这份定力。现在的创业圈有多浮躁?成立半年就想冲估值,一年就琢磨着IPO,老板天天上综艺讲鸡汤,心思全花在怎么给投资人讲故事上。可杨植麟呢?在全网嘲笑他“掉队”的日子里,直接砍掉了市场投放,把几乎所有资金和人力都砸进了技术研发,甚至公开说“不以IPO为短期目标”。在人人都想赚快钱的时代,愿意沉下心跟技术死磕的人,本来就该赢。当然,客观说KimiK3还不是全球第一,综合能力比起GPT和Claude的顶级闭源模型还有差距,官方自己也坦然承认了这一点。但开源模型的可怕之处就在于,它不是一个团队在战斗。一旦权重全面开放,全世界的开发者都能在上面迭代优化,这种社区式的成长速度,是闭源模型比不了的。长期来看,谁的后劲更足,真的不好说。我越来越觉得,梁文峰不是偶然,杨植麟也不会是最后一个。中国的AI产业早就过了跟风模仿的阶段,一批年轻的技术人正在用自己的方式改写行业规则。硅谷躺着垄断AI时代的好日子,恐怕真的要进入倒计时了。而这个92年的年轻人,和他名为“登月”的野心,才刚刚开始让世界侧目。
我有一种预感:第二个震惊硅谷的"梁文锋",已经出现了!谁能想到,DeepSee
我有一种预感:第二个震惊硅谷的"梁文锋",已经出现了!谁能想到,DeepSeek之后,第二个让华尔街集体冒冷汗的中国人,竟然是一个几个月前还被嘲笑"掉队"的90后。这个人叫杨植麟,月之暗面的创始人。1992年出生在广东汕头,标准的90后,清华姚班出身,卡内基梅隆大学博士。光这份履历,已经甩开绝大多数人几条街。谁能想到,就在几个月前,全网还在唱衰他。KimiApp月活从巅峰的2165万直接跌到902万,腰斩式下滑,媒体给他贴的标签清一色都是"掉队""热度消退""被时代抛弃"。那些嘲讽的声音有多刺耳,现在的反转就有多打脸。2026年7月16日深夜,杨植麟悄悄放出了KimiK3,一颗2.8万亿参数的重磅炸弹,直接炸醒了整个硅谷。2.8万亿参数是什么概念?这是目前全球参数规模最大的开源大模型,内置896个专家模型,每个Token只激活16个,既有深度又有效率,还自带100万token超长上下文窗口。技术参数可能太抽象,说点直观的。发布当天,KimiK3在AI评测平台Arena的综合得分直接冲到全球第三,前面只有Anthropic的ClaudeFable5和OpenAI的GPT-5.6Sol两座大山。代码能力更猛,直接登顶前端代码生成榜第一,1679分压过了Facebook的闭源模型,也压过了GPT-5.6。全球程序员圈子一夜之间全在讨论这个来自中国的狠角色。马斯克都坐不住了,在社交平台公开评论"Impressive"——令人印象深刻。能让眼高于顶的马斯克说出这句话,含金量有多高,懂的人自然懂。华尔街的反应最诚实。消息传出后72小时,美股AI板块合计蒸发约4700亿美元。费城半导体指数较6月底高点回撤20%,正式跌入技术性熊市。英伟达、AMD、博通这些AI概念股早盘集体跳水,投资者疯狂抛售。谁也没料到,一个被判定"掉队"的中国团队,能反手给全球AI产业格局来这么一下。杨植麟这个人,从来就不按常理出牌。高中拿了信息学竞赛广东一等奖,保送清华。自主招生又被录取一次。高三非要参加高考,硬是又考进去一次,等于三进清华。清华姚班读书,他拿年级第一,拿特等奖学金。读博去了卡内基梅隆,师从两大AI泰斗。Transformer-XL和XLNet这两篇NLP领域里程碑式的论文,他都是第一作者。GoogleBrain、MetaAI他都待过,苹果开出高薪挖他,他拒绝了。2023年,31岁的杨植麟选择回国创业,创办月之暗面,一头扎进大模型这条挤满巨头的赛道。创业这条路从来不好走。去年Kimi靠长文本火了一把,用户量冲得很快,但很快就遇到瓶颈。月活下滑,竞品围堵,外界质疑声一浪高过一浪,说他只会蹭热度,技术跟不上。杨植麟没辩解,闷头干了一年。这一年他把核心目标从"拉新"改成"留存",从追求用户数量转向打磨技术底座。外人看他是沉寂了,其实是在憋大招。KimiK3就是他憋出来的答案。自研的KDA混合线性注意力机制,解码速度比传统架构提升6.3倍。MoonClip二阶优化器,能让20T训练数据跑出40T的效果,成本直接砍半。这些底层技术创新,才是真正让硅谷紧张的地方。以前中国大模型靠堆参数、堆算力追赶,现在开始在架构层面搞原创突破,这是从跟跑到并跑的关键信号。更狠的是,KimiK3要开源。7月27日开放完整权重,全球开发者都能免费用。2.8万亿参数的顶级模型直接开源,等于把OpenAI、Anthropic花几十亿砸出来的技术门槛给踹碎了。闭源巨头靠信息差赚溢价的好日子,可能真的要到头了。中国公司用开源打法撕开一道口子,让全世界开发者都能站在万亿参数模型的肩膀上做创新,这才是最有想象力的地方。回头看梁文锋和杨植麟,两个广东人,一个85后一个90后,走的路竟然出奇地像。都是技术出身,都很低调,都不喜欢在媒体面前抛头露面,干起活来都是不要命的狠角色。梁文锋靠DeepSeek证明,中国公司能在通用大模型上跟美国掰手腕。杨植麟用KimiK3进一步证明,中国的年轻一代创业者,不仅能跟上,还能在某些方向上实现反超。硅谷焦虑的从来不是某一款模型,而是背后那批越来越能打的中国工程师。以前他们觉得中国AI只会模仿,现在发现这帮年轻人搞起原创来,一点都不含糊。当然也要清醒,KimiK3综合能力还是全球第三,和顶尖闭源模型还有差距。不能吹得太过头,技术追赶这条路还很长,容不得半点骄傲自满。杨植麟今年才34岁,梁文锋也不过41岁。这批正值当打之年的技术创业者,正在用实打实的产品说话,改写全球AI产业的权力版图。各位读者你们怎么看?评论区留言讨论吧!
美反思流失华裔精英人才,连重金都挖不动墙角,硅谷模式已经过时了!KimiK3大
美反思流失华裔精英人才,连重金都挖不动墙角,硅谷模式已经过时了!KimiK3大模型一发布,美国媒体铺天盖地的讨论就从模型本身转向了创始人杨植麟。很多人追问:美国为什么没留住这个人?一款中国大模型登场,硅谷先盯技术指标,随后却把放大镜挪到了创始人的履历。模型能写代码、做研究固然吸睛,可更让美国科技圈坐不住的问题是,杨植麟在美国接受过顶尖科研训练,也得到过大企业招揽,为何最终选择回国创业?这不是一张签证能解释的故事,而是一场人才选择题正在改写答案。2026年7月14日,月之暗面发布KimiK3。官方资料显示,这款旗舰模型拥有2.8万亿参数,原生支持多模态能力,具备百万次元上下文窗口,重点面向软件工程、知识工作和深度推理。新华每日电讯随后将其称为全球参数规模最大的开源模型。模型亮相后,海外科技媒体迅速跟进,讨论也从跑分表格转向杨植麟为何离开美国。杨植麟本科毕业于清华大学,随后赴卡内基梅隆大学攻读计算机博士,长期研究自然语言处理和大模型。他曾在谷歌大脑和脸书人工智能研究机构实习,博士毕业后并不缺少留在美国科技行业的机会。这样的履历放在硅谷人才市场,基本属于招聘人员见了就想把咖啡端稳一点的类型。争议出现后,其博士导师萨拉胡特迪诺夫公开说明,杨植麟并不是因为抽签或签证问题被迫离开美国。他当时拥有多种职业选择,苹果方面也曾表达招揽意愿,甚至提到可以安排其在北京办公室工作。但杨植麟已经决定回国创业,希望亲手创建一家面向通用人工智能的公司,而不是在大企业里做一枚待遇优厚的螺丝钉。2023年4月,杨植麟领衔创立月之暗面。公司此后围绕长文本、基础模型、智能体和开源生态持续投入。KimiK3的出现,说明这条创业路线已经形成了可以被全球开发者检验的产品。美国舆论感到别扭的地方正在这里:门开着,职位摆着,薪酬也不会寒酸,可人才还是选择了另一条路。过去几十年,硅谷最强的武器并非办公楼,也不是永远喝不完的免费咖啡,而是全球优秀人才愿意汇聚于此。高薪、资本、大学和大企业共同形成吸力,人才在美国完成训练,再进入科技公司和创业体系。这套循环仍然存在,却不再只有一个中心。英国金融时报和美国华尔街日报近年都注意到,一批在美国工作的中国人工智能、机器人和生物医药人才正在回国发展。原因既有家庭和生活考虑,也有职业空间、产业机会和创业环境的变化。对顶尖研究者而言,能否主持项目、组织团队、决定技术路线,有时比工资数字多几个零更重要。这也解释了重金为何未必能挖到墙角。人才不是仓库里的零件,贴上更高价格就能自动搬家。科研人员要看算力、数据、工程团队和市场场景,也要看成果能否快速走出实验室。中国拥有完整产业体系、广阔应用空间和不断壮大的开发者群体,大模型可以进入制造、交通、金融、医疗和科研等领域,技术迭代更容易获得真实反馈。2026年,中国继续推进人工智能赋能行动,并强调开源社区、人才培养和产业协同。相关政策支持模型、工具和数据集开放,推动人工智能与重点领域深度融合。杨植麟也在人民日报撰文表示,中国开源模型正在成为全球创新的重要基座。开源不是把家底往门外一摆,而是用更多开发者、更丰富场景和更快迭代换取生态影响力。所谓硅谷模式已经过时,不能理解成硅谷失去了科研和资本实力。真正过时的,是把美国视为全球顶尖人才唯一终点的想法。今天的竞争,不再是谁能一次性挖走人才,而是谁能长期提供尊重创造、允许试错、支持创业的环境。硅谷的磁铁仍然很强,中国的磁场也已经形成。KimiK3引发的讨论,表面是模型较量,背后却是创新体系的较量。留住人才,靠的不是口号和支票,而是让研究者有项目可做、有团队可带、有成果可落地。美国需要反思人才吸引机制为何松动,中国则要继续完善基础研究、知识产权保护、科研评价和创业服务。科技竞争像跑马拉松,靠抢跑赢不了全程,靠挖走几名选手也建不起完整队伍。硅谷仍是重要创新高地,但不再拥有唯一答案;中国人才也完全可以在自己的土地上,把月之暗面走成一条明亮大道。