万益资讯网

谁能想到,DeepSeek之后,第二个让华尔街集体失眠的中国人,居然是一个几个月

谁能想到,DeepSeek之后,第二个让华尔街集体失眠的中国人,居然是一个几个月前还被嘲“掉队”的90后,他叫杨植麟。

7月16日,WAIC大会开幕前夕,杨植麟创办的月之暗面干了一件让全球AI圈措手不及的事。没有铺天盖地的预热,没有几十场发布会,他们直接在官网上线了新模型Kimi K3。几个小时后才发了条公众号公告,轻描淡写。

然后整个硅谷炸了,2.8万亿参数,全球参数最大的开源模型,也是首个迈入3万亿级别的开源模型。896个专家中只激活16个的超稀疏MoE架构。原生支持视觉理解,100万token上下文窗口,相当于能一口气读完一整本长篇小说,或者一个完整项目的全部代码。完整模型权重定于7月27日前向全球开发者开放。

更狠的是,K3在Arena AI前端编程榜上直接登顶,1679分,压过了Claude Fable 5的1631分和GPT-5.6 Sol的1618分。7个前端细分领域拿了6个第一。连马斯克都在社交平台留了句:“Impressive”。

外媒的标题更直接,“美国在AI领域领先世界”这一认知被打破了,彭博社报道称,K3发布当天引发科技股和芯片股开盘重挫。福布斯打出了头条:“Kimi能否挑战OpenAI和Anthropic?”。英国《自然》杂志说,这是自DeepSeek以来最受关注的中国AI模型,有专家称之为“斯普特尼克时刻”。

K3到底能干什么?普通人用一句话就能复刻出童年玩过的、已经停更的游戏,还原度达到90%。输入20篇商业航天研报,一句话生成图文并茂的深度报告。更夸张的是,K3连续自主运行48小时,基于开源EDA工具和45nm工艺库,为自己设计了一款芯片,实现时序收敛和每秒超过8700token的仿真解码吞吐。

但K3太火了,火到月之暗面自己都扛不住,发布仅48小时,用户请求量逼近集群承载极限。7月19日,公司紧急发布公告:暂停C端新用户订阅,全部算力优先保障已付费老用户。一个开源模型,把自家服务器干崩了,这大概是AI行业最甜蜜的烦恼。

杨植麟是谁?1992年出生在广东汕头,本科清华计算机系年级第一,赴卡内基梅隆大学读博,2019年拿到博士学位,比通常少用了大约两年。Google Brain实习过,Facebook AI Research待过。Transformer-XL和XLNet两篇大模型核心论文的第一作者。研究成果被Google Scholar引用超过17000次。

苹果想要他,谷歌和Meta也抛出过橄榄枝,斯坦福和麻省理工向他敞开博士后大门,但2023年3月,他选择回国创办了月之暗面。公司名字来自平克·弗洛伊德那张经典摇滚专辑,成立当天正好是专辑发布50周年。五个创始人全部毕业于清华,会议室全用摇滚乐队命名。

美国网友在社交平台疯狂追问:他为什么不留在美国?这条帖子获得8800多点赞和1000多条回复。最高赞的几条回复说:“在美国创业签证太难”“中国对创新者来说是一个更有趣的地方”。连杨植麟的导师都出来澄清:不是签证问题,“他有很多机会留在美国,但植麟下定决心要回国创办一家初创企业”。

有美国网友说了一句扎心的话:“美国可以给杨植麟一个顶级科学家的岗位,却很难给一个刚毕业的外国年轻人足够的资本、算力和决策权,让他迅速组建团队,挑战OpenAI”。“他在美国可能会拥有一份漂亮的简历,却很难做出Kimi”。

商业层面,月之暗面的速度更让人咂舌,2025年年底估值还只有43亿美元,进入2026年,1到2月连续完成三轮融资,分别5亿、7亿、7亿美元,估值从100亿飙到180亿。5月又融了20亿美元,估值突破200亿美元。据媒体报道,公司计划8月启动Pre-IPO轮融资,目标估值500亿美元,半年多时间,估值翻了超过十倍。

从一个被嘲“掉队”的90后,到让华尔街失眠、让马斯克点赞、让硅谷重新审视中国AI的创业者,杨植麟只用了几个月。

K3的完整权重7月27日就要向全球开源了,到那天,全世界的开发者都能免费下载、修改这个2.8万亿参数的庞然大物。

DeepSeek之后,第二个“梁文峰”已经出现了。这一次,他叫杨植麟。