

Al当道的这两年,硅谷和华尔街开始有一种越来越浓的情绪:紧张中国年轻人和新兴Al企业。
因为每隔几个月,中国就会冒出一家新的公司,冲击他们的秩序,也让市场重估AI的未来。
去年,冲得最,厉害的是DeepSeek。它告诉世界,先进大模型不只有堆芯片和算力这条路。
今年,冲得厉害的是月之暗面(Moonshot)。
7月16日,月之暗面发布了2.8万亿参数、100万Token上下文的新一代大模型Kimi K3。它在编码测试中击败Anthropic的Fable 5和OpenAI的GPT-5.6 Sol,表现出了全球头部AI的能力。
几乎与此同时,全球AI产业链,尤其是芯片股再次股价大跌,英伟达直接失去了市值王位。
去年,带DeepSeek掀桌子的,是一个年轻人,生于1985年的梁文锋。
今年,带Kimi掀桌子的,是一个更年轻的人,生于1992年的杨植麟。
一般人认识杨植麟,是因为Kimi。真正了解AI的人,则是更早就通过论文上认识了他:
一个计算机科学天才。
杨植麟 1992年出生于广东汕头,本科清华大学计算机系毕业,导师也是计算机大牛——中国首个万亿市值AI企业智谱创始人之一唐杰。
清华毕业后,杨植麟赴全球计算机的顶级殿堂之一卡内基梅隆大学计算机系攻读博士,师从苹果AI负责人、著名学者Ruslan Salakhutdinov,研究方向是深度学习和自然语言处理。
然后不久,他就开始在Al世界开挂,成为全球最有实力与影响力的新一代Al学者。
2018年,杨植麟和导师团队提出了深度学习大模型架构Transformer-XL。第一次真正解决了Transformer模型处理长文本时“记忆太短”的问题,大幅提升了模型处理长上下文的能力。
一年后,他又参与提出了XLNet。这是当时全球最先进的自然语言模型之一,在二十多项国际权威基准测试中刷新纪录,成为全球AI领域最具影响力的论文之一。直到今天,大模型关于长上下文、复杂推理、长链思考的很多能力,都能看到Transformer-XL及Net留下的技术痕迹。
后来,他进入Google Brain和Meta AI工作,2023年回国创办月之暗面。所以,虽然Kimi才3岁,但Kimi K3却是杨植麟10多年积累的释放。
Kimi K3真正冲击市场的不是2.8万亿参数、100万Token上下文等击败GPT-5.6 Sol的强大功能,而是另一件事:
用户成本只有GPT-5.6Sol的40%。
Kimi K3采用开放权重发布,企业可以下载、部署、微调;官方API价格为每百万Token输入20元、输出100元。而OpenAI旗舰模型GPT-5.6 Sol对应却是34元和203元的价格。
而在一个月调用1亿输入Token、2000万输出Token的企业场景下,Kimi成本约4000元,而GPT-5.6 Sol约7450元,后者几乎贵一倍。
如果说deepseek是冲击了GPU的性能刚需,Kimi则是真正将美国AI打成了内伤。
它直接用模型打模型,以大幅低于美国旗舰模型的价格,提供接近全球第一梯队的能力,也让过去三年华尔街基于模型高收入预期形成的AI估值逻辑发生了动摇。有外媒甚至评价:
中国在一个下午就烧掉了美国AI的领先优势!
但真正让硅谷和华尔街睡不着的,恐怕还不是杨植麟和Kimi,而是中国到底还会有多少年轻人,不断跑出来,挑战他们的定义和定价。
从马云让硅谷和华尔街对中国创业者大开眼界开始,中国一代又一代,一批又一批年轻人跑了出来,跑进过去只属于他们的舞台,越跑越强。
其实,更睡不着的,还是杨植麟们自己。他们更清楚中国,也更担心,更紧张,下一个年轻人,把他们的桌子也给掀了。就像某种程度上,他已掀了中国所有同行,包括导师的桌子一样。
这就是现在的中国式竞争,美好而又残酷的现实。美好在于,能人雄才太多,总有人可以让对手睡不着;残酷也在于,能人雄才太多,自己人更让自己人睡不着。
相信用不了多久,下一个杨植麟,下一个重新定义Al,定义中国科技的年轻人,就会闪亮登场。
天宇优配提示:文章来自网络,不代表本站观点。