当世界盯着 Kimi K3,北京另一家 AI 公司已经悄悄登顶全球具身榜

Kimi K3 发布那几天,圈里人的朋友圈基本被刷屏了。马斯克把它列为 Grok 4.5 的追赶目标,OpenAI 战略负责人说它「不是简单蒸馏能达到的」,高盛出了一份研报,写的是「中国大模型走到定价权节点」。这些信号是实打实的,不是公关稿里的修辞。

距月之暗面办公室 13 公里外,另一家北京公司千寻智能的具身模型 Spirit v1.6,已经在 RoboArena 登顶全球第一——超过了英伟达的 DreamZero 和 Physical Intelligence 的 Pi0.5。这是中国模型首次在这个榜上拿到第一。它旗下的 Moz1 机器人,能用一句自然语言指令完成「客厅收纳」这种长程任务,同时在宁德时代的产线上常态化运行,作业成功率稳定在 99% 以上。

两家公司,一个让 AI 在数字世界里学会思考,一个让 AI 在物理世界里学会行动。硅谷有 OpenAI 和 Anthropic 攻数字智能,有 Figure 和 Optimus 攻具身智能,但能在同一座城市把两条线都做到全球前排的,目前北京算一个。

都选了难的路

这两家公司有一个共性:都没走应用层套壳那条路。

Kimi K3 的性能跳跃,来自 Moon Clip 优化器、线性注意力机制、注意力残差这三项底层改动。不是堆算力,也不是抄结构,是在优化器和注意力机制这些基础组件上做结构性突破。月之暗面的人说得直接:「目标从来不是做高性价比的雕琢。」——名字叫 Moonshot,登月,从一开始就没打算省力。

千寻走的路更陡。创始人韩峰涛的判断是:第一波具身智能创业浪潮里,再做基座模型的机会可能已经没了。但千寻还是选了从具身基座模型、一体化力控关节到数据采集体系全栈自研。他们的 Spirit 模型采用 VLA 与世界模型融合的架构,从物理世界的感知与控制需求出发重新做底层设计。

两家公司的领军人物都来自清华。Kimi 的杨植麟,千寻的首席科学家高阳——后者是「伯克利归国四子」之一,现任清华交叉信息研究院助理教授。让顶尖学者走出实验室做底层创新,这是两家公司的共同底色。

开源策略上的交集

两家公司在开源策略上选了同一个姿势。

Kimi K3 是以开源模型身份登顶 Frontend Code Arena 编程榜的,首次在该榜超越头部闭源模型,被外媒称为「DeepSeek 2.0 时刻」。因为供不应求,C 端新用户订阅一度暂停。千寻的 Spirit v1.5 是国内首个综合性能超过美国标杆 Pi0.5 的开源具身模型,v1.6 继续开源。

两家公司对开源的底层逻辑是一致的:做出来了最好的,所以开源。不是因为做不过闭源才开。杨植麟说过一句话,大意是——既能做前沿研究,又愿意把模型和技术开放出来,这在全球来看都挺少见。这句话放在千寻身上也成立。在一个所有人都在问「具身智能到底能不能落地」的阶段,千寻选择用开源和真机实操来回应——在宁德时代的产线上,在 WAIC 的现场演示里,不是只给一个 PPT 和一个 demo 视频。

北京 AI 在补什么

7 月 24 日,北京市委主要领导围绕智能经济调研,走了三家公司:360、月之暗面、千寻智能。调研中释放出的三组关键词是——「持续提升基础大模型能力」「探索世界模型多技术路线」「促进具身智能等前沿领域发展」。这三条线刚好跟 Kimi 和千寻的技术主航道一一对应。

两家公司都还在爬坡期。Kimi K3 很强,但大模型的竞争节奏远没到终局,开源模型面对闭源巨头的算力和数据碾压,优势能维持多久还不确定。千寻的 Spirit v1.6 登顶 RoboArena,但具身智能从实验室到规模化部署,中间还隔着成本、泛化性、场景适配好几道坎。99% 的产线成功率听起来很好,但剩下的 1% 在连续生产中可能就是每几小时停一次。

北京 AI 在做的一件事是:把「思考」和「行动」这两块拼图同时铺开。Kimi 管数字世界里的智能上限,千寻管物理世界里的智能落地。一座城市同时拥有这两条赛道的全球级选手,生态密度确实少见。

拼图还没拼完。下一块是什么,现在还看不到全貌。北京不再只是一个出大模型公司的城市了。