世界模型是上不了桌的另开一桌

坐小孩桌

「坐小孩桌」

时间到了2026年9月,我们基本可以宣布世界模型是一个垃圾概念。

世界模型的起因是一群没上大模型桌的老登,试图上桌,又做不明白已经沦为重工业、白热化竞争的大语言模型,于是生造出了一条世界模型赛道。

世界模型代表人物,李飞飞和杨立昆,这两人做的还是完全不一样的东西,你把截然不同的东西归类为一个概念就很幽默了。

更幽默的是,立即有一堆国内的小天才出来认领,说自己也在做世界模型。

当然,小天才的表达能力都是很好的,吹牛逼是核心壁垒。你问他们什么是世界模型,他们一定可以从自己的原生家庭讲到技术架构再讲到自己和大佬乱七八糟的师承关系。

总而言之一句话:小天才,世界模型,打钱。

然而,实际情况是:后训练开源视频模型,没卡没数据没人用,收入全靠爆VC金币。

然后这些小天才的打法一模一样。骗到钱后就立即上新智元、机器之心、量子位宣发,唯一的创新就是定语创新,在世界模型前加一堆定语。

让我简要列举一下:

因果世界模型、社交世界模型、社会世界模型、认知世界模型、神经认知世界模型、记忆增强世界模型、脑启发世界动作模型、心理世界模型、心智世界模型、主观世界模型、两层世界模型、双层智能体世界模型、人类社会世界模型、物理-社会统一世界模型、不断自我进化的企业世界模型;还有界面世界模型、AI4AI世界模型、世界联觉模型、世界统一模型、循环世界模型、开悟世界模型、分子世界模型、微观分子世界模型、微观世界模型、小时级世界模型、Flash World Model……

还有昨天刚发的这个XGEN。表面上,「去你X的世界模型」。实际上,「我们在做主观体验模型」。

我操,你只是名字不叫世界模型,而且还换了个更晦涩的词来恶心我们。

据我观察,主要有四类人讲世界模型故事:

第一类是,混不下去的应用公司,原地转型Neo lab,试图靠模型故事再爆金币,典型如Loopit,AI抖音转型世界模型大家竟然也听得下去。

第二类是,混不下去的视频模型公司,后训练一个实时生成的视频模型就号称世界模型,典型如生数、爱诗科技。当然,这些实时生成模型要是专注某些场景,说不定真有用。

第三类是最好的,AI 3D模型公司,原地转型世界模型。Tripo、影眸、Meshy都靠这个爆了大金币。这是好事啊。

第四类是最坏的,一众博士生学也不上了,工也不打了,被急于上桌的投资人撺掇出来创业。什么火做什么,做一堆数字人和劣质GTA短视频,就敢号称世界模型。

排除掉其中也许有价值的AI 3D模型,人家只是想讲故事爆金币可以理解。剩下的,全是后训练视频模型啊。

这几个月来唯一的进展是,融资那会大伙只能后训练Wan和LTX,这两模型新版本都开源快一年了,效果有点糟糕。

幸好,剑眉星目的天降伟人闫俊杰救了小天才们一把。MiniMax H3是唯一开源且能与Seedance 2.0一战的视频模型。

所以你能见到这些世界模型公司这段时间开始密集宣发产品,单纯因为后训练H3效果更好,又能圈一波钱了。

这就形成了一种很幽默的效果。

MiniMax是一家基模能力掉队了的大模型公司。虽然我坚信它和智谱、Kimi没有本质区别,只是发拉了一个版本,阶段性落后。但它的股价说明了市场共识,市值只有智谱的1/3-1/4。

大模型公司里大伙看不太上的MiniMax,在世界模型里是毋庸置疑的大爹。

我真诚建议这波骗到钱的世界模型公司们,捐一半融资款给闫俊杰,备注自愿赠与。本质都是后训练H3,MiniMax活着你们才能源源不断地炒作。

闫俊杰是世界模型唯一的太阳啊。他老人家肥厚的手缝里稍微漏点,就够这一堆成天吹牛逼的小天才再去爆两轮投资人金币。

这说明什么?

最牛逼的世界模型,也在桌子下边。二流的大模型,也在桌子上边。泾渭分明,只有上不了桌的人才去做世界模型。

道理很简单。大模型是技术路线收敛了的制造业,各个团队之间最大的差异是算力和数据。

大模型公司老板最重要的事情就两个,一个是搞算力,另一个是搞数据。 而我坚定相信MiniMax没有下桌的地方就在于,它的算力和数据都没有显著落后,那它就没有道理长期不行。

当然,上述假设要排除掉智谱Zcode偷摸上传的用户代码数据,我是坚信智谱不会用这些用户数据来训模型的!

说回世界模型。

这些小天才们都声称自己也在训模型,用模型公司的估值来融资。但最大的问题是,他们大部分没卡没数据,只能费劲搞点后训练,然后做出来的产品还没有任何差异:

整个市场都是实时生成的数字人直播间和WASD游戏画面,质量都还差不多,这些人全都声称自己的成本比同行低一个数量级。

绝望啊朋友们,完全是平地干拔。这些玩意首先都没用,其次还没差异,我只感到极端的匮乏,十分怀念曾经能讲出创新故事的马卡龙和明超平同学。

另一个感想是,热钱真是太多了,投资人真是太坏了,家人们真是太想拿大结果了。

上一个故事周期是投资人撺掇产品经理创业,于是做出来了一堆没人用的垃圾产品;

这个故事周期是投资人撺掇研究员创业,于是做出来了一堆没人用的后训练视频模型。

除了这些投资人靠项目升职了,极个别创始人卖老股套现了,所有人都知道大伙心怀二心,却都假装在严肃讨论这个赛道的技术问题。

我听到有人讨论世界模型有几种技术路线就想笑。这是技术问题吗?这是纯粹的动机问题。

投资人投世界模型的动机是,AI应用的故事暂时凉了,大模型如此火热,而Deepseek、Kimi估值太高上不了车,世界模型就属于大模型概念股,投一投很好交差,而且号称做模型短时间无法证伪。

小天才做世界模型的动机更简单了。我看杨圣当年也就那样,闫俊杰一开始还是做元宇宙数字人的,我做模型我也行啊。

Timing,Timing!一切都是时机问题。

大模型是纯粹的制造业,还是劳动力密集型的重工业。各家模型厂都讲自己自建了多少万卡集群的算力,有多少独特的数据管线做数据。

这行业重到智谱这半年都在二级市场快融资100亿美元了。各位小天才拿头去搞算力、做数据?

当然了,假如小天才把融资款全都花在买B300上,真买到了,考虑到恐怖的算力需求增长速度,投这些世界模型搞不好还能挣钱。

所以啊,做世界模型最重要的是别创新,把钱全部买算力,包赚的兄弟。

此时此刻,我不得不怀念实时生成领域概念最领先的创业公司,我们亲爱的刘宇同学做的Vivix。

Vivix才最有资格讲世界模型故事,他们领先版本一年多,2025年初就开始讲实时生成视频故事。账上现金比很多世界模型团队估值高。

然而,Vivix都不说自己做的是世界模型。抛开实际效果不谈,人家就很老实本分,客观描述自己做的是流式视频模型。有一次葬AI不小心描述Vivix为世界模型,人家还专门请我们改掉这个表述。

只能说啊,在这疯狂的世界模型热潮面前,Vivix和宇哥无论如何都算勤劳本分、踏实肯干、不乱吹牛逼的了。我的心里只有感恩❤️

顺便预告一下,我们准备好了直播间Bench,硬碰硬测试这些实时生成视频模型的能力,看看到底哪个H3后训练版本最强,或者有没有好汉超越H3,敬请期待!

(本文封面由ChatGPT生成,纯人工写作)


欢迎订阅我们的Substack funeralai.substack.com