告别“一分钟魔咒”:高德世界模型打破AI连续推理极限

在AI世界模型领域,一直存在一个令人头疼的“一分钟魔咒”。目前主流的世界模型在单次连续生成时,往往只能维持30秒到1分钟的“清醒”。一旦时间拉长,画面就会开始崩坏、物体变形、物理规律失效,甚至交互响应也会完全错乱。这背后的罪魁祸首,是自回归视频生成过程中不断累积并被逐步放大的误差。

不过,这个技术瓶颈如今迎来了重大突破。

从“分钟级”到“天级”的跨越

近日,阿里巴巴旗下的高德交出了一份惊艳的答卷:其自研的通用交互式世界模型 ABot-World-0 完成了新一轮技术升级。最令人振奋的是,它在单张消费级GPU上,成功实现了连续24小时的稳定推理

这意味着,在长达一整天的运行中,该模型的画质、物理一致性以及交互响应都没有出现明显衰减。高德也因此成为全球首个将交互式世界模型连续推理时长从“分钟级”硬生生拉升至“天级”的团队。

揭秘 LongForcing:如何驯服误差累积?

面对行业公认的难题,高德是如何让模型在超长时序中保持稳定的?

答案在于一种全新的 LongForcing 长程训练范式。这种范式巧妙地将“长时间稳定性”与“开放场景动态建模”统一纳入了训练目标。

在训练阶段,模型会持续将自身生成的结果作为后续输入。为了防止误差累积导致的分布漂移,LongForcing 引入了严格的约束机制,确保生成的内容始终处于合理且稳定的世界分布范围内。这一招釜底抽薪,有效化解了误差放大问题,让画面质量、场景结构和动态演化在超长时序推理中依然稳如泰山。

全面开源,赋能未来应用

这项突破并非仅仅停留在实验室阶段。目前,ABot-World-0 已正式开源,开发者仅需单张消费级显卡即可在本地轻松部署。同时,相关能力也已无缝集成至高德此前推出的通用世界模型开发平台 ABot-World Studio 中。

从长时交互、仿真模拟,到机器人训练和数字孪生,ABot-World-0 的这次升级为众多前沿场景注入了巨大的应用潜力。它不仅打破了时长的枷锁,更为交互式世界模型迈向真正的“长期自主运行”铺平了技术道路。AI构建的虚拟世界,终于可以实现“永不掉线”了。

类似文章