昊梵体育网

AI视频下一个突破口在哪AI视频从"几秒能动"到"30秒能讲故事",进化肉眼可见

AI视频下一个突破口在哪AI视频从"几秒能动"到"30秒能讲故事",进化肉眼可见。如果在现在,我们还在讨论AI视频能生成多长?格局小了。

从"几秒能动"到"30秒能讲故事",从靠运气的抽卡式生成到目前越来越可控的生产,AI视频技术迭代的速度快得吓人。但我的判断在未来AI视频的方向,根本不是卷视频时长,而是冲向世界模型。

世界模型这玩意是什么?简单说,就是AI在脑子里建了个能推演未来的模拟器。它看了海量真实世界数据后,学会了"做梦",只需要给它一个起始的状态和动作,它就能预测下一秒。如果我们把大语言模型(LLM)比作人类学习说话,那么我认为AI视频模型学的是如何凭空做梦,而且这梦越来越真。

看最新动态,高德今天发布ABot-World Studio,输入图文就能生成可交互世界,将交互式视频生成与3DGS场景生成整合至同一产品。之前Google发布的GENIE,阿里发布的快乐牡蛎,都是统一类型的世界视觉模型。

在我看来,视频只是表象。AI视频的本质是构建一个可交互、可推演、物理合理的数字世界。这才是AI视频的下一步。