凡人小北

你说一句,世界就变一下:我在 PixVerse R1 里体验了一次“活着的视频”

1/

PixVerse R1 真的有点东西,小时候做梦,能控制梦里发生的事。想飞就飞,想让场景变就变。

但一醒来,这种能力就没了。现实不听你的。 PixVerse R1 把这个能力还了回来,只不过现在还在屏幕里。

过去两年我用过不少 AI 视频工具,Runway、Pika、Sora,一个比一个强。但用下来都是同一个流程:写 prompt,等,拿到一个 MP4。不满意?再来一遍。

PixVerse R1 完全颠覆了。我试着对它说“让他坐上飞行器”,画面里的角色就真的飞起来了。再说一句“把剑换成冲锋枪”,武器就变了。没有重新生成一段新视频,画面直接变,世界还在继续跑。

这个感觉很奇怪,我们太习惯视频放完了就放完了,能暂停但不能改变。 终于有人把视频从文件格式里救了出来。


2/

然后我开始想一些奇怪的问题。

比如:如果我能用语言改变画面里的世界,那我到底是在看还是在活在里面? 又比如:如果每个人都能把故事改成自己想要的版本,那还有故事吗? 还是说每个人都活在自己的平行宇宙里?

但问题出现本身就说明范式真的变了, 也许我们未来剪辑的就是现实本身。

有人可能会说:这不就是游戏吗?不太一样。

游戏世界是设计师提前搭好的,你在里面活动。 R1 是你说什么,世界就长出什么。

也不是互动电影那种 A/B 选项,还记得爱情公寓结局让你选走向吗?本质上还是有限的预设分支,选完就没了。

在 R1 里能跟一个会听话的世界对话。说一句它变一下,然后继续往前跑。恶龙正喷火呢,你说变成小鸡,它就真变了。

这东西不属于任何已有的分类。 用语言控制世界这种事,过去只有两个地方做得到游戏引擎和梦里。

3/

说实话,R1 现在还很早期。实际体验下来响应速度确实惊艳。但画面精细度和复杂场景的稳定性还有提升空间。这是意料之中的,毕竟是第一代。

但 PixVerse 给它的定位挺有意思的:他们不叫它产品,叫它“实时生成层(live generative layer)”。意思是这是一个底层能力,游戏、影视、教育、广告,都可以往上搭。

这个定位说得很有野心,要打造一种新的基础设施。

就像 3D 引擎让游戏成为可能,R1 这类技术可能会让一种全新的媒介成为可能。

说不定这才是元宇宙该有的样子,你说什么它就长出什么。

4/

我个人比较期待游戏方向。

一个开放世界游戏,不需要设计师提前建好每一座山、每一棵树。你走到一片空地,说这里应该有个废弃的火车站,它就长出来了,而且跟周围的世界融在一起。

NPC 也不再是预设好的对话树,直接根据你说的话实时生成表情、动作和反应。

R1 指向的就是这个方向。

我说个可能有点远的想法, 人类一直在追求的一件事,让看到的东西听自己的。 画画是这样,摄影是这样,PS 是这样,AI 生成图片视频也是这样。

但这些都是先想好,再生成。 R1 的边想边改,让世界变成了一个过程。

这让我有点兴奋。如果你也想体验“边说边改的世界”,强烈建议玩两分钟:realtime.pixverse.ai