Geek Savvy

Day3丨鸽了1年,OpenAI终于把Sora放出来了!

Image

终于终于等了快一年,OpenAI 打出第一个概念“文生视频”的期货产品新版 Sora 终于放出来了。

Image

就在 OpenAI 12天连续工作日的直播中,奥特曼也知道关注前两天的直播热度不是很好,在直播的第三天,凌晨2点,奥特曼终于把Sora放出来了。

今晚的直播不在是4个人,只有3个人,奥特曼这次不缺席了。

Image

从 OpenAI 第一次发布Sora Demo,引领全球,已经整整过去298天,Runway Gen 2、Pika、可灵、海螺等等国内外 AI 生成视频工具不断出新迭代,从实现几秒钟内的流畅连贯性问题,到现在 Sora 能够制作出20秒的连续视频,保持视频中的主角和背景人物展现出了惊人的一致性,镜头之间的切换流畅自如,人物形象始终保持着极高的稳定性,无疑又是一次历史性时刻。

由于跑 Sora 需要200刀,显卡等设备也有要求,现在就先不测试啦。咱们来看看今晚的直播,都讲了什么。

01 先说重要的

Sora 现在已经在世界大部分地区上线,除了欧洲大部分地区和英国外,当然也不包括我们。现在,对于拥有 ChatGPT  Plus 或 Pro 账户的用户来说,使用 Sora 不需要额外费用,但显卡等硬件有要求。可在 sora.com 使用。

Sora 的新版本提供了从480p到1080p的多种分辨率选择,让用户可以根据自己的需求和偏好来定制视频质量。当选择1080p这一高清分辨率时,Sora能够生成的视频长度大约为20秒,这在保持高清晰度的同时,也确保了视频内容的精炼和精彩。

Image

Sora 带来了3种视频生成模式:

  1. 文本到视频(Text-to-Video)模式:这是Sora的核心功能之一,它允许用户仅通过输入文本描述就能生成完整的视频内容。依托于先进的自然语言处理技术和生成模型,Sora能够准确把握文字的精髓,将其转化为生动的视觉画面。无论是制作简短的短视频还是构建情节丰富的叙事视频,这一模式都能帮助创作者轻松实现他们的创意构想。

  2. 文本+图像到视频(Text+Image-to-Video)模式:在这一模式下,用户不仅可以提供文本描述,还能上传图像来辅助视频的生成过程。通过结合文本和图像,Sora能够更精确地理解并展现创作者的创意意图,制作出更符合视觉预期的视频内容。这一功能特别适合需要在视频中融入特定图像元素的场景,如广告制作、产品展示等,为创作者提供了更多的创意空间。

  3. 文本+视频到视频(Text+Video-to-Video)模式:Sora还提供了视频编辑和转换的功能,用户可以上传已有的视频素材,并结合文本描述进行修改或扩展。这一模式让用户能够在现有视频的基础上,添加新的情节、细节,甚至创作出全新的版本或完全不同的内容。例如,用户可以对现有的广告视频进行重新编辑,加入新的对话、场景或动画效果,从而提升视频的吸引力和表现力。

02 Sora 的3个核心价值

OpenAI 强调了视频的三个核心价值:

  1. 创意工具的重要性:视频作为一种创意工具,对于文化和人类使用AI的方式至关重要。Sora的推出,正是基于这样的理念,它将帮助人们以前所未有的方式表达自己的创意。

  2. 协同创造的新动态:Sora在早期测试中展现出了新的协同创造动态,这表明了广告创意工具的潜力。它不仅仅是一个工具,更是一个平台,让创意人士能够协作和共创。

  3. AGI路线图的关键一环:视频对于OpenAI的通用人工智能(AGI)路线图至关重要。Sora将成为学习的重要环境,帮助AI更好地理解世界及其物理学。

02 Sora Turbo 的技术突破

Sora 的技术突破在于其预览方式更快、更便宜,且能够生成高质量的视频。Sora Turbo 是原始Sora模型的高端加速版本,包含了从文本生成视频、动画图像以及大量视频到视频的功能,如重新混合成新的风格、向前扩展和及时包装等。

Image

03 飞升项目与 AI 系统的理解

飞升项目的目标是建立能够真正深入理解世界及其物理学的 AI 系统。Sora 的早期版本虽然会犯错误,但已经足够成熟,能够增强人类的创造力。OpenAI 期待看到世界与Sora的互动将如何发展。

04 Sora的产品体验与社区

Sora 的产品体验是为视频生成从头开始构建的。用户可以通过简单的文本描述或上传图像来创建视频。Sora还提供了一个社区共享的视频源,用户可以在这里探索、学习、分享技巧和方法。

05 视频创作的工具与功能

Sora 提供了多种视频创作的工具和功能。用户可以创建视频、收藏物品、查看书签,并使用简单作曲家通过文本描述或上传图像来创建视频。Sora 还允许用户生成不同分辨率和时长的视频,并提供多个视频变体。

06 故事板:视频创作的新维度

Sora引入了故事板功能,这是一种更先进的创意工具,允许用户在视频上引导多个动作。用户可以在时间轴上描述环境、角色以及希望在特定时刻发生的操作,从而创造出连贯的视频剪辑。

07 图像到视频的转换

Sora 还提供了图像到视频的转换功能,用户可以上传图像并让 Sora 自动放置图像,生成连续的视频标题。这个功能允许用户编辑卡片中的内容,创造出个性化的视频。

08 混音与循环:视频创作的新工具

Sora 的混音功能允许用户对视频进行调整,从强度到分辨率,都可以根据用户的需要进行定制。此外,Sora 的循环功能允许用户无休止地重复视频,创建无缝、重复的场景。

Last but not least

Sora 的发布是 OpenAI 的一个重要里程碑,展示了 AI 在视频生成领域的潜力,也为创意工作者提供了一个全新的工具。我们也相信国内的 AI 视频工具在可控性,流畅性越来越好。

现在快凌晨4点了,晚安!


关注公众号,用极客视角洞察未来!

Image

往期精彩文章推荐:

1.OpenAI Day2有点惊喜!o1模型将支持用户强化微调!可达博士水平!

2.AI自媒体熬了个寂寞