谷歌再次出击!推出Veo2和Imagen3新版本,效果超过Sora!同时上线有趣新工具Whisk!
要点速览
今天,谷歌宣布推出Veo 2 :声称是最先进的视频生成模型,可根据文本或图像提示生成逼真的高质量剪辑。谷歌还发布了文本转图像模型Imagen 3的改进版本- 可通过以下方式在 ImageFX 中使用。
Veo 2 能够:
创建分辨率高达 4k 的视频;
理解提示中的相机控制,例如广角镜头、POV 和无人机镜头;
更好地重现现实世界的物理和逼真的人类表情;在人类评分者的输出正面比较中,它比其他顶级视频生成模型更受欢迎。
还增强了 Imagen 3 的功能:
制作多样化的艺术风格:现实主义、幻想、肖像画等;
更忠实地将提示转化为准确的图像;
生成更明亮、构图更平衡的视觉效果
Imagen 3 的功能现已在 111 个国家/地区的 ImageFX 中实现 - 我们很高兴将 Veo 2 也推广到 VideoFX,明年将扩大可用性。✨
立即注册 → https://goo.gle/veo-2-imagen-3
01 详细介绍(来自Google官方)
今年早些时候,我们推出了视频生成模型 Veo 和最新的图像生成模型 Imagen 3。从那时起,看到人们借助这些模型将自己的想法变成现实,我们感到非常兴奋:YouTube 创作者正在探索YouTube Shorts视频背景的创意可能性,企业客户正在增强Vertex AI上的创意工作流程,创意人员正在使用VideoFX和ImageFX讲述他们的故事。我们与从电影制作人到企业的合作者一起,继续开发和改进这些技术。
今天,我们推出了一款新的视频模型 Veo 2 和最新版本的 Imagen 3,它们都取得了一流的成果。这些模型现已在 VideoFX、ImageFX 和我们最新的实验室实验Whisk中提供。
02 Veo 2:最先进的视频生成
Veo 2 可制作各种主题和风格的高质量视频。在由人类评分员评判的正面比较中,Veo 2 与领先模型相比取得了最先进的结果。
它能更好地理解现实世界的物理现象以及人类动作和表情的细微差别,有助于整体改善细节和真实感。Veo 2 了解电影摄影的独特语言:要求它指定类型、指定镜头、建议电影效果,Veo 2 就能提供这些效果——分辨率高达 4K,长度可延长至几分钟。要求一个穿过场景中间的低角度跟踪镜头,或者一个通过显微镜观察的科学家面部特写镜头,Veo 2 就能制作出来。在提示中建议“18mm 镜头”,Veo 2 就会知道如何制作这种镜头所擅长的广角镜头,或者通过在提示中输入“浅景深”来模糊背景并聚焦于拍摄对象。
虽然视频模型经常会产生“幻觉”不需要的细节(例如多余的手指或意外的物体),但 Veo 2 产生这些细节的频率较低,从而使输出更加逼真。
我们对安全和负责任的开发的承诺指导了 Veo 2。我们一直在刻意衡量 Veo 的可用性,因此我们可以帮助识别、理解和提高模型的质量和安全性,同时通过 VideoFX、YouTube 和 Vertex AI 慢慢推出它。
与我们的其他图像和视频生成模型一样,Veo 2 输出包含一个不可见的 SynthID 水印,有助于识别它们是由 AI 生成的,从而有助于减少错误信息和错误归因的机会。
今天,我们将新的 Veo 2 功能引入 Google Labs 视频生成工具 VideoFX,并扩大可以访问该工具的用户数量。请访问Google Labs注册候补名单。我们还计划明年将 Veo 2 扩展到 YouTube Shorts 和其他产品。
03 Imagen 3:最先进的图像生成
我们还改进了Imagen 3图像生成模型,现在该模型可以生成更明亮、构图更好的图像。它现在可以更准确地渲染更多不同的艺术风格——从照片写实主义到印象派,从抽象到动漫。此次升级还可以更忠实地遵循提示,并渲染更丰富的细节和纹理。在将人类评分者的输出与领先的图像生成模型进行并排比较时,Imagen 3 取得了最先进的结果。
从今天开始,最新的 Imagen 3 模型将在全球 100 多个国家/地区推出,这些国家/地区是我们 Google 实验室开发的图像生成工具 ImageFX。请访问ImageFX开始使用。
04 Whisk:一款有趣的新工具,可让您通过图像提示来形象化您的想法
Whisk是 Google 实验室的最新实验,它允许您输入或创建能够表达您心中主题、场景和风格的图像。然后,您可以将它们组合在一起并重新混合,以创建属于您自己的独特物品,从数字毛绒玩具到珐琅别针或贴纸。
关注公众号,用极客视角洞察未来!
往期精彩文章推荐: