12月17日消息,谷歌今日正式推出其最新版本的视频生成模型——Veo 2,标志着公司在AI视频生成领域的又一次重要突破。谷歌表示,Veo 2能够生成更为真实和细致的视频内容,成功与OpenAI的Sora模型展开了正面竞争。这一全新的视频生成器不仅在技术指标较之前作Veo有了显著提升,更是在用户体验和应用范围上进行了一系列优化。
首先,Veo 2在理解现实世界的物理规律、人物动作以及表情方面被认为表现尤为出色。据谷歌透露,该模型对人类行为的细腻反馈能力,将大大提升创作者的内容生成质量和真实感。此外,Veo 2还在电影制作技术的应用上有所突破,用户仅需指定视频类型、镜头和一些电影特效建议即可生成最高可达4K分辨率的视频。这对于电影制片人及视频内容创作者而言,无疑是一个极为实用的工具。
目前,Veo 2已开放给部分受邀用户试用,且可以通过谷歌实验室的VideoFX平台进行访问。不过,想要体验这项技术的用户需填写谷歌表格注册并加入等候名单。此外,通过Veo 2生成的视频将被嵌入谷歌独有的元数据水印SynthID,用以标识这些视频为人工智能生成内容。尽管Veo 2承诺新版本将显著减少视频生成中的“幻觉”现象,例如多余手指等不自然形象,但谷歌仍承认在某些情况下难以完全避免这些问题。
在与OpenAI的Sora进行对比时,谷歌在其内部测试中发现,Veo 显示出在“总体偏好”和“提示依从性”两个关键指标上皆超过了Sora及其他竞争对手。这一表现引发了业界的高度关注,尤其是在AI视频生成领域不断发展的背景下。谷歌早在今年5月的I/O开发者大会上就首次展示了Veo,期间更是邀请了著名演员兼音乐人唐纳德·格洛沃共同制作了展示视频,吸引了广泛的目光。
AI视频生成的未来发展仍将充满挑战,尽管谷歌和OpenAI等大厂的技术在持续进步,目前的视频生成工具还需更多的改善和迭代。尤其是在创作者和观众的质疑声中,如何确保生成内容的质量和真实性仍然是行业所需重点考虑的问题。在这一点上,RunwayML等小型企业也在力图通过推出诸如Gen-3 Alpha Turbo等更为强大的视频生成模型,以提升用户的控制力和创作自由度。与此同时,LumaAI与亚马逊AWS的合作,将AI视频生成技术引入Bedrock平台,增强了其企业级应用的能力。
随着AI视频生成技术的逐步成熟,越来越多的创作者开始探索这一领域的潜力。比如著名导演詹姆斯·卡梅隆已加入Stability AI的董事会,而演员安迪·瑟金斯则宣布成立一家专注于AI的制作公司,显示出行业对AI技术应用的强烈兴趣。据谷歌透露,YouTube创作者们已经开始使用VideoFX平台,利用AI生成工具为短视频制作背景,进而提高创作效率,充分体现了AI技术在媒体内容制作中的实用性。
另外,谷歌还对其另一项图像生成模型Imagen进行了升级,推出了Imagen 3。该模型通过Gemini聊天机器人提供服务,并且在图像生成的生动性和细节丰富度上也有了显著提升。Imagen 3能够更准确地渲染多种艺术风格,包括写实主义、印象派、抽象艺术及动画风格,用户在使用体验上将获得更大的灵活性和广泛的创作选择。
在总结Veo 2和Imagen 3的发展时,我们可以看到,人工智能生成工具正在不断缩小与人类创作之间的差距,成为内容创作者的重要助手。尽管还面临许多挑战,这项技术的快速进步已为未来的创作和表达方式带来了新的可能性。借助于诸多新兴的AI工具,创作者可以更高效地进行内容生产,更加专注于创意本身。
总之,AI视频生成和图像生成领域正处于快速发展之中,创作者们有理由期待即将到来的更高效的工具和更丰富的创作体验。在我使用了数十家AI绘画、AI生文工具后,强烈推荐给大家以下这个工具——简单AI。简单AI是搜狐旗下的全能型AI创作助手,包括AI绘画、文生图、图生图、AI文案、AI头像、AI素材、AI设计等。可一键生成创意美图,3步写出爆款文章。网站提供生成创意美图、动漫头像、种草笔记、爆款标题、活动方案等多项AI创作功能。工具链接:
