概述
Gemini Omni 是一款AI视频生成器,可根据文本提示、参考图像以及包括视频和音频在内的多模态输入生成视频片段。平台声称每个片段的生成速度不到一分钟——适合快速迭代工作流程——并为新用户提供无需信用卡的免费套餐,内含10个积分,足以在付费前生成多个视频。
角色一致性
该工具最突出的功能是跨镜头的角色一致性。用户上传一张或多张参考照片来定义角色,Gemini Omni 可在复杂的镜头移动、场景变化和多镜头过渡中锁定面部特征、服装、身体比例和视觉风格。据供应商称,即使场景几何结构和摄像机角度发生变化,这种一致性仍然保持——解决了AI视频生成中常见的角色外观漂移或变形、破坏叙事连续性的痛点。
对话式编辑
Gemini Omni 支持聊天内对话式编辑,允许用户用自然语言描述所需的更改,并由模型直接应用。支持的操作包括在场景中交换对象、替换背景、修改场景构图以及移除不需要的元素——所有这些都无需从头重新生成整个片段。供应商称此功能在主流AI视频生成器中独一无二,与仅通过提示重新生成的方法相比,是一种差异化的编辑工作流程。
计划和许可
该平台提供Lite和Pro订阅计划,增加积分额度、解锁更高分辨率输出,并在免费套餐基础上增加功能。Pro计划订阅者获得其生成内容的完整商业使用权,涵盖营销活动、社交媒体广告、产品演示、电商列表和其他商业应用。供应商明确指出免费套餐视频仅限个人使用,从而在套餐之间建立了清晰的许可边界。
API 与集成
Pro和Team计划订阅者可使用REST API,该API接受与Web应用相同的多模态输入——文本提示、参考图像、视频片段和音频——并返回带有同步音频流的渲染MP4文件。已发布的文档涵盖端点、速率限制和定价,使该工具适合程序化集成到内容生产流程中。
市场背景
Gemini Omni 在 AI视频生成器 领域运营,与 Viggle AI 和 Pixelverse AI 等工具竞争。每个竞争对手采用不同的AI驱动视频创作方法——一些强调角色动画,另一些专注于图像到视频的流程——而Gemini Omni 通过其角色一致性、对话式编辑和多模态API访问的组合实现差异化。
