多模态视频生成
支持结合文字、图片、音频和视频输入
支持结合文字、图片、音频和视频输入
通过自然语言连续修改视频,调整环境、角度、风格、动作或具体细节
可将人物、场景、动作、音乐节奏或视觉风格作为参考
Gemini Omni 提供多模态视频生成、对话式视频编辑、参考素材融合等功能。适合短视频创作者、品牌与营销团队、教育内容制作者围绕相关任务使用。
多模态视频生成:支持结合文字、图片、音频和视频输入;对话式视频编辑:通过自然语言连续修改视频,调整环境、角度、风格、动作或具体细节;参考素材融合:可将人物、场景、动作、音乐节奏或视觉风格作为参考。