从文本提示词或参考图像生成 AI 视频。720p、1080p 或 4K 输出,可选音频生成。16:9 或 9:16 格式,每个片段最长 8 秒。
使用 Veo 3.1 生成的示例输出。
AI 生成的电影场景,具有镜头运动和戏剧性光影。
Veo 3.1 是一个视频生成模型,从文本提示词或参考图像创建 4-8 秒的片段。它支持 720p、1080p 和 4K 分辨率,可选 AI 生成的音频。使用文本生成视频进行提示词引导的场景,或在视觉参考需要引导输出时使用图像生成视频。
编写最多 1000 个字符的提示词,描述主体、动作、镜头和风格。以 720p、1080p 或 4K 输出。
上传最多 3 张参考图像。帧模式使用 2 张图像作为开始/结束帧。参考模式使用 3 张图像进行风格引导。
为任何视频输出添加 AI 生成的音频。在所有分辨率下可用。比静音视频额外花费 $0.025/秒。
直接以 4K 分辨率生成——无需升级。用于最终渲染和客户交付。
在一次处理中生成带同步音频的视频。无需单独的音频工具或手动同步。
使用帧模式设置开始和结束帧,或使用参考模式从 3 张图像进行风格引导生成。
以较低成本在 720p 下测试提示词和参考,然后在方向锁定时扩展到 1080p 或 4K。
根据用例选择输出分辨率。720p 用于草稿,1080p 用于生产,4K 用于最大细节。
将片段长度设置为 4、6 或 8 秒。默认为 8 秒。
横向 (16:9) 用于电影和桌面内容。纵向 (9:16) 用于社交和移动。
在任何分辨率下添加 AI 生成的音频。静音视频以较低成本提供。
帧模式:2 张图像(开始 + 结束帧)。参考模式:3 张图像用于风格引导。
在最多 1000 个字符中描述主体、动作、镜头运动、照明、风格和氛围。
使用图像生成视频模式将产品图像动画化为视频广告。
为 TikTok、Reels 和 Shorts 生成 9:16 纵向视频。
创建带镜头运动和电影方向的 16:9 横向视频。
使用帧模式将概念艺术转化为动画预览。