概览
Google DeepMind 的专业视频生成模型线当前版本,最大特点是原生生成音频——音效、环境音与对白与画面一起产出,而不是后期配音(官方也坦承短句对白的自然度仍在改进中)。输出 1080p 与 4K,单段约 8 秒。API 端点为 veo-3.1-generate-preview(另有 fast 档),按秒计费,约 $0.05–$0.60 / 秒,无免费额度。注意:老的 veo-2.0-generate-001、veo-3.0-generate-001、veo-3.0-fast-generate-001 已于 2026-06-30 在 Gemini API 停用;官方现在把 Gemini Omni 1.1 Flash 作为视频生成的默认选择,Veo 3.1 保留给需要场景延展、末帧控制与旧管线对接的专项需求。
- 模态
- 视频
能力
- 原生音画同生:自动生成音效、环境音与对白
- 输出 1080p 与 4K,单段约 8 秒
- 场景延展与末帧控制
- 以参考图指导画面风格与主体
- 更贴近真实物理的运动表现
使用该模型的工具
浏览全部工具- Artlist AI把图像、视频、音乐、配音、数字人与 AI 编辑原生放进 Premiere Pro 时间线
- Higgsfield Apps用一段对话生成带前后端、数据库、登录和视觉模型的可发布 AI 应用
- RunwayGen-4.5 电影级视频生成与编辑
- Gemini长在 Google 生态里的多模态助手
- Adobe FireflyAdobe 的生成式 AI 创意平台
- Google FlowVeo 3.1 驱动的 AI 影片创作工坊
- Luma Dream MachineRay3.2/Ray3.14 + 多模型聚合的 Luma Agents 工作台
- PixVerse从提示词到带原生音频的 15 秒 1080p 多镜头视频
- Magnific把顶级生成模型、专业编辑与 2.5 亿级正版素材放进一个创意工作台
- VEED AI从提示词、角色与素材到字幕、品牌和 4K 导出的在线 AI 视频工作室
- Invideo AI用多智能体把一个创意推进到脚本、分镜、生成、配音和最终剪辑
- Hedra把角色视频、视觉创作与多模型推理统一到 Studio、API、SDK、CLI 和 MCP











