Veo 3.1 提示词怎么写:主体、动作、镜头、声音与对白的官方写法

Veo 3.1 和 Gemini Omni 的视频提示词怎么写才稳?本文按 Google 官方视频提示指南和最佳实践,拆解提示词的 7 个组成部分,讲清音效与对白写法、负面提示、图生视频和多镜头角色一致的技巧,附可复制模板。

NNathaniel bigo··原创首发·AI 辅助撰写
8 分钟读完
资料核对于 2026-10-07 · 依据官方文档与公开资料整理 Pro 账号

适用于谁

  • 搜「Veo 3.1 提示词」「Veo 提示词」「Gemini 生成视频提示词」的人;
  • 在 Google Flow、Gemini 或 API 里用 Veo / Gemini Omni 做视频,总觉得出来的效果「不是我想的那样」的人;
  • 想让同一个角色在多个镜头里长相、声音都一致的人。

本文根据 Google Cloud 官方「视频生成提示指南」和「视频生成最佳实践」整理(这两份文档同时适用于 Veo 和 Gemini Omni Flash),资料核对于 2026-10-07。官方文档内容以 CC BY 4.0 许可发布,本文为改写与归纳。

结论先说

  1. 把想法拆成组件写:主体、动作、场景、镜头角度、镜头运动、镜头与光学效果、视觉风格,外加时间感和声音。不必每次都写全,但写清楚的部分越多,越不容易出「通用脸」。
  2. 一条短视频只讲一个时刻:「先……再……然后……」的连续事件请拆成多条生成。
  3. 对白用冒号,别用引号:「她说:我叫小林」,避免引号里的字被画进画面。
  4. 负面提示写名词,不写「不要」:写「城市背景、建筑物」,而不是「不要城市背景」。
  5. 图生视频只写运动:参考图已经决定了人物、场景和风格,提示词只写镜头怎么动、主体怎么动、环境怎么变。

提示词的组成部分

组件回答什么写法示例
主体 Subject谁 / 什么一位经验老到的侦探;一只活泼的金毛幼犬;一台老式打字机
动作 Action在做什么慢慢转身;手指不耐烦地敲桌;花苞在快放中绽开
场景 Scene在哪里、什么时候雨夜霓虹街头;黄金时刻的海边;落满灰尘的阁楼
镜头角度 Camera angle从哪看平视、低角度、俯视、鸟瞰、过肩、第一人称 POV
镜头运动 Camera movement镜头怎么动固定、摇(pan)、推拉(dolly)、横移(truck)、升降、航拍、环绕
镜头与光学 Lens镜头「怎么看」广角、长焦、浅景深、焦点转移(rack focus)、镜头光晕
视觉风格 Style整体氛围光线(伦勃朗光、逆光剪影)、情绪、艺术风格、色调与质感

另外两类常被忽略的元素:

  • 时间感:慢动作、延时摄影、「天色渐渐变亮」这类细微变化——注意片段只有几秒,别写跨越很长时间的过程。
  • 声音:音效(电话铃声、水花声)、环境声(城市车流、海浪)、对白。官方建议用单独的句子描述声音。

官方提醒:部分高级镜头角度和镜头效果并非官方正式支持,效果和稳定性因提示词而异。

对白与声音怎么写

官方示例的结构可以概括为:先交代画面,再逐句写台词,最后补环境声。

中景,昏暗的审讯室。经验老到的警探说:你的说法漏洞百出。
紧张的线人在一盏裸灯下冒汗,回答:我知道的都告诉你了。
其余的声音只有墙上时钟缓慢的滴答声,和窗外隐约的雨声。

要点:

  • 每个说话的人先描述清楚(外貌、语气),再用「说:」接台词,不加引号;
  • 想要声音一致,可以固定描述说话者的嗓音特点,例如「声音清晰干脆、语气冷静、标准普通话」;
  • 在 Google Flow 里用 Omni Flash 时,还能直接选预设音色或创建自定义音色(见《Google Flow 怎么用》)。

负面提示

官方建议用名词列出不想要的元素,而不是写「no」「don't」。官方示例:同一段「狂风中的橡树动画」提示词,加上负面提示「城市背景、人造建筑、阴暗或暴风雨般的压抑氛围」之后,画面去掉了背景建筑,整体更明亮。

官方示例:未加负面提示时的橡树动画,背景出现了建筑物(动图截帧)

图片来源:Google Cloud 文档 · Video generation prompt guide(CC BY 4.0)

官方示例:加入负面提示「urban background, man-made structures, dark, stormy」后的同一提示词(动图截帧)

图片来源:Google Cloud 文档 · Video generation prompt guide(CC BY 4.0)

图生视频:只写运动

官方给了三类运动,可以单独用也可以组合:

  1. 镜头运动(场景不动,镜头动):最简单也最可靠,例如「缓慢推近主体」;
  2. 主体动作:适合细微、自然的动作,例如「她的头发和衣角在风里轻轻飘动」;
  3. 环境变化:例如「雾气慢慢漫过山谷」。

另外三条:

  • 源图要清晰、构图好,它决定了后面所有细节;
  • 不要在提示词里重新描述图中的人物、背景、光线,重复描述反而会让模型困惑;
  • 提到图里的人物时用泛称:「这位女士」「他」「主体」。

多镜头保持角色和声音一致

官方推荐的做法:

  1. 给角色起名字,写一段不变的特征描述:年龄体型、发色发型、脸型、眼睛、标志性特征、服装,以及嗓音风格;
  2. 每个新镜头都原样复制这段描述,只改动作和场景部分;
  3. 在 API 中使用相同的 seed 参数,提高视觉、风格和声音的一致性;
  4. 让 Gemini 帮忙:把你的角色描述交给 Gemini,让它扩写成多个镜头的提示词,或者在生成后帮你检查是否符合品牌规范。

可复制模板

[镜头角度],[镜头运动]。[场景:地点 + 时间 + 天气/氛围细节]。
[主体:外貌、服装、表情],正在[动作,按先后写一两个]。
[光线],[色调],[风格,如电影感 35mm 胶片 / 写实 / 水彩动画]。
声音:[环境声];[音效]。[角色]说:[台词]

填好的例子:

低角度跟拍,镜头缓慢向前推进。黄昏的沿海公路,海风很大,远处灯塔刚亮起。
一位穿黄色雨衣的骑行者站起身用力蹬车,雨衣在风里猎猎作响。
逆光,暖橙与冷蓝的对比色调,电影感,浅景深。
声音:海浪拍岸和呼啸的风声;自行车链条的咔嗒声。

常见问题

Q:中文提示词可以吗?

官方文档的示例均为英文。中文描述通常也能理解,但涉及专业镜头术语时,附上英文原词(如 dolly in、rack focus)更稳妥。

Q:为什么写了很长一串事件,视频只完成了一半?

官方说明短视频里串联多个独立事件常会导致混乱或不完整,应拆成多个片段分别生成,再在剪辑工具或 Flow 的 Scenebuilder 里拼接。

Q:提示词被拦截了怎么办?

Veo 和 Gemini Omni 都有安全过滤,违反负责任 AI 准则的提示会被拦截。检查是否涉及真实人物、未成年人、暴力或侵权内容,换成原创角色和中性描述。

Q:可以写「某某导演 / 某部电影风格」吗?

官方文档举过艺术风格的例子,但模仿特定在世艺术家或知名影视作品可能涉及版权和平台政策风险,商用场景建议用通用风格词(如「胶片颗粒、复古暖调、手绘水彩动画」)描述你想要的效果。

参考资料

  • Google Cloud 文档:Video generation prompt guide — https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/video/video-gen-prompt-guide
  • Google Cloud 文档:Best practices for generating videos — https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/video/best-practice
  • Google Flow Help:Create videos in Google Flow — https://support.google.com/flow/answer/16353334?hl=en
  • Google AI for Developers:Generate videos with Veo 3.1 in Gemini API — https://ai.google.dev/gemini-api/docs/veo

Nathaniel 的更多内容

  1. 01

    promptfoo 使用教程:对比提示词和模型、写断言自动评测(安装与配置)

    promptfoo 是什么、怎么使用?按官方 README 和入门文档讲清它的用途、三种安装方式、用示例项目起步、promptfooconfig.yaml 里提示词、模型和测试用例三部分怎么写、常用断言类型的含义、eval 与 view 两条命令,以及把它放进日常改提示词流程的方法。

    ChatGPT其他 AI 工具0
  2. 02

    Kimi API怎么用:API Key获取、Python调用、K3价格与429报错处理

    Kimi API Key 在哪里获取、怎么用 Python 调用 K3、价格怎么算、429 和 401 报错怎么办?本文按 Kimi API 开放平台官方文档讲清注册认证、创建 Key、base_url 与模型名、计费规则和常见错误排查。

    Kimi0
  3. 03

    Cursor Agent 模式怎么用:Agent、Plan、Ask 三种模式,检查点回滚与消息排队

    Cursor Agent 模式是什么、和 Plan / Ask 模式怎么选?按官方文档讲清 Agent 能调用哪些工具、Shift+Tab 切换模式、Plan 模式先出方案再动手、用检查点撤销改动、任务进行中排队或插话,以及 /goal 长目标。

    Cursor0
  4. 04

    Gemini 聊天记录怎么导出:导出到文档 / 表格、生成 PDF 与用 Takeout 批量导出完整对话

    Gemini 没有「一键导出全部对话」的按钮,但有三条官方路径:单条回答导出到 Google 文档、Gmail、表格;让 Gemini 直接生成 PDF、Word、Markdown 文件;用 Google Takeout 批量下载全部活动记录。本文给出每种方法的步骤和限制。

    Gemini0
  5. 05

    ChatGPT 生成图片中文乱码、文字错误怎么办:7 个按顺序试的办法

    让 ChatGPT 做海报、封面、信息图,中文总是缺笔画、错字、乱码?本文按 OpenAI 官方图像提示指南,给出从写法、字数、局部修改、质量档位到后期排版的 7 个办法,以及什么时候干脆别让 AI 写字。

    ChatGPT0
  6. 06

    OpenCode Skills 使用指南:技能目录、命名规则、权限配置与不加载排查

    OpenCode 的 Skills 放在哪个目录、怎么控制哪些技能能用?按 OpenCode 官方文档讲清六个扫描位置、name 的正则规则、skill 工具的工作方式、在 opencode.json 里用 allow / deny / ask 配置权限、按智能体覆盖,以及技能不出现时的五项检查。

    其他 AI 工具0

同模型

  1. 01

    NotebookLM 视频概览怎么生成:三种格式、视频风格、下载与水印说明

    NotebookLM(现名 Gemini Notebook)的视频概览能把资料做成带旁白的讲解视频。本文按官方帮助讲清电影效果、全面解析、短视频三种格式的区别,八种视觉风格、语言支持、下载分享方法,以及官方对水印的说明。

    Gemini0
  2. 02

    Gemini 怎么生成视频:Gemini Omni 用法、时长与限制(已取代 Veo)

    Gemini 里生成视频现在用的是 Gemini Omni,不再是 Veo。本文按 Google 官方帮助中心讲清谁能用、在哪里点、文字 / 图片 / 视频怎么生成和改视频、时长和比例、下载与 SynthID 水印,以及常见报错原因。

    Gemini0
  3. 03

    图生视频提示词怎么写:只写「运动」的官方原则与 20 个可套用句式

    图生视频(让照片动起来)的提示词和文生视频不一样:参考图已经决定了人物和画面,提示词只需写怎么动。本文按 Google、Midjourney 官方指南总结三类运动写法、首尾帧与循环技巧,并给出 20 个中英对照句式。

    Gemini其他 AI 工具0

同产品的其他教程

  1. 01

    Gemini API Node.js / JavaScript 调用教程:@google/genai 安装、流式输出与函数调用

    用官方 @google/genai SDK 在 Node.js 里调 Gemini API:安装配置、第一个请求、流式输出、多轮对话、传图片和函数调用的完整循环,并说明为什么密钥不能写进浏览器前端。

    Gemini0
  2. 02

    提示词链(Prompt Chaining)怎么用:把复杂任务拆成几步,前一步的输出交给后一步

    提示词链是什么、什么时候该把大提示词拆开?本文按 Anthropic 和 Google 官方文档讲清拆指令、串成链、分块聚合三种拆法,最常用的「起草 → 审查 → 修改」链,以及哪些情况不必拆。

    ClaudeGemini0
  3. 03

    Google AI Studio 系统指令怎么写:System instructions 与运行设置(思考等级、温度、联网搜索)

    系统指令决定模型的身份和输出规则。本文按官方文档讲清 AI Studio 里系统指令在哪填、怎么写、怎么保存复用,以及思考等级、温度(新模型已弃用)、联网搜索等工具的作用与限制。

    Gemini0
  4. 04

    Nano Banana 提示词怎么写:官方提示词指南要点与 7 个生成模板

    Nano Banana(Gemini 生图)的提示词怎么写效果最好?本文把 Google 官方提示词指南提炼成 6 条原则和写实照片、贴纸、带文字设计、商品图、留白背景、漫画分镜、搜索增强 7 个可复制模板,并给出改图句式。

    Gemini0
  5. 05

    Gemini 结构化输出(Structured Output)怎么用:JSON Schema、Pydantic 与 Zod 示例

    想让 Gemini API 稳定返回可解析的 JSON,就用结构化输出。本文给出 Pydantic 和 Zod 的官方写法、枚举与可空字段、流式、和工具组合、支持的 Schema 范围与限制,以及新旧接口的参数差别。

    Gemini0
  6. 06

    Gemini API 接口地址(Base URL)是什么:原生端点与 OpenAI 兼容调用写法

    Gemini API 域名是 generativelanguage.googleapis.com。本文列出原生与 OpenAI 兼容端点的地址和鉴权方式、v1 与 v1beta 的区别,和用 OpenAI SDK 调 Gemini 的写法。

    Gemini0

0 条评论

登录 后参与评论

还没有评论,来抢沙发~