图生视频提示词怎么写:只写「运动」的官方原则与 20 个可套用句式

图生视频(让照片动起来)的提示词和文生视频不一样:参考图已经决定了人物和画面,提示词只需写怎么动。本文按 Google、Midjourney 官方指南总结三类运动写法、首尾帧与循环技巧,并给出 20 个中英对照句式。

NNathaniel bigo··原创首发·AI 辅助撰写
7 分钟读完
资料核对于 2026-10-07 · 依据官方文档与公开资料整理 免费账号 账号

适用于谁

  • 搜「图生视频提示词」「AI 图生视频提示词」的人;
  • 用即梦、可灵、Gemini、Flow、Midjourney 等工具把一张图变成视频,结果人物变脸、画面乱动的人;
  • 想做商品动态图、插画动起来、风景延时、循环背景的人。

本文根据 Google Cloud 官方视频生成最佳实践与提示指南(适用于 Veo 和 Gemini Omni)、Midjourney 视频文档和 Google Flow 帮助中心整理,资料核对于 2026-10-07。各工具的入口和参数不同,但写提示词的原则相通;具体工具教程见文末。

结论先说

Google 官方给图生视频的三条核心建议:

  1. 源图质量决定一切:清晰、构图好的源图会得到更连贯、更高质量的视频——把它当成影片的第一帧。
  2. 只写运动:源图已经提供了主体、场景和风格,不要在提示词里重新描述人物、背景、光线,重复描述会让模型困惑、结果变差。
  3. 用泛称指代图中人物:写「主体」「这位女士」「他」「他们」,而不是重新描述外貌。

三类运动:单独或组合使用

类型是什么稳定性例子
镜头运动场景不动,镜头在动最简单、最可靠缓慢推近主体
主体动作人物或物体在动适合细微、自然的动作她的头发和衣角在风中轻轻飘动
环境变化背景或氛围在动适合营造氛围雾气缓缓漫过山谷

新手建议:先只用镜头运动,再逐步加主体动作;一条几秒钟的视频,主体动作写一到两个就够了。

Google 官方图生视频示例使用的源图:向日葵田边的一辆旧皮卡,提示词只需描述镜头如何运动

图片来源:Google Cloud 文档 · Best practices for generating videos

写法模板

[镜头运动],[主体动作(用泛称)],[环境变化]。[节奏/速度]。[可选:声音]

示例:

镜头缓慢推近,这位女士转头望向窗外,嘴角微微上扬;窗帘被风轻轻吹起。动作舒缓自然。

20 个可套用句式(中英对照)

镜头运动

  1. 镜头缓慢推近主体 — slow dolly in on the subject
  2. 镜头缓慢拉远,展现周围环境 — slow dolly out to reveal the surroundings
  3. 镜头从左向右平移 — slow truck right
  4. 镜头水平摇向右侧 — slow pan right
  5. 镜头从下往上摇,展现建筑全貌 — tilt up to reveal the full building
  6. 镜头环绕主体半圈 — arc shot around the subject
  7. 无人机视角缓缓升高 — drone shot slowly rising
  8. 固定镜头,画面不动 — static shot

主体动作

  1. 他缓缓眨眼,然后微笑 — he blinks slowly, then smiles
  2. 她转头看向镜头 — she turns her head toward the camera
  3. 主体深呼吸,肩膀轻轻起伏 — the subject takes a deep breath, shoulders rising gently
  4. 小狗摇着尾巴 — the dog wags its tail
  5. 咖啡杯冒出缓缓上升的热气 — steam rises slowly from the coffee cup
  6. 花朵慢慢绽放 — the flower slowly blooms

环境变化

  1. 树叶在微风中轻轻摇曳 — leaves sway gently in the breeze
  2. 云在天空中缓缓流动 — clouds drift slowly across the sky
  3. 雪花轻轻飘落 — snowflakes fall gently
  4. 水面泛起涟漪,倒影晃动 — ripples spread across the water, reflections shimmer
  5. 霓虹灯闪烁 — neon signs flicker
  6. 天色由黄昏渐渐转暗,街灯亮起 — dusk slowly darkens and streetlights turn on

首尾帧、循环与动态强度

  • 首尾帧:给出开始和结束两张图,提示词描述「两帧之间发生了什么」,适合变身、转场、产品展开。Google Flow 在 Frames 里分别拖入 start / end frame;Midjourney 网页版在 Ending Frame 放第二张图(或 --end)。
  • 循环视频:结束帧用同一张图,Midjourney 勾选 Loop(或 --loop),适合做动态壁纸、商品循环展示。
  • 动态强度:Midjourney 的 Low Motion(默认)更可能是静态场景、轻微运镜和细微动作;High Motion 动作和运镜更大,但官方提醒更容易出现不真实或抖动的动作。其他工具若有类似「运动幅度」选项,原理相同。
  • 想要更听话:Midjourney 视频可加 --raw,减少模型的「自由发挥」。

常见失败与调整

现象可能原因调整
人物变脸、换了个人提示词重新描述了外貌,或动作太大删掉外貌描述,用「她 / 主体」指代;减小动作幅度
画面乱晃、扭曲动作太多、动态强度太高只保留一个镜头运动;改用低动态
视频几乎不动提示词太笼统写出具体动作和方向,如「从左向右」「缓慢推近」
文字和 logo 变形运动经过文字区域选文字少的源图;用固定镜头
情节没演完一条视频塞了多个事件一条只讲一个时刻,拆成多段再拼接

常见问题

Q:图生视频用什么图最好?

清晰、主体明确、背景不杂乱、光线自然的图。官方建议把源图当成影片的第一帧来挑。

Q:可以用别人的照片做视频吗?

只用你自己或已获授权的图片。各平台都要求你对上传的图片拥有权利,并禁止用真实人物的图片做侮辱、欺骗类内容。

Q:中文提示词能用吗?

国内工具(即梦、可灵)以中文为主;Veo / Omni、Midjourney 的官方示例为英文,镜头术语附英文更稳妥。

参考资料

  • Google Cloud 文档:Best practices for generating videos(Image-to-video)— https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/video/best-practice
  • Google Cloud 文档:Video generation prompt guide — https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/video/video-gen-prompt-guide
  • Midjourney 官方文档:Video — https://docs.midjourney.com/hc/en-us/articles/37460773864589-Video
  • Google Flow Help:Create videos in Google Flow — https://support.google.com/flow/answer/16353334?hl=en

Nathaniel 的更多内容

  1. 01

    promptfoo 使用教程:对比提示词和模型、写断言自动评测(安装与配置)

    promptfoo 是什么、怎么使用?按官方 README 和入门文档讲清它的用途、三种安装方式、用示例项目起步、promptfooconfig.yaml 里提示词、模型和测试用例三部分怎么写、常用断言类型的含义、eval 与 view 两条命令,以及把它放进日常改提示词流程的方法。

    ChatGPT其他 AI 工具0
  2. 02

    Kimi API怎么用:API Key获取、Python调用、K3价格与429报错处理

    Kimi API Key 在哪里获取、怎么用 Python 调用 K3、价格怎么算、429 和 401 报错怎么办?本文按 Kimi API 开放平台官方文档讲清注册认证、创建 Key、base_url 与模型名、计费规则和常见错误排查。

    Kimi0
  3. 03

    Cursor Agent 模式怎么用:Agent、Plan、Ask 三种模式,检查点回滚与消息排队

    Cursor Agent 模式是什么、和 Plan / Ask 模式怎么选?按官方文档讲清 Agent 能调用哪些工具、Shift+Tab 切换模式、Plan 模式先出方案再动手、用检查点撤销改动、任务进行中排队或插话,以及 /goal 长目标。

    Cursor0
  4. 04

    Gemini 聊天记录怎么导出:导出到文档 / 表格、生成 PDF 与用 Takeout 批量导出完整对话

    Gemini 没有「一键导出全部对话」的按钮,但有三条官方路径:单条回答导出到 Google 文档、Gmail、表格;让 Gemini 直接生成 PDF、Word、Markdown 文件;用 Google Takeout 批量下载全部活动记录。本文给出每种方法的步骤和限制。

    Gemini0
  5. 05

    ChatGPT 生成图片中文乱码、文字错误怎么办:7 个按顺序试的办法

    让 ChatGPT 做海报、封面、信息图,中文总是缺笔画、错字、乱码?本文按 OpenAI 官方图像提示指南,给出从写法、字数、局部修改、质量档位到后期排版的 7 个办法,以及什么时候干脆别让 AI 写字。

    ChatGPT0
  6. 06

    OpenCode Skills 使用指南:技能目录、命名规则、权限配置与不加载排查

    OpenCode 的 Skills 放在哪个目录、怎么控制哪些技能能用?按 OpenCode 官方文档讲清六个扫描位置、name 的正则规则、skill 工具的工作方式、在 opencode.json 里用 allow / deny / ask 配置权限、按智能体覆盖,以及技能不出现时的五项检查。

    其他 AI 工具0

同模型

  1. 01

    AI生成图片有版权吗、能商用吗:各平台条款与中美官方观点

    AI 生成的图片和视频归谁、有没有著作权、能不能商用?本文对比 OpenAI、Google、Midjourney 官方条款的写法,介绍美国版权局 2025 年报告和北京互联网法院「AI 文生图」案的观点,并列出商用前的自查清单与国内标识义务。

    ChatGPT其他 AI 工具0
  2. 02

    Veo 3.1 提示词怎么写:主体、动作、镜头、声音与对白的官方写法

    Veo 3.1 和 Gemini Omni 的视频提示词怎么写才稳?本文按 Google 官方视频提示指南和最佳实践,拆解提示词的 7 个组成部分,讲清音效与对白写法、负面提示、图生视频和多镜头角色一致的技巧,附可复制模板。

    Gemini0
  3. 03

    AI扩图怎么做:ChatGPT、Gemini、Midjourney 把图片补全成更大画幅

    竖图想改横图、主体太满想往外扩一圈?本文按官方文档讲清 ChatGPT 改宽高比、Gemini 用文字扩图、Midjourney 的 Zoom Out / Pan / 编辑器三种扩图方式,附扩图指令模板和「扩出来的部分不自然」的修法。

    ChatGPT其他 AI 工具0
  4. 04

    Midjourney 局部重绘和扩图怎么用:编辑器、Vary Region、Zoom Out 与 Pan

    Midjourney 怎么只改图的一部分、怎么把画面往外扩?本文按官方文档讲清网页版编辑器(擦除、智能选择、图层、改画幅)、Discord 的 Vary Region,以及 Zoom Out 和 Pan 的用法与 V8 下的限制。

    其他 AI 工具0
  5. 05

    Midjourney 角色一致性怎么做:Edit 模型参考图、--oref 与 --cref 的区别

    Midjourney 怎么让同一个角色出现在多张图里?V8 起官方用 Edit 模型取代了 Omni Reference(--oref)和 Character Reference(--cref)。本文讲清三者关系、Edit 模型的具体用法和提高一致性的技巧。

    其他 AI 工具0
  6. 06

    NotebookLM 视频概览怎么生成:三种格式、视频风格、下载与水印说明

    NotebookLM(现名 Gemini Notebook)的视频概览能把资料做成带旁白的讲解视频。本文按官方帮助讲清电影效果、全面解析、短视频三种格式的区别,八种视觉风格、语言支持、下载分享方法,以及官方对水印的说明。

    Gemini0

同产品的其他教程

  1. 01

    Gemini API Node.js / JavaScript 调用教程:@google/genai 安装、流式输出与函数调用

    用官方 @google/genai SDK 在 Node.js 里调 Gemini API:安装配置、第一个请求、流式输出、多轮对话、传图片和函数调用的完整循环,并说明为什么密钥不能写进浏览器前端。

    Gemini0
  2. 02

    MinerU 是什么、怎么用:把 PDF 等文档解析成 Markdown(4.0 的安装、四档解析与命令)

    MinerU 是什么、怎么安装使用?按官方中文 README 讲清 4.0 版本的定位、支持的输入与输出格式、flash / basic / standard / advanced 四档解析各适合什么、pip 安装命令、mineru-kit 与 mineru 两个命令的分工和常用写法,以及从旧版升级要注意什么。

    其他 AI 工具0
  3. 03

    npx skills add 怎么用:从 GitHub 安装 Skill、skills.sh 是什么与常用命令

    网上的 Skill 安装命令大多是 npx skills add 开头,它是什么、装到哪去了?按官方 README 讲清 skills 命令行工具支持的来源写法、项目与全局两种范围、-a 指定工具、list / find / update / remove 等命令、软链接与复制的区别,以及怎么关掉遥测。

    Claude其他 AI 工具0
  4. 04

    即梦首尾帧怎么用:两张图生成过渡视频(在哪里、提示词、不能用怎么办)

    即梦首尾帧在哪里、怎么用?本文讲清首尾帧入口、哪些模型支持、两张图的比例要求、过渡提示词怎么写,以及「首尾帧不见了 / 不能用了」「画面跳变」的原因和解决办法。

    其他 AI 工具0
  5. 05

    DeepSeek怎么用:网页版与手机App入门(深度思考、智能搜索、上传文件)

    DeepSeek怎么用?本文从官方入口和登录方式讲起,说清输入框里的「深度思考」「智能搜索」和上传附件各管什么,历史对话怎么改名、置顶、分享和导出,以及手机上使用的注意点。

    其他 AI 工具0
  6. 06

    提示词链(Prompt Chaining)怎么用:把复杂任务拆成几步,前一步的输出交给后一步

    提示词链是什么、什么时候该把大提示词拆开?本文按 Anthropic 和 Google 官方文档讲清拆指令、串成链、分块聚合三种拆法,最常用的「起草 → 审查 → 修改」链,以及哪些情况不必拆。

    ClaudeGemini0

0 条评论

登录 后参与评论

还没有评论,来抢沙发~