Google AI Studio 系统指令怎么写:System instructions 与运行设置(思考等级、温度、联网搜索)

系统指令决定模型的身份和输出规则。本文按官方文档讲清 AI Studio 里系统指令在哪填、怎么写、怎么保存复用,以及思考等级、温度(新模型已弃用)、联网搜索等工具的作用与限制。

NNathaniel bigo··原创首发·AI 辅助撰写
14 分钟读完
资料核对于 2026-10-10 · 依据官方文档与公开资料整理 其他 账号
本文根据 Google AI for Developers 官方文档(AI Studio quickstart、Text generation、Prompt design strategies、Thinking、Safety settings、Google Search、Code execution、URL context)和 Google 官方博客整理,资料核对于 2026-10-10。截图来自官方博客和官方文档,图下注明出处,部分为早期界面。

适用于谁

  • 在 Google AI Studio 里想让模型固定身份、语气或输出格式的人;
  • 搜「google ai studio 系统指令」「system instructions」「temperature」「thinking level」想知道每个设置是干什么的人;
  • 准备把 AI Studio 里调好的设置搬到 Gemini API 代码里的开发者。

AI Studio 的整体入门见本站《Google AI Studio 怎么用:界面入口、选模型、发第一条提示与获取代码(入门)》。

结论先说

  1. 系统指令在右上角「运行设置(Run settings)」面板里,找到「系统指令(System Instructions)」输入框填写;对话开始后也能改。
  2. 写法上,把身份、硬性约束和输出格式放进系统指令,用 XML 风格标签或 Markdown 标题分块,这是官方对 Gemini 3 系列的建议。
  3. 新模型不要再调温度:官方说明从 Gemini 3.6 Flash、3.5 Flash-Lite 起,temperature、top_p、top_k 已弃用并被忽略;想要更稳定的输出,官方建议改用系统指令写明规则。
  4. 真正该调的是思考等级(thinking level):等级越高推理越充分,但更慢、消耗的 token 更多。
  5. 联网搜索、代码执行、URL 上下文是三个内置工具,在运行设置里按需打开,各有限制。

一、系统指令在哪里填

  1. 打开 Google AI Studio,默认进入 Playground。
  2. 点右上角「运行设置(Run settings)」展开面板,找到「系统指令(System Instructions)」输入框。
  3. 写入要求,然后在下方输入框提问、点「运行(Run)」。

官方快速入门用了一个例子:先只写一句「你是住在木卫二上的外星人」,模型的回答又长又发散;再补上「你叫 Tim,回答控制在三段以内,语气要活泼」,输出就稳定多了。官方同时说明,对话开始之后系统指令仍然可以修改。

系统指令面板:下拉框里可以新建指令(Create new instruction),也可以切换已保存的指令(2025 年 10 月的早期界面)

图片来源:Google 官方博客《Leveling up your developer experience in Google AI Studio》

官方博客介绍过「保存系统指令」功能:可以把系统指令存成模板,在不同对话里复用,不必为了保留指令而清空对话。

二、系统指令怎么写

官方《Prompt design strategies》对 Gemini 3 系列的建议,归纳起来是:

  • 直接、精确:把目标说清楚,不需要客套和反复强调;
  • 结构一致:用 XML 风格标签(如 <role>、<constraints>)或 Markdown 标题分隔各部分,选一种用到底;
  • 关键要求放进系统指令:身份(persona)、行为约束、输出格式放在系统指令里,或放在用户提示的最开头;
  • 想要详细回答要明说:Gemini 3 默认回答直接、简洁,需要更口语或更详细时必须在指令里写出来;
  • 长资料放前面,问题放最后:先给全部上下文,再用「根据以上信息……」这类过渡句提出问题。

一个可以直接改的模板(按官方示例的结构改写成中文):

text
<role>
你是一名面向初学者的 Python 老师,回答准确、耐心。
</role>

<constraints>
1. 只用中文回答。
2. 每个知识点配一个可以直接运行的最小示例。
3. 不确定的内容直接说不确定,不要编造。
</constraints>

<output_format>
先用一句话给结论,再分点解释,最后给示例代码。
</output_format>

三、思考等级(thinking level)

Gemini 3 系列默认开启「思考」,模型会先在内部推理再作答。官方 Thinking 页列出的默认值和可选等级(节选):

模型默认可选等级
gemini-3.8-flashmediumlow、medium、high
gemini-3.6-flashmediumminimal、low、medium、high
gemini-3.5-flash-liteminimalminimal、low、medium、high
gemini-3.1-pro-previewhighlow、medium、high

怎么选,官方的说法是:

  • low:对延迟敏感的任务,比如实时聊天、写草稿、快速数据分析;
  • medium:大多数任务质量最好,适合复杂代码和智能体场景;
  • high:深度推理、数学、多步骤难题。

注意两点:Gemini 3.8 Flash 不支持 minimal,传了会报错;输出费用是「输出 token + 思考 token」之和,等级越高越贵。官方还提醒,不要靠把最大输出 token 设得很小来省钱——这个上限包含思考 token,设小了会让回答被截断甚至为空,应当改为降低思考等级。

四、温度、Top P、Top K:新模型已弃用

这是最容易被旧教程带偏的地方。官方《What's new in Gemini 3.6 Flash and 3.5 Flash-Lite》写明:从这两个模型开始(以及之后发布的所有 Gemini 模型),temperature、top_p、top_k 已弃用,API 会忽略它们,未来的模型代际里再传会直接返回 400 错误,官方要求从请求里删掉。Gemini 3.8 Flash 的迁移清单里也有同样的一条。

想让输出更稳定、更可复现,官方给的替代做法是:在系统指令里把规则写明确。需要固定格式时用结构化输出,见本站《Gemini 结构化输出(Structured Output)怎么用:JSON Schema、Pydantic 与 Zod 示例》。

官方《Prompt design strategies》和排错页里还保留着一条稍早的提醒,方向是一致的:对 Gemini 3.x 模型「强烈建议保持默认值」,把温度调到 1.0 以下可能导致循环输出或推理质量下降。总之,不要再把调温度当成控制输出的手段。

五、安全设置(Safety settings)

运行设置面板的「高级设置(Advanced settings)」里有一项「安全设置(Safety settings)」,用来按类别设定内容过滤的严格程度,面向的是需要自行把关内容的应用开发者(例如给面向未成年人的产品加严)。官方文档的几个要点:

  • 危害儿童安全等核心伤害类内容始终被拦截,任何设置都改变不了;
  • 模型自身已带有安全机制,这些可调过滤器是在此之外的一层;
  • 使用时必须遵守服务条款和生成式 AI 禁止使用政策,责任在使用者;
  • 用代码调用时,官方说明新的 Interactions API 不支持自定义安全设置,这项功能只在旧的 generateContent API 里有。

六、三个常用工具

1. 联网搜索(Grounding with Google Search)

联网搜索的工作流程:模型自己决定是否搜索、生成搜索词、读取结果后再作答

图片来源:Google 官方文档《Grounding with Google Search》

打开后,模型自行判断要不要搜索、搜什么,回答里带引用来源。官方建议在需要较新或较冷门的事实时打开。计费方面,官方说明 Gemini 3 及更新的模型按模型实际执行的每次搜索查询计费,一个问题可能触发多次搜索;定价页上 Gemini 3.8 Flash 等模型的表格里,搜索接地在 API 免费层一栏标的是「不可用(Not available)」。具体价格以官方定价页为准。

2. 代码执行(Code execution)

让模型编写并运行 Python 代码,适合计算、计数、处理数据。官方列出的限制:运行环境最长 30 秒;只能用环境里预装的库,不能自己安装;只能返回代码和结果,不能返回媒体文件等其他产物;文本和 CSV 文件效果最好。启用它本身不额外收费,按所用模型的输入输出 token 计费。

3. URL 上下文(URL context)

把网页地址交给模型,让它读取页面内容来回答。官方限制:每次请求最多 20 个 URL,单个 URL 取回内容最大 34MB;地址必须能公开访问,需要登录或付费才能看的页面、本机地址和内网地址都不支持。

七、搬到代码里要注意什么

AI Studio 里的系统指令对应 API 的 system_instruction,思考等级对应 generation_config 里的 thinking_level:

python
from google import genai

client = genai.Client()  # 自动读取环境变量 GEMINI_API_KEY

interaction = client.interactions.create(
    model="gemini-3.8-flash",
    system_instruction="你是一名面向初学者的 Python 老师,只用中文回答。",
    input="列表推导式怎么用?",
    generation_config={"thinking_level": "low"},
    tools=[{"type": "google_search"}],  # 需要联网搜索时才加
)
print(interaction.output_text)

官方特别说明:用 previous_interaction_id 接续多轮对话时,服务器只保留对话历史;system_instruction、generation_config 和 tools 只对当次请求生效,每一轮都要重新传。完整的调用流程见本站《Gemini API Python 调用教程:安装 google-genai SDK、流式输出、多轮对话与传图片》。

常见问题

Q:系统指令和直接写在提问里有什么区别?

系统指令对整个对话生效,适合放不变的规则;提问里放每次不同的任务和资料。官方建议关键约束放系统指令或提示最开头。

Q:为什么调了温度没变化?

如果用的是 Gemini 3.6 Flash、3.5 Flash-Lite 或更新的模型,官方说明温度等采样参数已被忽略。

Q:模型思考太久怎么办?

把思考等级调低。官方排错页说明,延迟变高、token 用量变大,通常就是因为 Gemini 3 系列默认开启了思考。

Q:回复显示 Content blocked?

把鼠标悬停在提示上可以看到被拦截的类别。先检查提示和上传的内容是否确实触及了对应类别;属于误判的正常内容,换一种更明确、中性的表述通常就能通过。违反使用政策的请求不会、也不应该靠调设置来放行。

参考资料

  • Google AI Studio quickstart(官方):https://ai.google.dev/gemini-api/docs/ai-studio-quickstart
  • Leveling up your developer experience in Google AI Studio(Google 官方博客):https://blog.google/innovation-and-ai/technology/developers-tools/ai-studio-updates-more-control/
  • Text generation(官方):https://ai.google.dev/gemini-api/docs/text-generation
  • Prompt design strategies(官方):https://ai.google.dev/gemini-api/docs/prompting-strategies
  • Gemini thinking(官方):https://ai.google.dev/gemini-api/docs/thinking
  • What's new in Gemini 3.6 Flash and 3.5 Flash-Lite(官方):https://ai.google.dev/gemini-api/docs/whats-new-gemini-3.6
  • What's new in Gemini 3.8 Flash(官方):https://ai.google.dev/gemini-api/docs/latest-model
  • Safety settings(官方):https://ai.google.dev/gemini-api/docs/safety-settings
  • Grounding with Google Search(官方):https://ai.google.dev/gemini-api/docs/google-search
  • Code execution(官方):https://ai.google.dev/gemini-api/docs/code-execution
  • URL context(官方):https://ai.google.dev/gemini-api/docs/url-context
  • Interactions API(官方):https://ai.google.dev/gemini-api/docs/interactions-overview
  • Gemini Developer API pricing(官方):https://ai.google.dev/gemini-api/docs/pricing

Nathaniel 的更多内容

  1. 01

    promptfoo 使用教程:对比提示词和模型、写断言自动评测(安装与配置)

    promptfoo 是什么、怎么使用?按官方 README 和入门文档讲清它的用途、三种安装方式、用示例项目起步、promptfooconfig.yaml 里提示词、模型和测试用例三部分怎么写、常用断言类型的含义、eval 与 view 两条命令,以及把它放进日常改提示词流程的方法。

    ChatGPT其他 AI 工具0
  2. 02

    Kimi API怎么用:API Key获取、Python调用、K3价格与429报错处理

    Kimi API Key 在哪里获取、怎么用 Python 调用 K3、价格怎么算、429 和 401 报错怎么办?本文按 Kimi API 开放平台官方文档讲清注册认证、创建 Key、base_url 与模型名、计费规则和常见错误排查。

    Kimi0
  3. 03

    Cursor Agent 模式怎么用:Agent、Plan、Ask 三种模式,检查点回滚与消息排队

    Cursor Agent 模式是什么、和 Plan / Ask 模式怎么选?按官方文档讲清 Agent 能调用哪些工具、Shift+Tab 切换模式、Plan 模式先出方案再动手、用检查点撤销改动、任务进行中排队或插话,以及 /goal 长目标。

    Cursor0
  4. 04

    Gemini 聊天记录怎么导出:导出到文档 / 表格、生成 PDF 与用 Takeout 批量导出完整对话

    Gemini 没有「一键导出全部对话」的按钮,但有三条官方路径:单条回答导出到 Google 文档、Gmail、表格;让 Gemini 直接生成 PDF、Word、Markdown 文件;用 Google Takeout 批量下载全部活动记录。本文给出每种方法的步骤和限制。

    Gemini0
  5. 05

    ChatGPT 生成图片中文乱码、文字错误怎么办:7 个按顺序试的办法

    让 ChatGPT 做海报、封面、信息图,中文总是缺笔画、错字、乱码?本文按 OpenAI 官方图像提示指南,给出从写法、字数、局部修改、质量档位到后期排版的 7 个办法,以及什么时候干脆别让 AI 写字。

    ChatGPT0
  6. 06

    OpenCode Skills 使用指南:技能目录、命名规则、权限配置与不加载排查

    OpenCode 的 Skills 放在哪个目录、怎么控制哪些技能能用?按 OpenCode 官方文档讲清六个扫描位置、name 的正则规则、skill 工具的工作方式、在 opencode.json 里用 allow / deny / ask 配置权限、按智能体覆盖,以及技能不出现时的五项检查。

    其他 AI 工具0

同模型

  1. 01

    Gemini API Node.js / JavaScript 调用教程:@google/genai 安装、流式输出与函数调用

    用官方 @google/genai SDK 在 Node.js 里调 Gemini API:安装配置、第一个请求、流式输出、多轮对话、传图片和函数调用的完整循环,并说明为什么密钥不能写进浏览器前端。

    Gemini0
  2. 02

    Gemini 结构化输出(Structured Output)怎么用:JSON Schema、Pydantic 与 Zod 示例

    想让 Gemini API 稳定返回可解析的 JSON,就用结构化输出。本文给出 Pydantic 和 Zod 的官方写法、枚举与可空字段、流式、和工具组合、支持的 Schema 范围与限制,以及新旧接口的参数差别。

    Gemini0
  3. 03

    Gemini API 接口地址(Base URL)是什么:原生端点与 OpenAI 兼容调用写法

    Gemini API 域名是 generativelanguage.googleapis.com。本文列出原生与 OpenAI 兼容端点的地址和鉴权方式、v1 与 v1beta 的区别,和用 OpenAI SDK 调 Gemini 的写法。

    Gemini0
  4. 04

    Gemini 怎么看额度:用量限制在哪查、多久重置、额度变少怎么办

    Gemini 的额度不是按条数算的,而是按计算量:每 5 小时刷新、另有每周上限。本文讲在哪里查看用量、各档会员的额度倍数、哪些操作最费额度、额度用完后会怎样,以及官方认可的省额度方法。

    Gemini0
  5. 05

    Gemini Canvas 怎么用:写文档、生成网页和小应用、导出与分享全流程

    Gemini Canvas 是对话旁边的一块可编辑工作区:在里面写文档、做幻灯片、生成能直接运行的网页和小应用。本文按官方帮助中心讲入口、文档的局部修改与格式工具、应用的预览 / 代码 / 控制台、把文档变成测验 / 信息图 / 网页,以及导出和分享的方法与限制。

    Gemini0
  6. 06

    NotebookLM PPT 可编辑吗:演示文稿的生成、修改、下载 PPTX 与信息图

    NotebookLM(现名 Gemini Notebook)生成的 PPT 能改吗、怎么下载?本文按官方帮助讲清演示文稿的两种格式、用「修改(Revise)」逐页改稿、删页和调整顺序、下载 PDF 或 PPTX,以及信息图的风格和下载。

    Gemini0

同产品的其他教程

  1. 01

    提示词链(Prompt Chaining)怎么用:把复杂任务拆成几步,前一步的输出交给后一步

    提示词链是什么、什么时候该把大提示词拆开?本文按 Anthropic 和 Google 官方文档讲清拆指令、串成链、分块聚合三种拆法,最常用的「起草 → 审查 → 修改」链,以及哪些情况不必拆。

    ClaudeGemini0
  2. 02

    Nano Banana 提示词怎么写:官方提示词指南要点与 7 个生成模板

    Nano Banana(Gemini 生图)的提示词怎么写效果最好?本文把 Google 官方提示词指南提炼成 6 条原则和写实照片、贴纸、带文字设计、商品图、留白背景、漫画分镜、搜索增强 7 个可复制模板,并给出改图句式。

    Gemini0
  3. 03

    Gemini 音乐生成怎么用:用 Lyria 写歌作曲、歌曲长度、下载 MP3 与水印说明

    Gemini 里可以直接用 Lyria 模型生成带人声和歌词的完整歌曲。本文按官方帮助中心讲入口、使用条件、短曲与完整曲目的长度、人声 / 纯音乐与曲风选项、提示词五要素、下载 MP3 / MP4 和分享、SynthID 水印,以及次数限制该怎么看。

    Gemini0
  4. 04

    Veo 3.1 提示词怎么写:主体、动作、镜头、声音与对白的官方写法

    Veo 3.1 和 Gemini Omni 的视频提示词怎么写才稳?本文按 Google 官方视频提示指南和最佳实践,拆解提示词的 7 个组成部分,讲清音效与对白写法、负面提示、图生视频和多镜头角色一致的技巧,附可复制模板。

    Gemini0
  5. 05

    NotebookLM 怎么用:改名 Gemini Notebook 后的入口、三栏界面与基本流程

    NotebookLM 是什么、怎么用?2026 年 7 月它已改名 Gemini Notebook。本文按官方帮助中心讲清改名后哪些变了、使用条件、「来源 → 对话 → Studio」三步流程,以及回答不出来时的官方原因。

    Gemini0
  6. 06

    Gemini 隐私设置:怎么关闭模型训练、活动记录保留多久、人工审核怎么回事

    Gemini 的隐私核心是「保留活动记录(Keep Activity)」这一个开关:开着,对话会保存并可能用于训练和人工审核;关掉,对话只留 72 小时且不用于训练。本文讲开关位置、自动删除期限、音频与 Live 录制的单独选项,以及关掉后会失去哪些功能。

    Gemini0

0 条评论

登录 后参与评论

还没有评论,来抢沙发~