最后更新时间:2026-08-25

先说结论:Gemini 3.7 Flash 是什么

Google 已在 Google AI for Developers 的官方模型目录中上线稳定型号 gemini-3.7-flash,页面标注最新更新为 2026 年 8 月。它被官方描述为面向智能体工作流和多模态推理的 Flash 模型,重点不是单纯追求更短的响应时间,而是在速度、工具调用、长上下文和可控推理之间取得平衡。1

如果你正在寻找 gemini官网 的最新型号,或者希望在国内先体验 Gemini 3.7 Flash,可以先记住三件事:模型 ID 是 gemini-3.7-flash;它支持文本、图片、视频、音频和 PDF 输入;API 输入上限为 1,048,576 token,输出上限为 65,536 token。1

本文以官方模型文档和定价页为准,重点解释这次发布对普通用户、开发者和自动化团队意味着什么。模型菜单、免费额度、价格和可用地区可能随账号、平台和时间变化,正式接入前仍应以控制台显示为准。

Gemini 3.7 Flash 发布与多模态智能体工作流示意图
Gemini 3.7 Flash 的核心定位,是把长上下文、多模态理解和工具执行放进一个适合高频调用的模型。

Gemini 3.7 Flash 官方规格一览

下面这张表只列官方模型页已经明确写出的内容,不把社区传闻当成参数。1

项目 Gemini 3.7 Flash 官方信息 对用户的影响
模型 ID gemini-3.7-flash API、SDK 和平台配置时使用该 ID
状态 Stable,官方页面 2026 年 8 月更新 适合开始建立生产评测集
输入 文本、图片、视频、音频、PDF 可在同一请求中处理多模态材料
输出 文本 适合报告、代码、结构化文字结果
输入上下文 1,048,576 token 可放入大型代码库或多份文档
输出上限 65,536 token 支持较长的方案、代码和审阅报告
Thinking low、medium、high 可在速度与推理深度之间调节
工具能力 Function calling、Code execution、File search、URL context 能把聊天升级为可执行工作流
Grounding Google Search、Google Maps 适合需要最新信息或地点信息的任务
Computer Use Supported(Preview) 浏览器自动化仍需人工确认和审计
图片与音频生成 不支持 生成图片、声音应选择专门模型

这次发布最值得关注的四个变化

1. Flash 不再只是轻量问答模型

3.7 Flash 的官方定位是“面向 agentic workflows 和 multimodal reasoning”。这意味着它的价值不只在于回答一句话,而在于能否读材料、拆任务、调用工具、检查结果,再继续下一步。对客服质检、代码代理、资料归档、知识库问答等场景来说,多轮执行能力通常比一次回答的文采更重要。

2. 百万 token 上下文给资料型工作留出空间

1M 输入窗口可以容纳一批项目文档、较大的代码仓库、长会议转写和多份 PDF。它并不意味着“把所有资料一股脑塞进去就一定准确”。长上下文任务仍应提供文件名、章节标题、优先级和证据位置,并要求模型把事实、推断和建议分开输出。

一个更稳的提示词结构是:先给任务,再列材料目录,最后附具体问题。对于代码任务,还应说明允许修改的文件范围、必须保留的接口、测试命令和验收标准。这样做可以减少模型在超长输入中抓错重点。

3. Thinking 提供了可调的推理预算

官方文档写明,3.7 Flash 支持 low、medium、high 三档 Thinking,minimal 不受支持。1 实际使用时,可以把 low 用于分类、改写和简单抽取,把 medium 用于结构化分析、代码排障和多文件总结,把 high 留给复杂规划、跨文档推理和需要多步检查的任务。

Thinking 不是越高越好。推理档位越高,通常意味着更长的等待和更高的输出消耗。建议先用统一评测集比较“任务成功率、人工修改次数、平均延迟、每个任务成本”,而不是只看单次回答是否更长。

4. Computer Use 仍然需要人机协作

Computer Use 标注为 Preview,说明它适合试验和受控流程,不应被当作完全无人值守的浏览器机器人。涉及付款、删除、发信、改权限和提交生产数据时,必须设置人工确认、动作白名单、截图留档和回滚方案。间接提示注入、页面内容变化和权限过大,都是上线前需要重点测试的风险。

价格怎么计算:先看优惠期,再看长期成本

截至 2026-08-25,Google 定价页显示,Gemini 3.7 Flash 标准付费层按每 100 万 token 计价:2026 年 12 月 31 日前,输入为 0.75 美元,输出(含 thinking tokens)为 3.75 美元;2027 年 1 月 1 日起,输入为 1.50 美元,输出为 7.50 美元。上下文缓存、Batch、Flex 和 Priority 还有单独价格。2

调用方式 2026-12-31 前输入价 2026-12-31 前输出价 适合场景
Standard $0.75 / 1M $3.75 / 1M 交互式应用、常规 API
Batch $0.375 / 1M $1.875 / 1M 离线批处理、夜间任务
Flex $0.375 / 1M $1.875 / 1M 对时延不敏感的弹性任务
Priority $1.35 / 1M $6.75 / 1M 对时延和服务等级有要求的任务

这里的输出价格包含 Thinking tokens,不能只按界面上看到的最终文字估算。若一个任务需要多轮工具调用和高档推理,实际消耗可能高于短问答。团队应把输入 token、输出 token、工具请求次数和人工复核时间都计入单任务成本。

免费层是否可用、额度如何计算,取决于 Google AI Studio、API 项目、地区和账号状态。不要把“免费层”当作长期 SLA,也不要把第三方平台的会员价格误认为 Google API 价格。对需要中文界面和国内网络可达性的用户,可以把 gemini镜像站 作为体验入口,但应先确认平台展示的实际模型名称、数据政策、计费规则和退出方式。

Gemini 3.7 Flash 适合哪些任务

代码代理与研发协作

它适合根据错误日志定位问题、跨文件修改、补测试、解释依赖关系和生成迁移计划。建议让模型先输出根因和修改清单,得到确认后再生成补丁;不要一上来授予整个仓库的写权限。对于生产代码,必须让 CI、静态检查和人工 review 成为最终验收环节。

PDF、图表和会议材料分析

当输入同时包含文字、截图、表格和录音时,多模态能力能减少手工整理。可以要求它输出“结论—证据—不确定点—下一步”四列,尤其要注明证据来自哪份文件、哪一页或哪段转写。对财务、合同和医疗材料,不应只依赖模型摘要。

需要检索和外部工具的智能体

Function calling、Code execution、File search、URL context 和 Search grounding 可以组合成资料检索、数据库查询、报表生成或客服辅助流程。工具返回的数据应经过 schema 校验,模型只能调用白名单函数,关键动作由业务系统再次鉴权。

不适合的场景

如果任务只是短文本改写、简单分类或批量标签,低价 Flash-Lite 往往更划算。若目标是直接生成海报、插画、配音或视频,3.7 Flash 本身不支持图片和音频生成,应使用 Nano Banana、语音或视频专用模型。若是高难科研推理,也应保留 Pro 模型作为复核路径。

三步完成一次可靠评测

第一步,准备 20 个真实任务,覆盖代码、长文、多模态、结构化抽取和工具调用。每题固定输入和验收标准,避免今天换题、明天凭印象比较。第二步,分别测试 low、medium、high 三档 Thinking,记录成功率、耗时、token、重试次数和人工修改量。第三步,进行安全回归:加入提示注入、越权请求、敏感字段和错误工具返回,检查模型是否会停下并说明原因。

推荐的通用评测提示词如下:

请基于提供的材料完成任务,并按以下顺序输出:
1. 结论
2. 证据(标注文件或段落)
3. 不确定点
4. 下一步建议

不要编造材料中不存在的事实。如果信息不足,请明确列出缺口。

代码任务还应追加:“只修改允许的文件;先解释根因,再给最小补丁;最后列出需要运行的测试命令。”这比一句“帮我修复这个项目”更容易得到可复现结果。

国内怎么用:官方入口与中文入口分开看

有条件的开发者可以使用 gemini中文版 体验界面,再通过 Google AI Studio 或 Gemini API 做正式评测。两者的账号体系、模型菜单、配额和数据处理边界可能不同,不能因为聊天页面显示了某个名称,就默认 API 项目一定拥有相同能力。

选择 gemini 国内使用 入口时,建议先做四项核验:页面是否明确显示 gemini-3.7-flash;是否能查看计费和额度;是否提供隐私政策和账号注销方式;是否允许导出或删除对话。不要提交 Google 密码、验证码、API Key、生产源码、身份证件或未脱敏合同。

常见问题

Gemini 3.7 Flash 是免费的吗?

Google 定价页同时列出免费层和付费层,但是否开放、免费额度和地区限制取决于具体平台与账号。API 付费价还会随 2026 年底优惠期结束而变化,生产项目应按付费价格做预算。2

模型 ID 应该填什么?

API 配置使用 gemini-3.7-flash。不要把网页展示名称、旧 Preview 名称或第三方平台自定义别名直接当成模型 ID。

Gemini 3.7 Flash 能生成图片吗?

官方模型页显示图片生成和音频生成均不支持。它可以理解图片、视频、音频和 PDF,但输出主要是文本。1

3.7 Flash 是否取代 Pro?

不能这样理解。Flash 更适合高频、长上下文、工具调用和智能体工作流;复杂科研推理、极高风险决策和需要更强上限的任务仍应保留 Pro 或人工复核。

最后建议:先把它当默认候选,再用数据决定是否升级

Gemini 3.7 Flash 的发布重点,是把强多模态、可调 Thinking、百万 token 上下文和工具执行能力组合到一个可规模化调用的 Flash 型号中。它最适合“读材料—调用工具—生成结果—继续修正”的连续任务,而不是只看一轮聊天的炫技效果。

如果你只是想体验新模型,可以先用中文入口跑一组固定 prompt;如果你要接入产品,则应立即建立评测集、成本表、权限白名单和人工确认节点。完成这些准备后,再决定把 3.7 Flash 设为默认模型,或只用于代码代理、资料分析等高价值环节。

立即体验 AIMirror Gemini 中文站,并在正式上传资料前先阅读平台隐私政策与服务条款。

参考资料