最后更新时间:2026-08-25
先说结论:Gemini 3.7 Flash 是什么
Google 已在 Google AI for Developers 的官方模型目录中上线稳定型号 gemini-3.7-flash,页面标注最新更新为 2026 年 8 月。它被官方描述为面向智能体工作流和多模态推理的 Flash 模型,重点不是单纯追求更短的响应时间,而是在速度、工具调用、长上下文和可控推理之间取得平衡。1
如果你正在寻找 gemini官网 的最新型号,或者希望在国内先体验 Gemini 3.7 Flash,可以先记住三件事:模型 ID 是 gemini-3.7-flash;它支持文本、图片、视频、音频和 PDF 输入;API 输入上限为 1,048,576 token,输出上限为 65,536 token。1
本文以官方模型文档和定价页为准,重点解释这次发布对普通用户、开发者和自动化团队意味着什么。模型菜单、免费额度、价格和可用地区可能随账号、平台和时间变化,正式接入前仍应以控制台显示为准。
Gemini 3.7 Flash 官方规格一览
下面这张表只列官方模型页已经明确写出的内容,不把社区传闻当成参数。1
| 项目 | Gemini 3.7 Flash 官方信息 | 对用户的影响 |
|---|---|---|
| 模型 ID | gemini-3.7-flash |
API、SDK 和平台配置时使用该 ID |
| 状态 | Stable,官方页面 2026 年 8 月更新 | 适合开始建立生产评测集 |
| 输入 | 文本、图片、视频、音频、PDF | 可在同一请求中处理多模态材料 |
| 输出 | 文本 | 适合报告、代码、结构化文字结果 |
| 输入上下文 | 1,048,576 token | 可放入大型代码库或多份文档 |
| 输出上限 | 65,536 token | 支持较长的方案、代码和审阅报告 |
| Thinking | low、medium、high | 可在速度与推理深度之间调节 |
| 工具能力 | Function calling、Code execution、File search、URL context | 能把聊天升级为可执行工作流 |
| Grounding | Google Search、Google Maps | 适合需要最新信息或地点信息的任务 |
| Computer Use | Supported(Preview) | 浏览器自动化仍需人工确认和审计 |
| 图片与音频生成 | 不支持 | 生成图片、声音应选择专门模型 |
这次发布最值得关注的四个变化
1. Flash 不再只是轻量问答模型
3.7 Flash 的官方定位是“面向 agentic workflows 和 multimodal reasoning”。这意味着它的价值不只在于回答一句话,而在于能否读材料、拆任务、调用工具、检查结果,再继续下一步。对客服质检、代码代理、资料归档、知识库问答等场景来说,多轮执行能力通常比一次回答的文采更重要。
2. 百万 token 上下文给资料型工作留出空间
1M 输入窗口可以容纳一批项目文档、较大的代码仓库、长会议转写和多份 PDF。它并不意味着“把所有资料一股脑塞进去就一定准确”。长上下文任务仍应提供文件名、章节标题、优先级和证据位置,并要求模型把事实、推断和建议分开输出。
一个更稳的提示词结构是:先给任务,再列材料目录,最后附具体问题。对于代码任务,还应说明允许修改的文件范围、必须保留的接口、测试命令和验收标准。这样做可以减少模型在超长输入中抓错重点。
3. Thinking 提供了可调的推理预算
官方文档写明,3.7 Flash 支持 low、medium、high 三档 Thinking,minimal 不受支持。1 实际使用时,可以把 low 用于分类、改写和简单抽取,把 medium 用于结构化分析、代码排障和多文件总结,把 high 留给复杂规划、跨文档推理和需要多步检查的任务。
Thinking 不是越高越好。推理档位越高,通常意味着更长的等待和更高的输出消耗。建议先用统一评测集比较“任务成功率、人工修改次数、平均延迟、每个任务成本”,而不是只看单次回答是否更长。
4. Computer Use 仍然需要人机协作
Computer Use 标注为 Preview,说明它适合试验和受控流程,不应被当作完全无人值守的浏览器机器人。涉及付款、删除、发信、改权限和提交生产数据时,必须设置人工确认、动作白名单、截图留档和回滚方案。间接提示注入、页面内容变化和权限过大,都是上线前需要重点测试的风险。
价格怎么计算:先看优惠期,再看长期成本
截至 2026-08-25,Google 定价页显示,Gemini 3.7 Flash 标准付费层按每 100 万 token 计价:2026 年 12 月 31 日前,输入为 0.75 美元,输出(含 thinking tokens)为 3.75 美元;2027 年 1 月 1 日起,输入为 1.50 美元,输出为 7.50 美元。上下文缓存、Batch、Flex 和 Priority 还有单独价格。2
| 调用方式 | 2026-12-31 前输入价 | 2026-12-31 前输出价 | 适合场景 |
|---|---|---|---|
| Standard | $0.75 / 1M | $3.75 / 1M | 交互式应用、常规 API |
| Batch | $0.375 / 1M | $1.875 / 1M | 离线批处理、夜间任务 |
| Flex | $0.375 / 1M | $1.875 / 1M | 对时延不敏感的弹性任务 |
| Priority | $1.35 / 1M | $6.75 / 1M | 对时延和服务等级有要求的任务 |
这里的输出价格包含 Thinking tokens,不能只按界面上看到的最终文字估算。若一个任务需要多轮工具调用和高档推理,实际消耗可能高于短问答。团队应把输入 token、输出 token、工具请求次数和人工复核时间都计入单任务成本。
免费层是否可用、额度如何计算,取决于 Google AI Studio、API 项目、地区和账号状态。不要把“免费层”当作长期 SLA,也不要把第三方平台的会员价格误认为 Google API 价格。对需要中文界面和国内网络可达性的用户,可以把 gemini镜像站 作为体验入口,但应先确认平台展示的实际模型名称、数据政策、计费规则和退出方式。
Gemini 3.7 Flash 适合哪些任务
代码代理与研发协作
它适合根据错误日志定位问题、跨文件修改、补测试、解释依赖关系和生成迁移计划。建议让模型先输出根因和修改清单,得到确认后再生成补丁;不要一上来授予整个仓库的写权限。对于生产代码,必须让 CI、静态检查和人工 review 成为最终验收环节。
PDF、图表和会议材料分析
当输入同时包含文字、截图、表格和录音时,多模态能力能减少手工整理。可以要求它输出“结论—证据—不确定点—下一步”四列,尤其要注明证据来自哪份文件、哪一页或哪段转写。对财务、合同和医疗材料,不应只依赖模型摘要。
需要检索和外部工具的智能体
Function calling、Code execution、File search、URL context 和 Search grounding 可以组合成资料检索、数据库查询、报表生成或客服辅助流程。工具返回的数据应经过 schema 校验,模型只能调用白名单函数,关键动作由业务系统再次鉴权。
不适合的场景
如果任务只是短文本改写、简单分类或批量标签,低价 Flash-Lite 往往更划算。若目标是直接生成海报、插画、配音或视频,3.7 Flash 本身不支持图片和音频生成,应使用 Nano Banana、语音或视频专用模型。若是高难科研推理,也应保留 Pro 模型作为复核路径。
三步完成一次可靠评测
第一步,准备 20 个真实任务,覆盖代码、长文、多模态、结构化抽取和工具调用。每题固定输入和验收标准,避免今天换题、明天凭印象比较。第二步,分别测试 low、medium、high 三档 Thinking,记录成功率、耗时、token、重试次数和人工修改量。第三步,进行安全回归:加入提示注入、越权请求、敏感字段和错误工具返回,检查模型是否会停下并说明原因。
推荐的通用评测提示词如下:
请基于提供的材料完成任务,并按以下顺序输出:
1. 结论
2. 证据(标注文件或段落)
3. 不确定点
4. 下一步建议
不要编造材料中不存在的事实。如果信息不足,请明确列出缺口。
代码任务还应追加:“只修改允许的文件;先解释根因,再给最小补丁;最后列出需要运行的测试命令。”这比一句“帮我修复这个项目”更容易得到可复现结果。
国内怎么用:官方入口与中文入口分开看
有条件的开发者可以使用 gemini中文版 体验界面,再通过 Google AI Studio 或 Gemini API 做正式评测。两者的账号体系、模型菜单、配额和数据处理边界可能不同,不能因为聊天页面显示了某个名称,就默认 API 项目一定拥有相同能力。
选择 gemini 国内使用 入口时,建议先做四项核验:页面是否明确显示 gemini-3.7-flash;是否能查看计费和额度;是否提供隐私政策和账号注销方式;是否允许导出或删除对话。不要提交 Google 密码、验证码、API Key、生产源码、身份证件或未脱敏合同。
常见问题
Gemini 3.7 Flash 是免费的吗?
Google 定价页同时列出免费层和付费层,但是否开放、免费额度和地区限制取决于具体平台与账号。API 付费价还会随 2026 年底优惠期结束而变化,生产项目应按付费价格做预算。2
模型 ID 应该填什么?
API 配置使用 gemini-3.7-flash。不要把网页展示名称、旧 Preview 名称或第三方平台自定义别名直接当成模型 ID。
Gemini 3.7 Flash 能生成图片吗?
官方模型页显示图片生成和音频生成均不支持。它可以理解图片、视频、音频和 PDF,但输出主要是文本。1
3.7 Flash 是否取代 Pro?
不能这样理解。Flash 更适合高频、长上下文、工具调用和智能体工作流;复杂科研推理、极高风险决策和需要更强上限的任务仍应保留 Pro 或人工复核。
最后建议:先把它当默认候选,再用数据决定是否升级
Gemini 3.7 Flash 的发布重点,是把强多模态、可调 Thinking、百万 token 上下文和工具执行能力组合到一个可规模化调用的 Flash 型号中。它最适合“读材料—调用工具—生成结果—继续修正”的连续任务,而不是只看一轮聊天的炫技效果。
如果你只是想体验新模型,可以先用中文入口跑一组固定 prompt;如果你要接入产品,则应立即建立评测集、成本表、权限白名单和人工确认节点。完成这些准备后,再决定把 3.7 Flash 设为默认模型,或只用于代码代理、资料分析等高价值环节。
立即体验 AIMirror Gemini 中文站,并在正式上传资料前先阅读平台隐私政策与服务条款。
参考资料
-
Google AI for Developers,Gemini 3.7 Flash 模型文档(访问日期:2026-08-25)。 ↩︎ ↩︎ ↩︎ ↩︎ ↩︎
-
Google AI for Developers,Gemini API 定价(访问日期:2026-08-25)。 ↩︎ ↩︎