Gemini 3.8 Flash 是 Google 于 2026 年 9 月 2 日发布的稳定版 Flash 模型,重点面向长期软件工程、自主智能体和复杂企业工作流。同日发布的 Gemini 3.8 Flash Cyber 是独立的安全变体。想判断它是否适合你的工作,先要确认使用入口:API、AI Studio、企业产品和消费者订阅的权限与计费并不相同。 (Google)
要看清的数字:1,048,576
Google 列出的 1,048,576 输入 token 是 Gemini API 上限,不是每个浏览器、订阅或账户的额度。先确认模型名称和实际入口,再用测评与定价指南决定交给它什么任务。 (Google)
Google 对 3.8 的核心描述是“在复杂任务上投入更多工作”:模型可能增加推理步骤并迭代调用工具。这种设计可能改善长流程任务的完成度,也可能带来更多输出 token 和等待时间。社区任务演示不能证明模型在所有任务上普遍领先。更细的质量判断留给完整测评。

你现在真的能用 Gemini 3.8 Flash 吗?
选择最接近你的场景。这是访问自检,不承诺你的账户一定拥有模型权限。
开始开发前,先核对 API 项目、计费层级、地区和配额。
关键结论
稳定模型 ID 是
gemini-3.8-flash,支持文本、图片、视频、音频和 PDF 输入,输出为文本。输入上限是 1,048,576 token,输出上限是 65,536 token。thinking 支持 low、medium、high,minimal 不支持。
与 3.7 的主要差异是复杂任务会进行更深入的推理和更多工具迭代,因此不能只按每百万 token 的标价判断成本。
Google 列出 AI Studio、Gemini API、Android Studio、Google Antigravity、Stitch、Gemini Enterprise 和部分消费者订阅入口。这些入口不可互换。
2026 年 12 月 31 日前,标准 API 价格为输入 $0.75、输出(含 thinking)$3.75 / 百万 token;2027 年起官方列出的标准价格上调为 $1.50 和 $7.50。订阅与 Tabbit 费用不包含在内。 (Google API)
Gemini 3.8 Flash 规格速览
官方模型文档是限制和能力的首要来源。Google 发布说明解释了版本定位;Artificial Analysis提供特定时间和评测版本下的独立快照。它们不是同一套测试。
| 项目 | 当前信息 | 对使用的影响 |
|---|---|---|
| 模型状态 | Stable gemini-3.8-flash | 仍需确认目标产品是否开放这个稳定 ID。 |
| 输入 / 输出 | 文本、图片、视频、音频、PDF / 文本 | 多模态输入范围较广;官方页没有把图片或音频生成列为输出。 |
| token 上限 | 输入 1,048,576;输出 65,536 | API 上限不保证每个客户端都提供相同窗口。 |
| thinking | low、medium、high | minimal 不支持并会报错;更高档位可能使用更多 token。 |
| 工具能力 | 缓存、代码执行、Computer Use 预览、文件搜索、函数调用、搜索与地图 grounding、结构化输出、URL context | 这是 API 支持清单,不是每个客户端的可用性证明。 |
| 标准 API 价格 | 2026-12-31 前输入 $0.75、输出 $3.75 / 百万 token | 输出价格已含 thinking;缓存、批量与 Flex 按官方规则另行计算。 |
Artificial Analysis 在 2026 年 9 月 20 日检查的页面列出 Intelligence Index 41、v4.3.2、high thinking、305 output tokens/s 和每项指数任务 $1.24。页面没有公开 TTFT。它只能帮助读者理解某一评测快照,不能直接当作你的延迟、成本或成功率保证。
与 Gemini 3.7 Flash 的变化
Google 称 3.8 在软件工程、智能体任务和专业领域多步推理上取得提升,并说明模型通过长期智能体循环反复评估和改进。在复杂任务上,3.8 可能比旧版本执行更多推理和工具调用。Google 也明确表示,较低 effort 可以减少 token 开销,3.7 仍适合效率优先的工作。因此 3.8 是有条件的升级,而不是所有任务都必须迁移。
| 维度 | Gemini 3.7 Flash | Gemini 3.8 Flash | 选择提示 |
|---|---|---|---|
| 定位 | 快速、高效的日常编码和智能体模型 | 面向长期编码和自主工作的 Flash workhorse | 需要持续规划和迭代时优先试 3.8。 |
| 工作方式 | 公开资料没有给出同等程度的描述 | 复杂任务可能增加推理和工具调用 | 预算应允许输出量和等待时间变化。 |
| thinking 档位 | 取决于使用的客户端 | low、medium、high | 不要假定存在 minimal fallback。 |
| 价格 | Google 表示 3.8 延续 3.7 的引入价 | 2026 年底前输入 $0.75、输出 $3.75 / 百万 token | 标价相同不代表单任务成本相同。 |
| Cyber 变体 | 不在本文范围 | 独立且受限的防御安全模型 | 普通 3.8 访问不等于 Cyber 计划资格。 |
Google 发布页中的 benchmark、客户案例和产品演示都是厂商报告。更细的任务和证据边界可以在Gemini 3.8 Flash 模型资源中查看。
如何获取
开发者可以在 Google AI Studio 中试用,或在 Gemini API 中使用稳定模型 ID。Google 还列出 Android Studio、Google Antigravity 和 Stitch 作为开发入口。企业客户可以通过 Gemini Enterprise 获取,消费者则可能在 Gemini 应用、Google Search 的 AI Mode 和 Gemini in Sheets 中通过 Google AI Pro 或 Ultra 使用。具体资格、区域、配额和计费方式必须在实际产品中确认。
同一个模型名称不代表同一种控制方式。消费者订阅不是 API 计费账户,API 能用也不证明浏览器客户端已经开放该模型。计划上线工作流前,先检查产品的实时模型选择器和配额。
在 Tabbit Browser 中完成一个小任务
2026 年 9 月 20 日的编辑验证通过自动化辅助操作,在 Tabbit Browser Dev 测试站的已登录账户中新建对话,选择 Gemini-3.8-Flash。输入五条虚构付款记录,要求返回币种、已付合计、逾期 ID 与状态缺失 ID。实际返回 USD、145、B、D,四个字段符合预期;没有把缺失状态擅自补齐。
这只是一次抽取样例,不是生产性能测试。虽然提示词要求不用工具,界面仍显示 Google 搜索标记,实际工具执行未单独核验。思考档位、token 用量、费用与耗时均未测量。先检查截图中的任务和结果,再确认自己的模型选择器并尝试一个小任务。

谁适合尝试
需要多模态输入、大上下文、结构化输出或长期智能体循环,并能接受 token 用量波动的人,可以优先试 3.8。它尤其适合把复杂编码、资料分析和工具调用放在同一个长流程里的团队。
如果首要约束是固定预算、低等待时间或客户端工具支持,应保留 3.7 或其他模型作为对照。下方 Hacker News 原声只反映个人场景,不能替代自己的任务测试。费用见定价分析,质量见测评,其他选择见替代品。
社区原声:有条件的好评,也有反例
Hacker News 用户 handzhiev 说 Gemini 3.7 是快速、够用的工作模型,并表示愿意测试 3.8(原评论;个人经验,Gemini 3.7,2026 年 9 月 2 日)。simonw 分享了 Gemini 3.8 Flash 在个人编码代理中完成 HTML 渲染的经历(原评论;个人经验,Gemini 3.8 Flash,2026 年 9 月 2 日)。


反向信号来自获取和成本:robertwt7 表示 Plus 用户仍停留在 3.6 Flash,并询问澳大利亚能否使用 3.7(原评论;个人经验,Gemini 网页版,2026 年 9 月 3 日)。wyrdcurt 认为 Gemini 的 HTML 结果是快速的“cool HTML toy”,并与更便宜的模型比较(原评论;个人比较,评论中列出的模型版本,2026 年 9 月 2 日)。这些是场景经验,不是统一基准或权限证明。本轮 Reddit 出现人机验证,X 搜索未返回可用正文,未采用其内容。


来源与下一步
先阅读官方模型文档,再在你计划使用的产品中确认账号、地区和配额。若成本是主要约束,继续阅读Gemini 3.8 Flash 定价分析;若质量是主要约束,查看完整测评;若当前入口或预算不合适,查看替代品文章。
复现任务可看 任务指南 ,核对证据可看 测评来源 ,选择浏览器工作环境可看 浏览器迁移指南。
常见问题
Gemini 3.8 Flash 是什么?
Gemini 3.8 Flash 是 Google 面向长期软件工程、自主智能体和复杂企业工作流的稳定版 Flash 模型。API 支持文本、图片、视频、音频和 PDF 输入,并输出文本。
它比 Gemini 3.7 Flash 变化了什么?
Google 将 3.8 定位为更强的推理和编码版本。复杂任务可能执行更多推理步骤并反复调用工具,因此也可能消耗更多 token。
Gemini 3.8 Flash 的上下文和输出上限是多少?
官方模型页列出的输入上限为 1,048,576 token,输出上限为 65,536 token。具体客户端可能暴露更小的有效窗口。
它支持哪些 thinking 档位?
API 支持 low、medium 和 high。minimal 不受支持,调用会返回错误。
在哪里可以使用 Gemini 3.8 Flash?
Google 列出了 AI Studio、Gemini API、Android Studio、Google Antigravity、Stitch、Gemini Enterprise,以及 Google AI Pro 和 Ultra 的部分消费者入口。资格和地区条件会因入口不同而变化。
Gemini 3.8 Flash 已经能在 Tabbit 中使用吗?
2026 年 9 月 20 日,Tabbit Browser Dev 的一个测试账户完成了预期 JSON 抽取。这一个样本不证明正式版账户权限、性能或费用;请检查自己的模型选择器和实际结果。