Gemini 3.5 Flash 是 Google 于 2026 年 5 月 19 日发布的 Flash 模型,面向多模态输入、编码与智能体工作。Google 现在把它列为 legacy Flash;这表示较早的稳定路线,不表示已经停机。先看 Gemini 3.5 模型页,再固定实际使用的模型 ID 和客户端。
真正的决策锚点是单价与实际任务成本的差距。Google 付费 Standard 表列出每百万 token 输入 1.50 美元、输出 9 美元;独立 Artificial Analysis 全套评测估算成本为 1,552 美元,社区个人评测则认为它在某些视觉任务落后旧版。不同分母不能混用,也不要把 API 资格当成 Tabbit 资格。
关键结论
稳定 ID 是
gemini-3.5-flash;当前目录称其 legacy,停机表没有公布停机日期。Google 列出 1,048,576 token 输入、65,536 token 输出,以及文本、图片、视频、音频和 PDF 输入。
API 支持代码执行、文件搜索、函数调用、搜索/地图 grounding、结构化输出、URL context 和 computer use 预览;客户端与账户仍可能减少功能。
Google 模型卡报告 Terminal-Bench 2.1 76.2%、SWE-Bench Pro 55.1%,但指定 harness 决定了分数。
API、AI Studio、Antigravity、Enterprise、订阅与 Tabbit 是不同路线。
规格与生命周期
提示词资源和评测资源只能帮助复现材料,不能证明你的账户提供所有能力。
| 项目 | Google 当前资料 | 边界 |
|---|---|---|
| 发布/状态 | 2026-05-19;稳定/GA;当前标为 legacy | legacy 不是停机日期。 |
| 输入/输出 | 文本、图片、视频、音频、PDF;文本输出 | 产品可能暴露更少模态。 |
| 上下文 | 输入 1,048,576;输出 65,536 | 账户、工具或产品配额可能缩小有效值。 |
| 付费 Standard | 输入 1.50 / 输出 9 / 缓存输入 0.15 美元每百万 | Batch、免费层、grounding 和订阅另算。 |
| 停机 | 未公布 | 长期项目仍需保存替代模型。 |
与 3.6、3.7、3.8 的关系
Gemini 3.6 总览负责 2026 年 7 月的效率与验证;Gemini 3.7 总览负责后续 workhorse 与 3.8 比较;Gemini 3.8 总览负责 9 月长程路线。本页只负责 3.5 的发布基线,不能把后续版本的结果倒灌到 3.5。
Google 当前目录将 3.5 称为 legacy、3.6/3.7 称为前代稳定路线、3.8 称为更新的长程 Flash。迁移时固定日期、ID、思考级别和工具,再跑同一夹具。智能体推理指南可帮助设计验收。
| 决策点 | 3.5 Flash | 后续路线 | 应测什么 |
|---|---|---|---|
| 稳定基线 | 2026 年 5 月 GA | 3.6/3.7/3.8 各有独立快照 | 同一提示、 effort 和工具策略。 |
| 长程工作 | 1M 输入窗口 | 3.7/3.8 有更新的智能体定位 | 完成率、重试和复核时间。 |
| 生命周期 | legacy、无停机日期 | 新版本也会变化 | 保存 ID 和备用路线。 |
评测与社区证据
Google 模型卡报告 Terminal-Bench 2.1 76.2% 和 SWE-Bench Pro 55.1%;方法文档说明前者使用 Terminus-2,后者是 Google 自算、五次平均的内部 Antigravity harness。独立 Better Stack 估算一个全套评测需 1,552 美元,这是工作负载成本,不是 API 输出单价。
社区反馈不一致:一位开发者用约 10 个生产选择评测,称 3.5 在多数任务落后旧 Gemini;另一位认为复杂问题幻觉更多、更适合用 3.1 Pro 做深度编码;还有用户称它在表格和文档工作中被低估。YouTube 示例则展示了用本地 OpenAI 兼容 API 构建测速工具。它们适合设计试点,不是普遍排名。
| 场景 | 首次试验 | 验收条件 |
|---|---|---|
| 小型编码修复 | 固定仓库、只读分支、测试 | diff 在范围内,测试能区分真实修复与无变化。 |
| 文档/表格 | 有人工答案的带日期文件 | 字段与计算正确,未知值不被补写。 |
| 多模态抽取 | 5 个已知字段的图片或 PDF | 每个字段可追溯到输入。 |
| 浏览器/电脑操作 | 可丢弃页面、禁止写入 | 记录 URL、工具调用、重试和停止。 |
价格、数据与获取路线
| 路线 | 可能提供 | 不能证明 |
|---|---|---|
| Gemini API | ID、token 计费、免费/付费层 | Gemini 应用订阅或 Tabbit 选择器。 |
| Google AI Studio | 开发界面和 API 凭证 | Enterprise 控制或所有账户相同配额。 |
| Antigravity/Android Studio | 产品专属开发/智能体界面 | 相同 API 计费与数据条款。 |
| Tabbit Browser | 可能出现实时模型选择 | Google API 额度或固定可用性。 |
付费 Standard 的输入、输出、缓存和 Batch 价格要与免费层数据使用条款分开阅读。搜索/地图 grounding、重试、存储和订阅也应单独记账。不要用独立评测的 1,552 美元替代官方 token 价。
Tabbit 的实践边界
Tabbit Browser是独立浏览器层,不提供 Gemini API 额度,不改变 Google 数据条款,也不保证选择器出现 3.5。本文没有完成登录实测或合格截图,因此不声称可用性、延迟、额度或上下文。可参考AI 浏览器指南、浏览器自动化指南和Gemini 3.5 评测,先做公开且可回滚的小任务。
结论、来源与常见问题
Gemini 3.5 Flash 仍可作为多模态抽取、快速编码循环和窄工具的稳定基线。代价是较高的输出与思考 token 费用、legacy 生命周期,以及随任务变化的质量。只有在同一夹具证明 3.6、3.7 或 3.8 的验证收益值得迁移时才升级。
主要来源是Google I/O 发布、模型页、价格表、停机表和DeepMind 模型卡。独立资料为Better Stack。
现在还能用吗?
Google 将它列为 legacy,但停机表显示无停机日期。长期迁移前仍要重新检查账户和表格。
真的有 1M 上下文吗?
Google 列出 1,048,576 输入 token;客户端、账户、工具或产品计划可能更小。
每百万输出 9 美元就是总成本吗?
不是。它是付费 Standard 输出价,思考 token 包含在内;输入、缓存、Batch、grounding 和重试另计。
它比 3.6、3.7、3.8 好吗?
不能靠版本号排名。固定相同任务、客户端、思考设置和工具比较。
能自主运行智能体吗?
先使用最小权限、可丢弃环境、测试和人工检查。模型卡与社区都显示了幻觉和验证风险。
能在 Tabbit 用吗?
本文未验证登录账户,请检查实时选择器,并把成功视为账户级观察。
常见问题
Gemini 3.5 Flash 是什么?
Gemini 3.5 Flash 是 Google 于 2026 年 5 月 19 日发布的稳定 Flash 模型,面向多模态、编码和智能体工作。Google 当前将其列为 legacy Flash,但停机日期仍未公布。
Gemini 3.5 Flash 有哪些限制?
Google 列出文本、图片、视频、音频和 PDF 输入,1,048,576 token 输入上限和 65,536 token 输出上限。工具是否可用仍取决于客户端与账户。
Gemini 3.5 Flash 怎么收费?
2026 年 9 月 20 日核对的付费 Standard 表为每百万 token 输入 1.50 美元、输出 9 美元(含思考 token),缓存输入 0.15 美元。Batch 与免费层另计。
它适合编码智能体吗?
Google 模型卡在指定 harness 下报告 Terminal-Bench 2.1 为 76.2%、SWE-Bench Pro 为 55.1%。社区结果因任务而异,应使用固定仓库、测试、预算和人工检查。
要迁移到 Gemini 3.6、3.7 或 3.8 吗?
不应自动迁移。它们是不同稳定路线,有各自的日期、价格与任务证据。请固定模型 ID,在同一夹具上比较。
能在 Tabbit Browser 使用吗?
本文没有登录 Tabbit 实测 Gemini 3.5 Flash。请检查实时选择器,先验证一个可回滚的小任务;Google API 可用不代表 Tabbit 可用。