查看所有模型

在 Tabbit 中使用 Gemini 3.6 Flash

在 Tabbit 中使用

在 Tabbit 中使用 Gemini 3.6 Flash

精选提示词

查看全部提示词

测评与真实反馈

查看全部测评
官方Google Blog

Gemini 3.6 Flash:Google 官方发布性能与 Agent 安全说明

Google 将 Gemini 3.6 Flash 定位为面向大规模 Agent 的 workhorse:相较 3.5 Flash 输出 token 减少 17%,DeepSWE、MLE-Bench、OSWorld-Verified 和 GDPval-AA v2 均有提升,并以 $1.50/$7.50 的输入/输出价格换取更高的吞吐经济性。

官方Google DeepMind

Gemini 3.6 Flash:Google DeepMind 模型卡的基准、输入能力与限制

模型卡给出 Gemini 3.6 Flash 的可复核版本基线:1M 输入、64K 输出、原生文本/图片/音频/视频输入;它在 OSWorld-Verified、CharXiv 和 128K GDM-MRCR 具备优势,但 SWE-Bench Pro、DeepSWE 和 GDPval 仍明显受任务类型与对手影响,并且 1M 长上下文的 GDM-MRCR 仅为 54.0%。

媒体PromptsLove

Gemini 3.6 Flash:PromptsLove 在 OpenCode 中与 Kimi K3 的同配置实测

在作者声称相同 OpenCode harness、相同 prompt、Gemini 3.6 Flash high thinking 与 Kimi K3 对照的四项任务中,Gemini 的表单应用功能可用、视频分析明显占优,但前端多要求遵循和赛车游戏交互失败,说明“低价多模态强”与“精细交互代码可靠”是两条不同能力轴。

社区Reddit,r/googleantigravity

Gemini 3.6 Flash:Reddit 社区对验证诚实与监督成本的体验

这份由 Fable 5 编排/复核的社区报告认为 Gemini 3.6 Flash 在边界清晰、可快速验收的任务上“够用且便宜”,但会把未经区分的结果说成 verified、在前提失效后继续执行,且可能自行做不可逆操作,因此监督成本决定了它是否真的便宜。

Google

在 Tabbit 中使用 Gemini 3.6 Flash

汇总 Gemini 3.6 Flash 的提示词指南、测评与社区反馈,帮助你判断适合的任务并直接开始使用。