GPT-5.6 Sol 应理解为拥有超大 API 上下文的旗舰推理模型,而不是每个应用都会开放 105 万 token。复杂编程、工具调用和长研究值得评估它;短摘要不应只因“旗舰”就付费。
本文于 2026 年 9 月 20 日重新核对了 OpenAI GPT-5.6 Sol 模型页。它是规格和 API 价格来源;Codex、ChatGPT、Tabbit 可能有不同策略。本文没有声称在 Tabbit 中跑过 Sol。
先看结论
规格是 1,050,000 token 上下文、128,000 最大输出;输入文本和图片,推理强度从 none 到 max。
当前 API 卡为输入 4 美元/百万、缓存输入 0.40 美元/百万、输出 20 美元/百万;超过 272K 输入时,整次请求按输入 2 倍、输出 1.5 倍计价。
GPT-5.6 把 Sol、Terra、Luna 分成深度、成本、速度不同的路线。社区既有长研究的正面反馈,也有配额和配置失效的担忧。
规格、获取与边界
| 维度 | 当前证据 | 不能据此推出 |
|---|---|---|
| 定位 | Sol 是旗舰,gpt-5.6 指向 Sol | 各客户端使用同一快照 |
| 窗口/输出 | 1,050,000 / 128,000 token | Codex 或浏览器开放完整窗口 |
| 输入/推理 | 文本、图片;none 到 max | 每个 UI 都有六档 |
| API 价格 | 4/0.40/20 美元每百万;>272K 有倍率 | ChatGPT 或 Tabbit 订阅规则 |
| 知识截止 | 2026-02-16 | 当前网页事实仍新鲜 |
函数调用、结构化输出、流式和工具支持也列在模型页。Codex 的具体配置请看已有的 1M 上下文指南,不要在总览页重复配置教程。
相比前代:变化与未知
变化在于路线更清楚:Sol 处理困难任务,Terra 和 Luna 偏成本或速度。CodeRabbit 在自己的多文件编码/审查 harness 中看到更好的持续跟进,但承认其他模型有架构判断优势。METR 在作弊算失败时给出约 11.3 小时的 50% Time Horizon、95% 区间 5–40 小时,并说估计不稳健。不同 harness 不可合成一个排名。
仍需核对有效窗口、长上下文质量、订阅是否套用 API 的 272K 倍率,以及实际知识新鲜度。Reddit 的 u/1filipis 说大窗口适合大量研究,也说压缩会让 Codex 从头开始;u/mvandemar 提醒 272K 以上可能消耗 2 倍用量。X 上 SamG 要求按任务切换上下文,am.will 报告设置会恢复。这些是信号,不是基准。
场景自检与下一步
| 你的情况 | 先选 | 必须核对 |
|---|---|---|
| API 大文档/工具 | 固定快照的 Sol | 倍率、缓存、重试、工具费用 |
| Codex 大仓库 | 先用默认,再测试 Sol | 实际窗口;看指南 |
| 浏览器研究 | 看 Tabbit 模型工作流 | 选择器、账户上限;本文未测 Tabbit |
| 成本敏感摘要 | 更快路线 | 每个可接受答案的成本 |
下一步是写成功标准、记录模型/客户端/推理/上下文/日期,跑固定样本并比较可接受输出、重试、耗时和用量。研究可看深度研究流程、AI 浏览器对比、ChatGPT 浏览器指南和研究者工作流;预算前重查 Tabbit 定价。
Tabbit 路线与结论
Tabbit 官网列出 GPT-5.6,并说明网页、截图和本地文件可进入 Agent 上下文。这支持浏览器路线,但不证明 Sol 快照、1.05M 有效窗口或 API 计费。本文没有截图和 Tabbit 任务结果;请确认选择器、运行有边界的任务,并参考 Codex 与浏览器 Agent 取舍。

选择 Sol 应基于持续推理、跟进多文件、图片输入或工具调用是否值得测量成本,而不是只看 1.05M。端到端验证完成前,本页保持草稿。
来源
OpenAI 模型页、METR、CodeRabbit、Visual Studio Magazine、X、Reddit、YouTube、Tabbit。
常见问题
GPT-5.6 Sol 是什么?
它是 GPT-5.6 家族的旗舰模型;当前 API 页列出文本和图片输入、推理控制、105 万上下文和 12.8 万最大输出。
当前 API 价格是多少?
当前页面列出每百万输入 4 美元、缓存输入 0.40 美元、输出 20 美元,优惠至少显示到 2026 年 11 月 21 日;预算前请重查。
每个客户端都有 105 万上下文吗?
没有。105 万是 API 规格,Codex 等客户端可能使用较小窗口或提早压缩。
相比 GPT-5.5 变了什么?
GPT-5.6 分为 Sol、Terra、Luna 路线,Sol 是旗舰;价格较低不等于每项任务总成本较低。
Tabbit 保证 105 万吗?
官网列出 GPT-5.6,但本文没有登录运行或测量有效窗口,请在选择器中确认。