官方模型页给出了 gpt-6-astra 的输入输出能力、上下文和输出上限、推理档位、价格、端点、工具支持与速率限制,可直接作为 API 选型和成本估算基线。
适合的任务:复杂推理、编码、计算机操作、研究和文档创建;需要文本与图片输入、文本输出的 Responses API 工作流。
不适合的任务:音频或视频输入输出、微调,以及免费层 API 使用。
适用的模型版本:gpt-6-astra;页面列出的快照和别名均为 gpt-6-astra。
适用的客户端、Agent 或 API:Chat Completions 和 Responses 等列出的 API 端点;工具调用能力以 Responses API 为准。
推荐的推理档位和参数:low、medium、high、xhigh 或 max;页面没有为具体任务指定默认档位。
model: gpt-6-astra
reasoning.effort: low | medium | high | xhigh | max
input: text, image
output: text
context_window: 1,050,000 tokens
max_output_tokens: 128,000
knowledge_cutoff: 2026-04-30以上为依据官方模型页字段整理的配置摘要,不是页面逐字代码示例。
| 项目 | 官方值 |
|---|---|
| 标准输入 | $10.00 / 1M tokens |
| 缓存输入 | $1.00 / 1M tokens |
| Cache writes | $12.50 / 1M tokens |
| 输出 | $50.00 / 1M tokens |
| 超过 272K 输入 tokens | 全请求按 2×输入/缓存、1.5×输出计价 |
| Batch / Flex | 标准价格的 50% |
| Fast mode | 适用价格的 2× |
| 免费层 | 不支持 |
页面列出的 Responses API 工具包括 web search、file search、image generation、code interpreter、hosted shell、apply patch、skills、computer use、MCP 和 tool search。模型支持 streaming、function calling 和 structured outputs,不支持 fine-tuning。
页面给出了 Tier 1–5 的 RPM、TPM 和 batch queue limit;实际限额随账户 usage tier 自动变化,不能把 Tier 1 数值当作所有账户保证值。
页面同时列出 Chat Completions、Responses、Realtime、Batch 等端点;工具支持段明确限定为 Responses API。
价格和能力是页面采集日看到的官方值,后续可能变更;复现成本时应记录采集日期、输入 token 数、缓存命中情况和处理模式。
GPT-6 Astra