GPT-6 Astra 標準 API 檔的價格是每百萬輸入 token 10 美元、每百萬輸出 token 50 美元,快取命中 1 美元、快取寫入 12.50 美元——以上數字全部於 2026 年 9 月 22 日在 OpenAI 官方頁面核對。但這是費率卡,不是帳單:同一張卡上,Artificial Analysis 測得同一個基準任務在 low 推理強度下花 0.82 美元、在 max 下花 3.26 美元——一個價格都沒動,成本先擺了約 4 倍。
這兩個數字之間的落差就是本文存在的理由。Astra 發布時有位 Reddit 開發者說得很直接:「GPT-5.6 Sol:輸入 $4/M、輸出 $20/M。GPT-6 Astra:輸入 $10/M、輸出 $50/M。輸入輸出雙雙 2.5 倍漲價。」(r/codex 原帖,456 讚)。算術沒錯,但「貴還是便宜」的結論不能靠算術得出——推理強度、服務檔位、上下文長度與快取命中率,每一項對帳單的影響都超過換模型本身。文章後段會介紹 Tabbit Browser 作為算完帳之後比較模型路由的一個實踐入口;先看數字。
重點速覽
標準費率:每百萬 token 輸入 10 美元、快取命中 1 美元、快取寫入 12.50 美元、輸出 50 美元;輸入超過 272K 後整個請求改按 20/2/25/75 美元計。
同一張卡能差 4 倍。Batch 與 Flex 全線五折,Fast 模式全線兩倍;Artificial Analysis 在相同 token 價格下測得單一任務從 0.82 美元(low)到 3.26 美元(max)。
2.5 倍溢價的基準是促銷價。Sol 的 4/20 美元被官方標註為促銷價、「至少延續到 2026 年 11 月 21 日」;上一代 GPT-5.5 的輸入價是 5 美元。
訂閱是另一套經濟系統。ChatGPT Plus 月費 20 美元含有限 Astra;Pro 顯示 100 美元起。社群測得 Astra 在訂閱下的有效成本約為 API 價的 1.9 倍,快取保留約 30 分鐘。
按任務形狀做預算,別按 token 單價。短問答由輸出主導;快取命中的 agent 迴圈由快取讀取主導;超過 272K 的一切都為長上下文溢價買單。
GPT-6 Astra 定價速覽
完整標準費率卡,2026 年 9 月 22 日取自 OpenAI API 定價頁。GPT-6 Astra 總覽講它是什麼,這張表只講錢。
| 模型 | 輸入 / 百萬 | 快取命中 / 百萬 | 快取寫入 / 百萬 | 輸出 / 百萬 |
|---|---|---|---|---|
| gpt-6-astra | $10.00 | $1.00 | $12.50 | $50.00 |
| gpt-5.6-sol | $4.00 | $0.40 | $5.00 | $20.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $2.50 | $12.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $0.25 | $1.20 |

這張表裡真正決定帳單的是三件事,沒有一件是標題裡的 10 美元:
輸出是輸入的 5 倍價。Astra 是推理模型,思考過程就是可計費的輸出 token。一個不長的提示詞配上很長的思維鏈,就是一張穿著輸入外衣的輸出帳單。
快取寫入比輸入還貴。12.50 美元是非快取價的 1.25 倍——定價頁明文寫了 1.25x 規則。只有前綴真的被複用時,快取才划算。
272K 斷崖作用於整個請求。輸入一過 272,000 token,整單請求——不只是超出部分——按輸入 20 美元、快取 2 美元、寫入 25 美元、輸出 75 美元計。105 萬的上下文視窗不等於 105 萬的標準價預算。
那個關鍵數字:同一張卡,單任務 0.82 到 3.26 美元
如果只記一個數字,記擺幅,不記費率。Artificial Analysis 把 GPT-6 Astra 按推理強度拆成五個條目追蹤,其「每個智慧指數任務的成本」(2026 年 9 月 22 日快照)如下:
| 推理強度 | 智慧指數 | 每任務成本 | 輸出速度 |
|---|---|---|---|
| low | 46 | $0.82 | 55 t/s |
| medium | 50 | $1.54 | 52 t/s |
| high | 51 | $1.73 | 59 t/s |
| xhigh | 52 | $2.31 | 55 t/s |
| max | 53 | $3.26 | 67 t/s |
把最外兩列放在一起讀:max 檔的單任務成本是 low 檔的 3.98 倍,換來的智慧指數差距是 7 分。同一快照裡 low 檔的首 token 延遲也最低(2.46 秒)。貴的檔位不等於穩妥的檔位,它只是在可計費 token 裡想得更久的檔位。
這對 agent 型工作的影響是雙倍的。Astra 最亮的公開成績——OpenAI 模擬中 OSWorld 2.0 單任務約 40 分鐘、Sol 約 75 分鐘——描述的恰是 effort 和重試不斷複利的工作負載:每輪迴圈重讀上下文,每一步吐出推理 token,一個「能一直跑」的模型也是一個「一直在計費」的模型。Hacker News 有使用者報告 15 則訊息燒完 ChatGPT 五小時額度(HN 討論);同樣的形狀放到 API 計費上,就是深度研究工作流堅持先定驗收標準再跑長迴圈的原因。預算要按完成的任務算,把失敗嘗試算進去,而不是按第一次嘗試算。
把「比 Sol 貴 2.5 倍」翻譯成人話

2.5 倍這個數算得沒錯,但做預算前有兩個注意事項要放在它旁邊。
注意一:比較基準是促銷價。OpenAI 的 Sol 頁面註明「GPT-5.6 Sol 的促銷價至少延續到 2026 年 11 月 21 日」,其快速比較列顯示上一代 GPT-5.5 的輸入價為 5.00 美元。Sol 的這輪降價發生在 2026 年 7 月 30 日——Sam Altman 當天宣布 Luna 降 80%(至 0.20/1.20 美元)、Terra 降 20%(至 2/12 美元)、Sol 獲得按 2 倍價格換最高 2.5 倍速度的 Fast 模式(@sama)。如果 Sol 促銷到期,「2.5 倍溢價」會自己縮小,而 Astra 一分沒降。GPT-5.6 Sol 長上下文分析單獨追蹤這個家族。
注意二:單任務成本可能收斂。上面的原帖是對費率卡的價格衝擊,而 Artificial Analysis 測得 low 檔單任務 0.82 美元,說明帳單可以落到標價下方很遠;當能力省下重試時方向完全反轉:Sol 失敗兩次、Astra 一次完成的任務,即使按 2.5 倍費率也是 Astra 更便宜。你的任務屬於哪種,是經驗問題——用下面的算例回答,費率卡回答不了。
標題之外的計費線項
真正決定多數帳單的是四條線,而發布報導只提了第一條。
Batch 與 Flex:五折槓桿。兩者都按標準價的一半計費——輸入 5 美元、快取 0.50 美元、寫入 6.25 美元、輸出 25 美元。Batch 面向可以等幾小時的工作(API 暴露 v1/batch,佇列限額從 Tier 1 的 150 萬 token 到 Tier 5 的 150 億);Flex 是另一種低價容量模式,可用性取捨不同。評估批次、離線富集與一切非使用者面對的工作,這一個開關省下的錢超過任何提示詞優化。折扣不疊加:一次只選一個模式。
Fast 模式:兩倍加速器。按適用價率的兩倍計費——標準檔 20/100 美元,注意「適用」二字:Batch 任務開 Fast 是在 Batch 價上翻倍,不是回到標準價再翻。Priority processing 已於 2026 年 7 月 30 日更名為 Fast mode,service_tier: "priority" 與 "fast" 都還能用,舊程式碼要留意。
區域處理:加 10%。資料駐留端點對 2026 年 3 月 5 日之後發布且支援資料駐留的模型加收 10%——Astra 按發布日期符合條件。合規驅動的區域要為每一行多付一成。
272K 斷崖與快取時鐘。輸入超過 272K 後,長上下文一行(20/2/25/75 美元)作用於整單請求——沒有「只算超出部分」的算法。而本該給重複讀取降本的快取,社群回報它的保留時間很短:Codex 使用者觀察到 Astra 約 30 分鐘,而 Sol 與更早模型是 24 小時。

OpenAI 沒有公布 TTL 對照表,所以把 30 分鐘當作有兩個獨立來源的行為回報(原帖、留言),不是承諾。如果你的迴圈在兩步之間睡得比這更久,1 美元的快取命中會悄悄變回 10 美元的冷讀加 12.50 美元的寫入。
工具呼叫在這一切之外:OpenAI 說明 web search 等工具型能力按每次呼叫收費,一個搜尋 40 次的 agent 身上還掛著第二隻計費器。
家族階梯:哪一行才是你的
階梯裡反直覺的一行是 Luna:比 Astra 的輸入便宜 50 倍,而且它是真實存在的產品行。官方模型目錄把 Luna 描述為面向成本敏感、大批量工作負載,OpenAI 自己的選型建議也是「除非工作難到需要旗艦,否則預設 Terra 或 Luna」。便宜的那一行不是玩具,它是路由目標——每一路由到 Luna 而不是 Astra 的 token,輸入側省 50 倍。
第二個反直覺發現來自家族之外。Astra 與 Anthropic 的 Fable 5.1 掛著完全相同的 10/50 美元——而真實成本朝相反方向走:

發文者的算法:Astra 完成單一任務更省 token(其長單任務上「token 成本不到 Fable 5.1 的一半」),而 Fable 的快取讀取每百萬 0.25 美元,比 Astra 的 1.00 美元便宜 4 倍——所以「大快取上下文上的高頻呼叫」偏 Fable,「長單任務」偏 Astra。一位留言者在兩個模型上各跑了一週文件檢索管線,85% 快取命中率下 Fable 成本約為 Astra 的一半,「這個任務上表現基本一樣」:

可遷移的結論不需要你選哪家的實驗室:費率卡只是成本函數裡最小的輸入。任務長度、快取命中率、輸出體量這些流量形狀才是主導。社群評測合集 (简体中文)保留了更多這類帶條件的報告。
費率卡不覆蓋的東西
訂閱不是 API 信用。ChatGPT 方案給的是用量,按額度與時間窗計價——下一節會說明這些額度自成一套經濟系統。永遠不要拿 20 美元的方案除以 token 單價。
失敗的嘗試照樣計費。發布週的一份報告記錄了一次 33 分鐘的 Codex 執行:成功請求之前,兩次逾時的嘗試已經消耗了額度(r/ChatGPT)。重試是成本線,不是免費的。
API 免費檔關閉。速率限制表把 Astra 標為 Free 檔不可用;付費從 Tier 1 起步,每分鐘 500 次請求、50 萬 token。
稅費、工具與供應商加價另算。OpenRouter 市場頁顯示 Azure 與 OpenAI 都按 10/50/1 美元掛 Astra,但延遲畫像不同(今日快照中首 token P50 分別為 6.92 秒與 4.80 秒)——同價不同路由。Amazon Bedrock 商業區域官方聲明與 OpenAI 直連同價。
方案可得性:API 分層與 ChatGPT 方案
| API 檔位 | RPM | TPM | Batch 佇列限額 |
|---|---|---|---|
| Free | 不支援 | — | — |
| Tier 1 | 500 | 500,000 | 150 萬 token |
| Tier 2 | 5,000 | 1,000,000 | 300 萬 token |
| Tier 3 | 5,000 | 2,000,000 | 1 億 token |
| Tier 4 | 10,000 | 4,000,000 | 2 億 token |
| Tier 5 | 15,000 | 40,000,000 | 150 億 token |
來源:OpenAI gpt-6-astra 模型頁,2026 年 9 月 22 日核對。檔位隨消費提升,發布週的天花板不是永久的。
消費端,ChatGPT 定價頁目前展示四檔:Free 0 美元(無限 GPT-5.6 Luna 文字聊天——無 Astra)、Go 每月 8 美元、Plus 每月 20 美元(含「GPT-6 Astra 與 GPT-5.6 的高級推理模型」,比較矩陣中 Astra 標為有限)、Pro 顯示「100 美元/月起」、5 倍用量、「由 GPT-6 Astra 提供支援的專業推理」。社群討論仍提到 200 美元的 Pro 檔,YouTube 影片簡介也同時列出「100 與 200 美元」兩檔——以即時頁面為準,目前顯示的是「起價」口徑。
訂閱經濟學值得單獨貼一張警示標籤,因為三項獨立的社群測量指向同一方向:

第一,額度數學:兩個 Pro 帳號上,週度 API 等價額度從 Sol 的 2500+ 美元降到 Astra 的約 1200 美元——且這個數字已經按 Astra 更高的單價折算——「同樣的訂閱費只換來大約四分之一的可比用量」。第二,有效價率:一位 Plus 訂閱者反推出在同一額度下 Astra 相對 Luna 的有效成本約為 API 價的 1.90 倍(實測用量 134.42 對 70.59 美元)。第三,燃燒體驗:


「Astra 確實好用,但要做點有意義的事,200 美元一個月的訂閱給的 token 根本不夠」——這是一位遊戲開發者的總結,能力與抱怨在同一句話裡。如果你只是偶爾、有監督地用 Astra,Plus 可能夠;如果它是每日管線的引擎,帶 Batch 的 API 才是可預測的路線,訂閱是溢價互動路線。
兩組算例,假設全部擺明
使用標準短上下文費率,不含重試、工具與稅費。是算術演示,不是預測。
一個短問題,一段長思考。10,000 輸入 token、2,000 輸出 token:
(10,000 × $10 + 2,000 × $50) / 1,000,000 = $0.20一次跨過斷崖的冷啟動 agent 迴圈。300,000 輸入 token——注意已經過了 272K,長上下文費率作用於全部——8,000 輸出 token:
(300,000 × $20 + 8,000 × $75) / 1,000,000 = $6.60同樣的迴圈控制在 272K 以內(比如 260,000 token)是 4.00 美元。跨過那條線,這個形狀多付 65%。再看暖版本:同樣 300,000 token 上下文、90% 命中、每小時寫一次快取、8,000 輸出:
(270,000 × $2 + 30,000 × $20 + 8,000 × $75) / 1,000,000 = $1.68 + 寫入本機計算
估算 GPT-6 Astra API token 成本
使用 2026-09-22 核對的官方美元費率。輸入值只在瀏覽器本機處理。
快取寫入按輸入價的 1.25 倍計費。此估算不含重試、工具、稅費、10% 區域加價及供應商加價。輸入超過 272K 時自動將所有線項切換為長上下檔費率。 核對最新費率
計算器完全在本頁執行——不向任何地方傳送資料。它會自動套用 272K 長上下文切換、按所選服務檔計價、把快取寫入與命中分開。它刻意不建模的東西:重試、工具呼叫費、區域 10% 與快取時鐘——這些留在你的利潤率裡。承諾預算前請重新核對官方費率卡;本文數字截至 2026 年 9 月 22 日。
一個實踐入口:在 Tabbit 裡跑比較
預算之後是無聊的部分:真正跑 Astra 型工作,需要一個頁面、檔案與模型呼叫待在同一個地方的環境。這正是 Tabbit Browser 的位置——一個模型選擇器、即時頁面與本地檔案同處一個介面的 AI 瀏覽器,「先用 Astra 的 medium 檔試,不行退回 Luna」是一次選擇,而不是一個編排專案。

邊界要說清楚:Tabbit 是用戶端,不是 OpenAI 的計費層。模型可得性取決於你的帳號與版本,瀏覽器裡的任何操作都不改變 OpenAI 收什麼錢——上面的費率卡在哪兒跑 Astra 都適用。瀏覽器改變的是搭建成本:GPT-6 Astra 資源頁 (简体中文)與它的提示詞合集 (简体中文)描述了可以對著選擇器直接跑的可重現任務,這是弄清你的負載到底需要哪個強度檔的最便宜方式——不用寫一行編排程式碼。
如果工作重點是瀏覽器級自動化而不是對話,agentic 瀏覽器總覽、什麼是 agentic 瀏覽器與瀏覽器自動化指南覆蓋那條工作流;AI 瀏覽器指南是一般性起點。
GPT-6 Astra 定價決策表
| 你的工作負載 | 成本驅動 | 最佳起步路徑 | 當心什麼 |
|---|---|---|---|
| 互動式聊天、短回答 | 輸出 token | API 低/中強度,或 Plus | $50/M 輸出主導,是輸入價的 5 倍 |
| 過夜評估或富集 | 體量 | Batch 五折 | 分檔佇列限額,結果按小時計 |
| 272K 以內的長 agent 迴圈 | 快取讀取與寫入 | 標準檔 + 穩定前綴快取 | 社群回報約 30 分鐘快取保留 |
| 超過 272K 的上下文 | 斷崖 | 重構壓到線下,或按 20/75 預算 | 整單重新計價,不是只算超出部分 |
| 延遲敏感的生產流量 | Fast 模式 | 最低夠用強度上開 Fast(2x) | 強度選擇對成本的影響大於檔位 |
| 每日重度消費端使用 | 訂閱額度 | Pro(100 美元起)或 API+Batch | 社群回報額度消耗比 Sol 快約 4 倍 |
最終裁決
GPT-6 Astra 按「難活兒的原料」定價,也按這個方式出帳單。當任務長程、重工具、人工盯守成本高時買它——然後小心地買:能等的工作全走 Batch,強度從 low 起步直到驗收測試說不行,上下文工程化壓到 272K 以下,快取友好的前綴對著 30 分鐘的時鐘測算。不需要旗艦能力的體量留給 Luna 或 Terra——家族階梯存在的意義,就是讓旗艦成為一個路由決策而不是預設值。
如果 Astra 是你 API 上的日常引擎,按「完成的任務」做預算(含重試與工具費),並每月複查官方定價頁——Sol 的促銷基準掛著 11 月 21 日的日期,整條階梯都可能移動。專門的替代品比較還在準備中;在它上線前,模型資源頁 (简体中文)、總覽與上文引用的社群記錄就是溯源路徑。
來源
OpenAI API 定價與gpt-6-astra 模型頁——費率、檔位規則、速率限制,2026 年 9 月 22 日核對
ChatGPT 定價——Free/Go/Plus/Pro 展示口徑,2026 年 9 月 22 日核對
Sam Altman,2026 年 7 月 30 日——Luna/Terra 降價與 Sol Fast 模式公告
Artificial Analysis GPT-6 Astra 發布頁——強度檔智慧、速度與每任務成本快照,2026 年 9 月 22 日
OpenRouter GPT-6 Astra——供應商費率與延遲快照,2026 年 9 月 22 日
社群記錄(截圖與條件隨文標註):r/codex 1w6hvo9、r/codex 1wciwc1、r/codex 1w8r103、r/LLMDevs 1w9z8nb、r/ChatGPT 1w9nya5、Ask HN
常見問題
GPT-6 Astra 多少錢?
2026 年 9 月 22 日在 OpenAI 官方頁面核對的標準 API 費率為:每百萬輸入 token 10 美元、快取命中 1 美元、快取寫入 12.50 美元、輸出 50 美元。輸入超過 272K 的請求整單改按長上下文費率計費(輸入 20 美元、快取 2 美元、寫入 25 美元、輸出 75 美元)。Batch 與 Flex 按標準價五折計費,Fast 模式按兩倍計費,資料駐留區域端點另加 10%。
GPT-6 Astra 有免費額度嗎?
API 免費檔不支援。OpenAI 對 gpt-6-astra 的速率限制表把 Free 檔標為不可用,付費存取從 Tier 1 開始。消費端方面,ChatGPT 免費版提供無限的 GPT-5.6 Luna 文字聊天但沒有 Astra;Plus 含有限的 Astra 存取,Pro 檔官方描述為由 GPT-6 Astra 提供支援。
為什麼 GPT-6 Astra 比 GPT-5.6 Sol 貴 2.5 倍?
OpenAI 把 Astra 定位為處理推理、編碼、computer use 與研究等最難端到端工作的模型,因此按 10/50 美元對 Sol 的 4/20 美元定價。需要注意 Sol 目前費率是促銷價,官方標註至少延續到 2026 年 11 月 21 日,比較基準本身可能變化。當 Astra 能以更少的重試完成任務時,每個任務的實際成本會向 Sol 靠攏。
為了用 GPT-6 Astra,ChatGPT Pro 值得買嗎?
取決於工作負載。Pro 頁面顯示月費 100 美元起、5 倍用量、Astra 驅動的專業推理;但社群實測報告週度 API 等價額度從 Sol 的約 2500 美元降到 Astra 的約 1200 美元、快取保留約 30 分鐘,重度使用者很快燒完額度。如果你的任務是長程 agent 型,建議仔細核算預算,或在延遲允許時走 API 的 Batch 檔。
跑 GPT-6 Astra 最省錢的方式是什麼?
組合使用幾個槓桿:非緊急工作走 Batch 或 Flex(標準價五折);先用 low 或 medium 推理強度,驗收測試不通過再升級;把輸入控制在 272K 以下避免長上下文費率;快取穩定前綴,讓重複讀取按每百萬 1 美元而不是 10 美元計費。
GPT-6 Astra 的 API 價格包含工具呼叫嗎?
不包含。公布的 token 費率只涵蓋文字輸入與輸出。OpenAI 說明 web search、computer use 等工具型能力按每次呼叫另行收費,與 token 定價分開計費,所以重工具的 agent 需要在預算裡單獨列一條。