OpenAI 在 8 月 21 日調降了 GPT-5.6 Sol 的 API 費率:輸入從每百萬 token 5 美元降到 4 美元,輸出從 30 美元降到 20 美元,快取輸入從 0.5 美元降到 0.4 美元。這次調價為期三個月,11 月 21 日到期。
適用範圍寫得很明確。API 呼叫按新價計費,ChatGPT Work 和 Codex 裡消耗的額度(credits)也一併調降。Pro、Plus、Business 三個訂閱方案的月費維持不變。OpenAI 給的理由是,模型能力持續進步的同時效率也在提升,把省下來的成本讓一部分給用戶。
用實際用量算一次
官方說法是「超過 20%」,但三檔單價的降幅其實並不一致:輸入降 20%,快取輸入降 20%,輸出則降了三分之一。降最兇的是輸出這一檔,實際能省多少,要看負載長什麼樣子。
先拿一個寫程式用的 AI 代理來粗算。這類任務的特色是輸入重、輸出輕,而且會反覆讀取同一份程式碼上下文,快取命中率通常很高。假設單次任務吃掉 100 萬輸入 token、10 萬輸出 token,輸入有八成命中快取:舊價下是 0.2×5 + 0.8×0.5 + 0.1×30 = 4.4 美元,新價下是 0.2×4 + 0.8×0.4 + 0.1×20 = 3.12 美元,省了約 29%。
換成對話或長文生成這類輸出占比高的負載,省下的比例會往上靠近輸出那三分之一的降幅。反過來,如果是純檢索式的短問答、輸出只有幾百 token,省下的幾乎就等於輸入那 20%。同一則公告,落在不同產品上,體感能差出十幾個百分點。
位置卡到 Opus 5 下面
調降之後,Sol 在報價表上的位置也變了。Anthropic 的 Claude Fable 5 定價是每百萬 token 輸入 10 美元、輸出 50 美元,Opus 5 則是 5 美元和 25 美元。Sol 原本的 5/30 比 Opus 5 略貴一點,現在的 4/20 整體落到了 Opus 5 之下。
這個價位帶的競爭很直接。願意為旗艦模型付費的開發者,通常是把模型放進程式輔助工具、客服系統或代理(agent)流程裡跑長任務的那群人,帳單按月累積,換不換全看單位成本。Anthropic 在程式開發場景的存在感,加上中國模型在同價位持續壓低報價,壓力都落在這批按量付費的用戶身上。
單價之外還有一筆容易被忽略的帳:快取輸入的絕對值。降到 0.4 美元之後,命中快取的那部分輸入比未命中便宜十倍,在長上下文反覆呼叫的情境裡,這個比例比標價本身更能決定月底帳單的數字。真正把帳單壓下來的團隊,多半是在拚快取命中率,標價高低反而排在後面。
為什麼只給三個月
三個月是個很短的窗口。GPT-5.6 系列 7 月初一口氣推出三個等級,7 月底 Luna 和 Terra 就已經降過一輪——Luna 那次降了 80%,Terra 降 20%。輪到旗艦型號,OpenAI 給的是限時價,沒有動報價表本身。
限時的好處是留了退路:11 月 21 日之後價格自動回到 5/30,不必再發一次「漲價」公告,財務上也不用把這個折扣做成長期承諾。代價是開發者同樣清楚這一點,願意為一個帶倒數計時的價格重寫多少呼叫邏輯、搬多少既有流量,要打個問號。真正會為這個價格搬家的,多半是本來就在不同供應商之間來回比價的那批用量。
"As we continue to push the frontier of capabilities while improving efficiency, we're dropping API and credit pricing of GPT-5.6 Sol by over 20% for the next 3 months."
在持續推進能力上限、同時改善效率的過程中,未來三個月將 GPT-5.6 Sol 的 API 與額度價格調降超過 20%。
訂閱價格紋風不動這一點同樣有意義。包月訂閱是可預期的固定收入,用量端才是跟對手正面碰撞的戰場。這次讓利精準落在 API 和 Codex 額度上,也就是那些一個月能燒掉好幾千美元、隨時能把 base_url 換掉的帳號。
對中國的開發者來說,實際影響要看走哪條路線。直連 API 的按新價計費,走中繼站和代理的得等各家跟進,中間那段價差往往就是這幾個月的利潤來源。等三個月後價格回到原位,同一批呼叫會不會跟著搬走,那時候才有答案。
參考來源:OpenAI 官方公告、CocoLoop、OpenAI 開發者社群公告、路透社;以 OpenAI 定價頁核對 Sol 輸入、輸出、快取輸入三檔單價與三個月執行期的說法。