GPT-6.1 Sol上線 價格僅Astra五分一

OpenAI於9月29日的DevDay上發表GPT-6.1 Sol,定位為程式設計代理、電腦操作與專業辦公任務。API標準價格為每百萬輸入token 2美元、快取輸入0.10美元、輸出10美元,與GPT-6 Sol持平;對照旗艦GPT-6 Astra的10美元、0.20美元與50美元,輸入輸出兩項都只有五分之一。

發布節奏相當密集。GPT-6 Astra是26天前上線的,GPT-6 Sol才上線7天,就被6.1版取代。按OpenAI的說法,新模型在程式設計與電腦操作上「接近Astra」。

跑分貼近旗艦,部分項目差距仍在

OpenAI公布的成績顯示,GPT-6.1 Sol在DeepSWE v1.1以較高推理等級拿到75.2%,與Astra打平,成本約為後者的五分之一。OSWorld 2.0最高推理等級得分71.4%,比Astra低2.1個百分點,單一任務成本約為其七分之一。在考察命令列科研流程的Terminal-Bench Science 0.1上,它每項任務平均花5.47美元,Claude Opus 5.5是23.21美元,Astra是23.80美元。

第三方Artificial Analysis的獨立測試給出相近的結論:智慧指數比GPT-6 Sol高4分,比GPT-6 Astra低1分;在知識準確度測試裡,幻覺率從60%降到54%。代價是話變多了,完成同樣任務要多用10%到30%的輸出token。快取讀取折扣從90%提高到95%,部分抵銷了這筆開銷。

並非所有項目都貼得這麼近。OpenAI自己列出的數據中,內部版ExploitBench上Sol是21.5%,Astra是31.5%;故障排除類的TroubleshootingBench上是47.96%對63.46%。需要長鏈條排障的場景,旗艦仍有明顯優勢。

使用門檻與幾項限制

GPT-6.1 Sol已在ChatGPT Work與Codex向Plus、Pro、Business、Enterprise、Edu用戶開放,免費版與Go用戶暫時用不到,一般聊天介面也還沒接入。開發者用gpt-6.1-sol呼叫,上下文視窗約105萬token,單次最多輸出12.8萬token。

有幾處細節需要留意:

  • 單次提示超過27.2萬token的部分,輸入按2倍、輸出按1.5倍計價;
  • 不支援none與minimal兩檔推理強度;
  • 走Chat Completions介面時無法呼叫工具,要換到Responses API。

第二點對做即時互動的團隊影響最大。原本靠關掉推理換取低延遲的呼叫方式,在6.1 Sol上行不通。

中國大陸開發者能從哪裡用到

OpenAI官方API從2024年7月起就不對中國大陸提供服務,這點沒有改變。這次首發名單裡的第三方管道更貼近中國大陸開發者的實際情況:OpenRouter、Vercel AI Gateway同步上架,GitHub Copilot的Pro+、Max、Business、Enterprise檔位也已可選。

對中國大陸團隊來說,更直接的參照是中國國產模型的價格帶。GLM-5.3先前公布的API價格是每百萬輸出token 4.4美元,不到GPT-6.1 Sol的一半。Sol這次把旗艦級程式設計能力壓到10美元一檔,中國國產模型在程式設計場景裡靠價格拉開的距離被收窄了一截,各家後續會不會跟著調價,還要再看。

另一個變數在OpenAI自己身上。它前一天才撤下原定10月發布的GPT-6.1 Astra,理由是安全性未達標,旗艦線的下一次更新時間還沒有定案。在此之前,6.1 Sol大概率是OpenAI面向開發者主推的那個型號。

參考來源:OpenAI官方發布頁面與DevDay回顧、Artificial Analysis獨立評測、CocoLoop、DataCamp與Vellum評測整理;API各檔單價、上下文長度與長提示計費倍數以OpenAI公布口徑為準。