OpenAI開放Ultrafast 定價達標準6倍

Ultrafast推理層級結束了邀請制預覽。OpenAI在10月8日於Responses API中,為GPT-6.1 Sol正式開放這個服務層級,並第一次在定價頁面上標出價格。呼叫時模型名稱仍填gpt-6.1-sol,只要把service_tier設成"ultrafast"即可。模型本身沒有改變,縮短的是輸出token之間的間隔。

這個層級對所有API用戶開放,受速率限制,支援全球處理,也支援美國與歐盟的資料落地需求。Codex與ChatGPT Work同步上線,但僅提供給Pro 500、符合條件的企業按用量計費方案,以及按點數計費的教育方案;企業版則需要管理員手動開啟。

五個層級怎麼收費

依OpenAI定價頁面,272K輸入token以內算是短上下文,各層級價格如下(美元/百萬token):

層級輸入快取輸入快取寫入輸出
Batch / Flex10.051.255
Standard20.102.5010
Fast40.20520
Ultrafast120.601560

超過272K的長上下文,Ultrafast會漲到輸入24美元、輸出90美元。所有單價都是標準層級的6倍,快取相關的兩項也一樣。

到底快多少

OpenAI的文件只給出相對倍數,沒有寫絕對速度。OpenAI開發者帳號對外的說法是「最高約8倍」;多家媒體引述的更細分數字則是,Codex裡最高約8倍,API裡最高約6倍。VentureBeat報導的速度約為每秒300個token,這個數字並未出現在官方文件裡,應以倍數說法為準。

Ultrafast有獨立的速率限額:Build層級每分鐘100萬token,Launch層級400萬,Grow層級4000萬,不會占用Standard與Fast層級的額度。

OpenAI列出的適用情境是這樣寫的:

"Built for work where speed and intelligence make a difference: debugging an outage, agents navigating apps, and live experiences where every second counts."

(為速度與智慧都重要的工作打造:排查故障、在應用程式中操作的代理程式,以及分秒必爭的即時體驗。)

算一筆帳

假設一次代理任務讀入20萬token、輸出2萬token,不計快取。粗估下來,Standard層級約0.6美元,Fast層級約1.2美元,Ultrafast層級約3.6美元。

若以API情境最高6倍的速度估算,原本6分鐘的任務能壓縮到約1分鐘左右,省下5分鐘、多付約3美元,相當於每少等1分鐘要多花約0.6美元。這是最理想的狀況;實際提速若達不到上限,每分鐘的價錢會更高。

對排查線上事故的工程師來說,這點錢幾乎不用考慮;批量跑離線任務的團隊,則會繼續用Batch與Flex,這兩個層級的價格只有Standard的一半。

這個層級之前也經歷過一段預覽期。8月13日,Ultrafast以有限預覽亮相,當時只掛在GPT-5.6 Sol上,OpenAI當時的說法是每秒最高750個token、比標準處理快最多14倍,運算能力來自Cerebras的晶圓級晶片。到了GPT-6.1 Sol正式開放,官方倍數變成最高6到8倍,這次公告沒有提到底層硬體。

Ultrafast的呼叫量與付費用戶占比,OpenAI目前還沒有公布。它會不會延伸到Astra等其他模型,文件裡也沒有提到。

參考來源:OpenAI開發者更新日誌、CocoLoop、OpenAI API定價頁面(各層級短上下文與長上下文單價)、VentureBeat、Runtime Wire;Runtime Wire核對了速率限額與開放範圍。