Grok 4.7不漲價,單次任務token卻翻倍

SpaceXAI於9月21日發布Grok 4.7,官方稱這是自家「在程式設計與知識工作上能力最強的模型」。API價格與速度和Grok 4.6持平:每百萬輸入token 2美元、輸出6美元,另外還有一款價格翻倍、輸出速度也翻倍的快速版本。模型已在Cursor、Grok Build、API主控台與第三方平台上線。

"our most capable model for coding and knowledge work."

官方對Grok 4.7的定位是程式設計與知識工作。

官方表示新模型換上比4.6更大的基礎模型,強化學習訓練時間拉長,重點鍛鍊的是持續數小時的長任務,更擅長自我校驗與處理長上下文,也和Grok Bot做了原生整合。

官方跑分與第三方評測

SpaceXAI自行公布的幾項數據:DeepSWE v1.1 71.0%,CursorBench 4.0 46.3%,Terminal-Bench 4.0 37.6%,電機工程類的EEBench 64.0%。安全性方面,官方稱拒答與越獄抵抗能力在業界領先,風險提示放行率在HackerBench v0.3上為3.3%;紅隊測試以邀請制開放給部分資安合作夥伴。

第三方評測機構Artificial Analysis給出的結果:綜合智慧指數46分,比4.6高2分;搭配Grok Build的程式設計智慧體指數56分,比4.6高9分。分項來看,DeepSWE v1.1從65%升到73%,Terminal-Bench 4.0從18%升到33%,SWE-Atlas-QnA從58%升到63%。依這份評測,Grok 4.7加Grok Build在程式設計智慧體排名第四,前面是Claude Fable 5.1、GPT-6 Astra與Claude Opus 5。長程知識工作基準AA-Briefcase上它拿到1657 Elo,比4.6高111分。

官方發布頁沒有給出與競品的橫向排名,SpaceXAI也沒有針對第三方評測裡的名次做出回應。

算一筆用量帳

價格表沒有變動,但Artificial Analysis記錄的token用量變了:Grok 4.7(xhigh檔)每個任務平均輸出約8萬1000個token,4.6同檔約3萬8000個,漲了125%。輸出速度約每秒188個token,平均一個任務跑7.1分鐘。

粗略估算,只看輸出成本,一個任務在4.6上約0.23美元,在4.7上約0.49美元。標價持平,但按任務計算的花費翻了一倍多,分數的提升有相當一部分是用「想得更久」換來的。

放到本週的價格表裡看,這筆帳更明顯。Grok 4.7發布隔天,Anthropic的Claude Opus 5.5與OpenAI的GPT-6 Sol相繼上線:Opus 5.5每百萬token輸入4美元、輸出20美元,GPT-6 Sol降到2美元與10美元。以每百萬token的標價來看,Grok 4.7的輸出單價仍是三者中最低;但按每個任務的實際花費來算,差距會縮小多少,得看另外兩家的token用量,這部分第三方數據目前還沒出齊。

Grok 4.7的46分成績出來不到兩天,Opus 5.5與GPT-6兩代新模型就已進入Artificial Analysis的評測佇列,排行榜的上半部還會再變動。

參考來源:SpaceXAI官方發布頁、CocoLoop、Artificial Analysis評測報告;API標價與官方跑分以SpaceXAI發布頁核實,智慧指數、程式設計智慧體指數與token用量以Artificial Analysis口徑核實,單任務輸出費用為依標價粗略估算。