SpaceX旗下AI部門SpaceXAI(原xAI)在美國時間9月21日發表Grok 4.7,定位為自家最強的寫程式與知識工作模型,公告副標寫著「比同級模型快一倍、價格只要一半」,API標價維持前代Grok 4.6的水準,每百萬token輸入2美元(約新台幣63元)、輸出6美元(約新台幣190元)。
不過獨立評測機構Artificial Analysis的實測(截至9月22日)顯示,Grok 4.7在同價位的202款模型中,智慧指數排第16、輸出速度卻排第152,評測時的輸出token用量也是同級中位數的兩倍以上。
項成績都高於前代,橫向只有兩項居首
SpaceX今年2月收購xAI,7月將品牌併入SpaceXAI,Grok產品名沿用。SpaceXAI表示,Grok 4.7換上更大的底層模型,強化學習訓練拉長並加重需要多小時完成的任務,因此更會檢查自己的產出、更能處理長篇上下文,也原生理解自家代理產品Grok Bot的執行框架(harness,即代理程式接任務、呼叫工具的那一層)。
公告成績表把Grok 4.7與Grok 4.6、OpenAI的GPT-5.6 Sol、Anthropic的Fable 5.1並列,競品數字皆為SpaceXAI所列,且四款的推理強度(模型思考多深、多久的檔位)設定不同:Grok 4.7為xHigh、Grok 4.6為High,GPT-5.6 Sol與Fable 5.1為Max。
官方表列的七項測試分數都高於前代:CursorBench 4.0(長時程寫程式任務)從40.4%升到46.3%,Terminal-Bench 4.0(多小時終端機操作)從20.3%升到38.0%,EEBench(電機工程)從53.0%升到64.0%。
橫向比較就沒那麼好看。七項測試只有兩項居首:EEBench的64.0%高於Fable 5.1的56.4%,Harvey Legal Agent Benchmark(法律代理工作)19.6%遠高於Fable 5.1的6.7%與GPT-5.6 Sol的2.5%。
其餘五項中四項落後Fable 5.1:CursorBench 4.0上Grok 4.7的46.3%對Fable 5.1的51.8%,Terminal-Bench 4.0更是38.0%對57.9%,AA Briefcase v1.1(多小時辦公知識工作)與HealthBench Professional(臨床推理)也都居後;DeepSWE v1.1(軟體工程解題)71.0%則低於GPT-5.6 Sol的72.7%,而且該項是Grok 4.7改採High設定的分數。
「快一倍、半價」怎麼算?
先看價格。成績表列出的競品標價,GPT-5.6 Sol每百萬token輸入4美元、輸出20美元,Fable 5.1為10美元與50美元;Grok 4.7的輸入價是GPT-5.6 Sol的一半、輸出價只有三成,「半價」在表列的一般API單價上站得住。不過這是對競品的比較,對前代Grok 4.6並沒有降價;單價砍半也不代表每項任務都省一半,這要看評測成本。
再看速度。公告副標的「比同級模型快一倍」沒有交代比較對象與測試條件,同一份公告又寫Grok 4.7「與Grok 4.6同價同速」;另外提供的「快速版」輸出速度是標準版兩倍、價格也兩倍,這是另一項宣稱,與副標的「快一倍」不能混為一談。
Artificial Analysis實測,Grok 4.7(xhigh)每秒輸出38.8個token,只有同價位帶推理模型中位數70.7的一半多,在同價位比較群組的202款模型(含推理與非推理模型)中排第154。
最後看評測成本。Artificial Analysis跑完整套智慧指數評測,Grok 4.7共產出2.4億個token(含推理過程與回答),是同價位帶推理模型中位數9,400萬的兩倍以上,該機構以「非常囉唆」形容。
安全防護與哪裡能用
SpaceXAI表示Grok 4.7採用全新的安全防護機制,是自家測過拒答與抗越獄能力最強的模型:在自家設計的HackerBench v0.3(高風險與惡意網路攻擊任務)上,只有3.3%的高風險雙重用途提示被放行,同時很少誤擋正當的資安工作;在第三方LatchBio的生物安全基準上以62.4%居首。
Grok 4.7自9月21日起可在AI程式編輯器Cursor與SpaceXAI自家的Grok Build使用,後者提供免費試用;也透過Grok API、第三方程式開發工具、模型路由與雲端平台提供。快速版也已提供,輸出速度與價格都是標準版的兩倍。
資料來源:SpaceXAI官方公告、Artificial Analysis Grok 4.7評測頁、Artificial Analysis評測方法、《Business Insider》、OpenAI定價、Anthropic定價、Yahoo奇摩股市匯率
本文初稿為AI編撰,整理.編輯/ 李先泰
