請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

SpaceXAI發布Grok 4.7!號稱「快一倍、半價」,實測為何跌破眼鏡?

數位時代

更新於 09月22日06:48 • 發布於 09月22日06:45 • 李先泰

SpaceX旗下AI部門SpaceXAI(原xAI)在美國時間9月21日發表Grok 4.7,定位為自家最強的寫程式與知識工作模型,公告副標寫著「比同級模型快一倍、價格只要一半」,API標價維持前代Grok 4.6的水準,每百萬token輸入2美元(約新台幣63元)、輸出6美元(約新台幣190元)。

不過獨立評測機構Artificial Analysis的實測(截至9月22日)顯示,Grok 4.7在同價位的202款模型中,智慧指數排第16、輸出速度卻排第152,評測時的輸出token用量也是同級中位數的兩倍以上。

項成績都高於前代,橫向只有兩項居首

SpaceX今年2月收購xAI,7月將品牌併入SpaceXAI,Grok產品名沿用。SpaceXAI表示,Grok 4.7換上更大的底層模型,強化學習訓練拉長並加重需要多小時完成的任務,因此更會檢查自己的產出、更能處理長篇上下文,也原生理解自家代理產品Grok Bot的執行框架(harness,即代理程式接任務、呼叫工具的那一層)。

公告成績表把Grok 4.7與Grok 4.6、OpenAI的GPT-5.6 Sol、Anthropic的Fable 5.1並列,競品數字皆為SpaceXAI所列,且四款的推理強度(模型思考多深、多久的檔位)設定不同:Grok 4.7為xHigh、Grok 4.6為High,GPT-5.6 Sol與Fable 5.1為Max。

官方表列的七項測試分數都高於前代:CursorBench 4.0(長時程寫程式任務)從40.4%升到46.3%,Terminal-Bench 4.0(多小時終端機操作)從20.3%升到38.0%,EEBench(電機工程)從53.0%升到64.0%。

橫向比較就沒那麼好看。七項測試只有兩項居首:EEBench的64.0%高於Fable 5.1的56.4%,Harvey Legal Agent Benchmark(法律代理工作)19.6%遠高於Fable 5.1的6.7%與GPT-5.6 Sol的2.5%。

其餘五項中四項落後Fable 5.1:CursorBench 4.0上Grok 4.7的46.3%對Fable 5.1的51.8%,Terminal-Bench 4.0更是38.0%對57.9%,AA Briefcase v1.1(多小時辦公知識工作)與HealthBench Professional(臨床推理)也都居後;DeepSWE v1.1(軟體工程解題)71.0%則低於GPT-5.6 Sol的72.7%,而且該項是Grok 4.7改採High設定的分數。

「快一倍、半價」怎麼算?

先看價格。成績表列出的競品標價,GPT-5.6 Sol每百萬token輸入4美元、輸出20美元,Fable 5.1為10美元與50美元;Grok 4.7的輸入價是GPT-5.6 Sol的一半、輸出價只有三成,「半價」在表列的一般API單價上站得住。不過這是對競品的比較,對前代Grok 4.6並沒有降價;單價砍半也不代表每項任務都省一半,這要看評測成本。

再看速度。公告副標的「比同級模型快一倍」沒有交代比較對象與測試條件,同一份公告又寫Grok 4.7「與Grok 4.6同價同速」;另外提供的「快速版」輸出速度是標準版兩倍、價格也兩倍,這是另一項宣稱,與副標的「快一倍」不能混為一談。

Artificial Analysis實測,Grok 4.7(xhigh)每秒輸出38.8個token,只有同價位帶推理模型中位數70.7的一半多,在同價位比較群組的202款模型(含推理與非推理模型)中排第154。

最後看評測成本。Artificial Analysis跑完整套智慧指數評測,Grok 4.7共產出2.4億個token(含推理過程與回答),是同價位帶推理模型中位數9,400萬的兩倍以上,該機構以「非常囉唆」形容。

安全防護與哪裡能用

SpaceXAI表示Grok 4.7採用全新的安全防護機制,是自家測過拒答與抗越獄能力最強的模型:在自家設計的HackerBench v0.3(高風險與惡意網路攻擊任務)上,只有3.3%的高風險雙重用途提示被放行,同時很少誤擋正當的資安工作;在第三方LatchBio的生物安全基準上以62.4%居首。

Grok 4.7自9月21日起可在AI程式編輯器Cursor與SpaceXAI自家的Grok Build使用,後者提供免費試用;也透過Grok API、第三方程式開發工具、模型路由與雲端平台提供。快速版也已提供,輸出速度與價格都是標準版的兩倍。

延伸閱讀:不能生成文字卻暴紅!ChatGPT技術推手打造AI決策模型Jev,為何讓開發者搶到當機?

資料來源:SpaceXAI官方公告、Artificial Analysis Grok 4.7評測頁、Artificial Analysis評測方法、《Business Insider》、OpenAI定價、Anthropic定價、Yahoo奇摩股市匯率

本文初稿為AI編撰,整理.編輯/ 李先泰

「加入《數位時代》LINE好友,科技新聞不漏接」

查看原始文章

更多理財相關文章

01

新店央北百億建案深夜火警 建商「突發重訊」曝真相

三立新聞網
02

維格餅家喊撤興櫃!股價腰斬再暴衝73% 網傻:迴光返照

EBC 東森新聞
03

台積電傳攜手Terafab赴德州蓋晶圓廠 馬斯克親回應:有在討論

鏡報
04

黃仁勳愛女黃敏珊驚傳新婚 三星會長李在鎔紐約晚宴親揭:2天前才嫁人

CTWANT
05

勞保45800最高級距保24年!男子「54歲驟逝」家屬竟一毛都領不到 關鍵2原因曝

鏡報
06

4大利多扛台股!專家斷言5萬大關時間點 加碼這檔「週一必漲」

TVBS
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...