SpaceXAI 發布 Grok 4.6:追平 GPT-5.6 Sol、直逼 Claude Fable 5,價格卻只要對手零頭

Grok 4.6 上線,效能正式擠進第一梯隊
曾經一度被外界視為「掉隊」的馬斯克 AI 事業,如今用實績打臉質疑聲浪。SpaceXAI 正式發表新一代旗艦模型 Grok 4.6,在第三方權威評測機構 Artificial Analysis 的 Intelligence Index 綜合指數中拿下 61 分,與 OpenAI 的 GPT-5.6 Sol Max 打成平手,僅落後 Anthropic Claude Fable 5 Max 的 62 分一分之差,更只落後其同門更高階的 Claude Opus 5(63 分)兩分。相較於前代 Grok 4.5 High 的 56 分,這次一口氣進步了 5 分,短短一個多月內的迭代速度相當驚人。
馬斯克本人也在社群平台上親自站台,形容 Grok 4.6「聰明、快速、高性價比」。Cursor 執行長 Michael Truell 則評論,新模型在困難任務與知識型工作上的表現明顯提升,兼具 Opus 等級的智慧、低成本與高速度。
代理型任務表現搶眼,效率甚至超車對手
Grok 4.6 這次的重點並非單純堆疊分數,而是鎖定「長時間自主執行任務」的代理型(agentic)能力。SpaceXAI 表示,新模型能在研究陌生主題、深入探勘程式碼庫,或是把一個粗略的產品構想一路做成可運作的軟體原型時,維持穩定的多步驟推理,並且在長任務中展現出更明顯的自我檢查與驗證行為,而不是單純跑完一輪就停手。
在具體評測數據上,Grok 4.6 於衡量真實知識型工作的 GDPVal-AA v2 拿下 1753 分的 Elo 分數,僅次於 Claude Opus 5,與 Claude Fable 5、Qwen3.8 Max 的信賴區間有所重疊;在 CursorBench v3.2 拿下 69.9%,略遜於 Claude Fable 5 Max 的 70.5%,但領先 GPT-5.6 Sol Max 的 67.2%;軟體工程評測 DeepSWE v1.1 則拿下 65.9%,較前代 Grok 4.5 的 54% 大幅躍進,但仍落後 GPT-5.6 Sol Max 的 73%。值得一提的是效率表現:Grok 4.6 平均只需約 53 個回合、消耗約 5 億個輸入 token 就能完成任務,相比之下 Claude Opus 5(max)平均要跑 103 個回合、耗費約 20 億個輸入 token,換算下來 Grok 4.6 在長任務中的資源效率明顯更高。
價格是最大賣點,續打 AI 模型價格戰
比起效能追平對手更受矚目的,是 Grok 4.6 的定價策略。新模型延續 Grok 4.5 的收費標準,維持在每百萬輸入 token 2 美元、每百萬輸出 token 6 美元,比起 Claude Opus 5 的 5 美元/25 美元,以及 GPT-5.6 Sol 的 5 美元/30 美元,便宜超過六成,讓 Grok 4.6 站上「智慧與成本」效益前緣的甜蜜點。
事實上,這波降價競賽早已在業界同步展開。就在 Grok 4.6 發表當天,中國 AI 新創 DeepSeek 也悄悄推出 V4-Pro-0813 正式版模型,把輸入與輸出價格壓到每百萬 token 0.435 美元與 0.87 美元,並支援百萬 token 的超長上下文;再往前幾天,OpenAI 才剛把 GPT-5.6 Luna 的輸入價格從每百萬 token 1 美元砍到 0.2 美元,輸出價格也降到 1.2 美元,等於掀起一波全產業的價格戰。在這樣的競爭氛圍下,SpaceXAI 選擇用「效能持平、價格更親民」的策略切入,而非一味比拚跑分。
背後靠山:SpaceX 算力擴張野心
Grok 4.6 能維持這樣的性價比,某種程度也仰賴 SpaceX 集團持續加碼的算力基礎建設。根據先前報導,SpaceX 預計在 2026 年底前上線約 2 GW(十億瓦)的運算容量,並瞄準在 2027 年底前將這個數字推向「接近 10 GW、而非 5 GW」的規模,同時搭配高達 20 GW 的電力與散熱負載規劃。
截至 2026 年 5 月,SpaceXAI 位於美國的 Colossus 1 資料中心已部署超過 22 萬顆 NVIDIA GPU,涵蓋 H100、H200 以及約 3 萬顆 GB200 加速器;而規模更大的 Colossus 2 資料中心目前則擁有超過 55 萬顆 GPU,同樣以 GB200 與 GB300 為主力。龐大的算力儲備,正是 SpaceXAI 得以用相對親民價格提供前緣模型效能的底氣所在。
不過,Grok 系列模型並非毫無包袱。外媒指出,Grok 品牌過去曾多次捲入安全性與治理爭議,包括產出帶有極端主義色彩、反猶太傾向的內容、政治立場明顯偏頗的回應,甚至被爆出利用圖像x生成功能產製未經當事人同意的性化影像等爭議事件。對於重視合規與品牌安全的企業客戶而言,這類過往紀錄恐怕仍是導入 Grok 4.6 前需要正視的考量因素,效能與價格優勢能否完全蓋過這些疑慮,還有待市場進一步觀察。
Grok 4.6 是誰推出的?什麼時候發表?
Grok 4.6 由馬斯克旗下的 SpaceXAI(前身為 xAI)於 2026 年 8 月 12 日正式發表。
Grok 4.6 在 Artificial Analysis Intelligence Index 拿下多少分?
Grok 4.6 在該指數拿下 61 分,追平 OpenAI GPT-5.6 Sol Max,僅落後 Claude Fable 5 一分、落後 Claude Opus 5 兩分。
Grok 4.6 的 API 定價是多少?
每百萬輸入 token 2 美元、每百萬輸出 token 6 美元,與前代 Grok 4.5 相同,較 Claude Opus 5 與 GPT-5.6 Sol 便宜超過六成。
Grok 4.6 有哪些代理型任務評測表現亮眼?
在 GDPVal-AA v2 知識工作評測中排名第二,僅次於 Claude Opus 5,且平均任務回合數與 token 消耗量都遠低於 Claude Opus 5,展現高效率。
Grok 4.6 目前可以在哪些平台使用?
發表當天即已上線於 Cursor 程式編輯器、SpaceXAI 自家的 Grok Build 工具,以及官方 API。
參考網頁來源
- Artificial Analysis〈Grok 4.6 returns SpaceXAI to the intelligence frontier and leads on cost efficiency〉
- VentureBeat〈SpaceXAI debuts Grok 4.6, overtaking Kimi K3’s performance and matching GPT-5.6 Sol〉
- The Decoder〈SpaceXAI’s Grok 4.6 matches OpenAI’s best model and undercuts it on price〉
- Unite.AI〈SpaceXAI Launches Grok 4.6 for Long-Running Agents〉
- xAI 官方公告〈Introducing Grok 4.6〉
- Unite.AI〈DeepSeek Ships V4 Pro as Its Flagship Model Leaves Preview〉
延伸閱讀

TechSpace 鐵客空間網站編輯,圈內打滾多年,要說是貓奴、狗奴才也是,喜歡科技新品、看開箱,但也喜歡打遊戲的宅宅
歡迎加入我們的 Facebook 粉絲團,隨時掌握最新消息!
喜歡看圖說故事的話,也可以追蹤 Instagram 專頁!
我們也有 Threads 可以隨時 follow!
