TechSpace 鐵客空間

每日科技新聞新知、硬體開箱評測、賣場優惠!

SpaceXAI 發布 Grok 4.6:追平 GPT-5.6 Sol、直逼 Claude Fable 5,價格卻只要對手零頭

馬斯克旗下 SpaceXAI 推出新旗艦模型 Grok 4.6,在 Artificial Analysis Intelligence Index 拿下 61 分,追平 OpenAI GPT-5.6 Sol、僅落後 Claude Fable 5 一分,同時在多項代理型任務評測中表現亮眼。更關鍵的是,Grok 4.6 定價僅為 Claude Opus 5 與 GPT-5.6 Sol 的三分之一左右,性價比優勢明顯。
elon musks spacexai enters with grok 4 6

Grok 4.6 上線,效能正式擠進第一梯隊

曾經一度被外界視為「掉隊」的馬斯克 AI 事業,如今用實績打臉質疑聲浪。SpaceXAI 正式發表新一代旗艦模型 Grok 4.6,在第三方權威評測機構 Artificial Analysis 的 Intelligence Index 綜合指數中拿下 61 分,與 OpenAI 的 GPT-5.6 Sol Max 打成平手,僅落後 Anthropic Claude Fable 5 Max 的 62 分一分之差,更只落後其同門更高階的 Claude Opus 5(63 分)兩分。相較於前代 Grok 4.5 High 的 56 分,這次一口氣進步了 5 分,短短一個多月內的迭代速度相當驚人。

馬斯克本人也在社群平台上親自站台,形容 Grok 4.6「聰明、快速、高性價比」。Cursor 執行長 Michael Truell 則評論,新模型在困難任務與知識型工作上的表現明顯提升,兼具 Opus 等級的智慧、低成本與高速度。

代理型任務表現搶眼,效率甚至超車對手

Grok 4.6 這次的重點並非單純堆疊分數,而是鎖定「長時間自主執行任務」的代理型(agentic)能力。SpaceXAI 表示,新模型能在研究陌生主題、深入探勘程式碼庫,或是把一個粗略的產品構想一路做成可運作的軟體原型時,維持穩定的多步驟推理,並且在長任務中展現出更明顯的自我檢查與驗證行為,而不是單純跑完一輪就停手。

在具體評測數據上,Grok 4.6 於衡量真實知識型工作的 GDPVal-AA v2 拿下 1753 分的 Elo 分數,僅次於 Claude Opus 5,與 Claude Fable 5、Qwen3.8 Max 的信賴區間有所重疊;在 CursorBench v3.2 拿下 69.9%,略遜於 Claude Fable 5 Max 的 70.5%,但領先 GPT-5.6 Sol Max 的 67.2%;軟體工程評測 DeepSWE v1.1 則拿下 65.9%,較前代 Grok 4.5 的 54% 大幅躍進,但仍落後 GPT-5.6 Sol Max 的 73%。值得一提的是效率表現:Grok 4.6 平均只需約 53 個回合、消耗約 5 億個輸入 token 就能完成任務,相比之下 Claude Opus 5(max)平均要跑 103 個回合、耗費約 20 億個輸入 token,換算下來 Grok 4.6 在長任務中的資源效率明顯更高。

價格是最大賣點,續打 AI 模型價格戰

比起效能追平對手更受矚目的,是 Grok 4.6 的定價策略。新模型延續 Grok 4.5 的收費標準,維持在每百萬輸入 token 2 美元、每百萬輸出 token 6 美元,比起 Claude Opus 5 的 5 美元/25 美元,以及 GPT-5.6 Sol 的 5 美元/30 美元,便宜超過六成,讓 Grok 4.6 站上「智慧與成本」效益前緣的甜蜜點。

事實上,這波降價競賽早已在業界同步展開。就在 Grok 4.6 發表當天,中國 AI 新創 DeepSeek 也悄悄推出 V4-Pro-0813 正式版模型,把輸入與輸出價格壓到每百萬 token 0.435 美元與 0.87 美元,並支援百萬 token 的超長上下文;再往前幾天,OpenAI 才剛把 GPT-5.6 Luna 的輸入價格從每百萬 token 1 美元砍到 0.2 美元,輸出價格也降到 1.2 美元,等於掀起一波全產業的價格戰。在這樣的競爭氛圍下,SpaceXAI 選擇用「效能持平、價格更親民」的策略切入,而非一味比拚跑分。

背後靠山:SpaceX 算力擴張野心

Grok 4.6 能維持這樣的性價比,某種程度也仰賴 SpaceX 集團持續加碼的算力基礎建設。根據先前報導,SpaceX 預計在 2026 年底前上線約 2 GW(十億瓦)的運算容量,並瞄準在 2027 年底前將這個數字推向「接近 10 GW、而非 5 GW」的規模,同時搭配高達 20 GW 的電力與散熱負載規劃。

截至 2026 年 5 月,SpaceXAI 位於美國的 Colossus 1 資料中心已部署超過 22 萬顆 NVIDIA GPU,涵蓋 H100、H200 以及約 3 萬顆 GB200 加速器;而規模更大的 Colossus 2 資料中心目前則擁有超過 55 萬顆 GPU,同樣以 GB200 與 GB300 為主力。龐大的算力儲備,正是 SpaceXAI 得以用相對親民價格提供前緣模型效能的底氣所在。

不過,Grok 系列模型並非毫無包袱。外媒指出,Grok 品牌過去曾多次捲入安全性與治理爭議,包括產出帶有極端主義色彩、反猶太傾向的內容、政治立場明顯偏頗的回應,甚至被爆出利用圖像x生成功能產製未經當事人同意的性化影像等爭議事件。對於重視合規與品牌安全的企業客戶而言,這類過往紀錄恐怕仍是導入 Grok 4.6 前需要正視的考量因素,效能與價格優勢能否完全蓋過這些疑慮,還有待市場進一步觀察。

快速 Q&A 整理

Grok 4.6 是誰推出的?什麼時候發表?

Grok 4.6 由馬斯克旗下的 SpaceXAI(前身為 xAI)於 2026 年 8 月 12 日正式發表。

Grok 4.6 在 Artificial Analysis Intelligence Index 拿下多少分?

Grok 4.6 在該指數拿下 61 分,追平 OpenAI GPT-5.6 Sol Max,僅落後 Claude Fable 5 一分、落後 Claude Opus 5 兩分。

Grok 4.6 的 API 定價是多少?

每百萬輸入 token 2 美元、每百萬輸出 token 6 美元,與前代 Grok 4.5 相同,較 Claude Opus 5 與 GPT-5.6 Sol 便宜超過六成。

Grok 4.6 有哪些代理型任務評測表現亮眼?

在 GDPVal-AA v2 知識工作評測中排名第二,僅次於 Claude Opus 5,且平均任務回合數與 token 消耗量都遠低於 Claude Opus 5,展現高效率。

Grok 4.6 目前可以在哪些平台使用?

發表當天即已上線於 Cursor 程式編輯器、SpaceXAI 自家的 Grok Build 工具,以及官方 API。

參考網頁來源

延伸閱讀

歡迎加入我們的 Facebook 粉絲團,隨時掌握最新消息!
喜歡看圖說故事的話,也可以追蹤 Instagram 專頁!
我們也有 Threads 可以隨時 follow!

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *