馬斯克(Elon Musk)旗下 SpaceXAI 於 9 月 21 日宣布推出其迄今為止最強大的編碼與知識工作模型「Grok 4.7」。該模型專為處理耗時數小時的高難度任務而生,在基準測試中表現直逼 GPT-5.6,並導入了抵禦惡意提示的最強安全架構;同時,Grok 4.7 維持了與前代相同的親民定價,展現出極致的市場競爭力。
(前情提要:AI 教學》GrokBot 如何從零設定完整的 agent 團隊)
(背景補充:SpaceXAI 要改訂閱亂象:Grok、Cursor 幾週內將統一方案)
人工智慧領域的軍備競賽持續升溫。台北時間 9 月 21 日,SpaceXAI 官方正式發布了全新的「Grok 4.7」大型語言模型。官方將其定位為 SpaceXAI 旗下目前最強大的「編碼與知識工作模型」,旨在為開發者與專業人士提供更深入、更持久的運算支援。
專攻長時間任務,自帶強大除錯與驗證能力
相較於前代,Grok 4.7 採用了更龐大的基礎模型進行建構,並針對高難度任務混合進行了更長週期的強化學習(RL)訓練。特別的是,SpaceXAI 這次將重點放在「需要耗費數小時才能完成」的複雜問題上,使模型在長時間運作下,能更仔細地自我驗證與檢查工作成果,同時在管理極長上下文(Context)方面的表現也有顯著進步。
此外,Grok 4.7 如今能原生理解 Grok Bot 框架,這讓它在對話任務、一般知識處理,甚至是建立專業文件與簡報的任務上,展現出肉眼可見的升級。
基準測試亮眼,性價比輾壓競爭對手
在 SpaceXAI 公布的基準測試中,Grok 4.7(xhigh 版本)展現了足以挑戰前沿模型的實力。在軟體工程的 DeepSWE v1.1 測試中,Grok 4.7 取得了 71.0% 的優異成績,超越了 Fable 5.1 max(70.0%),並緊追 GPT-5.6 Sol max(72.7%);在多小時終端工作 Terminal-Bench 4.0 中,也從前代的 20.3% 大幅躍升至 38.0%。
值得注意的是,在模擬律師、護理師與財務分析師等多小時專業工作的基準測試(如 AA Briefcase 與 HealthBench)上,Grok 4.7 的表現已完全與業界頂尖模型並駕齊驅。更具殺傷力的是其定價策略:Grok 4.7 維持了每百萬輸入 Token 僅 2 美元、每百萬輸出 6 美元的收費,價格僅約為競爭對手的一半至三分之一,且在運算速度上更具優勢。SpaceXAI 同時也提供輸出速度加倍的「快速變體」版本供企業選擇。
導入全新安全架構,防禦網路駭客攻擊
除了效能升級,安全性也是本次 Grok 4.7 的一大亮點。SpaceXAI 強調,新模型採用了全新的安全堆疊打造,是該公司迄今測試過在「拒絕不當請求」與「抵抗越獄(Jailbreak)」方面最強悍的版本。
在面對網路安全與生物技術等雙重用途(Dual-use)領域時,Grok 4.7 能精準拿捏實用性與安全性。在針對惡意網路任務的 HackerBench v0.3 測試中,模型僅允許 3.3% 的高風險提示詞通過,且極少誤擋合法的安全防禦工作。為進一步強化防護,xAI 已開放特定網路安全合作夥伴,透過邀請制存取 Grok 4.7 的紅隊(Red-team)測試能力,共同投入防禦研究。
目前,開發者與企業用戶已可透過 Cursor、Grok Build、Grok API、各大雲端平台及模型路由器(Model Router)正式體驗 Grok 4.7 的強大功能。

📍相關報導📍
Grok Bot 初體驗:一個「有雲端電腦的 AI 代理」如何接手我的日常雜活
xAI 正式發布 Grok 4.6:跑分追平 GPT-5.6,超強寫碼能力登陸 Cursor
馬斯克 Grok Bot 公測上線:24 小時不停工的 AI 同事,值得從 Claude、Codex 跳槽嗎?
馬斯克旗下 SpaceXAI 正式推出最強模型「Grok 4.5」!攜手 Cursor 猛攻 AI 編碼代理,完美整合 Office 辦公軟體
