推出 Grok 4.6
今天,我們與 SpaceXAI 共同推出 Grok 4.6。
Grok 4.6 建基於 Grok 4.5,特別著重於長時間運行的 Agent,以及更具企圖心的互動與視覺工作。無論是研究主題、分析資訊、處理整個程式碼庫,或是將構想轉化為精緻的應用程式或工作產物,它都能持續完成橫跨多個步驟的複雜任務。
Grok 4.6 在多項代理式程式設計與知識工作基準測試中展現尖端智慧。它在 Artificial Analysis Intelligence Index 上與 GPT-5.6 Sol 持平,該指數是由九項基準測試組成的綜合分數。

Grok 4.6 今日起可在 Cursor 和 Grok Build 中使用。第一週我們在 Cursor 和 Grok Build 中提供 2 倍包含用量。
訓練 Grok 4.6
相較於 Grok 4.5,Grok 4.6 進行了更長時間的補充訓練,採用針對推理與進階技術概念精選的模型產生資料、高品質工程資料,以及改進的最佳化器與訓練方法。這為後續的 SFT 與 RL 階段奠定了更穩固的基礎。
接著,我們使用 Grok 4.5,針對不同的推理強度、Agent 工具鏈,以及 STEM、軟體工程和知識工作等領域,重新產生 SFT 軌跡。我們透過模型檢查篩除有問題的追蹤資料。最終的 SFT 檢查點展現出優異效能與更佳行為表現。
Grok 4.6 以廣泛的代理式 RL 任務進行訓練,包括知識工作、一般程式設計,以及核心最佳化、Web 開發、電腦輔助設計等特定領域的環境。
將宏大構想轉化為可運作的專案
我們在多個旨在考驗 Grok 4.6 能力範圍及其長時間多步驟持續作業能力的專案中進行測試。我們發現,這個模型特別擅長將寬泛的產品構想轉化為可運作的初版。它能研究陌生領域、規劃應用程式架構、實作核心互動,並透過數輪意見回饋持續完善成果。
在較長的軌跡中,我們也開始看到更多自主測試與驗證:模型會在繼續前檢查自己的工作。
相較於我們通常在 Grok 4.5 中看到的表現,Grok 4.6 在視覺與互動式專案上能產出更強的初步成果。只要提供具體的產品構想,它就能一次建立應用程式的架構與視覺語言。這使它特別適合那些最快獲得良好成果的方式,是先從具實質內容的版本開始,然後在迴圈中反覆迭代的專案。
安全性與能力
Grok 4.6 的安全防護機制已隨模型能力提升而改進與校準。
我們的安全堆疊旨在針對合法使用情境,兼顧實用性與安全性,讓 Grok 4.6 能在漏洞修補、加速工程設計週期及輔助 AI 研究等領域發揮效用,同時維持安全。
我們的安全防護評估反映了 Grok 4.6 擴展的能力,涵蓋迄今最全面的部署前能力測試與安全防護校準,以及廣泛的部署後第三方測試。
開始使用 Grok 4.6
Grok 4.6 現已在 Cursor 和 Grok Build 中推出,也可透過 SpaceXAI API,以及包括 OpenRouter、Vercel 和 Cloudflare 在內的合作夥伴使用。
定價自每百萬輸入 token 6 起。快速變體的價格為兩倍。
首週我們在 Cursor 和 Grok Build 中提供 2 倍用量。