Grok 4.5 走進終端

xAI 正式將 Grok 從聊天介面推進開發者工作流,發布終端編程代理 Grok Build,官方頁面標明由新模型 Grok 4.5 驅動,開放免費試用。Elon Musk 在 X 上示範上手流程:下載 Grok Build 後輸入 /tutorial 即可進入引導。安裝入口為 x.ai/cli,並提供完整文件與 changelog。

這一步的意義不在單一功能,而在定位轉變。xAI 成立以來的產品線——Grok 聊天、API、Enterprise——都是把模型當作消耗品販售:使用者付費調用、xAI 收費。Grok Build 改變了這個關係:它讓 Grok 4.5 直接住在開發者的終端裡,讀寫他們的程式碼、執行他們的指令、管理他們的 Git 操作。從「模型即服務」走向「代理即工具」,這是 OpenAI(Codex CLI)、Anthropic(Claude Code)與 Google(Jules)都已走過的路,xAI 現在正式跟進。

Skills、Plan、Subagents 三大主軸

Grok Build 把近期 AI 編程工具的主流能力一次打包。Skills 機制支援 AGENTS.md、plugins、hooks 與 MCP servers 開箱即用,可依任務自動觸發或以名稱呼叫,並能把任意工作階段透過 /skillify 收納為可重用技能——這意味著開發者可以把「每次都要手動做一次」的流程固化為代理可自動執行的技能,降低重複操作成本。

Plan mode 會在複雜任務中先提出結構化計畫,經開發者批准才動手修改,每筆變更以 diff 呈現。這與 Anthropic 在 Claude Code 系統提示詞精簡中提出的「漸進式揭露」原則異曲同工:不是把所有資訊一次倒給開發者,而是先給計畫、獲批准後才行動,讓人類在關鍵決策點保持控制。

Subagents 則把大型任務交給多個專精代理並行執行,各自擁有獨立 context window,並可於獨立 worktree 中運作,方便研究、實作、審查同時推進。此外內建 Q&A 機制,會針對模糊需求以多重選項釐清設計方向、框架或 schema。

Grok Build 以 Skills、Plan mode 與 Subagents 為三大功能支柱,並透過 MCP 串接外部工具。
圖2 Skills、Plan mode、Subagents 三大主軸加上 MCP 原生整合,共同撐起 Grok Build 的終端代理能力。

功能對齊度:與 Claude Code、Codex CLI 的逐項比對

Grok Build 的功能清單幾乎逐項對齊了當前三大終端編程代理:

能力Grok BuildClaude CodeCodex CLI
code search
多檔案編輯
Git 整合
Plan mode(先計畫後執行)
Subagents(並行獨立 worktree)
MCP 原生支援
Skills(/skillify 收納)✓(Skills + ToolSearch)
headless 模式
沙箱執行
Web 搜尋
背景任務
費用免費試用訂閱制(Claude Max/Pro)訂閱制(ChatGPT Plus/Pro)

功能對齊度高,但功能清單只是入場券。真正的差異化在模型本身的推理穩定度——Grok 4.5 在結構化輸出、大型 codebase 理解與 diff 品質上能否與 Claude Opus 5GPT-5.6 Sol 匹敵,目前沒有獨立第三方評測佐證,只有 xAI 自行公布的 benchmark 數字。

免費試用的策略意義

Grok Build 在推出初期免費開放,這不是慈善而是市場策略。終端編程代理的轉換成本極高——開發者一旦習慣了某個代理的 Skills 設定、Plan mode 工作流與 AGENTS.md 配置,就很難輕易切換。免費試用降低了嘗試門檻,目標是在開發者建立依賴之前先卡住位置。OpenAI 的 Codex CLI 和 Anthropic 的 Claude Code 都綁定各自的訂閱方案(ChatGPT Plus/Claude Max),xAI 用免費打破這個門檻。

Grok Build 以免費入口吸引用戶,但配置與工作流程累積後,可能提高轉換到 Claude Code 或 Codex CLI 的成本。
圖3 免費試用降低嘗試門檻,但終端代理的高轉換成本會在開發者建立依賴後鎖住選擇。

但免費能持續多久是關鍵問題。終端編程代理的 token 消耗遠高於聊天——一次大型重構可能消耗數十萬 token,若以 Grok 4.5 的 API 成本計算,每位活躍用戶的服務成本不低。xAI 未公布免費額度上限與後續計費方案,開發者在建立深度依賴前應留意這個不確定性。

對開發者的實際影響

Grok Build 代表 xAI 不再只把模型當作 API 或聊天產品販售,而是直接進入開發者日常的終端與版本庫。對團隊而言,多了一個免費可試、原生支援 MCP 與 worktree 的編程代理選項;同品牌若偏好在對話中直接生成並發布 App,則可比較全面開放到網頁與手機方案的 Grok Build,若評估範圍再擴到持久雲端工作環境,則可接著比較 Grok Bot 如何讓多個具名代理共用一台雲端電腦。但在實際採用前,仍須自行驗證 Grok 4.5 在自有 codebase 上的推理穩定度、diff 品質與 hook 安全性。若以 Claude Code 作為成本基準,還應把長會話的提示詞快取重建納入估算;claude-thermos 的快取保溫實測提供了可量測的另一條優化路線。模型表現與計費細節仍以 xAI 官方文件與 changelog 為準。