學會 Grok Build 安裝設定、Plan Mode 工作流、並行 sub-agents 實戰技巧,並看懂 Grok Build vs Claude Code vs Codex CLI 核心差異與選型建議。
什麼是 Grok Build
Grok Build 是 xAI 於 2026 年 5 月推出的終端機 AI coding agent,預設以 Grok 4.5 為核心模型,直接對標 Anthropic 的 Claude Code 與 OpenAI 的 Codex CLI。不同於傳統程式碼補全外掛,Grok Build 採 Agent 思維 設計:在專案目錄啟動後,開發者以自然語言下達任務,agent 即自動執行 plan → search → build 循環。
核心特色
- Plan Mode 預設開啟:動手修改檔案前先產出完整執行計畫,開發者可審查、註解或拒絕,變更以 clean diff 呈現,未經核准不 commit。
- 最多 8 個並行 sub-agents:可同時探索多條假設,適合 debug、審計陌生 code base、架構分析。
- 互動 TUI、headless scripting、plugins、skills、hooks,並標榜與 Claude Code 相容。
- 大型 context 訴求:行銷常強調 2M token,但官方 CLI 文件(如 v0.1)列出約 256k;2M 多屬 Grok 4 / 4.1 fast 系列模型能力,實際可用 context 需以當下文件為準。
完整安裝教學
官方 CLI 入口:https://x.ai/cli。整體安裝通常可在數分鐘內完成。
系統需求
- 支援常見開發環境(Windows / macOS / Linux)
- 終端機(PowerShell、bash、zsh 等)
- 有效的 xAI / SuperGrok 相關帳號(完整 agent 能力通常綁定較高階方案)
Windows(PowerShell)
irm https://x.ai/cli/install.ps1 | iex
macOS / Linux
依官方 CLI 文件使用對應的 shell 安裝指令(常見為 curl 管線安裝腳本)。完成後確認二進位是否在 PATH:
which grok
# 或
grok --version
登入與驗證
- 執行 CLI 登入流程(依官方提示完成 browser / token 驗證)。
- 確認帳號已啟用 Grok Build 與 Grok 4.5 權限。
- 進入目標專案目錄再啟動,避免在無 repo 的目錄空轉。
驗證安裝成功
cd /path/to/your-project
grok
若進入互動 TUI 或可接受自然語言任務,即表示安裝與登入成功。
權限提醒:完整 Grok Build 能力在公開報導中多與 SuperGrok Heavy 等較高階訂閱相關;定價曾出現前六個月約 $99/月、之後約 $299–$300/月的說法,實際以 xAI 當下方案為準。
如何使用 Grok Build with Grok 4.5
基本工作流
- 進入專案根目錄(有 git repo 較佳)。
- 啟動 Grok Build(CLI / TUI)。
- 用自然語言下任務,例如:「找出登入 API 的 race condition 並寫回歸測試」「把這個 monorepo 的 auth 模組重構成可插拔 strategy」。
- 審查 Plan Mode 產出的計畫 → 批准或修改。
- 檢視 diff → 確認後再 commit / 合併。
建議使用場景
| 場景 | 為什麼適合 Grok Build |
|---|---|
| 大型 monorepo / 跨模組調查 | 長 context + 並行 sub-agents 有助多路徑探索 |
| Debug / 回歸分析 | 可同時驗證多個假設 |
| 需要「先計畫再動手」的團隊 | Plan Mode 預設開啟,控管較嚴格 |
| 高頻 boilerplate / 快速迭代 | 未必是最強項;速度向工具往往更適合 |
實務技巧
- 任務要具體:指定檔案範圍、驗收條件、不可動的路徑。
- 善用 Plan 審核:把 Plan 當 code review 的第一關,而不是直接放行。
- 注意 rate limit:大 context + 多 agent 會快速消耗 token;API / 訂閱方案有 per-model RPS 與 tokens-per-minute 限制,高負載時可能卡在等待重置。
- Headless / CI:需要自動化時改用 headless scripting,並把核准策略寫進 pipeline 政策。
- 與 Claude Code 生態銜接:若團隊已有 Claude Code 工作流,可評估其相容層是否降低遷移成本。
安全建議
- 不要在含 production secret 的目錄直接開啟全自動寫入。
- 用 git worktree / 分支隔離 agent 變更。
- 所有寫入以 diff review 為強制關卡(Plan Mode 有助於此,但仍需人工把關)。
開發者社群熱門討論話題(2026 年 5–7 月)
綜合 Reddit、Hacker News 與開發者評論,圍繞 Grok Build 的熱點大致如下:
- 「2M context」到底是不是真的在 Grok Build 裡 — 行銷數字與 CLI 文件(例如 256k)不一致,成為最大爭議點之一。
- Rate limit 是否讓大 context 名存實亡 — 多 agent + 長上下文吃 token 極快,實戰常撞上限。
- SWE-bench 等 benchmark 落後 — 相對 Claude Code / Codex CLI 曾被指出約 dual-digit 分差,社群關心「demo 很炫、production 能不能穩」。
- Plan Mode 是否成為新標準 — 被視為 Claude Code 用戶最想要、而 xAI 出廠就給的功能;討論焦點是「控管 vs 速度」。
- 定價門檻(SuperGrok Heavy 級) — 月費接近團隊預算線,solo dev 是否划算爭論激烈。
- 並行 sub-agents 的真實收益 — 調查型任務(audit、regression、陌生 code base)評價較正面;單純 CRUD / boilerplate 則未必贏速度型對手。
- 三強鼎立後的選型焦慮 — 「可靠性選 Claude、速度選 Codex、大型探索選 Grok」幾乎成為固定話術。
Grok Build vs Claude Code vs Codex CLI 深度對決
以下整理自 2026 年中英文評測與公開比較(數字與方案可能隨版本變動,請以各官方文件為準)。
| 維度 | Grok Build | Claude Code | Codex CLI |
|---|---|---|---|
| 開發商 | xAI | Anthropic | OpenAI |
| 預設/主力模型 | Grok 4.5 / 相關 Grok 4.x | Claude Opus 等 Claude 4.x 系列 | GPT-5.x 系列(如 GPT-5.5 報導) |
| 產品型態 | Terminal agent(TUI + headless) | Terminal agent,生態成熟 | Terminal agent,偏實用與速度 |
| 標誌功能 | Plan Mode 預設、最多約 8 並行 sub-agents、長 context 訴求 | 穩定性、repo 理解、CI/CD 與整合廣 | 高吞吐、內建 review agent、omnimodal(可吃截圖/mockup) |
| Context(社群焦點) | 行銷常提 2M;CLI 文件或列 ~256k,需核對實際模型 | 相對較小但工作流成熟 | CLI 形態 context 通常更保守 |
| Benchmark 印象(SWE-bench 等) | 曾落後雙位數百分點級差距 | 可靠度與複雜 issue 常居前段 | 與 Claude 同屬較強一梯,速度優勢明顯 |
| 速度 | 中等;強在並行探索 | 穩但通常慢於 Codex | 報導可達 240+ tok/s 量級,約 2.5× Claude |
| 定價門檻(公開報導) | SuperGrok Heavy 級:約 $99/月(促銷期)→ 之後約 $299–$300/月 | 多綁 Claude Pro / Team,用量與 Chat 共享窗口 | 多綁既有 OpenAI / ChatGPT 方案 |
| Rate limit 感受 | Token 消耗快,隱藏上限常被抱怨 | 5 小時/週用量窗,曾因撞牆而調高限額 | 有 usage dashboard / credits,相對透明 |
| 最適合 | 大 repo 調查、多假設 debug、要先審計畫的團隊 | Production agent、要穩與生態整合 | 高頻迭代、boilerplate、已在 OpenAI 生態的團隊 |
務實選型結論
- 要穩、要上 production / CI:優先 Claude Code。
- 要快、要大量小改、已付 OpenAI:Codex CLI。
- 要掃超大 code base、並行調查、強調人工核准計畫:Grok Build(Grok 4.5);但需接受定價、rate limit 與 benchmark 仍在追趕的現實。
三強同時存在的最大意義,是把 Plan Mode、更長 context、並行 sub-agents 推成 2026 coding agent 的標配壓力;後續 Anthropic / OpenAI 是否跟進,會比單一產品的首發功能更影響長期選型。
Grok Build API 呼叫費用與計費方式
Grok Build 有兩條主要付費路徑:訂閱制(CLI/產品內建) 與 API 按量計費(grok-build-0.1 等模型)。API 採 token 計價,並可再疊加工具呼叫費、長 context 加價與 Batch/Priority 等選項。
兩種計費路徑
| 路徑 | 適合誰 | 怎麼收費 |
|---|---|---|
| SuperGrok 訂閱 + Grok Build CLI | 日常在終端用 agent、不想管每 request 帳單 | 月費制;方案門檻曾下修至約 $30/月起(2026-05 起解鎖),高階方案另有更高價位 |
xAI API(grok-build-0.1) |
自架工具、CI、headless、第三方整合 | Pay-as-you-go:依 input/cached input/output token 計費,另計工具與加價項 |
訂閱與 API 不是同一張帳單邏輯:CLI 訂閱通常包在 SuperGrok 權益內;直接打 API 則走 console 用量與 API key 扣款。
API Token 單價(Grok Build 0.1)
| 項目 | 約略單價 |
|---|---|
| Input | $1.00 / 1M tokens |
| Cached input | $0.20 / 1M tokens |
| Output | $2.00 / 1M tokens |
官方模型頁說明:每次 API 呼叫依實際使用的 token 計費;使用 cached input 可明顯降低成本;模型可能部署在多個 cluster,區域價可能不同,完整表以 xAI 官方 Pricing 與 Grok Build 0.1 模型頁為準。
長 Context 加價
文件指出:請求 超過約 200K context window 時,會套用 不同費率(長上下文通常更貴)。大 repo、多檔塞進單一 request 時,帳單往往由這段加價主導,而不只是「基礎 $1/$2」。
工具(Tools)額外費用
Agent 若啟用平台工具,除了模型 token 外還會收 工具呼叫費:
- Web Search、X Search、Code Execution:各約 $5 / 1,000 次呼叫
Grok Build 工作流常自動 search/執行程式,工具費可能接近甚至超過 token 費,尤其並行 sub-agents 時呼叫次數會放大。
計費怎麼算(實務公式)
Cost ≈ (T_in/10^6 × P_in) + (T_cache/10^6 × P_cache) + (T_out/10^6 × P_out)
+ Σ(N_tool,i/1000 × P_tool,i) + long-context surcharge
其中 T 為 token 數、P 為對應單價、N_tool 為工具呼叫次數。
粗估範例(僅示意)
假設一次 coding agent 回合:
- Input 80K tokens(無 cache)→ 0.08 × $1 = $0.08
- Output 20K tokens → 0.02 × $2 = $0.04
- Code Execution 10 次 → 10/1000 × $5 = $0.05
小計約 $0.17(未含長 context 加價、重試、多 agent 重複讀檔)。八路並行、反覆讀整庫時,同一「任務」很容易變成數美元級。
與訂閱的損益(Break-even)思路
- 低~中用量、固定用官方 CLI:訂閱(例如約 $30/月起 的 SuperGrok 路徑)較單純,不必每 request 精算。
- 偶發、自動化、可嚴格控 token:API $1 / $2 per 1M 較靈活;若月 API 帳單穩定超過訂閱價,改訂閱通常較省。
- 對照其他 Grok 模型:例如報導中 Grok 4.1 Fast 曾見約 $0.20/M input 等級,比
grok-build-0.1便宜,但能力/agent 行為不同,不能直接當 Build 替代品比價。
實際 break-even 取決於:是否開 tools、是否常超 200K、並行 agent 數、以及 output 比例(output 單價通常是 input 的兩倍)。
計費方式與控成本要點
計費單位與機制
- 以 token 為主(input/cached/output 分價)
- 工具按次(或每千次)另計
- 超長 context 分級費率
- Console 用量上限/rate limit;超限需申請提高或等待重置
- 可能有 Batch 折扣、Priority 加價、重試重複計費 等平台規則
降低帳單的實務做法
- 優先讓可重用前綴走 prompt cache(cached input 約為 input 的 1/5)
- 限制 agent 讀檔範圍,避免整庫反覆塞進 context、觸發 200K+ 加價
- 關閉不必要的 Web/X Search/Code Execution,或設呼叫上限
- 並行 sub-agents 數與「探索寬度」設 cap,減少重複 input
- CI/headless 用較短 system prompt、結構化 diff,壓低 output tokens
- 在 xAI 官方 Pricing 核對 區域價 與當日表,第三方彙整可能落後
與「聊天版 Grok/Grok 4.5」的區隔
| 產品面 | 計費印象 |
|---|---|
| Grok 聊天/App(含 4.5) | 多綁免費額度或 SuperGrok 訂閱,不是逐 token 對使用者開帳單 |
| Grok Build CLI | 主要走 訂閱解鎖(方案與價位以 xAI 為準) |
API grok-build-0.1 |
嚴格按 token + 工具 計費 |
| 其他 Grok API 模型(如 4.3/4.5 聊天向) | 另有 input/output 表,與 Build 模型價目分開 |
開發時請在 request 明確指定 model id(例如 grok-build-0.1),避免誤打到較貴或較便宜的一般對話模型。
官方查價入口
- 總表:
https://docs.x.ai/developers/pricing - 模型頁(含 Build 分項與長 context 說明):
https://docs.x.ai/developers/models/grok-build-0.1
第三方計算器適合快速試算,但 合約與出帳以 xAI console 為準。
快速上手檢查清單
- 到 xAI CLI 確認系統對應的安裝指令
- Windows:
irm https://x.ai/cli/install.ps1 | iex - 登入並確認 Grok 4.5 + Grok Build 權限
- 在 git 專案根目錄啟動,先丟一個「只讀分析」任務練 Plan Mode
- 再進階到「可寫入但必須 diff 核准」的小 refactor
- 同步用同一任務在 Claude Code、Codex CLI 跑一輪,比較計畫品質、耗時與 diff 可讀性
若你的使用情境偏 solo 快速交付、團隊 CI agent,或 超大 monorepo 審計,三者的最佳解會完全不同;以上比較可直接當 2026 年中選型起點。
結語
Grok Build 以 Plan Mode 預設開啟、並行 sub-agents、長 context 訴求 三大特色切入 2026 年 coding agent 戰場。對於需要在大型代碼庫中進行多假設探索、重視變更前審查流程的團隊,Grok Build 提供了差異化價值。但在 benchmark 表現、rate limit 實際體驗、定價門檻 三方面仍有追趕空間。建議以「小範圍實測同一任務」方式,在自家代碼庫上三強同跑一輪,再依實際產出品質、成本、團隊習慣做最終選型。