日付と account を伴う catalog から始める
2026-08-10 に取得した Grok Build 1.0.0 の authenticated grok.com runtime では、grok models は grok-4.5 だけを返し default と表示しました。取得時の model metadata は low、medium、high reasoning effort をサポートし、default high です。
これは release/account snapshot であり、全 account や将来版の保証ではありません。Automation/evaluation の直前に grok --version と grok models を実行します。Live result が異なる場合は account catalog を優先し、記憶上の model ID/effort を作りません。
grok --version
grok models Continuity first で route する
現在の Grok session/repository に decisions、tool results、uncommitted state があるなら維持します。別 CLI の具体的 native workflow、明示された independent review、または現在の session で満たせない boundary がある時だけ切り替えます。
Captured catalog では mechanical inventory/formatting に low、default を意図的に変更する bounded ordinary work に medium、ambiguous architecture、hard debugging、security-sensitive review、または model default の維持に high を使います。Effort を上げても subagent は生成されません。
- Continuity first: switch 前に context-transfer と verification cost を計上。
- Effort != delegation: --agents/subagents は別設定。single-agent は --no-subagents。
- Permission invariant: model/effort 選択は sandbox、tools、approval、credentials を決して昇格しない。
One-shot で authority を広げない
リリース済み -p/--single は single-turn prompt で、response を stdout に出して終了します。Model preset、permission flag、delegation mode ではありません。
Read-only analysis は read-only sandbox と plan permission mode を共に指定します。許可済み implementation は workspace sandbox と通常の default permission decisions を維持します。High effort は --always-approve や bypass の根拠になりません。
grok --model grok-4.5 --reasoning-effort low --sandbox read-only --permission-mode plan -p "Inspect the repository and report evidence only."
grok --model grok-4.5 --reasoning-effort high --sandbox workspace --permission-mode default -p "Implement the scoped change, run affected tests, and report the diff." Knowledge MCP で catalog evidence を先に得る
AI Worlds Knowledge MCP を接続したら、plan の前に worlds_list_cli_models を grok-build 向けに呼びます。Capture date、supported efforts、availability warning、selectors、sources を読み、実 account の grok models と比較します。
worlds_plan_cli_work には active CLI と実際に available な CLIs だけを渡します。Workstream は read-only が既定で、許可済み implementation だけ execution_intent may-edit を使います。出力は advisory です。Assignments、dependencies、model fallback、permission boundary、verification gate を確認します。Tool は Grok を起動せず、permission を与えず、live entitlement を証明しません。
worlds_list_cli_models
{"products":["grok-build"]}
worlds_plan_cli_work
{"task":"Inventory the repository, implement the bounded fix, and verify it","current_cli":"grok-build","available_clis":["grok-build"],"workstreams":[{"id":"implementation","goal":"Implement the bounded fix and run affected tests","execution_intent":"may-edit"}],"strategy":"continuity-first","risk_tolerance":"low","execution_environment":"local-workspace","require_independent_review":false} Catalog/capability drift は fail closed
Explicit selector が live catalog にない時は launch 前に停止します。grok models が返した ID を使うか、--model を省略して live default を維持します。Effort support を確認できない時は override を省略し、推測しません。
Write 後は repository tests と diff を検証します。Model response の成功は task pass の証明ではなく、model change が project policy を書き換えたり credential を露出させたりしてはいけません。
- Malformed/empty model output は uncertainty であり stale ID の許可ではない。
- Model、effort、delegation、permission evidence を別々の plan field にする。
- CLI update、account change、policy change 後に catalog を再確認。
Durable configuration は最小 scope に置く
models.default と models.default_reasoning_effort は new sessions、--model と --reasoning-effort/--effort は current launch、/model と /effort は TUI controls です。Team が shared default を検証するまでは one-run choice を使います。
Custom model は model.<id>.env_key で環境変数名を指定し、api_key や extra_headers の literal credential を避けます。Logs、debug files、environment、child processes の access も制限します。