TL;DR
Grok Build 0.1 は、通常のチャットボット会話ではなくエージェント型ソフトウェアエンジニアリング向けの、xAI のコーディング特化モデルです。2026年5月29日にパブリックベータとして xAI API にリリースされ、Web 開発、デバッグ、ツール呼び出し、MCP ワークフロー、自律型コーディングエージェントに注力しています。
このモデルは256,000 トークンのコンテキストウィンドウを提供し、テキストと画像を入力として受け付け、推論、構造化出力、関数呼び出しをサポートします。標準料金は入力 100 万トークンあたり $1、出力 100 万トークンあたり $2 です。最も強みが発揮されるのは単発のコード補完ではなく、エージェントがリポジトリを点検し、ファイルを編集し、ツールを呼び出し、テストを実行し、検証された結果に向けて反復するマルチステップのワークフローです。
重要な区別は単純です。Grok Build はコーディングエージェント製品であり、grok-build-0.1 は他のエージェント型コーディングハーネス内でも動作可能な API アクセス可能なモデルです。Grok Build 0.1 API in CometAPI も稼働しており、OpenAI 互換ゲートウェイを通じて同じモデル ID を提供します。
Key Takeaways
- Grok Build 0.1 はエージェント型コーディング、リポジトリ作業、デバッグ、ツール駆動のソフトウェアエンジニアリングに最適化。
- API のモデル ID は
grok-build-0.1。256K コンテキストウィンドウ、テキストと画像入力に対応。 - xAI のショートコンテキスト料金は入力 $1/M、キャッシュ入力 $0.20/M、出力 $2/M。Grok Build 0.1 API in CometAPI は 20% 低い $0.80/M 入力、$0.16/M キャッシュ入力、$1.60/M 出力。200K 以上はロングコンテキスト料金。
- 推論、関数呼び出し、構造化出力をサポート。ただし Batch API は未対応。
- 単純なトークン単価や単一のベンチマークではなく、完了したエンジニアリングタスクあたりのコストと時間で評価すべき。
What Is Grok Build 0.1?
Grok Build 0.1 は、エージェント型ソフトウェアエンジニアリングのワークフローに特化して設計された xAI の言語モデルです。xAI によれば、Web 開発、デバッグ、MCP 対応のコーディングエージェントなどのタスク向けに学習され、初代 Grok Build のコーディング環境を支えました。
その位置づけは汎用アシスタントとは異なります。コーディングエージェントは、リポジトリを繰り返し点検し、関連ファイルを特定し、ツールを呼び出し、コードを編集し、テストを実行し、失敗を読み取り、タスク状態を失わずに実装を見直す必要があります。
そのため、評価の意味ある単位は、リポジトリのナビゲーション → 計画 → 編集 → ツール実行 → 失敗からの回復 → 検証というエンドツーエンドのエンジニアリングタスクです。
Is Grok Build 0.1 the Same as Grok Build?
いいえ。Grok Build は xAI のターミナルベースのコーディングエージェントであり、Grok Build 0.1 は API を通じて呼び出せる基盤モデルです。
Grok Build には、計画レビュー、コード差分、AGENTS.md のサポート、プラグイン、フック、スキル、MCP サーバー、並列サブエージェント、ワークツリー統合、そして自動化のためのヘッドレスモードが含まれます。このモデルは、ターミナル製品の外でも、互換性のあるエージェントフレームワークやゲートウェイで使用できます。
What Are the Grok Build 0.1 Specifications?
| 仕様 | Grok Build 0.1 |
|---|---|
| 開発元 | xAI / SpaceXAI |
| Model ID | grok-build-0.1 |
| 主眼 | エージェント型コーディングとソフトウェアエンジニアリング |
| 入力 / 出力 | テキストおよび画像入力; テキスト出力 |
| コンテキストウィンドウ | 256,000 tokens |
| 機能 | 推論、関数呼び出し、構造化出力 |
| 標準トークン料金 | $1.00/M input; $0.20/M cached input; $2.00/M output |
| ロングコンテキスト閾値 | 200K prompt tokens |
| ロングコンテキスト料金 | $2.00/M input; $0.40/M cached input; $4.00/M output |
| Batch API | 未対応 |
| 公称上限 | 37 requests/s; 10,000,000 tokens/min |
| リージョン | us-east-1, us-west-2 |
これらの仕様は公式の xAI モデルページに記載されています。256K のコンテキストウィンドウは、相当量のリポジトリ文脈を保持できます。また、画像入力により、エージェントはソースコードに加えて、スクリーンショット、モックアップ、アーキテクチャ図、視覚的なバグレポートも解釈できます。
プロンプトがロングコンテキスト閾値に達すると、そのリクエストのすべてのトークンに高い料金が適用されます。リポジトリ重視のエージェントは、ファイルやツール出力を継ぎ足し続けるのではなく、文脈を圧縮するか、選択的に取得するべきです。
What Makes Grok Build 0.1 Different?
最適化の主対象はエージェント型コーディング
Grok Build 0.1 は、単に Python や JavaScript を書けるモデルではありません。推論、コード生成、ツールの相互作用に特化しています。有用なコーディングエージェントは、計画し、点検し、編集し、実行し、失敗から回復し、タスク状態を失わずに継続する必要があります。
MCP 指向のツールワークフロー
MCP 指向のワークフローにより、標準化されたインターフェースを通じて、コーディングエージェントをデータベース、デプロイメントシステム、ドキュメントストア、課題管理、可観測性システム、社内開発ツールに接続できます。
構造化された自動化
エージェントが散文ではなく予測可能なオブジェクトを返す必要がある場合、構造化出力が有用です。たとえば、ファイル変更計画、ツールパラメータ、テスト結果、レビュー所見、デプロイ判断などです。これにより、モデルとオーケストレーション層の間の脆いパースを減らせます。
Web と UI 作業のための視覚コンテキスト
このモデルは画像入力を受け付けるため、ソースコードに加えて、スクリーンショット、レンダリングされたページ、インターフェース参照、エラーダイアログ、アーキテクチャ図といった資料でも作業できます。
How Fast Is Grok Build 0.1?
xAI は、Grok Build 0.1 をローンチ時点で最速のコーディングモデルと説明し、1 秒あたり 100 を超える出力トークンを謳いました。これは公式のサービス表明であり、すべてのプロンプトやエンドポイントで保証されるものではありません。
独立測定はタイムスタンプ付きの観測として扱うべきです。Artificial Analysis は現在、SpaceXAI API で約 69.6 トークン/秒の出力速度と、最初のトークンまで 0.54 秒と報告しています。プロバイダーのインフラ、プロンプト長、推論の挙動、ツール使用、サーバー負荷によって結果は変動し得ます。
How Should You Interpret the Benchmarks?
| 独立指標 | 現行報告値 | 解釈 |
|---|---|---|
| Artificial Analysis Intelligence Index | 27(推定) | 複合推定値。独立評価は今後予定と表示 |
| 出力速度 | 69.6 tokens/s | 一次の SpaceXAI API において、最初のレスポンスチャンク以降を測定 |
| 最初のトークンまでの時間 | 0.54 s | エンドポイントのレイテンシ測定であり、タスク全体の完了時間ではない |
これらの数値はArtificial Analysis(2026年9月22日)で確認しました。ページは動的に更新されるため、将来の改訂では値を再確認し、検証日を保持してください。
自律型コーディングシステムでは、ベンチマークスコアは評価の一部に過ぎません。リポジトリのナビゲーション、編集精度、ツール選択、回復行動、テスト規律、レイテンシ、総トークン使用量が、開発生産性により大きく影響する場合があります。
How Much Does Grok Build 0.1 Cost?
Grok Build 0.1 はショートコンテキストとロングコンテキストで料金が分かれています。プロンプト長が 200,000 トークン未満の場合はショートコンテキストの料金が適用され、閾値に達したリクエストではロングコンテキスト料金が適用されます。
| 料金区分 | CometAPI | 公式 xAI |
|---|---|---|
| ショートコンテキスト入力 | $0.80/M | $1.00/M |
| ショートコンテキストキャッシュ入力 | $0.16/M | $0.20/M |
| ショートコンテキスト出力 | $1.60/M | $2.00/M |
| ロングコンテキスト入力 | $1.60/M | $2.00/M |
| ロングコンテキストキャッシュ入力 | $0.32/M | $0.40/M |
| ロングコンテキスト出力 | $3.20/M | $4.00/M |
ショートコンテキスト料金では、入力 100 万トークンと出力 100 万トークンの合計で CometAPI は $2.40、公式 xAI API は $3.00 です。ロングコンテキスト料金では同じトークン構成で CometAPI は $4.80、xAI は $6.00 になります。これらはモデルトークンの費用のみであり、本番ではツール呼び出し、リトライ、テスト実行、オーケストレーションのオーバーヘッドも予算に含めるべきです。
Grok Build 0.1 vs Grok 4.7 vs Grok Code Fast 1
| 観点 | Grok Build 0.1 | Grok 4.7 | Grok Code Fast 1 |
|---|---|---|---|
| ライフサイクル | 現行のコーディング特化モデル | 現行のフロンティアモデル | 旧世代のコーディングモデル; 2026年5月15日リタイア |
| 主なポジショニング | エージェント型コーディングに特化 | フロンティアなコーディング、エージェント作業、ナレッジワーク | 高速コーディングモデルで、xAI のコーディング系モデル系譜の前身 |
| コンテキストウィンドウ | 256K | 500K | レガシー仕様。新規導入の基準にしないこと |
| 推論とツール | 推論、関数呼び出し、構造化出力 | 構成可能な推論; 関数呼び出し、Web 検索、X 検索、コード実行 | レガシーなコーディングワークフロー。新規本番利用の拡大ではなく移行を推奨 |
| 公式ショートコンテキスト 入力/出力 | $1.00 / $2.00 per M tokens | $2.00 / $6.00 per M tokens | 現行の本番料金は存在せず想定不可 |
| CometAPI ショートコンテキスト 入力/出力 | $0.80 / $1.60 per M tokens | $1.60 / $4.80 per M tokens | 退役スラッグではなく現行カタログと代替モデルを使用 |
| 公式ロングコンテキスト 入力/出力 | $2.00 / $4.00 per M tokens | $4.00 / $12.00 per M tokens | 現行のモデル選定レートとしては非該当 |
| 適合する典型用途 | 高頻度のリポジトリループ、デバッグ、コスト重視のコーディングエージェント | より強力なフロンティア推論と広いコンテキストを必要とする、難易度が高く長時間のコーディングやプロフェッショナルワークフロー | 移行参照専用。現行のコーディングワークロードには grok-build-0.1 を明示指定 |
Grok Build 0.1 は、リポジトリの繰り返し点検・編集・テストがワークロードの中心となる場合に、より経済的なスペシャリストです。Grok 4.7 はコンテキストが約 2 倍でより広範なフロンティア能力を持ちますが、出力トークンの価格は大幅に高くなります。実務上の判断は、リトライ、ツール呼び出し、人間の修正時間を含む、成功裏に完了したタスクあたりのコストに基づくべきです。
両モデルは CometAPI で利用可能で、同一ゲートウェイ下で同じコーディングタスクを実行し、完了率、レイテンシ、コンテキスト使用量、総コストを一貫したハーネスのもとで比較できます。
How Is Grok Build 0.1 Related to Grok Code Fast 1?
識別子 grok-code-fast-1 は、xAI の 2026年5月15日のモデル退役に含まれていました。移行ガイドには、退役スラッグが grok-4.3 にリダイレクトされるという包括的な記述がある一方で、モデル固有の置換表と「Code workloads」セクションでは grok-build-0.1 を推奨し、コーディング用スラッグがそのモデルにルーティングされると記しています。
同一の公式ガイドが 2 つのレベルでリダイレクトを説明しているため、本番ユーザーは退役スラッグを安定したモデル識別子として扱うべきではありません。コーディングワークロードには grok-build-0.1 を明示的に指定し、デプロイ前に現行のルーティングを確認してください。
Grok Build 0.1 API in CometAPI は、現行のモデル ID で直接アクセスを提供し、退役済みエイリアスへの依存を避けられます。
Where Can You Use Grok Build 0.1?
このモデルは特定の IDE やプロバイダーのエンドポイントに縛られていません。CometAPI を通じて、チームは OpenAI 互換ワークフローで同じ grok-build-0.1 識別子を使用し、周辺のエージェントコントローラを作り直すことなく他のコーディングモデルと比較できます。
Grok Build 0.1 は xAI 経由、または CometAPI 経由で呼び出せます。CometAPI の場合は、model: "grok-build-0.1" と標準的な messages 配列を含む認証済みの POST リクエストを api.cometapi.com/v1/chat/completions に送信します。
curl "https://api.cometapi.com/v1/chat/completions" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $COMETAPI_KEY" \
-d '{
"model": "grok-build-0.1",
"messages": [
{
"role": "user",
"content": "Find the bug in this repository and propose a minimal fix."
}
]
}'
When Should You Use Grok Build 0.1?
IDE のコーディングエージェント
コーディング特化と低トークン価格の組み合わせは、エージェントがコードを繰り返し読み取り、編集し、検証するインタラクティブなワークフローに適しています。
自動デバッグ
エージェントはエラーを点検し、関連ファイルを検索し、パッチを生成し、テストを実行して修正を洗練できます。
Web と UI 開発
画像入力により、ソースコードと並行してスクリーンショットやデザイン参照に基づくワークフローが可能になります。
MCP ベースのソフトウェアエージェント
関数呼び出しと MCP 指向のワークフローは、外部開発システムへの制御されたアクセスを必要とするアシスタントに適しています。
CI とエンジニアリング自動化
ヘッドレスなワークフローにより、バグトリアージ、自動修復、テスト生成、リファクタリング、移行、プルリクエスト準備を支援できます。
Is Grok Build 0.1 Still Relevant in 2026?
はい。ただし「xAI の最新モデル」ではなく、役割は特化型です。その価値は、コーディング特化、256K コンテキストウィンドウ、推論、ツール呼び出し、構造化出力、画像入力、比較的低い標準トークン価格の組み合わせにあります。
繰り返しのソフトウェアエージェントループに対して応答性の高いモデルが必要で、独自のリポジトリ、テスト、レイテンシ目標、失敗コストに照らして評価できる場合に最も魅力的です。
Conclusion
Grok Build 0.1 は、普遍的なフロンティアモデルではなく、コーディングエージェントに焦点を合わせたモデルです。公式仕様と価格は高ボリュームのリポジトリ作業に魅力的ですが、本番でその優位性が維持されるかどうかは周辺のエージェント設計によって決まります。
採用前に、成功したタスク完了、人的修正時間、ツール呼び出し回数、トークン使用量、テスト合格率、ロングコンテキストへの曝露を測定する代表的な評価を実施してください。ベンチマークやトークン価格だけでなく、ワークフロー全体で代替案を上回る場合に選択すべきです。
