Coding Agent Comparison
Claude CodeとCodexの違い|業務・権限・レビューで選ぶ
Claude CodeとOpenAI Codexは、どちらもコードを読み、変更し、コマンドを実行できるコーディングエージェントです。ただし、利用画面、クラウド実行、権限モデル、サンドボックス、契約体系は同じではありません。製品名の人気ではなく、業務の実行場所と事故時の影響から選びます。
結論:モデル比較より「どこで何を実行させるか」で選ぶ
比較の出発点は生成品質だけではありません。ローカル端末で対話しながら進めるのか、IDE内で使うのか、隔離されたクラウドへ仕事を委ねるのか、GitHubレビューまで含めるのかで適した構成が変わります。両製品とも複数の利用面を持つため、「Claude Codeはローカル、Codexはクラウド」と単純化することもできません。
企業では、代表タスクを同じ入力と合格条件で試します。実装時間だけでなく、誤変更、レビュー時間、権限要求、ネットワーク接続、秘密情報の扱い、差し戻しを記録します。勝者を一つ決めるより、低リスクな文書修正、日常開発、大規模変更、非同期タスク、コードレビューなど、業務ごとに標準を決める方が実用的です。
利用できる主な画面と実行形態
Claude Codeはターミナル、VS CodeやJetBrainsなどのIDE、Desktop、Webから利用できます。公式セキュリティ資料では、Web実行はAnthropic管理の隔離VMで動き、ネットワーク制御、スコープされた認証、ブランチ制限、監査ログ、終了後の自動破棄が案内されています。ローカル利用では、開始した作業ディレクトリを基準に読み書きとコマンドを扱います。
CodexはCLI、IDE拡張、Codex app、クラウドタスク、GitHubコードレビューなどを提供します。OpenAI公式マニュアルでは、クラウドタスクは隔離されたOpenAI管理コンテナで実行され、セットアップ段階とエージェント段階を分け、エージェント段階のネットワークは既定で無効です。CLIとIDEではOSの仕組みを使うサンドボックスで、通常はワークスペース内の書き込みとネットワーク無効を基本にします。
権限設計の違い
Claude Codeはツールごとにdeny、ask、allowのルールを設定し、deny、ask、allowの順で評価します。読み取り、Bash、ファイル変更に異なる承認動作があり、managed settingsで組織標準を強制できます。plan、default、acceptEdits、dontAsk、bypassPermissionsなどのモードがあり、最後のモードは隔離環境以外で使わないよう公式に警告されています。
Codexはサンドボックスモードと承認ポリシーを別の制御として扱います。サンドボックスが技術的に実行できる範囲を決め、承認ポリシーが境界を越える時に停止して確認する条件を決めます。CLIの代表的なモードはread-only、workspace-write、danger-full-accessです。承認はuntrusted、on-request、neverなどから設定できますが、承認なしと無制限実行は同じ意味ではありません。
サンドボックスとネットワーク
Claude CodeはBashのサンドボックスでファイルシステムとネットワークを隔離し、作業ディレクトリ境界、追加ディレクトリ、ネットワーク許可を設計できます。Web取得やMCPは外部の命令を取り込む経路になるため、提供者、ドメイン、送信データを確認します。許可済みコマンドでも、コマンド注入検出や信頼確認など別の防御が働くと公式に説明されています。
Codexのローカル既定では、workspace-writeでもネットワークは無効です。有効化する場合も、ネットワークプロキシのドメインルールで宛先を絞れます。クラウドではセットアップ時に依存関係を取得し、エージェント実行時には秘密情報を取り除く二段階構成が案内されています。どちらも、サンドボックスを使えば不審なリポジトリや外部コンテンツが無条件に安全になるわけではありません。
料金と契約の比べ方
両製品とも個人向け、法人向け、API利用など複数の入口があり、固定の単一料金では比較できません。Claude Codeは対象となるClaudeプランやConsole、クラウド基盤によって認証・請求経路が変わります。CodexはChatGPTのFree、Go、Plus、Pro、Business、Enterprise/EduやAPIキー利用が案内され、プランごとに利用枠と管理機能が異なります。
月額表示だけでなく、利用上限、追加クレジット、APIトークン、クラウド実行、レビュー時間、管理者作業を含めて比べます。価格や提供条件は変更されるため、本記事の数値転載ではなく契約直前の公式ページを正本にします。個人契約を会社開発へ持ち込むと、請求、退職時無効化、監査、データ条件が曖昧になります。
業務別の選び方
ローカルで短い修正を対話的に進める
両製品のCLIやIDEが候補です。既存開発環境との相性、権限プロンプトの分かりやすさ、差分レビュー、テスト実行、チーム設定の配布方法で比較します。同じ小規模タスクを5件ほど実行し、完了時間と修正後レビュー時間を分けて測ります。
長いタスクを非同期で委ねる
クラウド実行の隔離方法、ネットワーク、秘密情報、ブランチ、成果物の取り込み方を確認します。実行時間だけでなく、開始時に渡す環境定義、失敗時の再開、レビュー可能な差分、ログの保持を評価します。
Pull Requestレビューを標準化する
GitHub連携や自動レビューの機能有無だけで決めません。どのイベントで動くか、指摘の公開範囲、誤検知を誰が閉じるか、外部コントリビューターのコードをどう扱うか、必須チェックにするかを決めます。AIレビューは人間の最終責任を置き換えません。
機密性の高いリポジトリを扱う
法人契約、学習利用条件、保持、データ所在地、SSO、SCIM、監査ログ、管理設定を確認します。モデルの回答品質が高くても、必要な契約・管理条件を満たさなければ導入しません。秘密情報をリポジトリから除き、隔離された検証環境から始めます。
比較検証のチェックリスト
- 同じ代表タスク、初期状態、合格条件で比較した
- 生成時間と人間レビュー時間を別々に測った
- 読み取り、編集、コマンド、ネットワークの境界を記録した
- 秘密情報、外部送信、本番操作を禁止または承認制にした
- 誤変更、テスト失敗、差し戻し、権限要求を件数化した
- 個人向けと法人向けの契約条件を混同していない
- 更新時に再検証する担当者と停止条件を決めた
よくある質問
どちらが優れていますか?
一律の優劣では決められません。対象業務、実行環境、権限、レビュー、契約を揃えて比較します。ベンチマーク上の強さだけで企業標準を決めません。
両方を同じ会社で使えますか?
使えます。ただし入力可能データ、対象リポジトリ、権限、ログ、停止条件を製品ごとに台帳化し、社員が任意に切り替えない運用が必要です。
サンドボックスがあれば人間確認は不要ですか?
不要にはなりません。サンドボックスは技術境界、人間確認は変更の妥当性や業務責任を判断する仕組みです。異なる制御として設計します。
料金だけで選べますか?
選べません。利用枠、API費用、クラウド実行、レビュー工数、SSOや監査など管理要件を含めた総費用で比較します。
公式情報
- Claude Code overview
- Claude Code permissions
- Claude Code security
- OpenAI Codex: Agent approvals & security
- OpenAI Codex pricing
Claude Code固有の導入確認は企業導入チェックリスト、権限の具体策はClaude Codeの権限設定へ進んでください。
次の一歩
Miraigentの無料診断では、候補製品を決める前に、対象業務、データ、権限、人間確認、評価指標を整理します。