先に、要点をまとめます。
- CodexはOpenAI、Claude CodeはAnthropicのAIコーディングエージェントです。2026年9月25日時点で、Codexの推奨モデルは GPT-6 Astra・Sol・Luna 、Claude Codeの既定モデルは Claude Opus 5.5 です。どちらもターミナル・IDE・デスクトップアプリ・Webで使えます。
- 料金は「チャット契約に含まれる利用枠」と「APIの従量課金」の2本立てで、両社とも同じ構造です。ただし 1文あたりのトークン数がモデルごとに違う ため、100万トークンあたりの単価表だけでは費用を比べられません。
- 優劣は同じ作業で試して決めます。比べる対象は生成されたコードだけでなく、 レビュー・修正の時間と、権限を組織で固定できるか です。
2026年9月25日時点で確認した情報です。モデル・料金・提供条件は数週間単位で変わるため、判断の直前には本文中の公式ページで最新の状態をご確認ください。
CodexとClaude Codeは何が違いますか?
提供元・使える契約・既定のモデルが違います。コードを読み、ファイルを編集し、コマンドを実行するという基本の動きは共通です。
CodexはOpenAIが提供し、ChatGPTの契約またはAPIキーで使います。Claude CodeはAnthropicが提供し、Claudeの有料プランまたはClaude Console(API)のアカウントで使います。Claude Codeはターミナル版とVS Code・JetBrains向けに限り、Amazon BedrockやGoogle Cloudなど他社クラウド経由でも使えます(Claude Code公式概要)。
| 項目 | Codex | Claude Code |
|---|---|---|
| 提供元 | OpenAI | Anthropic |
| 使える場所 | CLI、IDE拡張、デスクトップアプリ、Web、クラウド実行 | ターミナル、VS Code・JetBrains、デスクトップアプリ、Web(claude.ai/code)、スマートフォン |
| 必要な契約 | ChatGPTの各プラン、またはAPIキー | Claudeの有料プラン(Pro・Max・Team・Enterprise)、またはClaude Console |
| 2026年9月の既定・推奨モデル | GPT-6 Astra・Sol・Luna | Claude Opus 5.5(既定) |
| プロジェクトの指示ファイル | AGENTS.md | CLAUDE.md(AGENTS.mdも読める) |
どちらも手元の端末で動かす形とクラウド側で任せる形を持つため、結果を左右するのは どの契約で、どのモデルを、どの権限で動かすか の組み合わせです。単体の解説はOpenAI Codex CLIの始め方とClaude Codeはいつから使えるかにまとめています。
CodexとClaude Codeを、モデル・料金・権限の固定方法・指示ファイルの4項目で並べ、同じ作業で比べる流れを示した図
2026年9月時点でどのモデルを選べますか?
Codexは用途別にGPT-6の3モデル、Claude CodeはOpus 5.5を既定に、別名(エイリアス)でFable・Sonnet・Haikuへ切り替えます。
機能追加・AIを組み込みたいについて相談するいまの業務システムは残したまま、機能追加・改修やAIの組み込みで手間を減らす受託開発。書類の読み取り、社内資料への回答、既存システムとの連携まで機能追加・AIを組み込みたいを見る →Codexのモデル案内が推奨するのは次の3つです。
| モデル(ID) | 公式が示す用途 |
|---|---|
| GPT-6 Astra(gpt-6-astra) | コード・アプリ・調査にまたがる複雑な作業。判断を続けながら最後まで進める作業 |
| GPT-6 Sol(gpt-6-sol) | 複雑なコーディングとエージェント的な作業。曖昧な依頼や難しいコード変更を含む日常の作業 |
| GPT-6 Luna(gpt-6-luna) | 抽出・分類・変換・構造化した要約など、範囲の決まった大量の処理 |
同じページでは、GPT-5.4とGPT-5.4 miniは2026年8月31日にChatGPTでサインインしたCodexから引退済み、GPT-5.5は2026年10月14日に引退予定(APIでは継続)、GPT-5.2とGPT-5.3-Codexは非推奨と案内されています。リアルタイム補完向けに出ていたGPT-5.3-Codex-Sparkは、9月25日時点の推奨モデルの一覧に載っていません。 設定ファイルや社内手順書に古いモデル名を固定している場合は、引退日までに書き換えが必要です。
Claude Code側はモデル設定の公式ページによると、Pro・Max・Team・EnterpriseとAPIのアカウントでは既定がOpus 5.5です。/model や起動時の指定で次の別名を使えます。
| 別名 | Anthropic APIでの解決先 | 用途(公式の説明) |
|---|---|---|
fable | Claude Fable 5.1 | 最も難しく長時間かかる作業 |
opus | Claude Opus 5.5 | 複雑な推論 |
sonnet | Claude Sonnet 5 | 日常のコーディング |
haiku | Haikuモデル | 単純な作業 |
注意したいのは、 同じ別名でも提供先によって中身が違う ことです。sonnet はAnthropic APIではSonnet 5ですが、Amazon BedrockとGoogle CloudではSonnet 4.5、Claude Platform on AWSではSonnet 4.6に解決されます。Microsoft Foundryでは既定モデル自体がSonnet 4.5です。社内で「sonnetで試した」と記録するときは、提供先も一緒に残してください。
推論の深さ(effort)の既定値も揃っていません。Claude CodeではOpus 5.5だけが既定medium、それ以外のモデルはhighです。CodexのGPT-6 SolとLunaは既定medium(GPT-6 Sol・Lunaへの移行で確認)です。 モデルを比べるときはeffortを明示して揃えないと、推論の量の差をモデルの差と取り違えます。 Opus 5.5の既定値の変更についてはClaude Opus 5.5の解説で扱っています。
料金はどう比べればよいですか?
契約に含まれる利用枠で使うか、APIの従量課金で使うかを先に決めます。単価表どうしの比較は、トークンの数え方が違うため目安にしかなりません。
Codexは公式の料金案内で、ChatGPTのFree・Go・Plus・Pro・Business・Edu・Enterpriseの各プランに含まれるとされています。利用量の目安は5時間ごとのメッセージ数で示され、上限に達した後はクレジットで続けられます。APIキーで使う場合はAPIの料金で課金され、使えるモデルはそのキーで使えるAPIモデルに限られます。GitHubのコードレビューのようなクラウド側の機能は、APIキーでは使えません。
Claude CodeはClaudeの料金ページで、Freeを除く有料プラン(Pro・Max・Team・Enterprise)に含まれ、利用上限はプラン全体と共有すると案内されています。チャットでの利用が多い人は、Claude Codeに回せる枠がその分減ります。
APIで使う場合の単価は次のとおりです(100万トークンあたり・米ドル。2026年9月25日にOpenAIの料金ページとAnthropicの料金ページで確認)。
| モデル | 入力 | キャッシュ読み取り | 出力 |
|---|---|---|---|
| GPT-6 Astra | 10.00 | 1.00 | 50.00 |
| GPT-6 Sol | 2.00 | 0.20 | 10.00 |
| GPT-6 Luna | 0.10 | 0.01 | 0.50 |
| Claude Fable 5.1 | 10.00 | 0.25 | 50.00 |
| Claude Opus 5.5 | 4.00 | 0.20 | 20.00 |
| Claude Sonnet 5 | 2.00 | 0.20 | 10.00 |
| Claude Haiku 4.5 | 1.00 | 0.10 | 5.00 |
OpenAI側は短いコンテキスト(short context)での単価です。Claude Sonnet 5の入力2・出力10米ドルは、発売時に8月31日までの導入価格とされていましたが、9月1日の値上げは行われず標準価格になりました。
この表で「GPT-6 SolとSonnet 5は同じ単価」と読むのは早計です。Anthropicは料金ページで、Claude 4.7以降のモデルは新しいトークナイザーを使い、 同じ文章でもおよそ30%多くトークンを数える と説明しています。モデルが違えば文章の区切り方も違うため、同じ作業でも請求されるトークン数が一致しません。エージェントの作業では、読み込んだファイルやコマンドの結果も入力として積み上がります。 比べるべきは単価ではなく、同じ課題を1件終えるまでに実際に請求された金額です。
権限と管理機能はどこが違いますか?
どちらも「どこまで自動で実行させるか」を段階で選べ、管理者がその設定を利用者に上書きさせない仕組みを持っています。違いは設定の単位と名前です。
Codexは承認とセキュリティの公式案内で、ファイル・コマンドの範囲を決めるサンドボックスと、人の確認を挟む承認ポリシーの2軸で設定します。
| Codexの設定 | 選択肢 |
|---|---|
| サンドボックス | read-only、workspace-write(バージョン管理されたフォルダーでの既定)、danger-full-access(サンドボックスも承認もなし。公式が非推奨) |
| 承認ポリシー | on-request(既定。ワークスペース外の編集やネットワーク接続で承認)、never、granular |
| 管理者による固定 | requirements.toml の allowed_approval_policies・allowed_sandbox_modes で、利用者が選べる範囲を制限。管理者の設定がローカル設定より優先 |
Claude Codeは権限設定の公式ページで、動作モードと、ツールごとの許可・確認・拒否のルールを組み合わせます。
| Claude Codeの設定 | 選択肢 |
|---|---|
| 動作モード | default(各ツールの初回に確認)、acceptEdits、plan(読み取りと調査のみ)、auto、dontAsk、bypassPermissions |
| ルール | allow・ask・denyをツールやコマンド単位で書く。どこかでdenyされた操作は他の設定で許可できない |
| 管理者による固定 | 管理設定(managed settings)は利用者・プロジェクトの設定やコマンドライン引数で上書きできない。disableBypassPermissionsMode で確認なしモードを禁止できる |
| OSレベルの制限 | サンドボックスを有効にすると、ファイルとネットワークへのアクセスをコマンドの書き方に関係なく制限 |
比較するときは「最も緩い設定で何ができるか」ではなく、「自社が許す範囲を、利用者が変えられない形で配布できるか」を確かめます。 公式ドキュメントでは、Claude Codeの bypassPermissions は隔離されたコンテナや仮想マシンでのみ使うよう案内されています。Codexでも danger-full-access は公式に非推奨とされています。権限の設計そのものはAIエージェントのセキュリティ設計で扱っています。
同じ作業でどう比べればよいですか?
同じリポジトリ・同じ開始時点・同じ完成条件で1つの課題を渡し、合格までの時間と費用を記録します。
確認例:申請一覧へ権限を追加する
「自部署の申請だけを見られる」という同じ課題を渡します。画面のフィルターだけでなく、URLを直接開いたときに拒否されるか、一覧の件数、添付ファイル、管理者の操作を確認します。生成したコードの量や「完了しました」という報告だけで優劣を決めません。
テストに通らない場合は、修正を依頼してから合格するまでの時間も記録します。途中で質問が必要になった箇所は、ツールの理解不足なのか、要件の書き漏れなのかを分けてください。以下は記録の形を示す確認例で、当社が両ツールを測った結果ではありません。自社の課題に置き換えて使ってください。
| 記録する欄 | 単位 | 取り方 |
|---|---|---|
| 契約・提供先 | 名称 | ChatGPT Business、Claude Team、Bedrock等。APIキー利用かも書く |
| モデルID | 名称 | 別名ではなく実際のID(例: gpt-6-sol、claude-opus-5-5) |
| effort | 段階 | 明示した値。未指定なら「既定」と書き、既定値も併記 |
| 権限の設定 | 名称 | Codexはサンドボックスと承認ポリシー、Claude Codeは動作モード |
| 1回目で合格した条件 | 件数 | 完成条件のうち修正なしで満たした数 |
| 修正の依頼回数 | 回 | 合格までに追加で指示した回数 |
| 人の確認・修正時間 | 分 | 差分を読む時間を含む担当者の実時間 |
| 請求額 | 米ドル | API利用ならusageから計算、プラン内なら利用枠の消費を記録 |
表の最後の2行(人の時間と請求額)は、どちらを選ぶかの結論を左右します。当社の作業単価1時間11,000円(税込)で換算すると、確認・修正の30分は5,500円です。課題1件あたりのAPI請求額と、この金額を同じ表に並べて比べてください。
併用はできますか?使い分けはどう決めますか?
併用はできます。指示ファイルをAGENTS.mdに寄せれば、プロジェクトのルールを1か所で管理できます。費用とは別に、管理の手間が増えます。
CodexはAGENTS.mdを読み、Claude CodeはCLAUDE.mdに加えてAGENTS.mdも読めます(Claude Code公式概要)。ビルド・テストの手順や触れてはいけない範囲をAGENTS.mdに書けば、両方に同じ前提を渡せます。2つのファイルに同じ内容を書き分けると、片方だけ更新されて食い違います。
一方、アカウントと契約、権限の配布(requirements.tomlとmanaged settings)、ログと利用量、モデルの引退日・既定値の変更への追随は2系統になります。
同じ変更を別のツールでレビューさせる使い方もあります。ただし、両方が同じ要件の誤解をしていれば、同じ結論が出ても正しさの証明にはなりません。 別のツールに何を独立して確認させるか(テストの網羅、権限の抜け等)を先に決めてください。
導入の判断表
既存の契約、統制の要件、試した結果の3つで決めます。1つの条件だけで決めないでください。
| 自社の状況 | 最初に試す側 | 確認すること |
|---|---|---|
| 全社でChatGPT Business・Enterpriseを契約済み | Codex | 追加契約なしで使える範囲と、利用枠の上限 |
| 全社でClaude Team・Enterpriseを契約済み | Claude Code | チャットと共有する利用上限で足りるか |
| AWS・Google Cloudの契約内でAIを使う決まりがある | 提供先の対応を確認 | Claude CodeはBedrock等で使えるが、別名の解決先が変わる |
| 権限を利用者に変えさせたくない | 両方を同じ条件で試す | 管理設定で禁止したい操作を実際に止められるか |
| どちらも未契約 | 小さな課題で両方 | 上の記録表で、合格までの時間と費用 |
モデルは数週間単位で入れ替わるため、ツールの選定より、 モデルIDとeffortを設定として外に出し、次の世代でも同じ記録表で測り直せる状態 を作るほうが長く使えます。AIコーディングを使う開発会社へ発注する側の確認点は、AI駆動開発を外注する前のチェックリストを参照してください。
よくある質問
Q. 結局、CodexとClaude Codeはどちらが優秀ですか?
一律の優劣は決められません。どちらも複数のモデルを選べ、既定のeffortも異なるため、条件を揃えない比較では結論が逆になり得ます。自社の同じ課題で、合格までの修正時間と請求額を比べてください。
Q. 両方使うと費用は2倍になりますか?
契約の組み合わせと利用量によるため一律ではありません。費用とは別に、アカウント・権限の配布・ログ・モデル更新への追随の管理が2系統になります。
Q. 無料で試せますか?
CodexはChatGPTのFreeプランにも含まれると公式に案内されています。Claude CodeはFreeプランには含まれず、有料プランかClaude Console(API)のアカウントが必要です。業務のコードで試す場合は、無料枠かどうかより、コードの送信先と利用規約を先に確認してください。
自社の状況を整理して相談する
まず、比べたい課題、現在の契約、使うモデルID、実行権限、レビュー担当を書き出してください。この記事に合う検討シートとAI相談用プロンプトで、未確認の項目を残したまま整理できます。シートを完成させる前でも、お気軽にご相談いただけます。
運営・編集