2026年7月28日

GPT-5.5(Codex 5.5)徹底解説:性能、価格、使い方、競合比較

GPT-5.5のリリース日と基本スペック

公式画面

GPT-5.5 標準版 vs Pro版
機能標準版Pro版
利用可能プランPlus以上Proユーザー
コンテキスト100万トークン100万トークン
精度標準高精度
レイテンシ低(GPT-5.4同等)低(GPT-5.4同等)
効率性出力トークン削減出力トークン削減

2026年4月23日リリース、ChatGPTとCodexで利用可能

室谷室谷代表取締役
GPT-5.5が4月23日にリリースされましたね。ChatGPTとCodexの両方で一気に展開されたのは珍しい。

Plus、Pro、Business、Enterpriseユーザーが対象です。
テキトー教師テキトー教師.AI認定講師
たしかに統一感がありました。当日からすぐ使えたので、現場でも「いつから?」みたいな混乱は少なかったです。
室谷室谷代表取締役
Pro版はChatGPTのProユーザー向けに、標準版はPlus以上に降りてきてる。APIも同日からResponses APIで叩けるようになってます。
テキトー教師テキトー教師.AI認定講師
あと、Codexでも標準版とPro版の両方が使えるようになった。初めて触る人だと「どれを選べばいいんだ」と戸惑うかもしれませんね。

コンテキスト100万トークン、標準版とPro版の違い

室谷室谷代表取締役
コンテキストウィンドウはAPIで100万トークン。正直これだけあれば、大規模なコードベースやドキュメントをまるごと突っ込めます。
テキトー教師テキトー教師.AI認定講師
大きいですね。ChatGPT側の上限は公式で確認してほしいところですが、APIではそのサイズを活かせます。
室谷室谷代表取締役
GPT-5.5 Proは標準版より高精度な出力を求められるタスク向け。同じモデルファミリーですが、Proの方がより深く推論してくれます。
テキトー教師テキトー教師.AI認定講師
実際、複雑な分析や設計判断にはProが効く。標準版でも十分速いんですが、精度重視ならProを選ぶ価値はあります。

レイテンシーと効率性の進化

室谷室谷代表取締役
GPT-5.5はGPT-5.4と同等のレイテンシーを保ちつつ、出力トークンが減ってる。つまり同じ性能でより安く、速く処理できる。
テキトー教師テキトー教師.AI認定講師
現場感覚で言うと、同じCodexタスクで以前より応答が早く感じます。トークン消費も抑えられるので、月額の制限内でより多くの仕事が回せる。
室谷室谷代表取締役
経営から見ると、トークン単価が上がっても総コストが下がる可能性がある。これ、ROIで考えるとかなり大きい。
テキトー教師テキトー教師.AI認定講師
実際に使ってみて「思ったよりサクサク動く」という声が多い。スペック表だけでは伝わらない実感ですね。

GPT-5.5 vs GPT-5.4:性能と効率を徹底比較

GPT-5.5 vs GPT-5.4:性能と効率の比較
GPT-5.4
  • Terminal-Bench 2.0: 75.1%
  • FrontierMath Tier4: 27.1%
  • Expert-SWE: 68.5%
  • エージェントコーディング: 要件解釈不十分、手戻り多
  • Codexタスク消費トークン (xhigh): 120M
GPT-5.5
  • Terminal-Bench 2.0: 82.7%
  • FrontierMath Tier4: 35.4%
  • Expert-SWE: 73.1%
  • エージェントコーディング: 計画立案・実行、意図把握向上
  • Codexタスク消費トークン (xhigh): 75M

主要ベンチマークで大幅スコア向上

室谷室谷代表取締役
Terminal-Bench 2.0で82.7% vs 75.1%って、けっこうな差ですよね。FrontierMath Tier4でも35.4%と27.1%、GPT-5.4に対して明確に上回ってる。
テキトー教師テキトー教師.AI認定講師
たしかに、ベンチマークスコアだけ見ると結構な向上ですね。ただ現場で初めて触る人だと「数字だけだと実感が湧かない」って言うんですよ。
室谷室谷代表取締役
言いたいことはわかります。でもExpert-SWEの内部評価で73.1%と68.5%…あれ、結構難しいタスクを想定してるんで、実務のコードレビューや修正で体感できる差だと思います。
テキトー教師テキトー教師.AI認定講師
なるほど。だとすると、複雑なバグ修正やリファクタリングで効果を実感しやすいってことですね。

エージェントコーディングと知識作業での進化

室谷室谷代表取締役
今回のリリースノートでも強調されてるのが、エージェントコーディングと知識作業の進化。コード書くだけでなく、調査や分析、ドキュメント作成まで一貫してやってくれるようになった。
テキトー教師テキトー教師.AI認定講師
そうですね。今までは「コード生成は得意だけど、要件の解釈やツールの使い分けはイマイチ」って印象だった人もいると思うんですよ。
室谷室谷代表取締役
MYUUUの現場でも、GPT-5.5に複数の指示を雑に投げてみたんですけど、計画立ててから実行してくれる感じがありました。GPT-5.4だとその辺の手戻りが多かった。
テキトー教師テキトー教師.AI認定講師
ああ、それよく聞きます。「こんなに細かく指示しなくていいんだ」って感覚になるみたいです。

タスクの意図をくみ取る能力が上がったんでしょうね。

トークン効率の改善でコストパフォーマンスも向上

室谷室谷代表取締役
そして効率面。同じCodexタスクを完了するのに使うトークン数が大幅に減ってます。

xhigh設定で比較すると、GPT-5.4が120Mだったのに対してGPT-5.5は75M。highだと45Mまで下がる。
テキトー教師テキトー教師.AI認定講師
ということは、同じ仕事をするのにトークン消費が3割以上減るってことですよね。料金が気になる身としては嬉しい改善です。
室谷室谷代表取締役
そうです。OpenAIの発表では、GPT-5.5はGPT-5.4と同等のレイテンシを維持してる。

性能上げて効率も上げる…なかなか贅沢なアップデートですよ。
テキトー教師テキトー教師.AI認定講師
トークン効率が上がると、予算内でより多くの試行ができるようになりますね。特にスタートアップや個人開発者には大きいんじゃないでしょうか。

Codex 5.5の使い方:VSCodeとxhigh設定

Codex xhigh vs ChatGPT heavy thinking
Codex xhigh
  • コーディング用に最適化されたreasoning設定
  • エディタ操作やdiff生成に特化
  • 使うトークン量が増える
  • より深く考えた上でコードを出力
ChatGPT heavy thinking
  • 汎用の思考モード
  • 非コード作業(戦略立案など)に適している
  • コード生成には不向き(会話から推測)

Codex 5.5の新機能:xhigh reasoning設定とは

テキトー教師テキトー教師.AI認定講師
xhigh って、初めて見ると「何これ?」ってなりますよね。Codex の reasoning_effort を一番高くした設定で、より深く考えた上でコードを出力してくれます。
室谷室谷代表取締役
普通の high でも十分なケースは多いんですが、複雑なリファクタリングやアーキテクチャ設計だと差が出ますね。ただ、使うトークン量も増えるので、タスクに応じて使い分けるのがポイントです。
テキトー教師テキトー教師.AI認定講師
現場でよく聞かれるのが、「xhigh と ChatGPT の heavy thinking って同じですか?」という質問。実は別物で、Codex の xhigh はあくまでコーディング用に最適化された reasoning 設定です。
室谷室谷代表取締役
そうなんです。ChatGPT の heavy thinking は汎用の思考モードで、Codex はエディタ操作や diff 生成に特化してる。

用途が違うので、戦略立案みたいな非コード作業には ChatGPT 側を使った方がいいですね。

VSCodeでCodex 5.5を使うためのセットアップ

テキトー教師テキトー教師.AI認定講師
VSCode で Codex を使うには、まず拡張機能を入れて、OpenAI のアカウントと連携するだけです。最近のアップデートでモデル選択が分かりやすくなりました。
室谷室谷代表取締役
料金面だと、Pro プランなら追加費用なしで GPT-5.5 が使える。時給換算で考えたら、ちょっとしたコードレビューを任せるだけで元が取れる計算になります。
テキトー教師テキトー教師.AI認定講師
初めて設定するときに戸惑うのは、モデル選択で「GPT-5.5 Codex」を選ぶところ。間違って通常の GPT-5.5 を選んでしまうと、エディタ連携がうまく動かないんですよね。
室谷室谷代表取締役
それはあるあるですね。Codex 用のモデルはちゃんと「Codex」と名前に付いてるので、そこだけ気をつければ大丈夫です。

日本語での効果的なプロンプト例

テキトー教師テキトー教師.AI認定講師
日本語でプロンプトを書くときのコツは、曖昧な表現を減らすこと。「良い感じにして」ではなく、具体的な要件を箇条書きで渡すと、Codex が意図を汲み取りやすいです。
室谷室谷代表取締役
US の開発現場でも同じことが言えますが、日本語は特に主語が省略されがちなので、「この関数のエラーハンドリングを追加して」のように明確に指示するのが効率的です。
テキトー教師テキトー教師.AI認定講師
あと、xhigh のときは「詳細な設計案を考えてから実装してください」と前置きすると、思考の方向性が定まります。日本語でも問題なく動くので、英語が苦手な人には朗報ですね。
室谷室谷代表取締役
トークン効率も上がってるので、従来より少ないプロンプトで同等以上の成果が出ます。ROI で見るとかなり魅力的です。

GPT-5.5とClaude Opus 4.7のベンチマーク比較

GPT-5.5 vs Claude Opus 4.7 ベンチマーク比較
ベンチマークGPT-5.5Claude Opus 4.7
Terminal-Bench82.7%69.4%
FrontierMath Tier1-351.7%43.8%
FrontierMath Tier435.4%22.9%
Expert-SWE73.1%非公開
GDPval84.9%80.3%

Terminal-BenchやFrontierMathでGPT-5.5がリード

室谷室谷代表取締役
まずこのベンチマーク比較表を見てください。Terminal-BenchでGPT-5.5が82.7%、Claude Opus 4.7が69.4%。

FrontierMathでもTier1-3で51.7%対43.8%、Tier4では35.4%対22.9%と、かなり開いてます。
テキトー教師テキトー教師.AI認定講師
たしかに。でも、これって単なるベンチマークの数字ですよね。

現場感覚で言うと、コーディングタスクではGPT-5.5が明らかに効率いいという声が多いです。
室谷室谷代表取締役
MYUUUの現場でも、エージェントコーディングの成功率が上がってます。特に複雑な統合テストやリファクタリングで差が出る。

時給換算すると、同じタスクを短いトークン数でこなせるからコストも下がる。
テキトー教師テキトー教師.AI認定講師
最初にこの表を見ただけでは、Claudeも悪くないじゃんって思う人もいるでしょうね。でも実際に使うと、特に分析系のタスクでGPT-5.5の理解度が違うんですよ。

コーディングと分析タスクでの実力差

室谷室谷代表取締役
CodexにGPT-5.5を統合して使うと、コーディングの精度が一段上がります。Expert-SWEという内部ベンチで73.1%。

Claudeの数値は非公開ですが、ToolathlonでもGPT-5.5が55.6%で他モデルを上回ってます。
テキトー教師テキトー教師.AI認定講師
コーディング以外でも、BrowseCompやCyberGymでGPT-5.5の方が高いスコアです。でも、GDPvalでは両者ほぼ互角ですよね。

GPT-5.5が84.9%、Claudeが80.3%。あんまり差がないタスクもある。
室谷室谷代表取締役
そう。だから「Claudeの方が得意な領域はないのか」って聞かれますが、同じ表を見ればわかる通り、分析や研究よりは安全性評価や特定の指示追従でバランスがいいという印象です。

ただ、コストパフォーマンスで言うとGPT-5.5の方が効率が良いです。

どちらを選ぶべきかの判断基準

室谷室谷代表取締役
結局のところ、タスク次第です。コード量の多いプロジェクトやエージェント的なワークフローならGPT-5.5一択。

Claude Opus 4.7は、特定の安全要件が厳しい領域とか、OpenAIのAPIが使えない場合の選択肢として残ってます。
テキトー教師テキトー教師.AI認定講師
実際に選ぶときは、自社のタスクでどれだけ差が出るか測るのが一番ですね。ベンチマークは参考程度にして、自分のコードで試すのが確実です。

GPT-5.5 Proの料金とトークン制限の実態

GPT-5.5 Pro vs GPT-5.4 Pro: コスト・トークン消費比較
GPT-5.4 Pro (xhigh)
  • トークン消費: 120M
  • トークン単価: 1倍 (基準)
  • 相対コスト: 1倍
GPT-5.5 Pro (xhigh)
  • トークン消費: 75M
  • トークン単価: 2倍
  • 相対コスト: 1.25倍
GPT-5.5 Pro (high)
  • トークン消費: 45M
  • トークン単価: 2倍
  • 相対コスト: 0.75倍
GPT-5.5 Pro (medium)
  • トークン消費: 22M
  • トークン単価: 2倍
  • 相対コスト: 0.36倍

GPT-5.5 Proの価格設定と効率性

室谷室谷代表取締役
Proの料金、一見するとGPT-5.4より割高に見えるんですよね。でもトークン消費量が減る計算をちゃんとしないと誤解します。
テキトー教師テキトー教師.AI認定講師
現場でよく聞かれるのが「高くなったんでしょ?」って話。実際には同じタスクで使うトークンが大幅に減るので、実効コストは横ばいか下がるケースも多いです。
室谷室谷代表取締役
MYUUUの現場でも、同じCodexタスクでトークン消費が3割以上減った実測があります。時給換算すると、待ち時間が減って開発者の生産性が上がるメリットも大きい。
テキトー教師テキトー教師.AI認定講師
特にmedium reasoningまで落とせれば、かなり劇的なコスト削減になりますね。初めて触る人はまずmediumで試して、品質が足りなければ上げる形でいいんじゃないでしょうか。

トークン消費量の実データから見るROI

室谷室谷代表取締役
公開されてる数値を見ると、同じエージェントタスクでGPT-5.4のxhighが120Mトークン消費したところ、GPT-5.5のxhighだと75M、highで45M、mediumなら22Mまで下がるんです。
テキトー教師テキトー教師.AI認定講師
mediumだと実に6分の1近くに。これでトークン単価が2倍だとしても、総コストはかなり抑えられますね。
室谷室谷代表取締役
簡単な計算をすると、xhigh同士の比較だとトークンコストは2×0.625=1.25倍。でもhighなら2×0.375=0.75倍、mediumなら0.36倍。

むしろ安くなる。
テキトー教師テキトー教師.AI認定講師
ただし、mediumで品質が足りるかはタスク次第です。コードレビューとか精度が求められる場面はxhighが無難。

現場の感覚としては、まずmediumで試してダメなら上げる、で十分対応できる。

GPT-5.4 Proとのコスト比較

室谷室谷代表取締役
Pro同士で比較すると、GPT-5.5 ProはGPT-5.4 Proより効率が確実に上です。Proの制限は緩めだから、長時間エージェントを動かすなら違いが顕著に出る。
テキトー教師テキトー教師.AI認定講師
Proの使用制限って気になる人も多いですよね。xhighで回すと制限に引っかかりやすくなるけど、mediumに下げれば余裕。

運用次第でだいぶ変わる。
室谷室谷代表取締役
ビジネス視点では、Proの月額は固定費だから、トークン消費が減れば減るほど1タスクあたりのコストは下がる。迷う理由があまりない。
テキトー教師テキトー教師.AI認定講師
ええ。ただしGPT-5.4で十分なケースは無理に切り替える必要はないです。

コストと品質のバランスを見て、まずはトライアルで検証するのがおすすめですね。

よくある質問

Q1. Codex 5.5はローカル環境でも動作しますか?

室谷室谷代表取締役
基本的にはクラウドベースですね。ローカル実行というより、VSCode拡張経由でAPIを叩くイメージです。
テキトー教師テキトー教師.AI認定講師
ただ、特定のIDEではオフラインで補完だけ動くモードも聞いたことがあります。そこは公式の仕様確認が必要ですね。

Q2. GPT-5.5(Codex 5.5)は画像認識や生成に対応していますか?

室谷室谷代表取締役
現状の発表ではテキストとコードがメインですね。マルチモーダルは今後のアップデート次第でしょう。
テキトー教師テキトー教師.AI認定講師
画像生成ツールとして使いたいなら、別の専用モデルを検討した方がいいですね。

Q3. GitHub CopilotとCodex 5.5、どちらが優れていますか?

室谷室谷代表取締役
単純な補完ならCopilot、複雑なロジック生成ならCodex 5.5という使い分けが現実的です。
テキトー教師テキトー教師.AI認定講師
プロジェクト全体の設計を相談したい時はCodexの方が好みです。Copilotはもう少し軽い感じですね。

Q4. 無料でCodex 5.5を使う方法はありますか?

室谷室谷代表取締役
おそらく無料枠はないですね。Proプランの月額20ドルが実質的なエントリーです。
テキトー教師テキトー教師.AI認定講師
トライアル期間があるかどうかは、公式の最新情報を確認するのが確実です。

Q5. Codex 5.5のAPIは一般公開されていますか?

室谷室谷代表取締役
発表時はまずVSCode拡張が優先で、APIの一般公開はロールアウト次第という話です。
テキトー教師テキトー教師.AI認定講師
エンタープライズ向けには先行アクセスがある可能性も。興味があれば公式の待機リストに登録してみるといいでしょう。

まとめ

室谷室谷代表取締役
GPT-5.5ことCodex 5.5、開発体験を大きく変える可能性を感じますね。Proの月額20ドルも、時間節約を考えれば悪くない投資です。
テキトー教師テキトー教師.AI認定講師
一方で、まだ触っていない人も多いでしょう。最初はちょっとしたコード補完から試すのがおすすめです。
室谷室谷代表取締役
競合のClaude Opus 4.7との比較も重要ですが、結局は自分のワークフローに合うかどうか。無理に乗り換える必要はないです。
テキトー教師テキトー教師.AI認定講師
段階的に導入するのが吉ですね。まずはVSCode拡張を入れて、非同期での提案に慣れてみてください。
室谷室谷代表取締役
コード生成の未来は確実にここにある。面白い時代です。

関連記事

新着記事

関連記事

.AI TIMES一覧に戻る