最終更新日: 2026/08/02
OpenAI 公式 Models ページ をもとに OpenAI が提供するモデルについて日本語でまとめています。料金や仕様は変更される可能性があるため最新情報は必ず公式サイトでご確認ください。
- 単位 $ はすべて US ドルです
OpenAI API は多様なワークロードに対応する複数のモデル群で構成されています。モデルごとに対応モダリティ、推論能力、料金体系、サービスポリシーが異なります。開発用途に応じてモデルを選択し、必要であればファインチューニングやツール連携を組み合わせて利用できます。
| カテゴリ | 概要 |
|---|---|
| フロンティアモデル | 公式 Models ページで主要モデルとして案内されている最新世代の汎用モデル。 |
| その他フロンティアモデル | 公式の Frontier models に含まれる、上位版・小型版・旧世代の汎用モデル。 |
| 特化モデル | 画像、動画、リアルタイム・音声、コーディング、ディープリサーチ、オープンウェイト、ChatGPT 向けモデル。 |
| その他 | 上記の公式カテゴリに当てはまらない既存モデルや、More models 相当のモデル。 |
公式 Models ページで主要モデルとして案内されている最新世代の汎用モデルです。
複雑なプロフェッショナルワーク、推論、コーディング向けの GPT-5.6 系フロンティアモデル。 gpt-5.6 エイリアスはこのモデルにルーティングされます。
- モデル ID:
gpt-5.6-sol(エイリアス:gpt-5.6) - Reasoning: 最高
- Speed: 高速
- 価格(1M トークンあたり): 入力 $5.00 / キャッシュ入力 $0.50 / 出力 $30.00
- コンテキストウィンドウ: 1,050,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2026/02/16
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 推論トークン、ストリーミング、function calling、structured outputs をサポート。Responses API では web search、file search、computer use、MCP などのツールを利用できます。
知能とコストのバランスを取る GPT-5.6 系モデル。従来の GPT-5 系における mini 相当の位置付けです。
- モデル ID:
gpt-5.6-terra - Reasoning: 高
- Speed: 高速
- 価格(1M トークンあたり): 入力 $2.50 / キャッシュ入力 $0.25 / 出力 $15.00
- コンテキストウィンドウ: 1,050,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2026/02/16
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 推論トークン、ストリーミング、function calling、structured outputs と Responses API の各種ツールをサポート。
コスト重視かつ高ボリュームのワークロード向けに最適化された GPT-5.6 系モデル。従来の GPT-5 系における nano 相当の位置付けです。
- モデル ID:
gpt-5.6-luna - Reasoning: 高
- Speed: 高速
- 価格(1M トークンあたり): 入力 $1.00 / キャッシュ入力 $0.10 / 出力 $6.00
- コンテキストウィンドウ: 1,050,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2026/02/16
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 推論トークン、ストリーミング、function calling、structured outputs と Responses API の各種ツールをサポート。
公式の Frontier models に含まれる、上位版・小型版・旧世代の汎用モデルです。
コーディングとプロフェッショナルワーク向けの旧世代フロンティアモデル。複雑な推論やコーディングで利用できます。 reasoning.effort は none / low / medium / high / xhigh をサポートします。
- Reasoning: 最高
- Speed: 高速
- 価格(1M トークンあたり): 入力 $5.00 / キャッシュ入力 $0.50 / 出力 $30.00
- コンテキストウィンドウ: 1,050,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2025/12/01
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 複雑なプロフェッショナルワーク向けの最新モデル。スナップショット
gpt-5.5-2026-04-23が利用可能。
複雑な業務、コーディング、エージェントワークフロー向けのフロンティアモデル。 reasoning.effort は none / low / medium / high / xhigh をサポートします。
- Reasoning: 最高
- Speed: 中
- 価格(1M トークンあたり): 入力 $2.50 / キャッシュ入力 $0.25 / 出力 $15.00
- コンテキストウィンドウ: 1,050,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2025/08/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 複雑なプロフェッショナルワーク向けの中核モデル。推論トークン対応。
GPT-5.4 の強みをより高速・高効率にした mini モデル。高ボリューム処理、コーディング、 computer use、subagents 向けです。
- Reasoning: 高
- Speed: 高
- 価格(1M トークンあたり): 入力 $0.75 / キャッシュ入力 $0.075 / 出力 $4.50
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2025/08/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 高スループット用途向けの最上位 mini モデル。推論トークン対応。
GPT-5.5 をさらに高精度化した上位版。より多くの計算資源を使って難しい問題に取り組み、より賢く正確な応答を返すモデルです。
- Reasoning: 最高(推論トークン対応)
- Speed: 最低速
- 価格(1M トークンあたり): 入力 $30.00 / 出力 $180.00
- コンテキストウィンドウ: 1,050,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2025/12/01
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: Responses API と Batch API で利用可能。応答完了まで数分かかる場合があり、タイムアウト回避にはバックグラウンドモードが推奨されます。キャッシュ入力割引はありません。スナップショット
gpt-5.5-pro-2026-04-23が利用可能。
GPT-5.4 をさらに高精度化した上位版。より賢く正確なレスポンスを返す代わりに、計算資源を多く使うモデルです。
- Reasoning: 最高(推論トークン対応、
reasoning.effort=medium|high|xhigh) - Speed: 最低速
- 価格(1M トークンあたり): 入力 $30.00 / 出力 $180.00
- コンテキストウィンドウ: 1,050,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2025/08/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: Responses API 限定。複雑な問題向けで、応答完了まで数分かかる場合があります。タイムアウト回避にはバックグラウンドモードが推奨されます。
シンプルな高頻度タスク向けの最安価な GPT-5.4 系モデル。分類、抽出、ランキング、subagents のような速度・コスト重視の用途に向きます。
- Reasoning: 高
- Speed: 高
- 価格(1M トークンあたり): 入力 $0.20 / キャッシュ入力 $0.02 / 出力 $1.25
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2025/08/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: コストとレイテンシーを最優先する大量処理向け。推論トークン対応。
GPT-5 のより高速でコスト効率のよいバージョン。よく定義されたタスクや精密なプロンプトに向いています。
- Reasoning: 高(推論トークン対応)
- Speed: 高
- 価格(1M トークンあたり): 入力 $0.25 / キャッシュ入力 $0.025 / 出力 $2.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2024/05/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 定型業務や大量バッチ処理向け。
GPT-5 の最も高速で安価なバージョン。要約や分類のタスクに向いています。
- Reasoning: 普通(推論トークン対応)
- Speed: 非常に高速
- 価格(1M トークンあたり): 入力 $0.05 / キャッシュ入力 $0.005 / 出力 $0.40
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2024/05/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: レイテンシー重視の分類・要約パイプラインに最適。
GPT-5.1 以前のフラグシップモデル。高精度な推論とコード支援が可能で、既存ワークロードの互換性維持に使われます。
- Reasoning: 非常に高い(推論トークン対応)
- Speed: 中
- 価格(1M トークンあたり): 入力 $1.25 / キャッシュ入力 $0.125 / 出力 $10.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 高精度のコーディング支援とエージェント的操作に最適
指示追従とツールコールに最適化された非推論モデル。低レイテンシー重視。
- Reasoning / Intelligence: 非常に高い(推論ステップなし)
- Speed: 中
- 価格(1M トークンあたり): 入力 $2.00 / キャッシュ入力 $0.50 / 出力 $8.00
- コンテキストウィンドウ: 1,047,576
- 最大出力トークン: 32,768
- ナレッジカットオフ: 2024/06/01
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 推論トークンを使用せずリアルタイム性を優先。複雑なタスクには GPT-5 が推奨されます。
画像、動画、リアルタイム・音声、コーディング、ディープリサーチ、オープンウェイト、ChatGPT 向けのモデル群です。
画像生成と編集向けのモデル群です。
最新の画像生成モデル。高速かつ高品質な画像生成と編集に対応し、柔軟な画像サイズ指定と高忠実度の画像入力をサポートします。
- Performance: 最高
- Speed: 中
- 価格(1M トークンあたり):
- テキストトークン: 入力 $5.00 / キャッシュ入力 $1.25
- 画像トークン: 入力 $8.00 / キャッシュ入力 $2.00 / 出力 $30.00
- 入力モダリティ: テキスト・画像
- 出力モダリティ: 画像
- 特徴: スナップショット
gpt-image-2-2026-04-21が利用可能
1 つ前の画像生成モデル。指示追従性とプロンプトへの忠実さが改善されており、画像生成と編集に対応します。
- Performance: 最高
- Speed: 中
- 価格(1M トークンあたり):
- テキストトークン: 入力 $5.00 / キャッシュ入力 $1.25 / 出力 $10.00
- 画像トークン: 入力 $8.00 / キャッシュ入力 $2.00 / 出力 $32.00
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト・画像
- chatgpt-image-latest
- GPT Image 1
- gpt-image-1-mini
- DALL·E 3
- DALL·E 2
動画生成向けのモデル群です。
同期した音声付きの動画を生成するフラッグシップ動画モデル。自然言語や画像の指示からリッチで動的なクリップを作成できます。
- Performance: 高
- Speed: 低
- 価格(動画生成): 1 秒あたり $0.10 (縦長: 720x1280 / 横長: 1280x720 )
- 入力モダリティ: テキスト・画像
- 出力モダリティ: 動画
- 特徴: 汎用的な動画生成用途向け
最も高度な同期した音声付きの動画生成モデル。自然言語や画像の指示から映画品質のクリップを生成します。
- Performance: 最高
- Speed: 最も低速
- 価格(動画生成): 1 秒あたり $0.30 (縦長: 720x1280 / 横長: 1280x720 )、$0.50(縦長: 1024x1792 / 横長: 1792x1024 )
- 入力モダリティ: テキスト・画像
- 出力モダリティ: 動画
リアルタイム会話、音声入出力、文字起こし向けのモデル群です。
gpt-realtime-2 を更新した、推論対応のリアルタイム音声モデル。英数字の認識、無音・ノイズ処理、中断時の挙動が改善されており、複雑な音声エージェントワークフロー向けに設定可能な推論負荷、指示追従、ツール利用をサポートします。
- Reasoning: 最高(推論トークン対応、推論負荷を調整可能)
- Speed: 高速
- 価格
- テキストトークン / 1M: 入力 $4.00 / キャッシュ入力 $0.40 / 出力 $24.00
- 音声トークン / 1M: 入力 $32.00 / キャッシュ入力 $0.40 / 出力 $64.00
- 画像トークン / 1M: 入力 $5.00 / キャッシュ入力 $0.50
- コンテキストウィンドウ: 128,000
- 最大出力トークン: 32,000
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・音声・画像
- 出力モダリティ: テキスト・音声
- 特徴: 音声対話での認識精度や割り込み処理を改善した gpt-realtime-2 系の上位モデル。Realtime API のほか、Responses API / Chat Completions API などでも利用可能として掲載されています。
より高速・低コストなリアルタイム音声対話向けの蒸留推論モデル。 WebRTC / WebSocket / SIP 接続を通じた音声・テキスト入力に対応し、 gpt-realtime-2 より英数字認識が改善されています。
- Reasoning: 高(推論トークン対応)
- Speed: 非常に高速
- 価格
- テキストトークン / 1M: 入力 $0.60 / キャッシュ入力 $0.06 / 出力 $2.40
- 音声トークン / 1M: 入力 $10.00 / キャッシュ入力 $0.30 / 出力 $20.00
- 画像トークン / 1M: 入力 $0.80 / キャッシュ入力 $0.08
- 入力モダリティ: テキスト・音声・画像
- 出力モダリティ: テキスト・音声
- 特徴: 低レイテンシー・低コストの音声エージェント向け。Realtime API のほか、Responses API / Chat Completions API などでも利用可能として掲載されています。
低レイテンシーの音声対話向けに設計された、推論対応のリアルタイム音声モデル。音声エージェントでの強い指示追従、複雑なツール利用、長いセッション状態の扱いに向きます。
- Reasoning: 最高(推論トークン対応、推論負荷を調整可能)
- Speed: 高速
- 価格
- テキストトークン / 1M: 入力 $4.00 / キャッシュ入力 $0.40 / 出力 $24.00
- 音声トークン / 1M: 入力 $32.00 / キャッシュ入力 $0.40 / 出力 $64.00
- 画像トークン / 1M: 入力 $5.00 / キャッシュ入力 $0.50
- コンテキストウィンドウ: 128,000
- 最大出力トークン: 32,000
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・音声・画像
- 出力モダリティ: テキスト・音声
- 特徴: Realtime 2.0 のプロンプトガイドでは、強いリアルタイム推論、ツール利用、指示追従が必要な場合に推奨されています。プロダクションの音声エージェントでは
reasoning.effort=lowから評価することが案内されています。
音声エージェントやカスタマーサポート向けに設計された、 gpt-realtime 系の上位モデル。音声・テキストの双方向入出力に加えて画像入力にも対応します。
- 価格
- テキストトークン / 1M: 入力 $4.00 / キャッシュ入力 $0.40 / 出力 $16.00
- 音声トークン / 1M: 入力 $32.00 / キャッシュ入力 $0.40 / 出力 $64.00
- 画像トークン / 1M: 入力 $5.00 / キャッシュ入力 $0.50
- コンテキストウィンドウ: 32,000
- 最大出力トークン: 4,096
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・音声・画像
- 出力モダリティ: テキスト・音声
音声とテキストの双方向ストリーミングに特化した初の一般提供リアルタイムモデル。WebRTC、WebSocket、SIP 接続を介して応答します。
- 価格
- テキストトークン / 1M: 入力 $4.00 / キャッシュ入力 $0.40 / 出力 $16.00
- 音声トークン / 1M: 入力 $32.00 / キャッシュ入力 $0.40 / 出力 $64.00
- コンテキストウィンドウ: 32,000
- 最大出力トークン: 4,096
- ナレッジカットオフ: 2023/10/01
- 入力モダリティ: テキスト・音声・画像
- 出力モダリティ: テキスト・音声
gpt-realtime のコスト効率のよいバージョン。 WebRTC / WebSocket / SIP 接続を通じて音声・テキストを扱えます。
- 価格
- テキストトークン / 1M: 入力 $0.60 / キャッシュ入力 $0.06 / 出力 $2.40
- 音声トークン / 1M: 入力 $10.00 / キャッシュ入力 $0.30 / 出力 $20.00
- 画像トークン / 1M: 入力 $0.80 / キャッシュ入力 $0.08
- コンテキストウィンドウ: 32,000
- 最大出力トークン: 4,096
- ナレッジカットオフ: 2023/10/01
- 入力モダリティ: テキスト・画像・音声
- 出力モダリティ: テキスト・音声
ライブ多言語音声体験向けのストリーミング音声翻訳モデル。音声入力を受け取り、入力音声が届いている途中から翻訳済み音声と transcript delta を返します。会話管理やツール呼び出しを行うアシスタントではなく、「人が話した内容を翻訳する」用途向けです。
- Performance: 最高
- Speed: 非常に高速
- 価格: リアルタイム音声 1 分あたり $0.034
- コンテキストウィンドウ: 16,000
- 最大出力トークン: 2,000
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: 音声
- 出力モダリティ: 音声・テキスト
- 特徴: 専用の Realtime translation endpoint
v1/realtime/translationsで利用します。
Chat Completions REST API で利用できる初の一般提供音声モデル。テキストと音声の入力・出力に対応します。
- 料金
- テキストトークン / 1M: 入力 $2.50 / 出力 $10.00
- 音声トークン / 1M: 入力 $40.00 / 出力 $80.00
- コンテキストウィンドウ: 128,000
- 最大出力トークン: 16,384
- ナレッジカットオフ: 2023/10/01
- 入力モダリティ: テキスト・音声
- 出力モダリティ: テキスト・音声
Chat Completions REST API で利用できる、音声入出力向けの上位モデル。テキストと音声の双方向入出力に対応します。
- 料金
- テキストトークン / 1M: 入力 $2.50 / 出力 $10.00
- 音声トークン / 1M: 入力 $32.00 / 出力 $64.00
- コンテキストウィンドウ: 128,000
- 最大出力トークン: 16,384
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・音声
- 出力モダリティ: テキスト・音声
Chat Completions REST API で利用できる gpt-audio のコスト効率のよいバージョン。テキストと音声の双方向入出力を低コストで提供します。
- 料金
- テキストトークン / 1M: 入力 $0.60 / 出力 $2.40
- 音声トークン / 1M: 入力 $10.00 / 出力 $20.00
- コンテキストウィンドウ: 128,000
- 最大出力トークン: 16,384
- ナレッジカットオフ: 2023/10/01
- 入力モダリティ: テキスト・音声
- 出力モダリティ: テキスト・音声
話者ダイアライゼーション(話者特定)機能を備えた自動音声認識(ASR)モデル。会話音声を話者ごとのセグメントに紐づけながら文字起こしでき、Transcriptions API で利用できます。
- Performance: 高
- Speed: 中
- 価格(テキストトークン / 1M): 入力 $2.50 / 出力 $10.00
- 価格(音声トークン / 1M): 入力 $6.00
- コンテキストウィンドウ: 16,000
- 最大出力トークン: 2,000
- ナレッジカットオフ: 2024/06/01
- 入力モダリティ: テキスト・音声
- 出力モダリティ: テキスト
- 特徴: 話者識別を行い区間ごとに異なる話者を判別した結果を返す
ライブ音声から低レイテンシーの transcript delta が必要なアプリケーション向けのストリーミング speech-to-text モデル。レイテンシーと精度を調整したいリアルタイム用途のために設計されており、テキストトークンではなく音声時間に基づいて課金されます。
- Performance: 高
- Speed: 非常に高速
- 価格: リアルタイム音声 1 分あたり $0.017
- コンテキストウィンドウ: 16,000
- 最大出力トークン: 2,000
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・音声
- 出力モダリティ: テキスト
- 特徴: Realtime transcription session で
audio.input.transcription.modelに指定して利用します。ファイルやリクエスト・レスポンス型の文字起こし全般の置き換えではなく、ライブ音声での遅延と精度の要件に応じて評価するモデルです。
ライブ音声から低レイテンシーの transcript delta を取得するストリーミング speech-to-text モデル。レイテンシーを調整でき、非構造化コンテキスト、キーワードヒント、言語ヒントに対応します。
- 価格: リアルタイム音声 1 分あたり $0.017
- 入力モダリティ: テキスト・音声
- 出力モダリティ: テキスト
- 特徴: 低遅延の Realtime transcription 向け。ストリーミングに対応し、function calling と structured outputs には対応していません。
高精度な speech-to-text モデル。完了した音声ファイル、ストリーミング中のファイル文字起こし、WebSocket の Realtime セッションで確定したターンの文字起こしに対応します。非構造化コンテキスト、キーワードヒント、言語ヒントも利用できます。
- 価格: 文字起こし音声 1 分あたり $0.0045
- 入力モダリティ: テキスト・音声
- 出力モダリティ: テキスト
- 特徴: ファイル文字起こしと Realtime 入力の確定ターンの文字起こしに対応します。
- gpt-audio
- GPT-4o Audio
- GPT-4o mini Audio
- GPT-4o Realtime
- GPT-4o mini Realtime
- GPT-4o Transcribe
- GPT-4o mini Transcribe
- GPT-4o mini TTS
- TTS-1
- TTS-1 HD
- Whisper
ソフトウェアエンジニアリング向けに最適化されたモデル群です。
Codex (や Codex の類似環境)でのエージェント的コーディングタスクに最適化された GPT-5 の 1 バージョン。 Responses API 限定で提供され、定期的にスナップショットが更新されます。
- Reasoning: 非常に高い(推論トークン対応)
- Speed: 中
- 価格(1M トークンあたり): 入力 $1.25 / キャッシュ入力 $0.125 / 出力 $10.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
Codex(や類似の開発環境)でのエージェント的コーディングに最適化された最新世代の上位モデル。 Responses API 限定で提供され、 reasoning.effort=low|medium|high|xhigh をサポートします。
- Reasoning: 高い(推論トークン対応)
- Speed: 中
- 価格(1M トークンあたり): 入力 $1.75 / キャッシュ入力 $0.175 / 出力 $14.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2025/08/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 長時間のエージェント的コーディングタスクに向くよう最適化されたモデル。
GPT-5.2 を Codex(や IDE )向けに最適化したモデル。長期のエージェント的コーディングタスクに合わせた設計で、Responses API 限定で提供されます。推論負荷を reasoning.effort=low|medium|high|xhigh で調整可能です。
- Reasoning: 高い(推論トークン対応)
- Speed: 中
- 価格(1M トークンあたり): 入力 $1.75 / キャッシュ入力 $0.175 / 出力 $14.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2025/08/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 長期のエージェント的コーディングタスクに最適化された上位 Codex モデル。
GPT-5.1 を Codex (や IDE )向けに最適化したバージョン。 Responses API 限定で提供され、スナップショットが定期的に更新されます。
- Reasoning: 非常に高い(推論トークン対応、
reasoning.effort=noneも設定可) - Speed: 中
- 価格(1M トークンあたり): 入力 $1.25 / キャッシュ入力 $0.125 / 出力 $10.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト・画像
- 特徴: Codex や MCP ベースの開発環境でエージェント的なコーディングを行う用途に合わせ、プロンプト設計ガイド(dedicated guide)が提供されている。
GPT-5.1-Codex を長尺・高難度のエージェントコーディングに最適化した最上位モデル。Responses API 限定で提供され、推論トークン対応のまま長期コンテキストと高い速度を両立します。
- Reasoning: 非常に高い(推論トークン対応)
- Speed: 高
- 価格(1M トークンあたり): 入力 $1.25 / キャッシュ入力 $0.125 / 出力 $10.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 長いコンテキストを前提にしたエージェント的コーディングへ最適化。推論トークンを活用しつつ、高速レスポンスで複数ツール連携や長期タスクを支援。
GPT-5.1-Codex を小型化したコスト効率モデル。Responses API で Codex 体験を維持しつつ、スループット重視の自動化や大量ジョブに向きます。
- Reasoning: 高い(推論トークン対応)
- Speed: 中(GPT-5.1-Codex より低負荷)
- 価格(1M トークンあたり): 入力 $0.25 / キャッシュ入力 $0.025 / 出力 $2.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト・画像
- 特徴: 「Smaller, more cost-effective, less-capable version of GPT-5.1-Codex」として案内されており、推論負荷を抑えてもエージェント的コーディングワークフローを維持できる。
- codex-mini-latest (deprecated)
深い調査タスク向けに案内されているモデル群です。
- o3-deep-research
- o4-mini-deep-research
Apache 2.0 ライセンスで公開されているモデルウェイト。 HuggingFace から取得し、ローカル/オンプレミスでカスタマイズ・推論可能です。
OpenAI の最も強力なオープンウェイトモデル。 H100 GPU 1枚で動作可能な設計。 117B パラメータ( 5.1B アクティブ)。
- Reasoning: 非常に高い(推論トークン対応)
- Speed: 中
- 価格: API 課金なし(ダウンロード提供)
- コンテキストウィンドウ: 131,072
- 最大出力トークン: 131,072
- ナレッジカットオフ: 2024/06/01
- 入力モダリティ: テキスト
- 出力モダリティ: テキスト
- 主な特徴:
- Apache 2.0 ライセンスで自由に利用・再配布可能
- 推論負荷を調整可能(低/中/高)
- 推論過程を追跡できる完全な Chain-of-Thought
- ファインチューニングやエージェント用途(ファンクションコーリング・ウェブブラウジング・ Python コード実行・ Structured outputs 等)に対応
レイテンシの低い、中サイズのオープンウェイトモデル。ローカルや特化したユースケース向き。 21B パラメータ( 3.6B アクティブパラメータ)。
- Reasoning: 非常に高い(推論トークン対応)
- Speed: 中
- 価格: API 課金なし(オープンウェイト/ダウンロード提供)
- コンテキストウィンドウ: 131,072
- 最大出力トークン: 131,072
- ナレッジカットオフ: 2024/06/01
- 入力モダリティ: テキスト
- 出力モダリティ: テキスト
- 主な特徴:
- Apache 2.0 ライセンス
- 推論負荷を調整可能(低/中/高)
- 推論過程を追跡できる完全な Chain-of-Thought
- ファインチューニングやエージェント用途(ファンクションコーリング・ウェブブラウジング・ Python コード実行・ Structured outputs 等)に対応
ChatGPT 製品内で利用されるモデルです。 API 用途には推奨されないものを含みます。
- chat-latest
- GPT-5 Chat
- ChatGPT-4o (deprecated)
ChatGPT で現在使われている最新 Instant モデルを指すチャット向けエイリアス。基盤となるモデルスナップショットは定期的に更新されます。プロダクション API 用途では GPT-5.5 の利用が推奨されていますが、ChatGPT 向けの最新改善を試す用途に使えます。
- Intelligence: 高
- Speed: 中
- 価格(1M トークンあたり): 入力 $5.00 / キャッシュ入力 $0.50 / 出力 $30.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2025/08/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: Responses API で Web search、File search、Image generation、Code interpreter、MCP をサポートします。Hosted shell、Apply patch、Skills、Computer use、Tool search は非対応です。
上記の公式カテゴリに当てはまらない既存モデルや、More models 相当のモデルをまとめています。
GPT-5.5 / GPT-5.4 より前の世代にあたるフラグシップモデル。コーディングとエージェントタスク向けの高性能モデルです。
- Reasoning: 高い(推論トークン対応)
- Speed: 高(高速)
- 価格(1M トークンあたり): 入力 $1.75 / キャッシュ入力 $0.175 / 出力 $14.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2025/08/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: コーディング支援とマルチステップのエージェント処理の両方に強い。
GPT-5.2 の前世代にあたるフラグシップモデル。コーディングとエージェントタスク向けに推論負荷を柔軟に調整でき、 Responses API の推論トークン機能と相性が良いです。
- Reasoning: 非常に高い(推論トークン対応、
reasoning.effort=noneも設定可) - Speed: 高(GPT-5 より高速)
- 価格(1M トークンあたり): 入力 $1.25 / キャッシュ入力 $0.125 / 出力 $10.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト・画像
API リクエストに返答する前にマルチターンモデルインタラクションを行えるモデル。 Responses API のみで利用可。難しい問題に取り組むために設計されており、リクエスト処理に数分かかることがあります。タイムアウト回避にはバックグラウンドモードでの利用が推奨されます。 reasoning.effort として medium high xhigh をサポートします。
- Reasoning: 非常に高い(推論トークン対応、
reasoning.effort=medium|high|xhigh) - Speed: 低(シリーズ中最も遅い)
- 価格(1M トークンあたり): 入力 $21 / 出力 $168
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 128,000
- ナレッジカットオフ: 2025/08/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
GPT-5 のより賢く正確なレスポンスを返すバージョン。計算資源を多く使いよりよい答えを提供します。 API レスポンスを返す前に複数ステップのアクションを可能とするために Responses API 限定。
- Reasoning: 最高(
reasoning.effort: high固定) - Speed: 低(シリーズ中最も遅い)
- 価格(1M トークンあたり): 入力 $15.00 / 出力 $120.00
- コンテキストウィンドウ: 400,000
- 最大出力トークン: 272,000
- ナレッジカットオフ: 2024/09/30
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: 難しい問題に対応できるよう設計されておりリクエスト処理に数分かかることもある。タイムアウトを避けるにはバックグラウンドモードでの利用が推奨される。
ChatGPT で現在使われている GPT-5.3 Instant スナップショットを指すチャット向けモデル。 API 利用では GPT-5.2 が推奨されていますが、最新のチャット改善を試す用途に使えます。
- Intelligence: 高
- Speed: 中
- 価格(1M トークンあたり): 入力 $1.75 / キャッシュ入力 $0.175 / 出力 $14.00
- コンテキストウィンドウ: 128,000
- 最大出力トークン: 16,384
- ナレッジカットオフ: 2025/08/31
- 入力モダリティ: テキスト・画像
- 出力モダリティ: テキスト
- 特徴: ChatGPT で使われる GPT-5.3 系のチャット用エイリアス。 API の標準用途では GPT-5.2 が案内されています。
- o3-pro
- o3
- o4-mini
- GPT-4.1 mini
- GPT-4.1 nano
- o1-pro
- computer-use-preview
- GPT-4o mini Search Preview
- GPT-4o Search Preview
- GPT-4.5 Preview (deprecated)
- o3-mini
- o1
- omni-moderation
- o1-mini (deprecated)
- o1 Preview (deprecated)
- GPT-4o
- GPT-4o mini
- GPT-4o Turbo
- babbage-002
- ChatGPT-4o
- davinci-002
- GPT-3.5 Turbo
- GPT-4
- GPT-4 Turbo Preview
- GPT-5.3 Chat
- GPT-5.2 Chat
- GPT-5.1 Chat
- GPT-5 Chat
- text-embedding-3-large
- text-embedding-3-small
- text-embedding-ada-002
- text-moderation (deprecated)
- text-moderation-stable (deprecated)
- 多くの料金は 1M トークンあたりです。動画生成モデルは 1 秒あたり、文字起こしモデルは推定コストも併記しています。
- 料金は基本的に使用トークン数に基づきます。 Responses API でツールを呼び出す場合はツール呼び出しごとに追加料金が発生することがあります。
- Batch API を利用すると割引料金が適用されます。
- 以下は
Standardの主な価格です。最新のBatch/Flex/Priorityは公式 Pricing ページを参照してください。
| モデル | 短コンテキスト入力 | 短コンテキストキャッシュ入力 | 短コンテキスト出力 | 長コンテキスト入力 | 長コンテキストキャッシュ入力 | 長コンテキスト出力 |
|---|---|---|---|---|---|---|
GPT-5.6 Sol (gpt-5.6) |
$5.00 | $0.50 | $30.00 | $10.00 | $1.00 | $45.00 |
| GPT-5.6 Terra | $2.50 | $0.25 | $15.00 | $5.00 | $0.50 | $22.50 |
| GPT-5.6 Luna | $1.00 | $0.10 | $6.00 | $2.00 | $0.20 | $9.00 |
| GPT-5.5 | $5.00 | $0.50 | $30.00 | $10.00 | $1.00 | $45.00 |
| GPT-5.5 pro | $30.00 | - | $180.00 | - | - | - |
| GPT-5.4 | $2.50 | $0.25 | $15.00 | $5.00 | $0.50 | $22.50 |
| GPT-5.4 mini | $0.75 | $0.075 | $4.50 | - | - | - |
| GPT-5.4 nano | $0.20 | $0.02 | $1.25 | - | - | - |
| GPT-5.4 pro | $30.00 | - | $180.00 | $60.00 | - | $270.00 |
| モデル | モダリティ | 入力 | キャッシュ入力 | 出力 |
|---|---|---|---|---|
| gpt-realtime-2.1 | Audio | $32.00 | $0.40 | $64.00 |
| gpt-realtime-2.1 | Text | $4.00 | $0.40 | $24.00 |
| gpt-realtime-2.1 | Image | $5.00 | $0.50 | - |
| gpt-realtime-2.1-mini | Audio | $10.00 | $0.30 | $20.00 |
| gpt-realtime-2.1-mini | Text | $0.60 | $0.06 | $2.40 |
| gpt-realtime-2.1-mini | Image | $0.80 | $0.08 | - |
| gpt-realtime-2 | Audio | $32.00 | $0.40 | $64.00 |
| gpt-realtime-2 | Text | $4.00 | $0.40 | $24.00 |
| gpt-realtime-2 | Image | $5.00 | $0.50 | - |
| gpt-realtime-1.5 | Audio | $32.00 | $0.40 | $64.00 |
| gpt-realtime-1.5 | Text | $4.00 | $0.40 | $16.00 |
| gpt-realtime-1.5 | Image | $5.00 | $0.50 | - |
| gpt-realtime-mini | Audio | $10.00 | $0.30 | $20.00 |
| gpt-realtime-mini | Text | $0.60 | $0.06 | $2.40 |
| gpt-realtime-mini | Image | $0.80 | $0.08 | - |
| gpt-realtime-translate | Audio duration | $0.034 / minute | - | - |
| gpt-realtime-whisper | Audio duration | $0.017 / minute | - | - |
| モデル | モダリティ | 入力 | キャッシュ入力 | 出力 |
|---|---|---|---|---|
| gpt-image-2 | Image | $8.00 | $2.00 | $30.00 |
| gpt-image-2 | Text | $5.00 | $1.25 | - |
| gpt-image-1.5 | Image | $8.00 | $2.00 | $32.00 |
| gpt-image-1.5 | Text | $5.00 | $1.25 | $10.00 |
| gpt-image-1-mini | Image | $2.50 | $0.25 | $8.00 |
| gpt-image-1-mini | Text | $2.00 | $0.20 | - |
| モデル | サイズ | 縦長 | 横長 | 1 秒あたりの価格 |
|---|---|---|---|---|
| sora-2 | 720p | 720x1280 | 1280x720 | $0.10 |
| sora-2-pro | 720p | 720x1280 | 1280x720 | $0.30 |
| sora-2-pro | 1024p | 1024x1792 | 1792x1024 | $0.50 |
| sora-2-pro | 1080p | 1080x1920 | 1920x1080 | $0.70 |
| モデル | 用途 | 入力 | 出力 | コスト(推定/実際) |
|---|---|---|---|---|
| gpt-live-transcribe | Realtime transcription | - | - | 実際: $0.017 / minute |
| gpt-transcribe | Transcription / Realtime input transcription | - | - | 実際: $0.0045 / minute |
| gpt-4o-transcribe | Transcription | $2.50 | $10.00 | 推定: $0.006 / minute |
| gpt-4o-mini-transcribe | Transcription | $1.25 | $5.00 | 推定: $0.003 / minute |
| カテゴリ | モデル | 入力 | キャッシュ入力 | 出力 |
|---|---|---|---|---|
| ChatGPT | chat-latest | $5.00 | $0.50 | $30.00 |
| ChatGPT | gpt-5.3-chat-latest | $1.75 | $0.175 | $14.00 |
| Codex | gpt-5.3-codex | $1.75 | $0.175 | $14.00 |
gpt-5.5は 272K を超える入力トークンのプロンプトで、セッション全体に入力 2x / 出力 1.5x の長コンテキスト価格が適用されます。gpt-5.4とgpt-5.4-proには長コンテキスト価格があります。- Regional processing( data residency )エンドポイントでは、
gpt-5.5/gpt-5.5-pro/gpt-5.4/gpt-5.4-mini/gpt-5.4-nano/gpt-5.4-proに 10% の割増料金が適用されます。
いずれも先頭に v1/ が付きます。
chat/completionsresponsesrealtime(GPT-5 シリーズは未対応)realtime/translationsrealtime/transcription_sessionsassistantsbatchfine-tuning(GPT-5 シリーズは未対応)embeddingsimages/generationsimages/editsaudio/speechaudio/transcriptionsaudio/translationsmoderationscompletions(レガシー)
OpenAI API ではモデルと組み合わせて以下のツールや機能を利用できます。対応状況はモデルや API によって異なります。
- Web search (ウェブ検索)
- MCP and Connectors (MCP とコネクタ)
- Skills (スキル)
- Shell (シェル)
- Computer use (コンピューター操作)
- File search and retrieval (ファイル検索と検索拡張)
- Tool search (ツール検索)
- その他
- Apply Patch (パッチ適用)
- Local shell (ローカルシェル)
- Image generation (画像生成)
- Code interpreter (コードインタプリタ)
OpenAI の API レートは組織ごとに設定された Usage tier に基づきます。利用額が増えると自動的に次のティアへ昇格し利用上限が引き上げられます。詳細はアカウント設定の limits セクションで確認できます。
| ティア | 条件 | 月間利用上限(月) |
|---|---|---|
| Free | サービス対象地域のユーザー | $100 |
| Tier 1 | $5 支払い済み | $100 |
| Tier 2 | $50 支払い済みかつ初回支払いから 7 日以上経過 | $500 |
| Tier 3 | $100 支払い済みかつ初回支払いから 7 日以上経過 | $1,000 |
| Tier 4 | $250 支払い済みかつ初回支払いから 14 日以上経過 | $5,000 |
| Tier 5 | $1,000 支払い済みかつ初回支払いから 30 日以上経過 | $200,000 |
- OpenAI Models: https://developers.openai.com/api/docs/models
- GPT-5.5 model guide: https://developers.openai.com/api/docs/guides/latest-model
- Realtime prompting guide: https://developers.openai.com/api/docs/guides/realtime-models-prompting
- Realtime translation: https://developers.openai.com/api/docs/guides/realtime-translation
- Realtime transcription: https://developers.openai.com/api/docs/guides/realtime-transcription
- Pricing: https://developers.openai.com/api/docs/pricing
- Deprecations: https://developers.openai.com/api/docs/deprecations