GPT-5.6 Sol API値下げ:2026年11月21日までのプロモーション
OpenAIはGPT-5.6 SolのAPI料金を、入力100万トークン当たり400ドル、出力100万トークン当たり2,000ドルに引き下げました。プロモーション価格は少なくとも2026年11月21日まで維持され、処理方式やアカウント条件によって実際の請求額は異なる場合があります。
GPT-5.6 Solのプロモーション標準料金は、入力100万トークン当たり400ドル、出力100万トークン当たり2,000ドルです。
OpenAIが発表した値下げ率は入力20%、出力33%であり、モデルの知能レベルを下げる変更とは発表されていません。
値下げは高速モード、長いコンテキストのリクエスト、BatchおよびFlex処理にも適用されますが、各方式の実際の単価は公式料金表で確認する必要があります。
プロモーションは少なくとも2026年11月21日まで提供され、それ以降の延長または価格変更の有無は、確定した終了日とは区別する必要があります。
出力トークンの単価は入力トークンの単価の5倍であるため、応答の長さとエージェントの反復回数が実際のコストを大きく左右します。
OpenAIが高難度タスク向けモデルであるGPT-5.6 SolのAPIプロモーション価格を発表しました。新しい標準料金は入力トークン100万個当たり400ドル、出力トークン100万個当たり2,000ドルで、少なくとも2026年11月21日まで提供される予定です。
何が変わったのか
OpenAIが示した値下げ幅は、入力価格が20%、出力価格が33%です。発表内容によると、モデル自体の知能や機能を縮小した低価格版ではなく、同じGPT-5.6 Solに適用されるAPI価格の変更です。
項目 | プロモーション価格 | 発表された値下げ率
入力トークン | 100万トークン当たり400ドル | 20%
出力トークン | 100万トークン当たり2,000ドル | 33%
提供期間 | 少なくとも2026年11月21日まで | アカウント別の条件が適用される可能性あり
ここで「少なくとも2026年11月21日まで」とは、その日に必ずプロモーションが終了するという意味ではありません。その日までは提供されるものの、延長の有無やそれ以降の価格は別途決定される可能性があるという意味です。
また、「同一のSolインテリジェンス」という表現は、値下げと併せて別途性能の縮小が発表されたわけではないという意味に捉える必要があります。すべてのワークロードで以前と同じ結果が保証されるという、独立した性能検証を意味するものではありません。
実際のAPIコスト計算
提示された標準単価のみを適用した場合、基本コストは次のように計算できます。
予想コスト = 入力トークン数 ÷ 1,000,000 × 400ドル + 出力トークン数 ÷ 1,000,000 × 2,000ドル
使用例 | 入力コスト | 出力コスト | 合計
入力1万トークン、出力2千トークン | 4ドル | 4ドル | 8ドル
入力10万トークン、出力1万トークン | 40ドル | 20ドル | 60ドル
入力100万トークン、出力20万トークン | 400ドル | 400ドル | 800ドル
この計算は、発表資料に示された標準処理単価のみを反映した例です。長いコンテキスト、高速処理、Batch、Flex、キャッシュ関連料金、地域またはアカウント別の条件がある場合、実際の請求額は異なる可能性があります。
提供資料の注記では、コンテキスト長基準の単位が不明確に表記されています。コンテキスト区間ごとの正確な適用基準は推測せず、OpenAIの最新API価格表とアカウントコンソールで確認する必要があります。
価格表より重要なコスト変数
単純に入力単価だけを見ると、実際の予算を過小評価しがちです。Solのプロモーション出力単価は入力単価の5倍であるため、次の変数が総コストに大きな影響を与えます。
· 応答の長さ: 同じ入力でも、長いコード、レポート、または推論結果を生成すると、出力コストが急速に増加します。
· エージェントの反復回数: 計画策定、ツール呼び出し、検証、再試行が繰り返されると、各段階の入力と出力が累積します。
· コンテキストの再送信: 長い会話履歴や文書をリクエストのたびに再度含めると、入力トークンが継続して課金される可能性があります。
· エラーと再試行: 形式エラーやツール呼び出しの失敗により同じタスクを繰り返すと、成功したリクエスト以外のコストも残ります。
· 処理方式: 標準、高速モード、Batch、Flexはレイテンシーと処理条件が異なるため、単価だけで選択すべきではありません。
値下げの効果は、出力比率の高いワークロードで相対的に大きくなる可能性があります。しかし、応答を必要以上に長くしたり、エージェントが終了条件なしに反復したりすると、単価の値下げ分よりトークン使用量の増加のほうが大きくなる可能性があります。
Sol・Terra・Lunaの選択基準
GPT-5.6製品群は、タスクの難易度と処理量に応じて3つの階層に分かれています。最も高価なモデルをすべてのリクエストに固定する代わりに、実際に求められる品質水準に合わせてルーティングするほうが、コスト管理に有利です。
モデル | 主な用途 | 選択を検討する状況
Sol | 最も難しい問題と高難度の推論 | 複雑なコーディングエージェント、多段階分析、失敗コストが大きいタスク
Terra | 日常的なプロダクションタスク | 品質とコストのバランスが必要な反復業務
Luna | 大量・低コストのワークフロー | 分類、抽出、単純な変換など、処理量が重要なタスク
モデルごとの説明は推奨用途を示すものであり、特定のタスクでの性能を保証するものではありません。実際に導入する前に、代表的なデータを用いて、精度、レイテンシー、出力の長さ、再試行率、1件当たりのコストを併せて測定する必要があります。
混合ルーティングが有利な場合
すべてのリクエストをSolに送らず、次のように役割を分担できます。
· LunaまたはTerraがリクエストを分類するか、下書きを作成します。
· 難易度が高い、または不確実性が大きいリクエストのみSolに渡します。
· Solの出力も、ルールベースのチェックやより安価なモデルで検証します。
· エラー率と総トークンコストを基準にルーティングのしきい値を調整します。
ただし、低価格モデルで失敗したリクエストを何度も再処理した後にSolへ送ると、最初からSolを使用するより高くなる可能性があります。モデルの単価だけでなく、タスク完了1件当たりの総コストを比較する必要があります。
適用される処理方式
OpenAIの発表によると、今回の値下げは次の処理方式にも適用されます。
· 高速モード
· 長いコンテキストのリクエスト
· Batch処理
· Flex処理
これは、すべての処理方式に標準料金表の400ドル・2,000ドルという単価がそのまま適用されるという意味ではありません。方式ごとの割引、割増、レイテンシー、利用条件はそれぞれ異なる可能性があるため、実際の単価は公式価格表で区別して確認する必要があります。
導入前に確認すべき運用項目
値下げによって実験範囲を広げられる可能性がありますが、運用予算を管理するには、次の項目も併せて設定することを推奨します。
· リクエストごとの最大入力・出力トークン制限
· エージェントの最大ステップ数と再試行回数
· ユーザー・プロジェクト別の日次または月次予算
· Solへ昇格させる難易度および信頼度の基準
· 標準・Batch・Flex処理のレイテンシー要件
· タスク成功率と完了1件当たりのコストを示すダッシュボード
· プロモーション変更に備えた価格設定の分離
特に、単価をコードへ直接入力すると、プロモーションの終了や料金変更時にコスト計算が誤る可能性があります。価格とモデル名を設定値として分離し、請求データと定期的に照合するほうが安全です。
公式価格表で確認すべき項目
APIを使用する前に、次の情報を最新のOpenAI価格表で確認してください。
· GPT-5.6 Solの現在の入力・出力単価
· プロモーションの適用期間とアカウント別の条件
· 長いコンテキスト区間の基準と追加料金
· 高速モード、Batch、Flexの個別単価
· キャッシュ入力やその他の個別課金項目
· 実際のアカウントで利用できるモデルと処理方式
公式価格表は変更される可能性があるため、予算承認時または大規模デプロイ時点の単価を別途記録しておくことを推奨します。