世界を動かす技術を、日本語で。

GPT-5.6による価格性能のフロンティアの進展

2026年7月31日原文(openai.com)

概要

  • OpenAIは GPT-5.6ファミリーの効率化 によるコスト削減を発表
  • LunaとTerraモデルの価格を大幅値下げ、SolはAPIで高速化
  • 企業向けAI利用のコストパフォーマンス向上 を実現
  • Fast mode導入で SolモデルのAPI応答速度が最大2.5倍
  • 価格・利用条件の詳細と効率化技術の解説

GPT-5.6ファミリー:効率化と価格改定の概要

  • GPT-5.6 Luna は最速・最安モデル、価格が 80%値下げ
  • GPT-5.6 Terra はバランス型、 20%値下げ
    • これらの価格改定は ChatGPT WorkやCodexの利用クレジット計算にも反映
  • Luna は高品質な大量処理を低コストで実現
    • 複雑なワークフローやツール連携にも対応
  • OpenAIのミッション「 高度な知能の普及とコスト削減」の実践
  • モデル構築・運用・最適化の継続的な改善成果

APIの新機能:Fast modeの導入

  • Fast mode は従来のPriority Processingを置換
    • GPT-5.6 Sol で最大 2.5倍の高速処理 を提供
    • 価格はStandardの 2倍、知能レベルは同等
    • 既存のpriorityタグ付きリクエストは自動でFast modeに移行
  • 後方互換性 を維持したAPI設計

最適なAI活用のための選択肢拡大

  • AI活用は 成果・コスト・緊急性・規模 に応じて最適化
  • Luna は1タスクあたり約 6セント、速度は従来の9倍
    • Agents’ Last Examで Fable 5を圧倒的低コストで上回る
  • 例:
    • コーディングワークフローでは Solで計画立案、Lunaで実装・テスト
    • ワークフローごとに最適なバランスを選択可能
  • GPT-5.6ファミリー で柔軟な知能・コスト配分を実現

効率化の技術的進歩

  • モデル・推論システム・エージェント連携の最適化
    • ルーティング改善・生成ソフト最適化・コンテキスト管理強化
  • 同一計算資源でより多くの有用な処理 を達成
  • GPT-5.6 Sol は自律的にカーネル最適化・実験設計・トレーニング監視を実施
    • サーバーコスト 20%削減、トークン生成効率 15%以上向上
    • モデルの自律性向上で効率化の加速

スケールに対応する計算戦略

  • 需要増加に備えたインフラ拡充と最適配置
    • 高ボリューム作業は Luna/Terraの低価格 で大規模処理が可能
    • 高度なSolワークロードは Fast mode で高速化
  • エンタープライズ向け :日常業務のAI化と重要業務の高速化を両立
    • ドキュメント分析・顧客対応分類・ルーチン実装の大規模展開
    • 複雑なSolワークロードも迅速化
  • モデルの進化が 次世代の効率化サイクルを加速

価格・提供状況

  • GPT-5.6 Terra/LunaChatGPT Work、Codex、OpenAI API で利用可能
    • ChatGPT Work/Codex:Free/GoユーザーはTerra、Plus/Pro/Business/EnterpriseはTerraとLunaが選択可
  • API価格(7月30日以降)
    • Terra: 入力100万トークン=$2、出力100万トークン=$12
    • Luna: 入力100万トークン=$0.20、出力100万トークン=$1.20
    • Solの価格は変更なし
  • ChatGPT/Codexの サブスクリプション価格・クレジット枠は据え置き
    • Terra/Luna利用時のクレジット消費量が減少
  • AWSなどで 価格変更が順次反映
  • Fast mode はAPIのPriority Processingを置換、Codexの/fastと連携
    • 既存のpriorityタグ付きリクエストも継続利用可能
  • API価格詳細は公式サイトで公開

Hackerたちの意見

カーネル作業のおかげで、モデルのエンドツーエンドコストが20%削減されました。その実験ではトークン生成効率が15%以上向上しました。もしGPT-5.6の提供コストが20%下がったら、毎月数十億ドルの節約になるってこと?AnthropicがSpaceXから推論能力を借りるのに12.5億ドル使ってるのは知ってるけど(2つのColossusデータセンターで)、それがAnthropicの推論能力のどれくらいなのかは分からないな(おそらく少しだけだろうけど、SpaceXとの契約前はAWSや他のプロバイダーを使ってたから)。OpenAIの月ごとの推論コストについては具体的な数字を見たことがないけど、きっとそれも数十億ドルにはなってるはず。だから20%の削減は本当に大きな意味があるね。

それを履歴書に書くのを想像してみて。> 推論コストを20%削減し、会社に毎月数十億ドルの節約をもたらした。

約2年前、gemini2.5は自分のためにより良いカーネルを書くのを手伝って、(たった)1%の効率向上を達成した。今は20%だね。

すでにめっちゃ安くて超優秀なLunaを5倍安くするなんて、頭おかしいよね。仕事ではSolを使ってるけど、家ではLunaを使ってる。確かに違いはあるけど、そこまで大きな差は感じないかな。価格がどんどん上がってたのに、急に(これやKimi K3、GLM 5.2の影響で)また価格が下がってきた気がする。

SolとLunaの比較 > 夜と昼の違いは感じないね。君の言いたいことは分かるよ。 :)

何をしているかによるよ。バグ修正みたいな検証可能なタスクをやってるなら、正しい検証をすればどのモデルでも大丈夫だよ。

キミってそんなに安いの?結構高価なモデルだと思ってたけど。

もう時間の問題だね。これらの企業は市場をつかむために昼夜を問わず働いてるよ。

今日から、GPT-5.6 Luna、最速で最も手頃なモデルが80%安くなる。言葉が出ないよ。正直、私たちは停滞していて、数ヶ月で5-10%の改善を目指している段階だと思ってた。こんな急激な変化を見ると、本当に底がどこにあるのか疑問に思う。

正直なところ、今の価格については何が本物で何が投資家の補助で市場を奪おうとしているのかは分からない。もしかしたら、OpenAIはAnthropicを潰そうとしてるのかもしれないね、もし彼らがより深いポケットを持っていると感じているなら。

ソネット5はかなり微妙な立場になりそうだね。

信じられない数字だね。批判するつもりはないけど、本当に感心してる。たとえ性能が数パーセント低くても、競合より80%以上安くて、アメリカの会社がアメリカのハイパースケーラーのクラウドでホスティングされてるなら、これはもう選ぶ理由がないよね。ほとんどのビジネスにとって、他の選択肢を正当化するのは難しいと思う。

Hacker Newsで議論の続きを見る