世界を動かす技術を、日本語で。

DeepSeekのピーク/オフピーク料金更新

概要

  • DeepSeek-V4-Pro の正式リリース
  • Agent機能 の大幅強化と生産性向上
  • 柔軟な推論モード でタスクごとに最適化
  • OpenAI API とのネイティブ連携と簡単セットアップ
  • API料金体系 のアップデートとピーク・オフピーク導入

DeepSeek-V4-Proのリリース内容

  • DeepSeek-V4-Pro が本日より正式リリース
  • Agent機能 の大幅アップグレードによる生産性向上
  • 推論負荷 をタスクごとに自動調整
    • シンプルなタスク: 低負荷推論
    • 日常Agentワークフロー: 高負荷推論
    • 複雑なタスク: 最大負荷推論
  • V4-Pro および V4-Flash 両モデルで柔軟な推論モード対応

API・Codex連携と利用方法

  • OpenAI Responses API とネイティブ連携
  • Codex 向けに最適化されたワンクリックセットアップ
  • V4 Proアプリ/Web 両方で利用可能
  • Expert Mode から簡単に試用可能
  • API経由 でも V4 Pro 利用対応
  • モデル名は変更なし、 APIドキュメント 参照でセットアップ

API料金体系の変更

  • V4シリーズ リリースに伴い API料金 をアップデート
  • ピークタイム/オフピークタイム 料金を新導入
    • オフピーク料金 はピークの50%でコスト削減
    • 柔軟なワークロードスケジューリングが可能
  • 新料金適用開始 :2026年8月16日 16:00 UTC

今後の利用・推奨事項

  • V4 Pro の新機能や料金メリットを最大限活用
  • APIドキュメント 確認によるスムーズな移行
  • オフピーク活用 でコスト効率の高い運用推奨

Hackerたちの意見

中国ではピーク時間が仕事の時間で、アメリカやヨーロッパでは夜、ヨーロッパの朝でもあるのが面白いね。だからDeepseekの顧客は主に国内向けなんだろうね。

それにはあまり驚かないな。個人的には、企業が一つのプロバイダーに全力投球するのをよく見てきたけど、たいていはAnthropicだった。中国のモデルをローカルで使うことは許可されてないと思うし。

それはちょっと明らかじゃない?

ピーク時間: 01:00–04:00 と 06:00–10:00 UTC。ヨーロッパとアメリカの顧客にとっては、実質的に2倍の増加だね。前と同じようにFlashとProの両方を使い続けるつもりだよ。編集: オフピークの価格が旧価格のままだと勘違いしてた。

理解できる。多くのアメリカの顧客は、ウェイトがリリースされたらアメリカのプロバイダーに移るだろうね。

これが本当なら、二つの面で勝利だね。西側に安価な選択肢を提供し、自国のオーディエンスに対してリターンを最大化する。

もちろん。今はGemini Flashが基本的に無料だから、Deepseekは使わないようにしてる。あと、Deepseekは中国製だからEUやアメリカの企業では禁止されてる。カジュアルに使ってるとき、Deepseekは完全に中国語で返事してきたよ。さあ、中国風の返事を待ってる。

うん、彼らのツイッターの発表の下で、金持ちの外国人顧客に割引を与えて、自国の人々を裏切ってるって文句があったの見たよ。

相対的な増加やパーセンテージの記載はないみたいだけど、まあ仕方ないよね。ちょっと怠け者なんだけど、価格が上がる前と比べて、APIを通じてv4フラッシュとv4プロを使うのはどれくらい高くなったの?2倍、5倍、10倍くらい?

フラッシュはオフピークで約2倍から2.5倍、プロは2倍から4倍くらいかな(キャッシュインでは6倍の増加が一番大きい)。ピーク時間ではその2倍だね。

フラッシュ、オフピークキャッシュヒット 2.5倍 キャッシュミス 1.57倍 アウト 2.36倍 # フラッシュ、ピークキャッシュヒット 5倍 キャッシュミス 3.14倍 アウト 4.71倍 編集: 数字とフォーマットを修正したよ。

昨日、誰かが相対的な増加を含む比較をして、GPT-5.6 Lunaについても触れたんだけど、その後に他の人がOpenAI、Anthropic、K3、GLM 5.2も追加したんだ。https://news.ycombinator.com/item?id=49286679 でも、もう古い情報だと思うよ、GLM 5.3が最新だからね :)

Hacker Newsで議論の続きを見る