AIツール2026年8月更新

DeepSeek API値上げが確定|8月17日適用の新料金・最大12倍の内訳・代替LLM乗り換え判断【2026年8月最新】

公開日: 2026/08/06
更新日: 2026/08/15
DeepSeek API値上げが確定|8月17日適用の新料金・最大12倍の内訳・代替LLM乗り換え判断【2026年8月最新】

この記事のポイント

DeepSeek APIの新料金を公式数値で整理。2026年8月17日01:00(JST)適用のピーク/オフピーク課金、項目別の値上げ倍率(最大12.14倍)、月額シミュレーション、他社LLMとの実効コスト比較と乗り換え判断をまとめました。

DeepSeekは2026年8月13日、API料金の改定内容を公式に確定させました。新料金は日本時間2026年8月17日01:00から適用され、ピーク/オフピークの時間帯別課金が新設されます。値上げ幅は項目によって+52%〜+1114%(最大12.14倍)と、単一の倍率では語れない構造になっています。

この記事では、公式料金ページの数値をもとに、新旧単価の全項目比較、項目別の値上げ倍率、ワークロード別の月額シミュレーション、他社LLMとの実効コスト比較、そして「DeepSeekに残るか・別のモデルへ移るか」を自分で判定するための基準を整理します。

対象読者は、DeepSeek APIを本番環境で使っている開発者・PdM・情シス、そしてDeepSeekの低価格を前提にAI機能の原価を設計しているスタートアップです。

特に押さえておきたいのは、値上げの偏り方と時間帯の設計です。

  1. 値上げ幅は一律ではない。最も上がるのはV4-Proの入力キャッシュヒット単価(ピーク時で12.14倍)で、最も上がらないのはV4-Proの入力キャッシュミス単価(オフピークで1.52倍)
  2. 「キャッシュを効かせて値上げを吸収する」戦略は今回は機能しない。キャッシュヒット単価の値上げ率がキャッシュミス単価を大きく上回るため、キャッシュヒット率が高いチームほど値上げ倍率は悪化する
  3. ピーク時間帯(JST 10:00–13:00 / 15:00–19:00)は日本の業務時間とほぼ完全に重なる。日本のBtoB用途では実質的にピーク単価が既定値になり、V4-FlashはGPT-5.6 Lunaより高くなるケースが出てくる

確定した新料金と適用日時(2026年8月17日01:00 JST から)

まず事実確認です。値上げは「予告」段階を終え、新料金表・適用日時・時間帯区分のすべてが公式ページに掲載されています。

DeepSeek API公式ドキュメントの料金ページ

出典: DeepSeek API Docs — Models & Pricing

適用開始日時(3つのタイムゾーンで確認)

公式は北京時間・UTCで告知しているため、日本から読むときに1日ずれて解釈される事故が起きやすい部分です。

表記

適用開始日時

日本時間(JST)

2026年8月17日 01:00

北京時間

2026年8月17日 00:00

UTC

2026年8月16日 16:00

英語版公式の原文は次のとおりです。

DeepSeek API pricing will be updated to peak / off-peak billing, with off-peak rates at half the peak rates. Peak hours are 01:00 - 04:00 and 06:00 - 10:00 UTC (all other hours are off-peak). The new prices take effect at 16:00 UTC on August 16, 2026

新料金表(100万トークンあたり・USD)

モデル

時間帯

入力(キャッシュヒット)

入力(キャッシュミス)

出力

deepseek-v4-flash

オフピーク

$0.007

$0.22

$0.66

deepseek-v4-flash

ピーク

$0.014

$0.44

$1.32

deepseek-v4-pro

オフピーク

$0.022

$0.66

$1.98

deepseek-v4-pro

ピーク

$0.044

$1.32

$3.96

オフピーク単価はピーク単価のちょうど半額という関係が公式に明記されています。中国語版公式では人民元建てでも掲示されています(参考値)。

モデル

時間帯

入力(キャッシュヒット)

入力(キャッシュミス)

出力

deepseek-v4-flash

空闲时段(オフピーク)

0.05元

1.5元

4.5元

deepseek-v4-flash

高峰时段(ピーク)

0.10元

3.0元

9.0元

deepseek-v4-pro

空闲时段(オフピーク)

0.15元

4.5元

13.5元

deepseek-v4-pro

高峰时段(ピーク)

0.30元

9.0元

27.0元

なお、USD建てとCNY建ては厳密には比例していません(V4-Flashの入力キャッシュミスは、CNYでは1元→1.5元の1.5倍ですが、USDでは$0.14→$0.22の約1.57倍)。請求はUSD建てで見るのが安全です。円換算は為替次第で動くため、1ドル=約155円とした場合の概算として扱ってください。

値上げ前の旧料金(〜2026年8月17日01:00 JST)

比較のため、改定前の単価も並べておきます。

モデル

入力(キャッシュヒット)

入力(キャッシュミス)

出力

deepseek-v4-flash

$0.0028

$0.14

$0.28

deepseek-v4-pro

$0.003625

$0.435

$0.87

モデル仕様は改定後も変わらず、両モデルとも1Mトークンのコンテキストと最大384Kトークンの出力に対応します。値上げ発表と同日の2026年8月13日に deepseek-v4-proDeepSeek-V4-Pro-0813 へ更新されており、モデルIDは deepseek-v4-pro のまま最新版へ接続されます。各モデルの性能・仕様はDeepSeek V4 Flash 0731の解説DeepSeek V4 Proの解説にまとめています。

「最大12倍」の正体|値上げ倍率を項目別に分解する

報道で使われている「最大12倍」「最大1,100%」は同じ事象の別表現です。V4-Proの入力キャッシュヒット単価がピーク時に$0.003625→$0.044になる部分(12.14倍=+1114%)を指しています。

公式単価から全項目の倍率を計算すると、次のようになります。

モデル

項目

旧単価

新(オフピーク)

倍率

新(ピーク)

倍率

V4-Flash

入力キャッシュヒット

$0.0028

$0.007

2.50倍

$0.014

5.00倍

V4-Flash

入力キャッシュミス

$0.14

$0.22

1.57倍

$0.44

3.14倍

V4-Flash

出力

$0.28

$0.66

2.36倍

$1.32

4.71倍

V4-Pro

入力キャッシュヒット

$0.003625

$0.022

6.07倍

$0.044

12.14倍

V4-Pro

入力キャッシュミス

$0.435

$0.66

1.52倍

$1.32

3.03倍

V4-Pro

出力

$0.87

$1.98

2.28倍

$3.96

4.55倍

この表から見えるのは、値上げの重心がどこに置かれているかです。

  • 「12倍」は最悪ケースの一点であって、平均ではない。実際の請求増加率は、自社の入出力比・キャッシュヒット率・実行時間帯の組み合わせで決まります
  • 最も値上げ率が低いのは、キャッシュを使っていない素の入力(1.52〜1.57倍)。皮肉なことに、最適化していないワークロードほどダメージが小さくなります
  • 出力単価は全パターンで2.28〜4.71倍。生成量が多いプロダクトほど影響は大きくなります

V4-Proは「リリース時の定価」すら超えた項目がある

V4-Proは2026年4月24日のリリース時、定価$1.74(入力)/$3.48(出力)で登場し、75%割引が付いていました。この割引は同年5月22日に「恒久化」と発表され、$0.435/$0.87が正規価格になっています。

新ピーク単価と当初定価を並べると次のとおりです。

項目

当初定価(2026-04)

新オフピーク

新ピーク

入力(キャッシュミス)

$1.74

$0.66(定価の約38%)

$1.32(定価の約76%)

出力

$3.48

$1.98(定価の約57%)

$3.96(定価超え)

つまり「75%OFFの恒久化」は、実質的にオフピーク限定の約40〜60%OFFへ後退し、ピーク時間帯の出力単価は当初定価を上回ったという整理になります。

ピーク/オフピーク課金の中身と、日本のビジネスアワー問題

今回の改定で最も実務に効くのは、単価そのものより時間帯別課金の新設です。

DeepSeek公式サイトのトップページイメージ

出典: DeepSeek 公式サイト

ピーク時間帯の対応表

表記

ピーク時間帯(合計7時間)

日本時間(JST)

10:00–13:00 / 15:00–19:00

北京時間

09:00–12:00 / 14:00–18:00

UTC

01:00–04:00 / 06:00–10:00

この時間帯以外の1日17時間はすべてオフピークで、単価はピークの半額です。

問題は、このピーク時間帯が日本の業務時間とほぼ完全に一致する点です。9:00–19:00に稼働する社内ツールやBtoB SaaSの場合、10時間のうち7時間、つまりトラフィックの約7割がピーク単価で課金される計算になります。

月間入力1億トークン/出力2000万トークン・キャッシュ0%のワークロードで試算すると、業務時間中心のトラフィック(ピーク7割)では次のようになります。

モデル

旧料金

業務時間中心(ピーク7割)

実効倍率

V4-Flash

$19.60

$59.84

約3.05倍

V4-Pro

$60.90

$179.52

約2.95倍

「最大12倍」という見出しの数字よりは小さいものの、日本のBtoB用途では実効3倍前後と見積もるのが現実的なラインです。

時間帯をずらせる処理/ずらせない処理の仕分け

オフピークに寄せられれば単価は半分になります。自社のワークロードを次のように棚卸ししてください。

分類

具体例

オフピークへの移行

完全に移せる

夜間バッチ集計、定期レポート生成、埋め込みインデックス再構築、ログ要約、コンテンツの一括生成

◎ スケジューラの時刻変更だけで済む

条件付きで移せる

メール・チケットの自動分類、非同期の文書要約、データクレンジング

○ 数時間の遅延を許容できるなら可

移せない

対話UI・チャットボット、業務中の社内アシスタント、ユーザー操作に同期する生成

× 構造的にピーク単価が既定値

なお、同時実行上限はV4-Flashが2500、V4-Proが500です。大量のバッチをオフピークの17時間に押し込む設計にする場合、この上限がスループットの天井になる点は事前に確認しておいてください。

土日祝日にピーク/オフピーク区分が適用されるかどうかは、公式に言及がなく未確認です。平日のみの可能性も否定できないため、週末バッチを前提にした原価計算は保守的に置くのが安全です。

キャッシュで値上げを吸収する作戦は、今回は通用しない

ここが今回の改定で最も誤解されやすい部分です。コンテキストキャッシュのヒット率を上げても値上げは相殺できません。むしろキャッシュヒット率が高いほど、値上げ倍率は悪化します。

理由は単純で、値上げ率がキャッシュヒット単価に最も強くかかっているためです。

項目

値上げ倍率のレンジ

入力キャッシュヒット

2.50〜12.14倍

入力キャッシュミス

1.52〜3.14倍

出力

2.28〜4.71倍

キャッシュヒット率別に月額を計算すると、この逆説がはっきり出ます(月間入力1億トークン/出力2000万トークン、USD)。

モデル

キャッシュヒット率

旧料金

新オフピーク

新ピーク

V4-Flash

0%

$19.60

$35.20(1.80倍)

$70.40(3.59倍)

V4-Flash

50%

$12.74

$24.55(1.93倍)

$49.10(3.85倍)

V4-Flash

80%

$8.62

$18.16(2.11倍

$36.32(4.21倍

V4-Pro

0%

$60.90

$105.60(1.73倍)

$211.20(3.47倍)

V4-Pro

50%

$39.33

$73.70(1.87倍)

$147.40(3.75倍)

V4-Pro

80%

$26.39

$54.56(2.07倍

$109.12(4.13倍

V4-Flashはキャッシュ0%なら1.80倍で済むところ、キャッシュ80%だと2.11倍に悪化します。プロンプト構造を作り込んでキャッシュを効かせてきたチームほど、相対的な打撃は大きくなります。

キャッシュの「お得さ」自体は残るが、優位は4分の1に縮小

誤解のないように書くと、キャッシュを使わないよりは使ったほうが安いという関係は維持されます。ただし割引の倍率は大きく縮みました。

モデル

旧:キャッシュミス単価÷ヒット単価

V4-Flash

50.0倍

31.4倍

V4-Pro

120.0倍

30.0倍

V4-Proの「入力が120分の1になる」という異常な割引は、30分の1へ縮小しました。キャッシュは引き続き有効な節約手段だが、値上げの相殺手段としては期待できない——これが今回の正確な理解です。

キャッシュのヒット判定は、プレフィックス単位に完全一致した場合のみ成立します(部分一致では効きません)。効かせるには、システムプロンプト・ツール定義・Few-shot例をリクエストの先頭に固定し、ユーザーIDやタイムスタンプなど毎回変わる値を冒頭に置かないこと。レスポンスの prompt_cache_hit_tokens / prompt_cache_miss_tokens を計測しておけば、改定後の請求増を分解して説明できます。

月額はいくら増えるか|ワークロード別シミュレーション

入出力の比率によって影響度が変わるため、2パターンで計算します。

パターン1:入力支配型(月間 入力1億 / 出力2000万トークン)

RAG、長文分類、ドキュメント要約などが該当します。

モデル

旧料金

新オフピーク

新ピーク

ピーク・オフピーク半々

V4-Flash

$19.60

$35.20

$70.40

$52.80

V4-Pro

$60.90

$105.60

$211.20

$158.40

パターン2:出力支配型(月間 入力5000万 / 出力5000万トークン)

コード生成、長文執筆、エージェントの多段実行などが該当します。

モデル

キャッシュ率

旧料金

新オフピーク

新ピーク

V4-Flash

0%

$21.00

$44.00(2.10倍)

$88.00(4.19倍)

V4-Flash

80%

$15.51

$35.48(2.29倍)

$70.96(4.57倍)

V4-Pro

0%

$65.25

$132.00(2.02倍)

$264.00(4.05倍)

V4-Pro

80%

$47.99

$106.48(2.22倍)

$212.96(4.44倍)

規模が10倍・100倍のプロダクトなら、そのまま金額を10倍・100倍してください。月間トークン量が数十億規模でV4-Proをピーク時間帯に回している事業では、年間の増加額が数百万円単位になります。

自社の月間トークン消費量とキャッシュヒット率を把握していない場合、まずそこから測ってください。それが分からないままでは、どの表も判断材料になりません。

値上げ後、DeepSeekはまだ最安か|他社公式単価との実効コスト比較

「DeepSeekが最安」という前提は、少なくともピーク時間帯では成立しなくなります。各社の公式単価(100万トークンあたり・USD)を並べると次のとおりです。

OpenRouterに掲載されたDeepSeekモデルの一覧と料金

出典: OpenRouter 公式サイト

モデル / 提供元

入力

キャッシュ入力

出力

備考

Gemini 2.5 Flash-Lite(Google)

$0.10

$0.01

$0.40

最安クラス。無料枠あり

DeepSeek V4-Flash(新オフピーク)

$0.22

$0.007

$0.66

GPT-5.6 Luna(OpenAI)

$0.20

$0.02

$1.20

2026-07-30に80%値下げ

Arcee Trinity Large Thinking

$0.22

$0.85

オープンウェイト系

MiniMax M2.5(標準ティア)

$0.30

$1.20

提供元はM2.7 / M3を主力扱い

DeepSeek V4-Flash(新ピーク)

$0.44

$0.014

$1.32

Gemini 3.5 Flash-Lite(Google)

$0.30

$0.03

$2.50

無料枠あり

DeepSeek V4-Pro(新オフピーク)

$0.66

$0.022

$1.98

Kimi K2.6(Moonshot)

$0.95

$0.16

$4.00

DeepSeek V4-Pro(新ピーク)

$1.32

$0.044

$3.96

GLM-5.2(Z.ai)

$1.40

$0.26

$4.40

Qwen3.8-Max(Alibaba)

$2.00

$0.25

$6.00

1Mコンテキスト全域でフラット単価

※ いずれも各提供元の公式料金ページに基づく数値です。OpenRouterなど再販経由では単価が異なる場合があるため、原価計算には提供元の公式単価を使ってください。

実効コストで並べ替えると順位が入れ替わる

単価表では判断できません。月間入力1億トークン/出力2000万トークン・キャッシュ0%で実際の月額を計算すると、次の順になります。

LLMのコストと性能を比較する指標イメージ

出典: Artificial Analysis 公式サイト

順位

モデル

月額

1

Gemini 2.5 Flash-Lite

$18.00

2

DeepSeek V4-Flash(新オフピーク)

$35.20

3

Arcee Trinity Large Thinking

$39.00

4

GPT-5.6 Luna

$44.00

5

MiniMax M2.5(標準)

$54.00

6

DeepSeek V4-Flash(新ピーク)

$70.40

7

Gemini 3.5 Flash-Lite

$80.00

8

DeepSeek V4-Pro(新オフピーク)

$105.60

9

Kimi K2.6

$175.00

10

DeepSeek V4-Pro(新ピーク)

$211.20

11

GLM-5.2

$228.00

12

Qwen3.8-Max

$320.00

実効コストで並べると、単価表を眺めていたときとは違う構図が出てきます。

  • ピーク時間帯のV4-Flash($70.40)は、GPT-5.6 Luna($44.00)より高い。日本の業務時間はほぼピークなので、日本のBtoB用途では「DeepSeekが最安」は成立しないケースが出てきます
  • 入力が支配的なワークロードでは、GPT-5.6 Luna(入力$0.20)がオフピークのV4-Flash($0.22)より安い
  • 出力が支配的なワークロードでは、V4-Flashのオフピーク(出力$0.66)がまだ強い。GPT-5.6 Lunaの$1.20の約半分です
  • Gemini 2.5 Flash-Liteは全域でDeepSeekより安い。ただし性能クラスが同等かは未検証で、価格だけで置き換え可否は決まりません

値下げ側に動いたOpenAIの改定内容はGPT-5.6 Lunaの80%値下げに、DeepSeekと米国勢の性能面の差はDeepSeek V4 vs GPT-5.5の比較にまとめています。

最適解を決める3つのポイント

「一律に乗り換えるべき」でも「残るべき」でもありません。次の3つの掛け合わせで答えが変わります。

  1. 入出力比 — 入力支配型ならGPT-5.6 LunaやGemini系が有利。出力支配型ならV4-Flashのオフピークがまだ強い
  2. 実行時間帯 — オフピークへ寄せられるならDeepSeek継続の合理性は高い。業務時間に固定されるならピーク単価が既定値になる
  3. 求める性能クラス — 最安モデルは性能クラスが1〜2段下がることがある。ベンチマークではなく自社タスクの合格率で判定する

用途別の乗り換え先候補

Google Gemini APIの公式料金ページ

出典: Google — Gemini Developer API pricing

用途

第一候補

理由

夜間バッチ・非同期の要約/分類

DeepSeek V4-Flash(オフピーク)

時間をずらせるならオフピーク$0.22/$0.66は依然として競争力がある

業務時間中の対話UI・社内アシスタント

GPT-5.6 Luna

ピーク時のV4-Flash($70.40)より実効月額が安い($44.00)

大量の分類・タグ付け(入力偏重・品質要件が低い)

Gemini 2.5 Flash-Lite

月額$18.00で最安。無料枠で先に検証できる

コード生成・長文生成(出力偏重)

DeepSeek V4-Flash(オフピーク) / GPT-5.6 Luna

出力$0.66はこの価格帯では最安クラス。時間帯が固定ならLunaと再計算

中国系モデルを継続したい

GLM-5.2

用途はコーディング寄り。中国系の選択肢はGLM 5.2の解説を参照

データを国外に出せない

国産LLM / ローカル実行

国産LLM 7選の比較Ollamaによるローカル実行

価格変動そのものを避けたい

複数プロバイダー併用

1社の価格改定で原価が崩れない構成にする

DeepSeekはOpenAI互換(https://api.deepseek.com)とAnthropic互換(https://api.deepseek.com/anthropic)の両方を提供しています。これは乗り換えが容易であることの裏返しでもあり、base_url とモデル名を設定値に逃がしておけば、他社への切り替えは接続レベルでは数時間で済みます。時間がかかるのはプロンプト調整と回帰テストのほうです。

適用前後にやること|今日・今週・来月の3段構え

新料金の適用は2026年8月17日01:00(JST)です。残り時間で効果が出る打ち手と、腰を据えて取り組む打ち手を分けます。

適用前(今日中にやる)

  1. モデル別・機能別の月間トークン消費とキャッシュヒット率を出す。これがないと増加額を見積もれません
  2. 新単価で自社の月額を再計算する。ピーク割合を「業務時間中心なら7割」で置くと現実に近い数字になります
  3. 時間をずらせるバッチのスケジュールを、JST 19:00以降〜翌10:00へ移す。単価が半額になるため、設定変更だけで効果が出る唯一の即効策です
  4. チャージ残高の入金は必要最小限に絞る。既存残高が旧単価で使えるかどうか(経過措置)について公式の言及はなく、未確認です
  5. 予算アラートを設定する。改定初日に想定外の請求増が出ていないか検知できるようにします

適用後1週間でやる

  • 実請求を旧料金期間と比較し、ピーク/オフピーク別・キャッシュ別に増加額を分解する
  • 代表タスク20〜50件で、GPT-5.6 Luna / Gemini 2.5 Flash-Lite などの代替候補と出力品質を比較する
  • 出力トークンの削減(thinkingモードの限定適用、構造化出力のスキーマ縮小、max_tokens の見直し)を実施する

来月以降に見直す

  • V4-ProからV4-Flashへ落とせるタスクの棚卸し(新料金でもProはFlashの約3倍)
  • LLMゲートウェイ/抽象化レイヤーの導入で、プロバイダー切り替えを設定変更だけで完結させる
  • 単一プロバイダー依存を前提にした原価モデルの見直し

なぜ値上げに踏み切ったのか|背景と、そこから学ぶべきこと

理由は「安すぎて需要を捌けなくなった」という一点に集約されます。以下は報道ベースの情報で、公式が説明したものではありません。

  • 需要の急増:V4-Flash正式版API公開(2026年7月31日)後、OpenRouterの週間処理量で首位(7兆2200億トークン)に立ち、8月4日にはアクセス集中で処理が一時的に追いつかない事態が発生したと報じられています
  • 推論コストとハード制約:米国の輸出規制下でNVIDIA GPUの調達が制限され、DeepSeekはHuawei Ascendへの移行を進めている最中とされます。ハードウェア制約が推論単価に直結しています
  • 中国AI業界全体の潮流:「低価格でシェアを取る」段階から「コスト許容範囲での商業化」段階へ移行しつつあると指摘されています。前例として、Zhipu AIが2026年Q1に累計83%、Tencentが2026年3月に約463%の値上げを実施しています

この業界全体の流れは中国製AIモデルがOpenRouter利用の60%超えに至った背景と合わせて読むと、今回の改定が単発の事故ではないことが見えてきます。

本当のリスクは「値上げ幅」ではなく「価格を前提にした設計」

見落とすべきでないのは時系列です。

日付

出来事

2026-04-24

V4-Pro リリース(定価$1.74/$3.48、75%プロモ割引付き)

2026-05-22

75%割引を「恒久化」と発表($0.435/$0.87が正規価格に)

2026-07-24

V3 / R1世代のエイリアス廃止。旧世代の時間帯割引も終了

2026-07-31

V4-Flash 正式版API公開

2026-08-06

値上げ予告を公式料金ページに掲載(幅・日付は未公表)

2026-08-13

新料金・適用日時を公式発表。同日V4-Proを0813版へ更新

2026-08-17 01:00 JST

新料金・時間帯別課金 適用開始

「恒久化」と発表された価格が約2か月半で覆り、V4-Flash公開からわずか6日後に値上げが予告されました。公式ページには「製品価格は変動する可能性があり、価格を改定する権利を留保する」旨が明記されています。

つまり、特定プロバイダーの低価格を前提に原価を設計すること自体がリスクだということです。値上げ幅そのものより、この構造をどう扱うかのほうが長期的には重い論点になります。

乗り換え先選定で、価格と同時に確認すべき項目

コストだけで移行先を決めると、社内審査で差し戻されます。DeepSeekを含め、次の項目は価格と同じ場で判断してください。

確認項目

DeepSeekの状況

データ保存場所

公式プライバシーポリシーに、ユーザー情報が中華人民共和国内のサーバーに保存される旨が明記

準拠法

中国の法律に準拠する旨がポリシーに明記

学習利用

Web版・アプリ版では入力テキストが学習に利用される。APIが同一の扱いかは公式に明示されておらず未確認

SLA・稼働保証

公式な明示は確認できず。2026年8月4日にはアクセス集中による処理遅延も発生

価格改定リスク

公式が価格改定権を留保。今回の改定後もさらに変わり得る

金融・医療・公共など越境データ移転に制約がある業種では、価格が有利でも採用できないケースがあります。DeepSeek全体のセキュリティ論点はDeepSeekとは?特徴・料金・セキュリティリスクに整理しています。

DeepSeekに残るべきケース/今すぐ移行準備を始めるべきケース

OpenAI公式のGPT-5.6 Lunaモデル解説ページ

出典: OpenAI — GPT-5.6 Luna Model

残るのが合理的なケース

  • ワークロードをオフピーク(JST 19:00〜翌10:00 / 13:00–15:00)に寄せられる。単価が半額になり、V4-Flashは実効コストで依然として上位に残ります
  • 出力トークンが支配的。オフピークの出力$0.66は、この性能クラスでは最安に近い水準です
  • 月額規模が小さく、3倍になっても数万円以内に収まる。移行に使うエンジニア工数のほうが確実に高くつきます
  • 1Mコンテキスト・384K出力を実際に使っている。同条件を安価に満たす代替は限られます
  • キャッシュヒット率が低い(0〜30%程度)。今回の改定では、キャッシュを使っていないほうが値上げ倍率は小さくなります

今すぐ移行準備を始めるべきケース

  • AI推論費が売上原価の主要項目で、実効3倍の増加が利益構造を崩す
  • 業務時間帯のリアルタイム処理が中心で、オフピークへ寄せる余地がない(ピーク単価が既定値になる)
  • 入力が支配的なワークロード。GPT-5.6 LunaやGemini 2.5 Flash-Liteのほうが既に安い水準にある
  • キャッシュヒット率を80%まで作り込んできた。今回の改定では、その投資が値上げ倍率を悪化させる側に働きます
  • 中国拠点サービスへのデータ送信に社内制約がある、または今後審査が入る見込みがある
  • 年度予算が確定しており、上振れを吸収できない
  • DeepSeek単独に依存していて、フォールバック先がない

公式が明らかにしていない項目(判断前に社内で共有すべき)

新料金は確定しましたが、実務で効いてくる次の点は公式に記載がありません。断定した情報を見かけたら、一次情報かどうかを確認してください。

項目

状態

土日祝日にピーク/オフピーク区分が適用されるか

公式に言及なし・未確認

既存チャージ残高・前払い分に旧単価が適用されるか

公式に言及なし・未確認

消費者向けチャットアプリ・サブスクへの波及

今回の告知はAPI価格に関するもの。公式言及なし

バッチAPI・非同期割引の新設

公式ページに記載を確認できず

API入力のモデル学習利用可否

Web/アプリ版とAPIの扱いの差異は未確認

よくある質問

Q. 新料金はいつから適用されますか?

日本時間2026年8月17日01:00です。公式告知は北京時間(8月17日00:00)とUTC(8月16日16:00)で書かれているため、日付を1日読み違えないよう注意してください。

Q. 「最大12倍」と「最大1,100%」は別々の値上げですか?

同じ数字の別表現です。V4-Proの入力キャッシュヒット単価がピーク時に12.14倍(=+1114%)になる部分を指しており、2件の改定があるわけではありません。

Q. うちの請求額は何倍になりますか?

入出力比・キャッシュヒット率・実行時間帯で変わります。日本の業務時間帯にトラフィックが集中するサービスなら、実効で約3倍が目安です。オフピークに寄せられるバッチ中心なら1.7〜2.3倍程度に収まります。

Q. オフピークに寄せれば、値上げ前と同じコストに戻せますか?

戻せません。オフピーク単価でも旧料金の1.5〜2.3倍です。半額になるのは「新ピーク単価に対して」であって、旧料金に対してではない点が混同されやすいところです。

Q. 8月17日をまたぐリクエストはどちらの単価ですか?

公式は適用開始日時のみを示しており、境界時刻をまたぐ処理の扱いには言及がありません。日本時間01:00という深夜帯のため多くの用途では影響が小さいですが、大規模バッチを回している場合は開始時刻を余裕をもってずらすのが安全です。

Q. モデルウェイトをセルフホストすれば値上げを回避できますか?

V4世代の推論をセルフホストするにはGPU調達・運用体制・電力コストが必要で、小〜中規模のトラフィックではAPI利用より高くつくのが通例です。日次数十億トークン規模を安定して回す事業でなければ、現実的な選択肢にはなりにくいのが実情です。

Q. 他の中国系AIも追随して値上げしますか?

断定はできませんが、Zhipu AIが2026年Q1に累計83%、Tencentが2026年3月に約463%の値上げを実施しており、業界全体が商業化フェーズへ移行しつつあるのは事実です。中国系モデル1社に依存する構成そのものが、価格変動リスクを抱えることになります。

Q. 値上げ後もDeepSeekの信頼性は変わりませんか?

値上げは需要抑制の側面も持つため、混雑緩和によって安定性が改善する可能性はあります。ただし公式にSLAや稼働保証が示されているわけではなく、可用性が事業要件になっている場合はフォールバック先を用意しておくべき状況に変わりはありません。

まとめ

DeepSeekのAPI値上げは「予告」から「確定」に変わりました。変わったのは単価だけではなく、課金の構造そのものです。

  1. 2026年8月17日01:00(JST)から新料金とピーク/オフピーク課金が適用される。値上げ幅は項目別に+52%〜+1114%で、日本の業務時間帯中心のサービスでは実効約3倍が目安
  2. キャッシュ最適化で値上げを吸収する作戦は今回は成立しない。キャッシュヒット単価の値上げ率が最も大きく、ヒット率が高いほど倍率は悪化する
  3. オフピークへ寄せられるかどうかが分水嶺。寄せられるならV4-Flashは依然として競争力があり、寄せられないならGPT-5.6 LunaやGemini 2.5 Flash-Liteのほうが実効コストで安くなる

そして今回の一件が示した最大の教訓は、「恒久化」と発表された価格が約2か月半で覆ったという事実です。単一プロバイダーの低価格を前提にAI機能の原価を設計すること自体がリスクであり、base_url とモデル名を設定値に逃がして切り替え可能な状態を保つことが、次の価格改定に対する最も確実な備えになります。

値上げ対象モデルの性能・仕様はDeepSeek V4 Flash 0731の解説DeepSeek V4 Proの解説、逆方向に動いたOpenAIの改定はGPT-5.6 Lunaの80%値下げ、DeepSeek全体の評価軸はDeepSeekとは?特徴・料金・セキュリティリスクを合わせてご覧ください。

出典

このツールを自社の毎月の業務に組み込むと何が変わるか、ご提案します

業務を1つ送る

この記事の著者

AI革命

AI革命

編集部

AI革命株式会社の編集部です。最新のAI技術動向から実践的な導入事例まで、企業のデジタル変革に役立つ情報をお届けしています。豊富な経験と専門知識を活かし、読者の皆様にとって価値のあるコンテンツを制作しています。

経理・事務作業・開発を、AI革命にまとめて任せられます

ご相談は無料です。オンラインで完結します