DeepSeek V4.1とは?V4-Pro継続でどっちを使う?Flash版の料金・HFトレンド1位・日本語性能・セキュリティ【2026年9月最新】

この記事のポイント
DeepSeek V4.1 Flashは2026年9月10日公開の最新モデルで、公式APIのモデルIDはdeepseek-flashです。9月14日のV4-Pro転送は撤回済み。V4との違い、料金、HFトレンド1位の実態、日本語性能、セキュリティ、V4-Proとの選び方を公式情報で解説します。
DeepSeek V4.1は、中国のDeepSeek(深度求索)が2026年9月10日に正式リリースした最新モデルです。現時点で出ているのは「DeepSeek-V4.1-Flash」1種類だけで、公式APIのモデルIDは deepseek-flash です。当初は「9月14日からV4-Pro宛のリクエストをすべてV4.1 Flashに転送する」と発表されていましたが、9月11日夜に撤回されました。V4-Proは9月14日以降も同じ料金で使えます。
そのため今は「自動で切り替わるのを待つ」のではなく、V4-Proを使い続けるか、自分でV4.1 Flashに移るかを選ぶ段階です。この記事では、公式Change Log・公式Pricingページ・Hugging Faceの公式モデルカードを主な根拠に、V4との違いや料金、選び方を整理します。

出典: DeepSeek 公式サイト
この記事でわかること
- DeepSeek-V4.1-Flashの中身(リリース日・モデルID・構造・できること/できないこと)
- V4-Flash/V4-Proとの違い
- V4-Proの転送が撤回されるまでの3日間の流れと、9月14日以降に何が起きるか
- V4-Proのまま使うか、V4.1 Flashに移るかの判断基準
- 料金の推移(8月の値上げ → 9月の値下げ)と、ピーク時間帯が日本の業務時間と重なる問題
- 「Hugging Faceトレンド1位」「Opus 5超え」はどこまで本当か
- 日本語性能の現状と、業務で使うときのセキュリティ・運用上のリスク
DeepSeek APIを本番で使っている、または導入を検討している開発者、コストを見直したいプロダクト責任者、中国製LLMを社内で使ってよいか判断する情報システム・法務の担当者に向けた記事です。DeepSeekという会社とサービスの基本はDeepSeekとは?特徴・料金・使い方、V4シリーズ全体はDeepSeek V4とは?性能・料金・V3との違いで解説しています。
DeepSeek V4.1 Flashとは:新しい構造を採用したシリーズの「最小モデル」
DeepSeek-V4.1-Flashは、公式Change Logで「新しいアーキテクチャ・ファミリーの中で最小のモデルで、ネイティブのマルチモーダル(画像理解)を備える」と説明されているモデルです。「最小」とあるので、より大きいV4.1系のモデルが後に続くと考えられますが、V4.1 Proの発表時期は公式には一切告知されていません。

出典: Hugging Face deepseek-ai 公式組織ページ
基本スペック(公式情報の要点)
項目 | 内容 |
|---|---|
正式名称 | DeepSeek-V4.1-Flash |
リリース日 | 2026年9月10日(API料金は04:00 UTCから、Web・アプリは北京時間12:00から) |
公式APIのモデルID |
|
他サービスでの名前 | OpenRouter: |
構造 | Causal Encoder-Decoder(CED)。40層Transformer(エンコーダ20層+デコーダ20層) |
パラメータ | 552BのMoE(リポジトリ上の表記は763B) |
実際に動くパラメータ | 入力処理(prefill)時 8B/出力生成(decode)時 16B |
MoE構成 | 各MoE層に共有エキスパート1+ルーテッドエキスパート384 |
画像エンコーダ | DeepSeek-ViT(ゼロから学習) |
事前学習 | 画像を含む45兆トークン |
コンテキスト長/最大出力 | 100万トークン/384Kトークン |
KVキャッシュ | CSA2(Compressed Sparse Attention 2)とFP4 KVキャッシュを採用 |
ライセンス | MIT(オープンウェイト) |
同時リクエスト上限(公式API) | 2,500 |
推奨設定 | temperature 1.0、top_p 0.95 |
パラメータを増やして賢くするのではなく、動かすパラメータを減らし、KVキャッシュを圧縮して、速度と単価を下げにきたモデルです。第三者評価サイトArtificial Analysisの計測では、出力速度は217 tok/sで、V4-Pro(69 tok/s)の約3倍になっています。
できること
- 画像入力に標準対応。V4世代では
V4-Flash-Vision-Expという実験版だった機能が正式モデルに入りました。実験版についてはDeepSeek V4 Flash Vision Expの解説にまとめています - thinking(推論あり)/non-thinking(推論なし)の両モード。既定はthinking
- 推論の深さ(reasoning effort)を1〜100の数値で指定できる。V4-Pro-0813はlow/high/maxの3段階です
- JSON出力、Function Calling(Tool Calls)、Chat Prefix Completionに対応。FIM補完はnon-thinkingモードのみ
- OpenAI互換に加え、Responses API形式とAnthropic API形式でも呼べる。Codex系・Claude Code系のツールから接続しやすい
- MITライセンスで重みを公開。Transformers/vLLM/SGLangで自社サーバーに載せられ、HuggingChatでも試せます
できないこと・現時点の制約
- 画像・動画・音声の「生成」はできません。画像は読み取りのみです。公式アプリで音声機能のテストが始まったという報道はありますが、モデルとしての音声対応は公式に確認できていません
- V4.1 Proはまだ出ていません
- 知識系の難しい推論(GPQA Diamond、HLE)ではV4-Proに負ける項目があります
- 552BのMoEなので、個人PCでそのまま動かすのは現実的ではありません。Hugging Faceにはコミュニティ製の量子化版(GGUF)も出ていますが、DeepSeek公式のものではありません
- 公式モデルカードに safety(安全性)/limitations(制約)の項目がありません
V4(V4-Flash/V4-Pro)との違い
V4.1 FlashはV4-Flashの後継で、旧V4-FlashとV4-Flash-Vision-Expはすでに退役しています。一方V4-Proは退役が撤回され、V4.1 Flashと並んで提供が続いています。公式APIで今選べるのは deepseek-flash と deepseek-v4-pro の2つです。

出典: DeepSeek API Docs — Models & Pricing
項目 | V4-Flash(0731・退役済み) | V4-Pro-0813(提供継続) | V4.1-Flash(最新) |
|---|---|---|---|
公式APIのモデルID |
|
|
|
総パラメータ/動くパラメータ | 284B/13B | 1.6T/49B | 552B/8B(prefill)・16B(decode) |
構造 | Decoder-only MoE | Decoder-only MoE | Causal Encoder-Decoder |
画像入力 | 非対応(Vision-Expは実験版) | 非対応 | 標準対応 |
コンテキスト長 | 100万 | 100万 | 100万 |
推論の深さの指定 | ― | low/high/max | 1〜100の数値 |
出力単価(オフピーク) | 退役 | $1.98 | $0.60 |
同時リクエスト上限 | 退役 | 500 | 2,500 |
Artificial Analysis Intelligence Index | 35 | 36 | 40 |
出力速度(Artificial Analysis) | 212 tok/s | 69 tok/s | 217 tok/s |
※Artificial Analysisの値は2026年9月13日確認。max設定での計測値です。
前の世代の詳細はDeepSeek V4 Flash 0731の解説とDeepSeek V4 Proとはで解説しています。
実装でつまずきやすい点:モデルIDは deepseek-flash
公式APIで指定するIDは deepseek-flash です。deepseek-v4.1-flash はOpenRouterなど他社サービスでの名前か、9月8日ごろに一時公開されたテスト版 deepseek-v4.1-flash-expires-on-0910 の名残で、公式APIのIDではありません。
もう1つ注意したいのが、旧ID deepseek-v4-flash と deepseek-v4-flash-vision-exp の扱いです。公式は「一時的にV4.1 Flashへ転送する」としており、エラーにはならない代わりに、同じ名前のまま中身が別のモデルに入れ替わっています。旧IDで本番を動かしているなら、出力が変わっていないかを確認し、deepseek-flash へ書き換えておくのが安全です。
V4-Proはどうなった?9月14日の転送は撤回された
2026年9月13日時点の公式Change LogとPricingページには、「ユーザーの要望を受けて、2026年9月14日以降もDeepSeek V4 ProのAPI提供を続け、料金もそのままにする」と書かれています。9月14日にV4-Proが自動でV4.1 Flashに切り替わることはありません。
公式の原文は次のとおりです。
In response to user demand, we have decided to continue providing API services for DeepSeek V4 Pro after September 14, 2026, with the billing method remaining unchanged. We will provide further notice should there be any changes.
3日間で方針が3回変わった流れ
日付 | 出来事 |
|---|---|
9月8日 | テスト版 |
9月9日 | DeepSeek Harnessチームが「V4.1 FlashはV4-Proを全面的に上回る。V4-Pro宛のリクエストはFlashへ転送する」と通知(報道) |
9月10日 | V4.1 Flash正式リリース。 V4-Flash/Vision-Expを退役。Web・アプリの3モードを1つに統合。V4-Proの転送開始を北京時間9月14日12:00と告知 |
9月11日夜 | V4-Pro退役を撤回。Change LogとPricingページを「9月14日以降も提供、料金は変えない」に書き換え |
9月14日 | 当初の転送予定日だったが、撤回により予定されていた変更はない |
注意したいのは、公式Newsページ(9月10日付の発表記事)には、9月13日時点でも「V4-Proを段階的に廃止し、9月14日から転送する」という撤回前の文章が残っている点です。より新しく書き換えられたChange LogとPricingページが現在の公式見解と考えられます。日本語で「9月14日にV4-Proが終わる」と書かれた記事の多くは、この撤回前の情報をもとにしています。
撤回には「変更がある場合は改めて告知する」という一文が付いており、期限のない保証ではありません。V4-Proを使い続ける場合も、Change Logを定期的に確認しておく必要があります。V4-Pro自体の性能や使いどころはDeepSeek V4 Proとはにまとめています。
Web・アプリは「スマートモード」に1本化
API以外にも変化があります。報道によると、9月10日にWeb版とアプリの「快速」「専家(エキスパート)」「識図(画像認識)」の3モードが「智能模式(スマートモード)」1つにまとめられ、質問の難しさを自動で判断し、画像があれば画像理解を自動で使う形になりました。中国のユーザーからは「エキスパートモードがなくなった」と反発があり、API側のV4-Proは残りましたが、Web・アプリのエキスパートモードは9月13日時点で戻っていないと報じられています(公式の発表文では確認できていません)。
V4-Proのまま使うか、V4.1 Flashに移るかの判断基準
エージェント・コーディング・画像入力・コスト重視ならV4.1 Flashへ移る価値が大きく、知識系の難しい推論や、今の出力を変えたくない本番環境ならV4-Proのまま様子を見るのが現実的です。撤回によって「強制的に移される」状況ではなくなったので、用途ごとに選べます。
あなたの状況 | おすすめ | 理由 |
|---|---|---|
コーディングエージェント・ターミナル操作が中心 | V4.1 Flash | DeepSWE v1.1で74.2対62.7、Terminal-Bench 2.1で90.6対87.9(DeepSeek公表値) |
API費用を下げたい | V4.1 Flash | オフピーク出力$0.60対$1.98。入力1,000万+出力100万トークンで$2.10対$8.58 |
応答速度が大事 | V4.1 Flash | Artificial Analysis計測で217 tok/s対69 tok/s |
スクリーンショット・図表・帳票を読ませたい | V4.1 Flash | 画像入力はdeepseek-flashだけ。V4-Proは非対応 |
並列で大量にリクエストを投げる | V4.1 Flash | 同時リクエスト上限2,500対500 |
専門知識を問う難しい推論が中心 | V4-Proのまま検証 | GPQA Diamond 92.4対90.9、HLE 42.7対39.1でV4-Proが上 |
プロンプトを細かく調整済みの本番環境 | V4-Proのまま+並行テスト | 出力形式・拒否の境界・ツール呼び出しの順番が変わる可能性がある |
V4.1 Proの登場を待ちたい | V4-Proのまま | ただしV4.1 Proの時期は未告知 |
V4.1 Flashへ移る前のチェックリスト
確認項目 | 何を見るか | 起こりうる影響 |
|---|---|---|
出力品質 | 本番で使っている代表的なプロンプトで、V4-Proと出力を並べて比べる | 難しい推論や長い論理展開で品質が変わる |
出力トークン量 | 同じプロンプトでの平均出力長 | 推論の深さの設定次第で請求額が変わる |
reasoning effortの指定 | low/high/maxの指定が残っていないか | 1〜100の数値指定に変わる |
ツール呼び出し | 呼び出す順番・引数の形式 | エージェントの動きが変わる |
同時リクエスト数 | 500を前提にしたリトライ・並列設計 | 上限が2,500に上がるので設計を見直せる |
請求額 | 切り替え前後の日次コスト | 単価は下がっても、出力が長くなれば差が縮む |
「安くなるから何も確認せずに切り替える」のは危険です。数日間はV4-ProとV4.1 Flashを並行で動かし、品質と日次コストを並べて見るのが安全です。
料金:9月10日に値下げ、ただし8月の値上げ前には戻っていない
V4.1 Flash(deepseek-flash)の公式API料金は、オフピークで入力(キャッシュミス)$0.15、出力$0.60です(100万トークンあたり)。8月17日の値上げから24日で下がりましたが、出力は値上げ前の$0.28と比べてまだ2倍以上です。
現在の公式料金(2026年9月10日04:00 UTCから)
単位はUSD/100万トークン。オフピークはピークのちょうど半額です。
モデル | 時間帯 | 入力(キャッシュヒット) | 入力(キャッシュミス) | 出力 |
|---|---|---|---|---|
deepseek-flash(V4.1 Flash) | オフピーク | $0.003 | $0.15 | $0.60 |
deepseek-flash(V4.1 Flash) | ピーク | $0.006 | $0.30 | $1.20 |
deepseek-v4-pro(9月14日以降も継続) | オフピーク | $0.022 | $0.66 | $1.98 |
deepseek-v4-pro | ピーク | $0.044 | $1.32 | $3.96 |
人民元建てでは、deepseek-flashがキャッシュヒット¥0.02/¥0.04、キャッシュミス¥1/¥2、出力¥4/¥8(オフピーク/ピーク)です。
撤回により、「V4-Proユーザーは9月14日から自動で約7割安くなる」という話はなくなりました。V4-Proは今の料金のまま続き、安くしたい場合は自分で deepseek-flash に切り替える必要があります。
Flash系の料金の推移
時点 | 入力(キャッシュヒット) | 入力(キャッシュミス) | 出力 |
|---|---|---|---|
〜2026年8月17日(時間帯の区別なし) | $0.0028 | $0.14 | $0.28 |
2026年8月17日〜(値上げ・オフピーク) | $0.007 | $0.22 | $0.66 |
2026年9月10日〜(V4.1 Flash・オフピーク) | $0.003 | $0.15 | $0.60 |
キャッシュミス入力は$0.14→$0.15とほぼ元の水準ですが、出力は$0.28→$0.60で2倍以上のままです。ITmedia AI+は「値上げから一転」と報じましたが、値上げ前からFlashを使っていた人にとっては、まだ値上げ後の水準だと考えたほうが正確です。値上げの経緯はDeepSeek APIの値上げまとめで解説しています。
日本の読者が見落としやすい点:ピーク時間帯が業務時間と重なる
公式のピーク時間帯は、月〜金の01:00–04:00 UTCと06:00–10:00 UTCです。日本時間では月〜金の10:00–13:00と15:00–19:00にあたります。
日本の会社で日中に対話的に使うと、多くのリクエストがピーク料金になります。見積もりはオフピークの$0.60ではなく$1.20で考えるほうが実態に近いでしょう。逆に、次のような工夫で単価を半分にできます。
- 要約・分類・データ整形などのバッチ処理を、日本時間19:00以降や早朝に回す
- 土日は終日オフピークなので、大量処理は週末にまとめる
- 対話用とバッチ用でAPIキーを分け、どちらがピーク料金になっているか見えるようにする
コスト試算:V4.1 FlashとV4-Proの差
入力1,000万トークン+出力100万トークンを処理した場合の概算です(オフピーク・キャッシュミス前提)。
モデル | 入力 | 出力 | 合計 | 円換算(1ドル150円) |
|---|---|---|---|---|
deepseek-flash(V4.1 Flash) | $1.50 | $0.60 | $2.10 | 約315円 |
deepseek-v4-pro | $6.60 | $1.98 | $8.58 | 約1,287円 |
ピーク時間帯なら、どちらも2倍になります。為替は変動するので円換算は目安としてください。
この試算は出力トークン数が同じという前提です。第三者の検証では、V4.1 Flashのreasoning effortを25から100に上げると出力トークンが約2.5倍になったと報告されています。単価が安くても、推論の深さを上げれば請求額は増えます。安さを活かすなら、effortの既定値をコードで固定しておくのがおすすめです。
公式API以外で使う場合の料金
提供元 | 入力 | 出力 | 補足 |
|---|---|---|---|
DeepSeek公式API(ピーク) | $0.30 | $1.20 | データは中国国内に保存 |
DeepInfra | $0.30 | $1.20 | 9月11日時点の公開価格。キャッシュ入力$0.006。中国外で動かす選択肢 |
Baseten | 未確認 | 未確認 | Model APIsでV4.1 Flash(1Mコンテキスト)の提供を開始 |
OpenRouter | 未確認 | 未確認 | モデルID |
中国の外にある推論サービスでも、公式APIのピーク料金とほぼ同じ水準で使えます。料金は変わりやすいので、契約前に各社のページで確認してください。
「Hugging Faceトレンド1位」はどこまで本当か
2026年9月13日時点で、deepseek-ai/DeepSeek-V4.1-Flash はHugging Faceのトレンド1位でした。いいね数は約1.97k、先月のダウンロード数は約14.1万(140,636)です。
順位 | モデル | いいね |
|---|---|---|
1 | deepseek-ai/DeepSeek-V4.1-Flash | 1.97k |
2 | openbmb/MiniCPM5-2B | 1.25k |
3 | nex-agi/Nex-N2.5-mini | 724 |
4 | Qwen/Qwen3.8-27B | 14.8k |
5 | XHToken/Spark-X2.5-4B | 1.13k |
※2026年9月13日の実測値
9月11日の時点ではいいね1.2kだったので、2日で約1.6倍に増えています。ただしHugging Faceのトレンドは、直近の伸びで日ごとに入れ替わる指標です。リリース直後の数字で、数週間後も1位とは限りません。
順位そのものより大事なのは、MITライセンスで重みが公開されていることです。制約が軽いので、推論サービス各社の対応や量子化版の公開が早く進み、「公式APIを使わずにV4.1 Flashを動かす」という選択肢が現実的になっています。
ベンチマークと第三者評価の読み方
DeepSeekは「V4.1 FlashがTerminal-Bench 2.1などでClaude Opus 5.0を上回った」と公表していますが、自己申告の値です。より難しいベンチマークでは差をつけられており、両方を見ないと判断を誤ります。

エージェント系ベンチマーク(DeepSeek公表値・reasoning effort最大)
ベンチマーク | Claude Opus 5.0 | GPT-5.6 Sol | Kimi K3 | V4.1-Flash |
|---|---|---|---|---|
Terminal-Bench 2.1 | 89.1 | 88.8 | 88.3 | 90.6 |
DeepSWE v1.1 | 74.0 | 73.0 | 67.5 | 74.2 |
CyberGym | ― | 84.5 | 80.0 | 88.1 |
AutomationBench | 50.3 | 45.8 | 46.7 | 54.8 |
V4-Proとの比較:勝っている項目と負けている項目
ベンチマーク | V4-Pro | V4.1-Flash | 上のモデル |
|---|---|---|---|
DeepSWE v1.1 | 62.7 | 74.2 | V4.1 Flash |
Terminal-Bench 2.1 | 87.9 | 90.6 | V4.1 Flash |
GPQA Diamond | 92.4 | 90.9 | V4-Pro |
HLE(テキストのみ) | 42.7 | 39.1 | V4-Pro |
Baseモデルの比較(公式モデルカード)でも、MMLU-Pro(74.1対73.5)・HumanEval(79.4対76.8)・GSM8K(93.0対92.6)ではV4-Proを上回る一方、AGIEval(83.4対84.4)・C-Eval(92.1対93.1)・BBH(86.1対87.5)では届いていません。「すべての項目でV4-Proを超えた」わけではありません。V4-Proを残すかどうか決めるときは、この差が自社の用途に関係するかを見てください。
第三者評価:Artificial Analysis
モデル | Intelligence Index | 出力速度 | 混合単価(100万トークン) |
|---|---|---|---|
DeepSeek V4.1 Flash(max) | 40 | 217 tok/s | $0.18 |
DeepSeek V4 Pro 0813(max) | 36 | 69 tok/s | $0.67 |
DeepSeek V4 Flash Vision(max) | 35 | 215 tok/s | $0.23 |
DeepSeek V4 Flash 0731(max) | 35 | 212 tok/s | $0.22 |
※2026年9月13日確認。Artificial Analysisは指標を随時改訂しているため、過去に公表された数値と並べて比べないでください。
第三者の評価でも、V4.1 FlashはV4-Proよりスコアが高く、約3倍速く、単価は約4分の1です。Artificial Analysisは「DeepSeekのモデルで性能と速度のバランスが最も良い」と評価しています。
「Opus 5超え」の注意点
- Terminal-Bench 3.0では、V4.1 Flashが30.0、Claude Opus 5.0が43.3と報じられています。2.1で勝っても、より難しいタスクで勝てるとは限りません
- 公表値はDeepSeekの自己申告で、第三者による独立した検証はまだありません
- エージェントの実行環境によって結果が大きく変わります。DeepSWEでは同じモデルでも8.7ポイントの差が出たという指摘があります
- ベンチマークはreasoning effort最大での計測です。コストを抑えるためにeffortを下げれば、スコアも下がります
日本語性能:実用レベルだが、日本語トップ層には届かない
V4.1 Flash自体の日本語スコアは、2026年9月13日時点でまだ第三者評価に載っていません。Nejumi Leaderboard 4をもとにしたQualitegの「日本語対応LLMランキング2026」は9月1日版が最新で、9月10日リリースのV4.1 Flashは入っていません。
前の世代までのスコアは次のとおりです。
モデル | 総合スコア |
|---|---|
Claude Opus 5 | 0.8720 |
Claude Fable 5 | 0.8699 |
Qwen3.8-2.4T-A95B | 0.8598 |
Claude Opus 4.8 | 0.8523 |
GPT-5.6-sol | 0.8499 |
DeepSeek-V4-Flash-0731 | 0.8169 |
DeepSeek-V4-Pro | 0.8067 |
DeepSeek-V4-Pro-0813 | 0.7984 |
※Qualiteg「日本語対応LLMランキング2026」9月1日版より抜粋
この表を見ると、DeepSeek V4系の日本語は業務で使えるレベルだが、Claude系のトップ層とは0.05ポイント前後の差があることがわかります。また、Flash系のほうがPro系より日本語スコアが高いのも特徴です。V4.1 Flashもこの傾向を引き継ぐ可能性はありますが、数値はまだ出ていません。
実務では、お客さまに直接届く日本語の文章やサポートの最終回答はClaude/GPT系、社内向けの要約・分類・コード生成・下書きはDeepSeek、という分け方がおすすめです。国産モデルを含めた比較は国産LLM7種の比較、中国製モデルを国産サービスとして出した騒動は楽天 Rakuten AI 3.0とDeepSeekの騒動が参考になります。
使い方:3つの方法
使い方は「公式API」「Web版・アプリ」「オープンウェイトを自社や中国外のサービスで動かす」の3つです。コスト・データの置き場所・手軽さのどれを優先するかで選びます。

出典: OpenRouter 公式サイト
方法 | 手順 | 向いている場面 | 注意点 |
|---|---|---|---|
公式API | APIキーを発行し、モデルIDに | 最安で使いたい、すぐ試したい | データは中国国内に保存。ピーク時間帯は料金2倍 |
Web版・アプリ | chat.deepseek.com かスマホアプリで「スマートモード」を使う | 手軽に試す | 業務データ・個人情報は入れない。エキスパートモードは報道では未復活 |
自社運用・中国外サービス | Hugging Faceの | データを中国に出したくない、モデルのバージョンを固定したい | 552B MoEを動かすGPUが必要。各社のデータ保持方針を確認 |
公式APIは、OpenAI ChatCompletions互換に加えてResponses API形式・Anthropic API形式のエンドポイントがあるので、既存のコードは base_url とモデル名を変えるだけで動くことが多いです。
エージェント用途では、Claude Code/OpenClaw/OpenCodeなどの裏側のモデルとして組み込む使い方ができます。DeepSeek公式のエージェント実行環境であるDeepSeek Harnessは、バージョン0.1.5でV4.1 Flashに対応しました。複数のモデルを1つのAPIで切り替えて使うならOpenRouterとはも参考になります。
セキュリティ・規制リスクと、モデルが予告なく変わるリスク
公式APIや公式アプリを使う限り、入力データは中国国内のサーバーに保存され、中国の法律が適用されます。加えて今回の騒動で、「同じモデルIDのまま中身が変わる」「数日で方針が変わる」という運用面のリスクもはっきりしました。

出典: デジタル庁 公式サイト
データの保存先と日本の公的機関の注意喚起
- 個人情報保護委員会は2025年2月3日、DeepSeekが集めた個人情報を含むデータは中国国内のサーバーに保存され、中国の法律が適用されるとして、情報提供を公表しました。DeepSeekのプライバシーポリシー(2026年2月10日更新)でも、中国本土での保存が明記されています
- デジタル社会推進会議幹事会事務局は2025年2月6日、各府省庁に対し、DeepSeekなどの生成AIを業務で使う場合の注意喚起を出しました。機密情報は扱わないこと、使う場合はNISC(内閣サイバーセキュリティセンター)とデジタル庁に相談することを求めています
- 海外では、台湾が公的機関でのDeepSeek利用を(自社サーバーでの利用を含めて)広く制限しているほか、米商務省が政府端末での利用を控えるよう求め、韓国・オーストラリアでも制限の動きがあります
台湾のように自社サーバーで動かす場合まで制限対象にしている例があるため、「オープンウェイトを自社で動かせば何でも問題ない」とは言えません。
また、公式モデルカードにはsafety/limitationsの項目がないため、社内審査でベンダー自身の安全性に関する説明を引用できません。第三者評価や各国の規制資料で補う前提で審査の流れを組む必要があります。
モデルが予告なく変わるリスク
今回、中国の開発者コミュニティで特に強く反発されたのは次の3点でした。
- 準備期間がない:告知から数日で転送が決まり、本番で調整してきたプロンプトが、出力形式・回答を断る基準・ツールを呼ぶ順番の変化で壊れるおそれがあった
- バージョンを固定できない:同じモデルIDのまま中身が入れ替わる。実際に
deepseek-v4-flashは今も同じ名前で中身がV4.1 Flashになっている - 研究の再現ができない:同じIDで同じ結果が出るとは限らない
V4-Proの転送は撤回されましたが、公式APIではバージョンが固定される保証が弱いという点は変わっていません。本番で使うなら、次の対策をしておくと安心です。
- 代表的なプロンプトと期待する出力をセットにした回帰テストを用意し、定期的に回す
- 公式Change Logを定期的に確認する(今回は3日で方針が3回変わった)
- 旧IDを使わず、現行のモデルID(
deepseek-flash/deepseek-v4-pro)を明示する - バージョンを確実に固定したいなら、オープンウェイトを自社で運用する
現実的な3つの選択肢
方針 | 内容 | 向いているケース | 残る課題 |
|---|---|---|---|
自社運用 | MITのオープンウェイトを自社や国内クラウドで動かす | データを国外に出せない、バージョンを固定したい | 552B MoEを動かすGPUのコスト。「中国製モデルそのもの」を問題視する規制には対応できない |
中国外のサービス経由 | DeepInfra・Baseten・OpenRouter経由の中国外プロバイダなど | すぐ始めたい、中規模の利用 | 各社のデータ保持・学習利用の方針を個別に確認する必要がある |
公式APIを用途を限って使う | 機密情報・個人情報を入れない業務だけに使う | 社内向けの下書き、公開情報の要約 | 入力内容をどう管理するか。ログ監査の仕組みが必要 |
生成AI全般のセキュリティ対策は生成AIのセキュリティ対策、エージェントを運用するときの権限設計はAIエージェントのセキュリティ対策で解説しています。
こんな人におすすめ/おすすめしない人
DeepSeek V4.1 Flashがおすすめな人・組織
- コーディングエージェントやターミナル操作を大量に動かして、API費用を抑えたい開発者・スタートアップ
- V4-Proを使っていて、エージェント用途で速度とコストを改善したいチーム(自分で
deepseek-flashに切り替える必要があります) - スクリーンショット・図表・帳票など、画像を読ませる処理を安く組みたい開発者
- 100万トークンの長い文脈で、リポジトリ全体や大量の文書を処理したいエンジニア
- MITライセンスのオープンウェイトを自社で動かし、データを外に出さずバージョンも固定したい企業
- 夜間・週末のバッチ処理が中心で、オフピーク料金を活かせる運用体制
おすすめしない・慎重に判断したい人・組織
- 個人情報・医療情報・金融情報など、中国でのデータ保存が認められない業務(公式APIを使う場合)
- 官公庁・自治体や、取引先との契約でDeepSeekの利用が制限されている事業者
- お客さまに直接届く日本語の品質を最優先する用途
- GPQA DiamondやHLEのような専門知識を問う難しい推論が中心で、今のV4-Proで満足しているチーム
- 本番の出力が変わることを許容できないのに、回帰テストを用意する余裕がないチーム
- 画像・音声の生成が必要な用途
- 今後1年の原価を今の単価で固定したい事業計画(この1か月で値上げと値下げ、提供方針の変更と撤回が起きています)
- 個人PCでローカル実行したい人
他モデルとの選び方
「安いから全部DeepSeek」も「中国製だから全部使わない」も、判断としては大ざっぱです。用途とリスクの許容度で分けるのが実務的です。
状況 | おすすめ | 理由 |
|---|---|---|
コーディング・エージェントを大量に動かす | DeepSeek V4.1 Flash | Terminal-Bench 2.1で90.6、出力オフピーク$0.60 |
知識系の難しい推論をDeepSeekで続けたい | DeepSeek V4-Pro | GPQA・HLEではV4.1 Flashより上。9月14日以降も提供継続 |
難しい長時間タスクの失敗を減らしたい | Claude Opus 5系 | Terminal-Bench 3.0で43.3対30.0 |
お客さま向けの日本語品質を最優先 | Claude/GPT系 | 日本語総合スコアで0.05ポイント前後の差 |
データを中国に出せない | 自社運用か中国外のサービス | MITなので選択肢は作れる。ただし規制側の方針は要確認 |
別のオープンウェイトとも比べたい | Kimi K3/GLM 5.2/Qwen3.8 | ライセンス条件・得意分野・日本語性能が違う |
各モデルはKimi K3とは、GLM 5.2とは、Qwen3.8-Maxとはで解説しています。GPT系との比較はDeepSeek V4 vs GPT-5.5、値下げ競争の流れはGPT-5.6 Lunaの80%値下げも参考になります。
よくある質問
Q. 9月14日以降も deepseek-v4-pro は使えますか?
使えます。公式Change LogとPricingページには、9月14日以降もV4 ProのAPI提供を続け、料金も変えないと書かれています(2026年9月13日確認)。ただし「変更がある場合は改めて告知する」とも書かれているため、期限のない保証ではありません。
Q. 「9月14日にV4-ProがV4.1 Flashに転送される」と書かれた記事を見ました。どちらが正しいですか?
9月10日の発表時点ではそう告知されていましたが、9月11日夜に撤回されました。公式Newsページには撤回前の文章が残っているため、それをもとに書かれた記事が多く見られます。現在の公式見解は、書き換えられたChange LogとPricingページのほうです。
Q. deepseek-v4-flash のまま呼ぶと、どのモデルが動きますか?
V4.1 Flashが動きます。旧V4-Flashは退役していて、deepseek-v4-flash と deepseek-v4-flash-vision-exp は一時的にV4.1 Flashへ転送されています。転送はあくまで一時的な措置なので、deepseek-flash に書き換えておくのが安全です。
Q. Web版やアプリのエキスパートモードはどこへ行きましたか?
報道によると、9月10日に「快速」「エキスパート」「画像認識」の3モードが「スマートモード」1つにまとめられました。質問に応じて自動で推論の深さを変える仕組みです。API側ではV4-Proの継続が決まりましたが、Web・アプリのエキスパートモードは9月13日時点で戻っていないと報じられています。
Q. APIで deepseek-v4.1-flash を指定すればいいですか?
公式APIでは deepseek-flash を指定してください。deepseek-v4.1-flash という表記はOpenRouterなど他社サービスでの名前です。
Q. 日本時間の昼に使うと料金は高くなりますか?
高くなります。ピーク時間帯は日本時間の月〜金10:00–13:00と15:00–19:00で、この時間の料金はオフピークの2倍です(V4.1 Flashの出力で$1.20)。土日は終日オフピークです。
Q. V4.1 Flashは本当にClaude Opus 5より高性能ですか?
DeepSeekの公表値では、Terminal-Bench 2.1(90.6対89.1)やAutomationBench(54.8対50.3)で上回っています。一方、より難しいTerminal-Bench 3.0では30.0対43.3と報じられており、「特定のベンチマークでは上回る」が正確な表現です。
Q. 業務で使っても安全ですか?
公式APIを使う限り、入力データは中国国内のサーバーに保存されます。機密情報を扱う業務なら、オープンウェイトを自社で動かす、中国外のサービスを使う、公式APIは機密を含まない用途だけに限る、のいずれかを選んでください。本番で使う場合は、モデルの中身が変わったときに気づけるよう、出力の回帰テストも用意しておきましょう。
Q. V4.1 Proはいつ出ますか?
公式は時期を一切告知していません。V4.1 Flashが「新しいシリーズの最小モデル」と説明されていることから、より大きなモデルが続く可能性はありますが、具体的な予定は出ていません。
まとめ
DeepSeek V4.1は、2026年9月10日にリリースされた DeepSeek-V4.1-Flash として提供されている最新モデルです。公式APIのモデルIDは deepseek-flash で、552BのCED構造に画像入力を標準搭載し、オフピーク出力$0.60という単価と、V4-Proの約3倍の速度を実現しています。Hugging Faceでは9月13日時点でトレンド1位になっています。
一方、9月14日に予定されていたV4-ProからV4.1 Flashへの転送は9月11日に撤回され、V4-Proは同じ料金で提供が続いています。エージェント・コーディング・画像入力・コスト重視ならV4.1 Flashへ、知識系の難しい推論や今の出力を変えたくない本番環境ならV4-Proのまま、というように自分で選べる状況です。
ただし、出力料金は8月の値上げ前の2倍以上で、日本の業務時間はほぼピーク料金の時間帯です。公式APIのデータは中国国内に保存され、同じモデルIDで中身が変わるリスクもあります。安さと速さは本物ですが、条件付きという前提で、回帰テストとChange Logの確認を続けながら使うのが安全です。
シリーズ全体はDeepSeek V4とは、会社とサービスの基本はDeepSeekとは、V4-Proの詳細はDeepSeek V4 Proとはで解説しています。
このツールを自社の毎月の業務に組み込むと何が変わるか、ご提案します
業務を1つ送るこの記事の著者

AI革命
編集部
AI革命株式会社の編集部です。最新のAI技術動向から実践的な導入事例まで、企業のデジタル変革に役立つ情報をお届けしています。豊富な経験と専門知識を活かし、読者の皆様にとって価値のあるコンテンツを制作しています。
最新記事

AI導入ロードマップ|1年目にやること・費用・自動化からシステム化までの順番【2026年9月最新】
2026/09/21

AIエージェントに月10万円で任せられる業務量は?処理量と料金の関係を件数で試算【2026年9月最新】
2026/09/21

AI導入の相談タイミングはいつ?|要件が固まる前に相談する利点と段階別の費用【2026年9月最新】
2026/09/21

自動化候補の洗い出し方|「毎月同じ作業」を見つける4ステップと合格ライン【2026年9月最新】
2026/09/20

業務自動化と受託開発はどちらを選ぶべきか|5つの質問で分かる判断フロー【2026年9月最新】
2026/09/20

生成AIのAPI利用料を削減する方法|膨らむ原因と設計での抑え方【2026年9月最新】
2026/09/20

