先に、要点をまとめます。
deepseek-v4-flashというモデル名はすでに現行名ではありません。 2026年9月10日にDeepSeek-V4.1-Flashが公開され、API上のモデル名はdeepseek-flashに変わりました。旧名も当面は受け付けられますが、実体はV4.1-Flashへ転送されます。- 料金は「入力・出力」だけでなく「キャッシュ命中の有無」と「実行時間帯」で4通りに変わります。 ピーク時間はオフピークのちょうど2倍で、日本時間の平日日中がピークに当たります。
- ウェイトはMITライセンスで公開されていますが、「公式APIを使う」「公開ウェイトを自分で動かす」は条件がまったく別です。 料金・データの扱い・必要な計算資源を混ぜて判断しないことが、検討の出発点になります。
2026年9月23日時点の情報です。料金・モデル名・提供状況は変動が速いため、導入判断の直前には本文中の公式ページを必ずご確認ください。
DeepSeek V4 Flashとは?どこの会社のモデル?
DeepSeek V4 Flashは、中国のAI企業DeepSeekが提供する大規模言語モデルの軽量・高速クラスにあたるモデルです。2026年9月10日以降は後継のDeepSeek-V4.1-Flashが現行版になっています。
DeepSeekは中国・杭州に拠点を置くAI企業です。V4シリーズは旗艦の「Pro」と軽量の「Flash」の2本立てで、Flash側が2026年9月10日にV4.1-Flashへ更新されました。「DeepSeek V4 Flash」という語でたどり着いた記事や資料が、旧版の話か現行版の話かをまず区別する必要があります。
どこの国の企業が開発・運営しているかは、業務利用ではデータの保存場所や準拠法に直結します。この点は後半の「業務データを流してよいか」で扱います。
モデル名は何を指定すればよい?(deepseek-v4-flash は使える?)
現在指定すべきモデル名は deepseek-flash です。旧名の deepseek-v4-flash はリクエスト自体は通りますが、公式ドキュメントでは「retired(廃止済み)」として扱われ、一時的に現行モデルへ転送されている状態です。
2026年9月23日に確認したDeepSeek API公式ドキュメントでは、deepseek-v4-flash と deepseek-v4-flash-vision-exp の2つの旧名がV4.1-Flashへ「一時的に」転送されると案内されています。転送がいつまで続くかは保証されていません。
すでに旧名で動いているシステムがある場合、(1)転送によって実行モデルが変わった=出力の傾向が変わり得ることを把握しているか、(2)モデル名がコードに直接書かれているか設定値として外に出ているか、(3)転送が終了したとき誰がいつ気づけるか、の3点を確認してください。モデル名やエンドポイントを設定値として外に出しておく設計は、業務へのAI組み込みでも最初に決める項目です。
料金はいくら?価格表の読み方
2026年9月23日時点で、deepseek-flash の料金は100万トークンあたり、入力(キャッシュ未命中)がオフピーク0.15米ドル・ピーク0.30米ドル、出力がオフピーク0.60米ドル・ピーク1.20米ドルです。
DeepSeek公式料金表で確認した内容です。単位はいずれも100万トークンあたりの米ドルです。
| 項目 | オフピーク | ピーク |
|---|---|---|
| 入力・キャッシュ命中 | 0.003米ドル | 0.006米ドル |
| 入力・キャッシュ未命中 | 0.15米ドル | 0.30米ドル |
| 出力 | 0.60米ドル | 1.20米ドル |
同じ料金表の deepseek-v4-pro(DeepSeek-V4-Pro-0813)は入力キャッシュ未命中0.66米ドル・出力1.98米ドル(オフピーク。ピークは2倍)で、Flashのほうが1桁近く安い価格帯です。
読み方で間違えやすいのは3点です。オフピークが基準でピークがその2倍という構造なので、「安い時間帯がある」ではなく「高い時間帯がある」と捉えるほうが見積もりを誤りません。キャッシュ命中と未命中で入力単価は50倍違います。 また、表の単価は請求額ではありません。 実際の金額は、自社の代表的な処理を流してトークン数を実測しないと分かりません。
ピーク時間はいつ?日本時間ではどうなる?
公式のピーク時間は月曜〜金曜のUTC 01:00〜04:00と06:00〜10:00です。日本時間では10:00〜13:00と15:00〜19:00にあたり、日本の一般的な営業時間の大半がピークに重なります。
公式料金表には、中国の祝日を除く平日がピーク対象と記載されています。日本の祝日ではない点に注意してください。
| 日本時間 | 区分 | 業務での意味 |
|---|---|---|
| 平日 10:00〜13:00 | ピーク(2倍) | 日中のリアルタイム処理はここに入る |
| 平日 13:00〜15:00 | オフピーク | 短いが単価が半分になる帯 |
| 平日 15:00〜19:00 | ピーク(2倍) | 夕方の処理もピーク帯 |
| 平日 19:00〜翌10:00・土日 | オフピーク | バッチ処理を寄せられる帯 |
夜間の一括変換・分類・要約などはオフピークへ寄せれば単価が半分になりますが、ユーザーの操作に即応する処理は時間帯を選べません。 「安い時間帯があるから全体の費用が半分になる」とはならないため、自社の処理を「時間をずらせるもの」と「ずらせないもの」に分けてから試算してください。
性能・パラメータ数はどうなっている?
DeepSeek-V4.1-Flashは総パラメータ552BのMoE(Mixture-of-Experts)構成で、1トークンあたりに実際に動くのは入力処理時8B・出力生成時16Bとされています。コンテキストは100万トークン、最大出力は384Kトークンです。
公式のモデル配布ページによれば、20層の因果エンコーダと20層のデコーダを組み合わせた構成を採り、入力側で動くパラメータを絞ることで入力量の多い処理のコスト効率を上げています。独自の画像エンコーダを持ち、画像入力にも対応します。
注意したいのは、「総パラメータが大きい=賢い」でも「実行パラメータが小さい=軽い」でもないことです。総パラメータ552Bは自社サーバーで動かす場合のメモリ量に直結し、実行8B/16Bは1トークンあたりの計算量に効きます。「小さいモデルだから社内サーバーで動く」と読み替えると、必要なGPU環境の見積もりを大きく外します。
日本語の業務で使えるか?何を検証すればよい?
多言語に対応していますが、日本語の実務品質を示す第三者データは限られています。公開スコアではなく、自社の実際の文書で合否を判定してください。
この記事で公開ベンチマークのスコアを載せないのも同じ理由です。公開されている評価は英語・コーディング中心で、日本語の業務文書の品質を保証しません。検証では「良さそうに見える」ではなく合格条件を先に決めます。商品説明の草稿化や一次分類であれば、元資料にない仕様・材質・効能を補って書かないこと、欠けている項目を埋めずに「確認が必要」として残せること、敬語・社内用語・製品名の表記が既存文書と揃うこと、同じ入力を複数回流しても判断がぶれないこと、といった条件です。
そのうえで、単価ではなく「合格1件あたりの費用」で比較します。 単価が安くても修正や再実行が増えれば人の確認時間が増え、総額では逆転します。判定の観点はAI導入前に確認すべき項目で整理しており、小さく試すなら新しく作りたい方向けの相談ページのように対象業務を1つに絞る進め方が向いています。
ライセンスは?自社サーバーで動かせる?
ウェイトはMITライセンスで公開されており、商用利用・改変・再配布に制限はありません。ただし「ライセンス上動かせる」ことと「自社で現実的に動かせる」ことは別です。
実務では、次の3つのどれを検討しているのかを社内で区別してください。条件がまったく違います。
| 使い方 | 先に確認すること | 判断例 |
|---|---|---|
| DeepSeekの公式APIを使う | 送信データの保存場所と準拠法、契約でデータ取扱いを担保できるか | 機密を含まない検証用データに限定する |
| 他社クラウドがホストするAPIを使う | 処理・保存されるリージョン、事業者との契約条件、モデル版の追随 | 処理場所を契約で選べるなら候補 |
| 公開ウェイトを自社環境で動かす | 総パラメータ552Bを動かす環境の規模、更新・監視の担当 | 中小企業が自前で抱えるのは現実的でないことが多い |
「オープンソースだから安心」「MITだから無料」という要約は、この3つを混ぜた言い方です。自社ホストなら外部送信が一切ない、と自動的に判断しないでください。 監視・ログ収集・外部の補助サービスを併用していれば、送信先は別に発生します。
業務データを流してよいか?
個人情報や取引先の機密を含むデータをDeepSeekの公式APIへそのまま流すことはおすすめしません。理由は性能ではなく、データの保存場所と準拠法です。
日本の個人情報保護委員会は2025年2月3日に情報提供(注意喚起)を公表しており、同サービスを通じて取得した個人情報を含むデータが中華人民共和国内のサーバーに保存されること、中国の法令が適用されることを挙げています。
確認は、(1)何を送るか(個人情報・取引先名・価格・図面など送信対象を具体的に列挙する)、(2)どこへ送るか(前節の3分類)、(3)どう残るか(保存期間、ログ、学習利用の有無を契約または公開条件で確認する)、(4)誰が可否を判断するか、の順に進めます。このうち(3)を契約で担保できるかが、法人向けAPIと公式APIの最も大きな差です。料金の安さはこの差を埋めるものではありません。
業務で試すときの確認点
金額の試算より先に、次の記録を作るほうが判断を誤りません。
| 記録する項目 | 具体例 |
|---|---|
| 対象業務と1日の件数 | 商品説明の草稿化、1日300件 |
| 実行時間帯 | 夜間バッチに寄せられるか、日中の即応が必要か |
| 送信するデータ | 型番・仕様表(個人情報・価格は含めない) |
| 期待する合格条件 | 元資料にない情報を補わない、欠落は確認へ回す |
| 再試行の扱い | 不合格時に誰が直すか、何回まで自動再実行するか |
| 未確認事項 | 日本語の表記ゆれ、既存システムとの接続方法 |
この記録があれば、料金表の単価と自社の処理量を突き合わせた試算ができます。記録がないまま単価だけを比較すると、キャッシュ・時間帯・再試行の3つが抜けた数字になります。採用するモデルがDeepSeekであってもなくても、価格も性能も数ヶ月単位で変わる前提で、特定のモデル名に依存しない設計にしておくほうが結果的に安くつきます。他社の軽量クラスはGemini 3.7 Flashの料金・仕様、上位クラスの現在地はClaude Opus 5の解説、同じくオープンウェイト系はKimi K3の料金・性能もあわせてご確認ください。
よくある質問
Q. DeepSeek V4 Flashの料金はいくらですか?
2026年9月23日時点の公式料金表では、現行の deepseek-flash が100万トークンあたり入力(キャッシュ未命中)0.15米ドル・出力0.60米ドル(いずれもオフピーク)です。ピーク時間はその2倍になります。キャッシュ命中時の入力は0.003米ドルまで下がるため、同じ前提文を繰り返し送る使い方かどうかで実際の請求額は大きく変わります。
Q. DeepSeek V4 Flashは無料で使えますか?
APIは有料です。ウェイト自体はMITライセンスで無償公開されていますが、総パラメータ552Bのモデルを動かす計算環境の費用が別にかかるため、「ライセンスが無償=運用が無料」ではありません。チャットサービスの無料枠の有無と、APIの課金は別に確認してください。
Q. deepseek-v4-flash を指定したままでも動きますか?
2026年9月23日時点では動きます。公式ドキュメントでは旧名は廃止済みとされ、リクエストは現行のV4.1-Flashへ「一時的に」転送されると案内されています。転送の終了時期は明示されていないため、新規実装では deepseek-flash を指定し、既存実装もモデル名を設定値として外に出しておくことをおすすめします。
自社の状況を整理して相談する
まず、実行時間帯、キャッシュ、期待品質、送信するデータを書き出してください。この記事に合う検討シートとAI相談用プロンプトで、未確認の項目を残したまま整理できます。シートを完成させる前でも、お気軽にご相談いただけます。
運営・編集