ニュース

DeepSeek V4が正式版に|7/24旧モデル名廃止と移行ガイド

DeepSeek V4が7/24に正式ラインナップへ移行、旧モデル名deepseek-chat/deepseek-reasonerが完全廃止されることを示すサムネイル画像

この記事の結論

DeepSeek V4が7/24に旧モデル名deepseek-chat/reasonerを完全廃止し正式ラインナップへ移行。V4-Pro/Flashの仕様・料金・API移行手順を解説する。

DeepSeek V4正式版移行のポイント

2026年9月現在、旧モデル名deepseek-chat / deepseek-reasonerは廃止済みです。移行先はdeepseek-v4-flashまたはdeepseek-v4-proで、V4-Proは8月13日に正式版、実験的な画像対応V4-Flash-Vision-Expは8月21日に公開されました。

【2026年9月4日更新】 DeepSeekは7月31日にV4-Flashを公開ベータ化し、8月13日にV4-Pro正式版、8月21日に実験的な画像対応V4-Flash-Vision-Expを公開しました。最新のモデルID・料金・利用可能なAPIは公式ドキュメントで再確認しています。V4-Flashのベンチマークと使い分けはDeepSeek V4-Flash 0731、V4-Pro超えの実力と使い分けで詳しく解説しています。

続報(2026年7月31日): V4系の最新モデル「V4-Flash 0731」が公開されました。ベンチマーク実測と使い分けは「DeepSeek V4-Flash 0731、V4-Pro超えの実力と使い分け」で解説しています。

DeepSeekのAPIでは、2026年4月のプレビュー公開時から互換名として使われてきた「deepseek-chat」「deepseek-reasoner」が、UTC基準で2026年7月24日15:59(日本時間では7月25日0:59)をもって完全に廃止された。現在の主要な移行先は「deepseek-v4-pro」と「deepseek-v4-flash」だ。

その後、V4-Flashは7月31日に公開ベータへ、V4-Proは8月13日に正式版へ進み、8月21日には画像理解に対応する実験モデルも追加された。料金は8月16日からピーク・オフピーク制へ改定されている。この記事では、旧モデル名からの移行手順と、2026年9月時点のモデル構成・料金を整理する。

DeepSeekが辿った3ヶ月 — 何が起きたのか

日付 出来事 開発者への影響
2026年4月24日 DeepSeek-V4-Pro / V4-Flashをプレビュー公開。MITライセンスでHugging Faceに重みを公開 旧名deepseek-chat/deepseek-reasonerは自動的にV4系へルーティング開始
2026年6月30日 ピーク時間帯課金の導入を発表(北京時間9-12時、14-18時は2倍) 本番運用のコスト試算に時間帯係数を組み込む必要が発生
2026年7月24日 旧モデル名deepseek-chat / deepseek-reasonerがUTC 15:59に完全廃止 未移行のコードはAPIエラーで停止するため、当日中の移行が必須
2026年7月31日 DeepSeek-V4-Flashを公開ベータ化 APIのモデルIDはdeepseek-v4-flashのまま利用可能
2026年8月13日 DeepSeek-V4-Pro正式版をWeb・アプリ・APIへ展開 Responses APIとCodex接続、思考強度low/high/maxに対応
2026年8月21日 DeepSeek-V4-Flash-Vision-Expを公開 画像理解を伴うエージェント処理を実験可能

特に注意したいのは「モデル名廃止」だ。プレビュー期間中は互換性維持のためdeepseek-chat/deepseek-reasonerという名前でもV4系に自動転送されていたが、この仕組みは終了した。既存コードはV4-Pro/V4-FlashのモデルIDへ明示的に移行する必要がある。

V4-Pro / V4-Flashの仕様を確認する

まず現行ラインナップの技術仕様を整理しておく。主要なテキストモデルはDeepSeek-V4-Pro-0813とDeepSeek-V4-Flash-0731の2系統で、API上のモデルIDはdeepseek-v4-pro / deepseek-v4-flashだ。別に実験的な画像理解モデルdeepseek-v4-flash-vision-expも提供されている。

項目 DeepSeek-V4-Pro DeepSeek-V4-Flash
総パラメータ数 約1.6兆(1.6T) 約2,840億(284B)
アクティブパラメータ数/トークン 約490億(49B) 約130億(13B)
コンテキスト長 最大100万トークン 最大100万トークン
最大出力トークン 384K 384K
同時実行数上限(公式API) 500 2,500
ライセンス MIT MIT
公開形態 Hugging Face(deepseek-ai組織)でオープンウェイト公開 同左

アーキテクチャ面での特徴は、Compressed Sparse Attention(CSA)とHeavily Compressed Attention(HCA)を層ごとに組み合わせたハイブリッドAttention構成だ。DeepSeek-AIが発表した技術レポートによると、100万トークンのコンテキスト設定において、V4-Proは前世代のV3.2と比べて1トークンあたりの推論FLOPsを27%、KVキャッシュを10%まで圧縮できるという。長文コンテキストを使うAIエージェント用途では、この効率化がレイテンシとコストの両面に効いてくる。

ベンチマークで見る実力

DeepSeek-AIが公式モデルカードで公開しているベースモデルのスコアは以下の通り。いずれも自社発表の数値であり、第三者による独立検証ではない点は踏まえておきたい。

ベンチマーク スコア(公式発表) 条件
MMLU 90.1% 5-shot
HumanEval 76.8% Pass@1, 0-shot
GSM8K 92.6% 8-shot
LongBench-V2 51.5% 1-shot

推論(Thinking)モードを有効にした「Pro-Max」構成では、SimpleQA-Verifiedで57.9%、LiveCodeBenchで93.5%、競技プログラミングのCodeforcesレーティングで3206という数値が同モデルカードに掲載されている。コード生成・数学系のベンチマークで高いスコアが出ている一方、これらは公式発表値であり、独立系ベンチマーク(Vals AI等)による第三者評価は本記事執筆時点(2026年7月24日)ではまだ確認できていない。実運用の判断材料にする場合は、自社のタスクに近い条件で検証してから採用することをおすすめする。

今日から試す — API移行の実践ガイド

移行作業自体はシンプルだ。DeepSeekはOpenAI互換のChatCompletions APIとAnthropic互換APIの両方をサポートしており、既存コードはbase_urlを変えずにmodelパラメータの値だけを書き換えれば動く。

# 動作環境: Python 3.11以降, openai>=1.30.0
# 注意: 本番環境で使用する前に、必ずテスト環境で動作確認してください。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_DEEPSEEK_API_KEY",
    base_url="https://api.deepseek.com/v1",
)

# 旧: model="deepseek-chat" は 2026-07-24 15:59 UTC 以降エラーになる
# 新: 用途に応じて v4-flash(高速・低コスト) か v4-pro(高精度) を明示指定
response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "サンプルの問い合わせ文"}],
    max_tokens=1024,
)
print(response.choices[0].message.content)

ポイント: 旧名deepseek-reasonerを使っていたコードは、思考(Thinking)モードが必要なタスク向けだったはずなので、単純にdeepseek-v4-flashへ置き換えるのではなく、精度要件に応じてdeepseek-v4-proの利用も検討したい。エージェント型のツール呼び出しやマルチステップ推論を伴うワークフローの設計は、AIエージェントツール比較完全ガイドで扱っているフレームワーク選定の考え方と合わせて確認すると判断しやすい。

# 移行漏れを検知する簡易チェック(CI等に組み込む用途を想定)
# 注意: 実際のリポジトリ構成に合わせてパスやパターンを調整してください。

import re
import sys

DEPRECATED_MODELS = ["deepseek-chat", "deepseek-reasoner"]

def scan_file(path: str) -> list[str]:
    with open(path, encoding="utf-8") as f:
        text = f.read()
    hits = []
    for name in DEPRECATED_MODELS:
        if re.search(rf'["']{name}["']', text):
            hits.append(f"{path}: '{name}' が残っています")
    return hits

if __name__ == "__main__":
    for path in sys.argv[1:]:
        for hit in scan_file(path):
            print(hit)

環境変数にAPIキーをハードコードしている場合は、この機会に.envやシークレットマネージャー経由の管理に切り替えることも推奨する。

料金体系とピーク時間帯課金の注意点

DeepSeek公式のAPI料金ページで2026年9月4日に確認した、100万トークンあたりのオフピーク価格は以下の通り。ピーク時間は各価格が2倍になる。

モデル 入力(キャッシュヒット) 入力(キャッシュミス) 出力
V4-Flash $0.007 $0.22 $0.66
V4-Pro $0.022 $0.66 $1.98

現行のピーク時間は月〜金曜のUTC 1:00〜4:00と6:00〜10:00で、日本時間では10:00〜13:00と15:00〜19:00にあたる。この時間帯はV4-Flashがキャッシュヒット$0.014・キャッシュミス$0.44・出力$1.32、V4-Proが同$0.044・$1.32・$3.96となる。新料金は2026年8月16日16:00 UTCに適用された。大量バッチはオフピークへ寄せ、固定プロンプトを活用してキャッシュヒット率を高めるとコストを抑えやすい。

中国系オープンウェイト新世代の中でどう位置づけるか

DeepSeek V4が正式ラインナップへ移行した時期には、Moonshot AIも2.8兆パラメータの「Kimi K3」を公開した。Kimi K3はテキスト・画像・動画のネイティブなマルチモーダル処理と100万トークンのコンテキストウィンドウを備え、現在はMoonshot AI公式のHugging Faceで全モデル重みが公開されている。自前運用・ローカル実行を検討する開発者にとって、V4系と比較できる選択肢が増えた。Kimi K3自体の詳しい仕様やAPI利用方法はKimi K3 APIエージェント開発ガイド、他の中国系オープンウェイトモデルとの勢力比較はKimi K3・Qwen3.8-Max連発の解説記事でまとめている。

商用利用前に確認すべきこと

DeepSeek-V4-Pro/Flashのモデル重みはMITライセンスでHugging Face上に公開されており、ライセンス上の制約は比較的緩やかだ。ただし、公式APIを商用利用する場合は、送信するデータの内容(個人情報・機密情報を含めない)や、データ保持・学習利用に関する利用規約を自社のコンプライアンス基準と照らして確認しておく必要がある。

あわせて触れておきたいのが、中国系AI研究機関を巡る業界の議論だ。2026年2月、Anthropicは公表したレポートの中で、DeepSeek・Moonshot AI・MiniMaxの3社が、約24,000件の不正アカウントを使ってClaudeとの間で1,600万件超のやり取りを生成し、利用規約に違反する形でモデルの能力を抽出する「蒸留」を行っていたと主張した(Bloomberg、CNBC報道)。この主張についてはAI業界内でも賛否が分かれており、Anthropic自身を含む主要ラボが著作権・学習データを巡る訴訟の被告になっている中での主張である点を指摘する声もある。事実関係が係争的な話題であるため、本記事ではこれ以上踏み込まず、商用利用の可否や自社への影響は法務・コンプライアンス部門を交えて個別に判断することを推奨する。

よくある質問

Q1. DeepSeek V4の「安定版」とは具体的に何が変わったのですか?

2026年4月からプレビュー扱いだったV4-Pro/V4-Flashが、2026年7月24日の旧モデル名(deepseek-chat/deepseek-reasoner)完全廃止をもって、唯一の正式ラインナップになりました。モデル自体の重みが差し替わったわけではなく、呼び出し名の一本化とピーク時間帯課金の導入が主な変更点です。

Q2. 旧モデル名で送っていたAPIリクエストはどうなりますか?

UTC基準で2026年7月24日15:59(日本時間7月25日0:59)以降、deepseek-chatとdeepseek-reasonerを指定したリクエストはエラーになります。deepseek-v4-flashまたはdeepseek-v4-proへの書き換えが必要です。

Q3. V4-ProとV4-Flashはどちらを使うべきですか?

速度とコストを優先するならV4-Flash(アクティブパラメータ13B、オフピーク出力$0.66/Mトークン)、精度や複雑な推論を優先するならV4-Pro(アクティブパラメータ49B、同$1.98/Mトークン)が基本です。旧deepseek-reasonerからの移行では、思考モードの要否に加え、low/high/maxの思考強度も選べます。

Q4. ピーク時間帯課金はどのプランにも適用されますか?

公式APIでは、月〜金曜のUTC 1:00〜4:00・6:00〜10:00がピーク料金です。オフピーク料金はピーク料金の半額なので、バッチ処理主体の用途は時間帯をずらすか、キャッシュヒット率を高める設計でコストを抑えられます。

Q5. Kimi K3とDeepSeek V4はどう違いますか?

DeepSeek V4は1.6T(Pro)/284B(Flash)パラメータのMoEモデルで、API・重み双方が利用可能です。Kimi K3は2.8Tパラメータのネイティブマルチモーダルモデルで、公式Hugging Faceで全モデル重みが公開されています。用途で選ぶなら、DeepSeek APIとの互換移行を優先する場合はV4、自前展開を含めKimi系を評価する場合はK3が候補です。詳しい比較はKimi K3・Qwen3.8-Max連発の解説記事を参照してください。

Q6. 商用利用する上で特に注意すべき点は?

モデル重み自体はMITライセンスで制約は緩やかですが、公式API利用時のデータ取り扱いに関する利用規約は必ず確認してください。また、中国系AI研究機関を巡っては学習データの出所について業界内で議論が続いているため、自社のコンプライアンス基準に照らした判断を法務部門を交えて行うことを推奨します。

まとめ — 開発者が今日やるべき3つのこと

  1. 今日やること: コードベース内のdeepseek-chat/deepseek-reasonerをgrepし、deepseek-v4-flash/deepseek-v4-proへ書き換える。
  2. 今週中: バッチ処理のスケジュールを見直し、月〜金曜の日本時間10-13時・15-19時のピーク料金を避けられないか確認する。
  3. 今月中: V4-Pro/V4-Flashの性能を自社タスクで検証し、Kimi K3など今後公開されるオープンウェイトモデルとの比較検討も並行して進める。

あわせて読みたい:

運営元 Uravation よりAIエージェントを構想から本番運用まで進める順番と、体制・KPIの決め方をまとめた資料を無料で公開しています。 AIエージェント導入ロードマップを受け取る(無料)

参考・出典


著者: 佐藤傑(さとう・すぐる)
株式会社Uravation代表取締役。X(@SuguruKun_ai)フォロワー10万人超。100社以上の企業向けAI研修・導入支援。著書累計3.1万部突破。

この記事を読んで導入イメージが固まってきた方へ

UravationではAIエージェント導入の研修・コンサルを行っています。

Need help moving from reading to rollout?

この記事を読んで導入イメージが固まってきた方へ

Uravationでは、AIエージェントの要件整理、PoC設計、社内導入、研修まで一気通貫で支援しています。

この記事をシェア

X Facebook LINE

※ 本記事の情報は2026年9月時点のものです。サービスの料金・仕様は変更される可能性があります。最新情報は各サービスの公式サイトをご確認ください。

関連記事