---
title: "DeepSeekの新型「V4.1 Flash」、上位モデル「V4 Pro」を締め出したのはなぜか。価格と性能を確かめる"
description: "DeepSeekが2026年9月10日、マルチモーダル対応の新型「V4.1 Flash」を公開。9月14日以降は上位モデル「V4 Pro」への通信も自動でV4.1 Flashへ切り替わる。値下げと性能向上の中身を確かめた"
url: https://itpostjp.com/ai/deepseek-v4-1-flash-release-pricing-v4-pro-retirement/
category: "AI・生成AI"
published_at: 2026-09-10T22:20:00Z
updated_at: 2026-09-10T22:20:00Z
author: "IT Post編集部"
editor: "編集長 千田智也"
publisher: "IT Post by Rice Studio Lab"
language: ja-JP
ai_generated: true
ai_model: Sonnet 5
terms: ["MoE（専門家混合）", "オープンウェイト", "大規模言語モデル（LLM）"]
---

# DeepSeekの新型「V4.1 Flash」、上位モデル「V4 Pro」を締め出したのはなぜか。価格と性能を確かめる

IT Post編集部 ＆ 編集長 千田智也

DeepSeekが2026年9月10日、マルチモーダル対応の新型「V4.1 Flash」を公開。9月14日以降は上位モデル「V4 Pro」への通信も自動でV4.1 Flashへ切り替わる。値下げと性能向上の中身を確かめた

## 30秒で分かる結論

中国のAI企業DeepSeekは2026年9月10日(北京時間)、新型AIモデル「DeepSeek-V4.1 Flash」を公開しました。文章を扱う大規模言語モデル(LLM)に加えて画像も直接読み取れるマルチモーダル対応で、複数の専門知識を持つ小さなAIを組み合わせて動かすMoE(Mixture of Experts、専門家混合)という設計を採用しています。同社自身の発表によるベンチマーク評価では、旧型のFlashモデルを上回る性能を示し、一部の指標では米OpenAIのGPT-5.6 Sol・米AnthropicのClaude Opus 5を上回ったとしています。価格面では、同日付でAPI(外部の開発者がAI機能を自社サービスに組み込むための窓口)の利用料金を、入力・出力・キャッシュの種類によっておおむね1割から6割弱値下げしました。さらに2026年9月14日正午(北京時間)以降は、従来の上位モデル「DeepSeek V4 Pro」宛てのアクセスがすべてV4.1 Flashへ自動的に転送され、V4.1 Flashの料金で課金される仕組みに切り替わります。モデルの重み(パラメータ)はオープンウェイト(無料で公開され、誰でもダウンロードして自分のサーバーで動かせる形式)としてHugging Face上で公開されました。

## まず初めに

*「上位モデル」と名乗っていたV4 Proは、わずか1カ月ほどで下位モデルに看板を奪われて表舞台から退場することになった。*正式版としてV4-Pro-0813が公開されたのが8月13日、その約1カ月後にはアクセスそのものが下位のFlashへ強制的に付け替えられるというのだから、忙しい話だ。値下げ競争のスピードが尋常でないAI業界のなかでも、自社の「上位モデル」を自社の「廉価モデル」がひと月で食ってしまうという展開は、なかなか見られるものではない。※個人の感想です

![チップとAIを描いた挿絵](/images/articles/deepseek-v4-1-flash-release-pricing-v4-pro-retirement-inline-1.webp)

## 何が起きているのか

DeepSeekは2026年9月10日、新型モデル「DeepSeek-V4.1 Flash」を正式に公開しました。同社は前日の9月9日ごろから、9月10日前後に正式版を公開する方針を予告していました。

V4.1 Flashは、文章に加えて画像もモデルの基本設計に組み込まれた形で直接理解できるマルチモーダル対応のモデルです。設計上はMoE(専門家混合)という方式を採用しており、モデル全体としては5520億のパラメータ(AIが学習した知識を数値化したもの)を抱えつつ、実際に1つの単語を処理する際に働くパラメータはそのごく一部にとどまります。これに加えて、同社が「Engram」と呼ぶ独自のメモリー機構に1960億のパラメータを割り当てており、過去に読み込んだ内容を効率よく参照できるようにする狙いがあるとみられます。1回に読み込める文章量を示すコンテキストウィンドウは最大100万トークン(AIが文章を処理する際の最小単位)です。

*ここまで来ると、もう「軽量版」と呼ぶにはいささか大げさな体格である。*DeepSeekが自社で行ったとするベンチマーク評価では、汎用知識を問う「MMLU-Pro」でV4.1 Flashは74.1点を記録し、旧型のV4 Flashの68.3点を上回ったとしています。また、AIエージェント(人に代わって自律的に作業をこなすAIの仕組み)の性能を測る「DeepSWE」「AutomationBench」などの評価でも、米OpenAIのGPT-5.6 Sol・米AnthropicのClaude Opus 5を上回る結果を示したと発表しています。ただし、これらはいずれもDeepSeek自身が公表した評価であり、第三者による独立した検証結果ではない点には注意が必要です。

![ネットワークとAIを描いた挿絵](/images/articles/deepseek-v4-1-flash-release-pricing-v4-pro-retirement-inline-2.webp)

## なぜ重要なのか

今回の発表が重要なのは、単なる新モデルの公開にとどまらず、価格体系そのものを大きく変えた点にあります。DeepSeekは9月10日付で、API利用料金を入力・出力・キャッシュの種類に応じておおむね1割から6割弱値下げしました。具体的には、混雑しない時間帯の料金として、キャッシュ済み入力が100万トークンあたり0.003ドル、キャッシュされていない入力が0.15ドル、出力が0.60ドルに設定されています。一方、平日の協定世界時(UTC)1時から4時・6時から10時にあたる混雑時間帯は、これらの料金が2倍になる仕組みが導入されました。

さらに見過ごせないのが、上位モデルだった「V4 Pro」の扱いです。DeepSeekは、2026年9月14日正午(北京時間)以降、次期上位モデル「V4.1 Pro」が公開されるまでの間、V4 Pro宛てのすべてのリクエストをV4.1 Flashへ自動的に転送し、V4.1 Flashの料金で課金すると発表しました。実質的に、8月13日に正式版として公開されたばかりのV4 Proは、1カ月あまりで現役を退くことになります。AI業界全体で、数週間から数カ月という短い周期でモデルの入れ替えが起きている実態を象徴する動きといえます。

## 私たちへの影響

一般の利用者がDeepSeekのチャットアプリやWebサイトを無料で使っている場合、今回の切り替えによる直接的な操作は特に必要ありません。裏側で使われるモデルが自動的に更新される形になります。

一方、DeepSeekのAPIを自社サービスに組み込んで利用している開発者や企業にとっては、影響が及ぶ可能性があります。特に「V4 Pro」を指定してAPIを呼び出している場合、9月14日正午(北京時間)以降は自動的にV4.1 Flashへ転送され、料金体系もV4.1 Flashのものに変わります。処理内容や出力の傾向が変化する可能性があるため、DeepSeekのAPIを業務で利用している場合は、事前に自社のシステムでの動作確認をしておくことをお勧めします。オープンウェイトとして公開されたモデルの重みは、Hugging Face上から48個のファイルに分割された形でダウンロードでき、自分のサーバー上で動かすことも技術的には可能です。

## 初心者が知っておくべきこと

「オープンウェイト」とは、AIモデルの学習済みの重み(パラメータ)そのものを無料で公開し、誰でもダウンロードして自分の環境で動かせるようにする公開方式です。DeepSeekやMeta、Alibabaなどの企業が採用しており、OpenAIやAnthropic、Googleの主要モデルが基本的に自社のサーバー上でしか動かせない(クローズドな)のとは対照的です。オープンウェイトのモデルは、企業や研究者が自社のデータを外部に送らずに、自前のサーバー上でAIを動かしたい場合に選ばれることが多くなっています。

## よくある質問

**Q. V4.1 FlashはV4 Proより高性能なのですか。**

DeepSeek自身の発表によると、複数のベンチマーク評価でV4.1 FlashはV4 Proを上回る結果を示したとされています。ただし、これは同社自身による評価であり、第三者による独立した検証結果ではない点に注意が必要です。

**Q. 今までV4 Proを使っていたサービスはどうなりますか。**

2026年9月14日正午(北京時間)以降、V4 Pro宛てのリクエストは自動的にV4.1 Flashへ転送され、V4.1 Flashの料金体系で課金されるようになります。

## IT Postの見方――値下げ合戦の行き着く先は、ただの体力勝負

IT Postでは、DeepSeekの今回の値下げと機能強化を、利用者にとっては素直に歓迎できる動きだと考える。

*ただし、これを「AIがどんどん安く賢くなっていく明るい未来」とだけ見るのはお人好しが過ぎる。*ひと月前の「上位モデル」を、自社の廉価版があっさり追い越して看板を奪う。これが繰り返されているということは、要は体力のある企業が値下げと性能向上を同時に押し通す消耗戦をやっているということだ。ベンチマークで他社の看板モデルを上回ったと自社発表するのも、もはやこの業界の様式美になりつつある。数字自体を疑う必要はないが、「自分で出した点数で自分を勝者と呼ぶ」を毎月のように繰り返されると、読む側はいい加減、慣れっこになってくる。IT Postでは、こうした発表を追いかける際には、常に「誰がその数字を測ったのか」を確認する視点を持ち続けたいと考える。※個人の感想です

![この記事の内容にちなんだ挿絵](/images/articles/deepseek-v4-1-flash-release-pricing-v4-pro-retirement-inline-3.webp)

## 今後どうなりそうか

DeepSeekは、次期上位モデル「V4.1 Pro」の具体的な公開時期を明らかにしていません。それまでの間は、V4.1 Flashが同社の実質的な主力モデルという位置づけになります。オープンウェイトモデルの分野では、DeepSeekのほか、中国のMoonshot AI・Alibaba(Qwen)・Zhipu(GLM)などが数週間おきに新型モデルを公開する状況が続いており、性能と価格の両面での競争は今後も続くとみられます。IT Postでは、こうした動きが日本の開発者や企業にとってどのような選択肢の広がりをもたらすかについても、引き続き取り上げていきます。

## 情報源

- [Change Log](https://api-docs.deepseek.com/updates/) — DeepSeek（一次情報）
- [deepseek-ai/DeepSeek-V4.1-Flash](https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash) — DeepSeek公式(Hugging Face)（一次情報）
- [DeepSeek AI Released DeepSeek-V4.1-Flash with 1M Context, FP4 KV Cache, and Cross-Layer Attention Reuse](https://www.marktechpost.com/2026/09/10/deepseek-ai-released-deepseek-v4-1-flash-with-1m-context-fp4-kv-cache-and-cross-layer-attention-reuse/) — MarkTechPost

## この記事に出てくるIT用語

- [MoE（専門家混合）](https://itpostjp.com/terms/mixture-of-experts-moe/): AIモデルを多数の「専門家」に分割し、入力内容に応じて一部だけを働かせることで、効率よく高い性能を実現する仕組みです。
- [オープンウェイト](https://itpostjp.com/terms/open-weights/): AIモデルの学習済みデータ(重み)そのものが公開され、誰でもダウンロードして自分の環境で動かせる状態のことです。
- [大規模言語モデル（LLM）](https://itpostjp.com/terms/large-language-model/): 大量の文章から言葉のつながりを学習した、文章を扱うAIの中核技術です。

---

この記事は、公開情報と出典URLの検証、文章作成の一部に生成AIを使用しています。内容の責任はIT Post by Rice Studio Labが負います。

出典表記: IT Post by Rice Studio Lab — https://itpostjp.com/ai/deepseek-v4-1-flash-release-pricing-v4-pro-retirement/
