DeepSeek、V4.1-Flashを公開 5520億MoE採用、API料金を引き下げ

DeepSeek、V4.1-Flashを公開 5520億MoE採用、API料金を引き下げ

※記事を視覚化したイメージであり、実際の事象とは異なります。

本サイトの記事や画像は、AIが公的資料や複数の報道を基に事実関係を整理・再構成し制作したものです。[続きを表示]特定の報道内容や表現を再利用・要約することを目的としたものではありません。ただし、誤りや不確定な情報が含まれる可能性がありますので、参考の一助としてご覧いただき、実際の判断は公的資料や各出典元の原文をご確認ください。[私たちの取り組み]

DeepSeekは2026年9月10日(中国時間)、画像とテキストを扱うAIモデル「DeepSeek-V4.1-Flash」を公開し、APIでの提供を開始した。モデルファイルとリポジトリはMITライセンスで公開し、API料金も引き下げた。同社公表の比較表では、一部の評価でClaude Opus 5やGPT-5.6 Solを上回った。

入力と出力で異なる構成、一部の評価で競合を上回る

V4.1-Flashは5520億パラメータのMoEモデルで、「Causal Encoder-Decoder」構成を採用した。入力処理時には80億、出力生成時には160億のパラメータを動かし、入力負荷が大きいエージェント用途でのコスト低減を狙う。

DeepSeekによると、KVキャッシュは従来のDeepSeek-V4-Flashと比べ、HBMの使用量を4分の1、SSDへの保存量を8分の1に抑えた。モデルファイルとリポジトリはMITライセンスで提供されている。

同社の比較表では、V4.1-FlashはTerminal-Bench 2.1で90.6、DeepSWE v1.1で74.2を記録し、いずれもClaude Opus 5とGPT-5.6 Solを上回った。一方、GPQA DiamondとHLEでは両モデルを下回った。比較はDeepSeekが示した評価設定と公表値に基づき、全用途での優位を示すものではない。

APIは時間帯別料金、V4-Proの移行も予定

新しいAPI料金は9月10日4時(UTC)に発効し、オフピーク料金はピーク料金の半額となった。MITライセンスで公開されたモデル重みとは別に、DeepSeek APIの利用は有料となる。

DeepSeekはV4-Proを段階的に終了する方針で、9月14日4時(UTC)以降、V4-Pro向けAPIリクエストをV4.1-Flashへ振り向け、V4.1-Flashの料金を適用する予定だ。この措置はV4.1-Proの公開まで続くとしている。

参考・出典

ニュースはAIで深化する—。日々の出来事を深掘りし、次の時代を考える視点をお届けします。

本サイトの記事や画像はAIが公的資料や報道を整理し制作したものです。
ただし誤りや不確定な情報が含まれることがありますので、参考の一助としてご覧いただき、
実際の判断は公的資料や他の報道を直接ご確認ください。
[私たちの取り組み]