auto_awesomeAi Trend
DeepSeek V4 が安定版に―Flash は100万トークン0.14ドル、上位版は SWE-bench Verified 80.6%
DeepSeek V4 系列が安定版に移行。軽量版 V4-Flash は入力100万トークンあたり0.14ドル、上位版 V4-Pro-Max はソフトウェア改修ベンチマーク SWE-bench Verified で80.6%を記録した。
概要
※本記事は公開情報をもとに編集部が再構成したサマリです。一次情報は出典欄をご参照ください。
DeepSeek の V4 系列が2026年7月24日に安定版へ移行した。軽量版の「V4-Flash」は入力100万トークンあたり0.14ドル、出力0.28ドルという価格設定で、上位モデル群と比べて一桁以上安い水準にある。上位版「V4-Pro-Max」は、実在のソフトウェア不具合を修正できるかを測る SWE-bench Verified で80.6%を記録したとされる。
同時期に公開された欧米の最上位モデルが入力5ドル前後の価格帯にあることを踏まえると、性能競争と並行して価格帯の分化が進んでいる状況が読み取れる。
事実のポイント
- 安定版移行: 2026年7月24日
- V4-Flash 料金: 入力 $0.14 / 出力 $0.28(100万トークンあたり)
- V4-Pro-Max 性能: SWE-bench Verified で 80.6%
- 同時期の最上位モデル(Claude Opus 5)の標準料金は入力 $5 / 出力 $25
用語・背景の補足
SWE-bench Verified: GitHub 上の実在のリポジトリから採られた不具合修正課題を、AI が実際にコードを書いて解決できるかを測る評価。人手で妥当性を検証した課題に絞った版で、単なる知識問題ではなく実務に近い作業能力の指標とされる。
オープンウェイト: モデルの重み(学習結果のパラメータ)が公開され、自前の環境で動かせる形態。外部 API に送信せず自社環境で処理する選択肢が生まれる一方、動作させる計算資源は利用者側の負担になる。
価格帯の分化: 同じ「LLM」でも、最上位の推論能力を求める用途と、大量の定型処理を安く回す用途では適するモデルが異なる。単価が一桁違えば、月間の処理量によっては費用差が業務判断を左右する。
注意点
- ベンチマークの数値は特定の評価セットの結果であり、日本語業務や自社の文書形式での性能を示すものではない
- 安価なモデルを大量処理に充てる設計は有効だが、誤りの発生率が上がれば確認工数が増え、総コストでは逆転しうる
- 提供元の所在国によっては、データの取り扱い・法域に関する社内規程との整合を確認する必要がある
- 料金・提供形態は変更されうるため、導入検討時は公式情報の確認を要する
編集部見解
(追記予定)
info 公開情報をもとに編集部が再構成したサマリです。一次情報・追加情報は出典欄をご参照ください。