DeepSeekはなぜAPIを最大約1,100%値上げしたのか——中国オープンウェイト攻勢の直後に

約 20 分で読めます · MACCOME · 最終更新:2026 年 8 月 17 日

導入:8 月 12 日から 17 日までの 5 日間に、中国の大規模言語モデル圏は、互いに矛盾しつつ呼応する 3 つの動きを重ねました。DeepSeek は API を最大約 1,100% 値上げすると発表し、アリババはこれまで公開してこなかった Qwen-Max 級旗艦の 2.4 兆パラメータ重みを放出し、智譜は同一基盤のまま後学習だけでプログラミング系の点数を数倍に引き上げました。本稿ではタイムライン、料金表、ライセンス条項、ベンチマークを突き合わせ、「価格競争から価格決定権の競争へ」という主線を整理し、請求試算と選定手順まで落とします。V4 正式版とピーク/オフピーク課金の背景はDeepSeek V4 GA 移行ガイドを、Qwen の公開窓口はQwen3.8-Max 公開解説をご覧ください。

warning

一文の結論:3 社、3 つの打ち手は、同じ信号を指しています。国産大規模モデルは「価格を削る競争」から「価格を決める競争」へ移っています。本文の価格・ライセンス・点数は公開公告を突き合わせています。チップ推論、Cursor 脆弱性、輸出規制の噂は、いずれも独立検証なしと明示します。

6 つの痛点:「約 1,100% 値上げ」を見たあとに、チームが本当に揃えるべき勘定

見出しの数字は派手です。しかし Agent を回し、オープンウェイトを評価し、API 請求を分解しているチームが意思決定で詰まるのは、次の盲点です。

  1. 値上げの口径が揃いません:「11 倍」「約 1,100%」「350%」はいずれも正しいですが、それぞれキャッシュヒット入力、出力、キャッシュミス入力に対応します。混ぜると予算が歪みます。
  2. ピーク時間帯が見落とされます:北京時間 9–12 時と 14–18 時が新しいピーク窓です。同じワークロードでも、オフピークにずらすかどうかで請求は約 2 倍変わります。
  3. 「公式が最安」が初めて崩れます:ピーク時の DeepSeek 公式価格は、一部の第三者転売(GMI Cloud、Novita の現行提示は公式ピークより安い場合があります)を上回っています。
  4. オープンソースは Apache 2.0 と同義ではありません:Qwen3.8-Max はカスタムライセンスです。直近 12 か月の当該事業売上が 5,000 万ドルを超える MaaS/AI 作業アシスタントは、別途商用ライセンスが必要です。
  5. 地域禁止の噂が、ライセンス原文より速く広がります:公式文面に米・欧・英・韓のダウンロード禁止はありません。誤信するとコンプライアンス判断を誤ります。
  6. ベンダー自己測定を本番切替の根拠にします:GLM-5.3 の Terminal-Bench 上昇は独立第三者の再測定がなく、GPT-5.6 Sol と Claude Fable 5 にはまだ届きません。

何が起きたか:2 週間を 1 枚のタイムラインで見る

レンズを少し引きます。7 月 30 日、OpenAI は最安帯の GPT-5.6 Luna を 80% 値下げし、8 月 6–7 日には Luna を無料ユーザーの既定モデルにしてテキスト対話を無制限に開放しました。中国側が値上げとオープンウェイトで足し算をしている同じ時間に、米国側は無料化と値下げで足し算をしています。偶然ではなく、同じ価格ゲームの両面です。Luna の値下げ詳細はGPT-5.6 値下げ分解をご覧ください。

日付出来事
7 月 16 日月之暗面 Kimi K3(2.8 兆パラメータ)がオープンウェイト公開。これ以前から米側の安全保障上の関心を呼んでいました
8 月 2 日–3 日アリババ Qwen3.8-Max が予告のあと、クラウド API に投入されます
8 月 10 日Meta がオープンソースモデル Muse Glimmer(300 億パラメータ、Apache 2.0)を公開し、旗艦 Muse Spark 1.2 のウェイトを「まもなく公開」と予告します
8 月 12 日アリババが ModelScope/Hugging Face で Qwen3.8-2.4T-A95B のオープンウェイトを正式公開。同日、xAI が Grok 4.6 を発表します
8 月 13 日DeepSeek-V4-Pro 正式版が投入され、8 月 17 日起算の API 値上げを同時公告。Google は値下げした Gemini 3.7 Flash を公開します(価格は半額)
8 月 14 日智譜が GLM-5.3 を公開。基盤は GLM-5.2 と同じ 7,430 億パラメータです
8 月 17 日 0 時(北京時間)DeepSeek の新料金が正式に発効します

核心データ:DeepSeek 値上げ明細、Qwen 仕様、GLM ベンチマーク

DeepSeek 値上げ明細(8 月 17 日 0 時発効。北京時間 9–12 時・14–18 時がピーク)

単位は 100 万トークンあたり、人民元です。キャッシュヒット入力の上げ幅が最大(最高で約 12 倍/約 1,100%)ですが、絶対額は小さく残ります。ヘビーユーザーの請求を動かす本丸は、出力(350%)とキャッシュミス入力です。

課金項目(100 万トークンあたり)値上げ前オフピーク(新)ピーク(新)上げ幅(ピーク)
V4-Flash キャッシュヒット入力¥0.02¥0.05¥0.10約 400%
V4-Flash キャッシュミス入力¥1.0¥1.5¥3.0200%
V4-Flash 出力¥2.0¥4.5¥9.0350%
V4-Pro キャッシュヒット入力¥0.025¥0.15¥0.30約 1,100%
V4-Pro キャッシュミス入力¥3.0¥4.5¥9.0200%
V4-Pro 出力¥6.0¥13.5¥27.0350%
info

データの出典:DeepSeek 公式公告を、華爾街見聞、IT之家、V2EX などで突き合わせています。見出しの「約 1,100%」はピーク時のキャッシュヒット入力だけに対応します。出力の 350% こそ、多くの実請求の主項目です。

Qwen3.8-2.4T-A95B(Qwen3.8-Max オープンウェイト)の主要仕様

アリババが Max 級(旗艦)モデルの重みを公開するのは史上初です。これ以前の Qwen3.5/3.6/3.7 Max は、いずれもクローズド API でした。

項目データ
パラメータ規模総パラメータ 2.4 兆、活性化 950 億(MoE、専門家 512、ルーティング 10+共有 1)
コンテキスト窓オープンウェイトはネイティブ 262,144 トークン、約 101 万まで拡張可能。クラウド Max 版の既定は 100 万トークンです
公開リズム8 月 2 日予告 → 8 月 3 日 API 投入 → 8 月 12 日オープンウェイト
API 価格(国際サイト)入力 $2/100 万トークン、出力 $6/100 万トークン
ライセンスApache 2.0 ではなく、カスタム「Qwen3.8-Max License」です
意味アリババ史上初めて、Max 級旗艦の重みを公開した点です

GLM-5.3 対 GLM-5.2:同一基盤、後学習だけ

以上は智譜の公式自己測定です。独立第三者の再測定はまだありません。GLM-5.3 は Terminal-Bench 3.0 で GPT-5.6 Sol(34.6%)と Claude Fable 5(33.7%)に遅れます。全面首位ではなく、「オープンモデルの第一集団」です。

ベンチマークGLM-5.2GLM-5.3変化
Terminal-Bench 3.04.6%28.3%+23.7
DeepSWE v1.146.2%66.9%+20.7
Agents' Last Exam(CLI)23.8%28.5%+4.7
CyberGym77.2%84.5%+7.3
AutomationBench26.2%48.2%+22.0

深掘り:3 つの戦略、3 つの論理

1. DeepSeek:一律の低価格から時間帯別価格へ。本質は計算資源の逼迫を可視化したことです

今回の値上げは「追随値上げ」と読まれやすいですが、構造を見ると「計算資源の請求を透明化した」動きに近いです。これまで DeepSeek は時間帯を分けない一律の低価格を長く続け、低価格で利用者規模を取り、キャッシュヒット率とオフピーク分散でコストを薄めてきました。呼び出しが指数的に増え、GPU 供給が追いつかなくなると、この型は持ちません。値上げ公告の「より柔軟なワークロードスケジューリングを促す」は、「計算資源が足りないので、ピークをずらしてください」と読み替えられます。

注目すべき細部があります。値上げ後の DeepSeek 公式 API は、ピーク時に一部の第三者転売(GMI Cloud、Novita など。現行提示は公式ピークより安い場合があります)を上回っています。「公式が最安」という、かつての堀を支えた仮定が、初めて崩れます。

2. アリババ:重みを公開して生態系を囲い、カスタムライセンスで収入を囲います

Qwen3.8-Max の公開は、単純な「慈善」ではありません。アリババは同時に 2 つのことをしています。2.4 兆パラメータの重みをダウンロード可能にし、同時に従来の Apache 2.0 とは異なるカスタムライセンスを付けています。直近 12 か月の当該事業売上が 5,000 万ドルを超える「モデル即サービス」または「AI 作業アシスタント」は、アリババと別途商用ライセンスを交渉する必要があります。月間アクティブユーザーが 1 億を超える、または月商が 2,000 万ドルを超える製品は、画面上でモデル名を目立つ形で示す必要があります。

この組み合わせの論理は、オープンウェイトで開発者生態系と評判を取り(とくに海外開発者向けに、「国産モデルは表舞台に出せない」印象を和らげる)、現金収入を生む大口顧客では交渉余地を残す、というものです。だから Meta の Muse Glimmer(完全な Apache 2.0、付加条項なし)とは、「オープンの度合い」が同じではありません。Kimi K3 のオープンウェイト条件との対照は、Kimi K3 全面オープン解説をご覧ください。

広く流れた噂を訂正します。アリババのライセンスが米国、欧州連合、英国、韓国のユーザーによるダウンロードを禁じている、という話は事実ではありません。公式ライセンス原文に地域制限条項はありません。こうした噂は、原文を一度読むより速く広がります。情報源を疑う価値があります。

3. 智譜 GLM-5.3:基盤は替えず、「後学習のレシピ」だけを替える。規模化事前学習が唯一のレバーではない、ということです

GLM-5.3 で最も見るべきなのは点数そのものではなく、「どう取ったか」です。基盤は GLM-5.2 と完全に同一(7,430 億パラメータ)で、再事前学習はありません。強化学習環境の規模を広げた後学習だけで、Terminal-Bench 3.0 を 4.6% から 28.3% へ、約 6 倍に引き上げています。これは、事前学習のスケーリング則の限界収益が鈍るなか、「後学習の強化学習を規模化する」ことが新しい性能レバーになっている、という半年ほどの流れを裏付けます。このレバーの敷居は、千億級基盤を一から作り直すより明らかに低く、中小ベンダーも「内装の仕上げ」で先頭集団に追いつく余地があります。

横比較:値上げのあと、DeepSeek はまだ「最安の旗艦」ですか?

換算は約 ¥7.15/$1 の参考値です。実際は公式公告に従ってください。値上げ後の DeepSeek V4-Pro オフピークは、Claude Opus 5 より明らかに安い一方、「全体で最安」ではなくなっています。アリババ国際サイトの Qwen3.8-Max と OpenAI の Luna は、DeepSeek のオフピークより安いです。「国産=最安」の等式は崩れ、価格競争は層に分かれています。

モデル入力価格(100 万トークンあたり)出力価格(100 万トークンあたり)オープンの度合い
DeepSeek V4-Pro(ピーク)¥9.0(約 $1.26)¥27.0(約 $3.78)ウェイト未公開
DeepSeek V4-Pro(オフピーク)¥4.5(約 $0.63)¥13.5(約 $1.89)ウェイト未公開
Qwen3.8-Max(国際サイト)$2$6オープン(カスタムライセンス)
OpenAI GPT-5.6 Luna$0.20$1.20クローズド
Claude Opus 5(アリババ開示の倍率関係からの推計)約 $5約 $25クローズド

争点と、確認しておきたい細部

  • 値上げ幅の口径が乱れています:媒体によって「11 倍」「約 1,100%」「350%」と報じます。いずれも正しいですが、課金次元が違います(キャッシュヒット入力、出力、キャッシュミス入力)。読むときは、どの項目かを確認してください。
  • アリババ「震悟 M890」国産チップ推論の話:複数の中国語経済メディアは、Qwen3.8-Max の一部推論がアリババ自社の震悟 M890(Zhenwu M890)と「盤古 AL128」スーパーノード上で動くと伝えています。この細部は現時点で中国語メディアの転述に限られ、アリババ公式の独立技術文書や第三者ベンチマークはありません。独立検証なしとして扱ってください。
  • GLM-5.3 が「Cursor の重大な脆弱性を発見した」という話:VentureBeat の報道と智譜側の説明に由来します。具体的な脆弱性の詳細は未公開で、真偽と影響範囲は第三者のセキュリティ機関の確認を待ちます。ベンダー一方の開示です。
  • 中国商務部(MOFCOM)が対抗的な輸出規制を検討している、という噂:一部報道は、中国当局が AI/半導体技術への対抗的な輸出規制を検討していると伝えます。現時点で公式の正式確認はありません。媒体の推測/伝聞で、背景参考に限ります。

影響と背景:孤立した出来事ではなく、「二正面の戦争」です

これらを大きな物語に置くと、過去 1 か月の中国先頭ベンダーは「週に 3 回更新する」密度で公開しています。DeepSeek、アリババ、智譜に加え、月之暗面 Kimi K3(7 月 16 日、2.8 兆パラメータのオープンウェイト)や MiniMax H3 なども交代で登場します。国内の経済メディアは、この現象を「中国オープンモデルの密集公開が、世界の AI 業界に再価格設定を迫っている」と読むことが多いです。

同時に、米国ベンダーは別の道を進みます。OpenAI は 7 月 30 日に大幅値下げ(Luna は 80% 減)し、8 月 6–7 日には値下げ後の Luna を無料ユーザーの既定モデルにしてテキスト対話を無制限に開放しました。Google は 8 月 13 日、価格を半額にした Gemini 3.7 Flash を公開します。つまり中国側は「旗艦のオープンウェイト+段階的値上げ」、米国側は「消費側の無料化+値下げ防衛」です。二つの経路が同時に起き、2026 年 8 月を、大規模モデル業界の価格論理が組み変わる節目にしています。

もう一層の背景は地政学です。月之暗面 Kimi K3 の公開は、これ以前から米側の安全保障審査の関心を呼んでいました。アリババがこの窓口で 2.4 兆パラメータの旗艦を公開したことは、一部分析では「規制が締まる前に、国産モデルの国際的影響力と技術対等の物語を先に固める」と読まれます。この判断には推測が混じりますが、今回のオープンウェイトのタイミングを理解するうえで無視できない背景です。

6 ステップの請求・選定 Runbook:値上げ発効後に、どう落とすか

見出しの百分率に引っ張られないでください。次の 6 ステップで、「高くなるか」を実行可能な請求とルーティング判断に落とします。

前提:DeepSeek 公式の 2026-08-17 00:00(北京時間)発効料金表を手元に置きます。直近 7〜30 日の API ログ(時刻、キャッシュヒット/ミス、入出力トークン)を取得できる状態にしてください。参考為替は ¥7.15/$1 です。Qwen 国際サイト($2/$6)と GPT-5.6 Luna($0.20/$1.20)の公式表も並べます。

  1. 先にピーク窓を印します:既存呼び出しを北京時間で 9–12、14–18、それ以外のオフピークに切り、各帯のトークン比率を集計します。期待結果:ピーク比率が 1 つの百分率(例:80% または 20%)として出ます。
  2. 次に課金項目を分解します:キャッシュヒット入力、キャッシュミス入力、出力を別集計します。見出しの約 1,100% は第 1 項だけに当たり、出力 350% が多くの請求の主項目です。期待結果:3 項目の月次トークン量が並びます。
  3. 公式、転売、代替モデルを対照します:ピークで公式 DeepSeek が最安とは限りません。Qwen3.8-Max 国際サイト($2/$6)と GPT-5.6 Luna($0.20/$1.20)を同時に確認します。GMI Cloud/Novita の現行提示が公式ピークより安い場合もあります。期待結果:同一ワークロードの一行比較表ができます。
  4. ライセンスは原文を読み、転載を読まないでください:個人と社内利用はほぼ影響を受けません。MaaS/AI 作業アシスタントで、直近 12 か月の当該事業売上が 5,000 万ドルを超える場合だけ、別途商用ライセンスが必要です。月間アクティブユーザー 1 億、または月商 2,000 万ドル超なら、画面上のモデル名表示が必要です。地域禁止は事実ではありません。期待結果:「該当/非該当」の判定が 1 行で残ります。
  5. GLM-5.3 は「オープン第一集団」として扱い、本番切替命令にはしないでください:公式自己測定は第三者再測定がなく、Terminal-Bench 3.0 は Sol 34.6%/Fable 5 の 33.7% に遅れます。小流量で対照し、全量は一度に切らないでください。期待結果:シャドウ評価の合格基準(点数差と失敗モード)が文書化されます。
  6. オフピークのバッチとオープンウェイト推論を、常駐ノードへ置きます:ノート PC のフタ閉じは、北京時間の夜間オフピーク窓を切ります。7×24 のスケジューリングが必要なら、専用 macOS ノードでバッチ、ローカル重み、監査ログを回してください。期待結果:ピーク比率が下がり、下記スニペットの 80% ケース(¥243)から 20% ケース(¥162)へ寄ります。
python
# DeepSeek V4-Pro の概算です。出力項目だけを「ピーク対オフピーク」で比較します。
# 価格は 2026-08-17 発効の公式表(人民元 / 百万トークン)です。
PEAK_OUT, OFF_OUT = 27.0, 13.5

def monthly_output_bill(out_tokens_m, peak_share):
    peak = out_tokens_m * peak_share * PEAK_OUT
    off = out_tokens_m * (1 - peak_share) * OFF_OUT
    return round(peak + off, 2)

print(monthly_output_bill(10, 0.8))  # ピーク比率 80% → ¥243.0
print(monthly_output_bill(10, 0.2))  # ピーク比率 20% → ¥162.0

引用してよい 3 つの硬データ

  • 約 1,100%:V4-Pro ピーク時のキャッシュヒット入力は、¥0.025 から ¥0.30/100 万トークンへ上がります。絶対額は小さく、見出しは最大です。
  • 2.4T/95B:Qwen3.8-2.4T-A95B は総パラメータ 2.4 兆、活性化 950 億です。オープンウェイトはネイティブ 262,144 トークン、約 101 万まで拡張できます。
  • 4.6% → 28.3%:GLM-5.3 は同一の 7,430 億基盤のうえで、Terminal-Bench 3.0 を約 6 倍に伸ばします。それでも Sol 34.6% と Fable 5 の 33.7% には届きません。

締め:価格決定権は層に分かれました。常駐の計算資源は、自分で握ってください

8 月の 5 日間は、3 つの出来事を同じ料金表の上に重ねました。DeepSeek はピーク/オフピークで計算資源の不足を請求に書き込み、アリババはオープンウェイトで生態系を取り、カスタムライセンスで交渉余地を残し、智譜は後学習で「内装の仕上げ」でも第一集団に追いつけることを示しました。Agent とオープンウェイトを回しているチームには、次の 3 つの構造的な隘路が残ります。

  • ノート PC のスリープがオフピーク窓を切ります:フタを閉じると、北京時間の夜間オフピーク価格を捨て、見出しの上げ幅がそのまま請求に落ちます。
  • 共有開発機の権限が広すぎます:API キー、重みファイル、バッチキューが、スリープする 1 台に混ざると、ピーク/オフピークもライセンス監査も揃いません。
  • 7×24 のスケジューリング中枢がありません:オフピークのバッチ、ローカルのオープンウェイト推論、呼び出しログには専用ノードが必要で、一時的なクラウド関数では足りません。

オフピークのスケジューリング、オープンウェイト推論、API 請求の監査を、安定して隔離できる本番トポロジに置くなら、MACCOME の Mac クラウドホストは実 macOS、SSH 引き継ぎ、ネットワーク境界を制御できる環境を提供し、7×24 の常駐に向きます。公開プランはMac mini クラウドレンタル価格をご覧ください。

データの出典:DeepSeek 公式値上げ公告を、華爾街見聞、IT之家、AIGC ツール案内、V2EX コミュニティ議論で突き合わせています。アリババ Qwen 公式モデル倉庫(Hugging Face/ModelScope)と、南華早報(SCMP)のライセンス条項報道。智譜(Z.ai)GLM-5.3 公式技術ページと VentureBeat、StableLearn の関連報道。Meta AI Research 公式ブログと VentureBeat の Muse Glimmer 報道。第一財経、搜狐財経など、中国大規模モデルの密集公開リズムに関する総合報道。以上は原稿時点の公開情報です。価格、ライセンス条項、ベンチマーク点数は、公開前に最新の公式公告を再確認してください。チップ推論、セキュリティ脆弱性の発見、輸出規制の噂など、一部細部は本文で独立検証なしと明示しています。

よくある質問

DeepSeekの今回の値上げで、今後は必ず高くなりますか?

場面で分かれます。呼び出しの大半がオフピーク(北京時間 9–12 時・14–18 時以外)に落ち、キャッシュヒット率が高いヘビーユーザーなら、実際の請求増は見出しの「350%」「約 1,100%」より小さく、分析では約 1.8 倍程度に収まることがあります。ピークに集中し、キャッシュヒット率が低い場合は、見出し数字に近づきます。

アリババが公開したQwen3.8-Maxは、個人開発者が無料で商用利用できますか?

個人開発と社内利用は、ほぼ影響を受けません。ただし事業が「モデル即サービス」または「AI 作業アシスタント」で、直近 12 か月の当該事業累計売上が 5,000 万ドルを超える場合は、アリババへ別途商用ライセンスを申請する必要があります。月間アクティブユーザーが 1 億を超える、または月商が 2,000 万ドルを超える製品は、画面上でモデル名を明示する必要があります。

GLM-5.3とGLM-5.2は同じモデルですか?なぜ急に強くなったのですか?

基盤モデルは完全に同一(7,430 億パラメータ)で、智譜は再事前学習していません。点数が大きく伸びた理由は、後学習段階で強化学習環境の規模を大幅に広げたことです。いまの段階では「後学習の規模化」自体が独立した有効な性能レバーであり、より大きな基盤を再事前学習する必要は必ずしもありません。

ネット上で、Qwen3.8-Maxのライセンスは米欧ユーザーのダウンロードを禁じていると聞きます。本当ですか?

事実ではありません。公式ライセンス原文に地域制限条項はなく、主な制限は一定の売上規模を超える商用サービス向けです。ユーザーの所在地とは無関係です。

MetaがMuse Glimmerを公開したことは、Llama時代のオープンソース精神の復活ですか?

現時点では「部分的な回帰」にすぎません。Muse Glimmer 自体は 300 億パラメータの蒸留小型モデルで、Meta の旗艦クローズドモデル Muse Spark 1.2 は未公開です。ザッカーバーグは将来のウェイト公開を「予告」した段階です。それが本当に実現すれば、米国ベンダーが旗艦級クローズドモデルをオープンへ転じた初めての例になります。現時点では続報を追う必要があります。常駐 Mac でオープンウェイトやオフピークのバッチを回す場合は、MACCOME Mac クラウドレンタルプランをご覧ください。