導入:8 月 12 日から 17 日までの 5 日間に、中国の大規模言語モデル圏は、互いに矛盾しつつ呼応する 3 つの動きを重ねました。DeepSeek は API を最大約 1,100% 値上げすると発表し、アリババはこれまで公開してこなかった Qwen-Max 級旗艦の 2.4 兆パラメータ重みを放出し、智譜は同一基盤のまま後学習だけでプログラミング系の点数を数倍に引き上げました。本稿ではタイムライン、料金表、ライセンス条項、ベンチマークを突き合わせ、「価格競争から価格決定権の競争へ」という主線を整理し、請求試算と選定手順まで落とします。V4 正式版とピーク/オフピーク課金の背景はDeepSeek V4 GA 移行ガイドを、Qwen の公開窓口はQwen3.8-Max 公開解説をご覧ください。
一文の結論:3 社、3 つの打ち手は、同じ信号を指しています。国産大規模モデルは「価格を削る競争」から「価格を決める競争」へ移っています。本文の価格・ライセンス・点数は公開公告を突き合わせています。チップ推論、Cursor 脆弱性、輸出規制の噂は、いずれも独立検証なしと明示します。
見出しの数字は派手です。しかし Agent を回し、オープンウェイトを評価し、API 請求を分解しているチームが意思決定で詰まるのは、次の盲点です。
レンズを少し引きます。7 月 30 日、OpenAI は最安帯の GPT-5.6 Luna を 80% 値下げし、8 月 6–7 日には Luna を無料ユーザーの既定モデルにしてテキスト対話を無制限に開放しました。中国側が値上げとオープンウェイトで足し算をしている同じ時間に、米国側は無料化と値下げで足し算をしています。偶然ではなく、同じ価格ゲームの両面です。Luna の値下げ詳細はGPT-5.6 値下げ分解をご覧ください。
| 日付 | 出来事 |
|---|---|
| 7 月 16 日 | 月之暗面 Kimi K3(2.8 兆パラメータ)がオープンウェイト公開。これ以前から米側の安全保障上の関心を呼んでいました |
| 8 月 2 日–3 日 | アリババ Qwen3.8-Max が予告のあと、クラウド API に投入されます |
| 8 月 10 日 | Meta がオープンソースモデル Muse Glimmer(300 億パラメータ、Apache 2.0)を公開し、旗艦 Muse Spark 1.2 のウェイトを「まもなく公開」と予告します |
| 8 月 12 日 | アリババが ModelScope/Hugging Face で Qwen3.8-2.4T-A95B のオープンウェイトを正式公開。同日、xAI が Grok 4.6 を発表します |
| 8 月 13 日 | DeepSeek-V4-Pro 正式版が投入され、8 月 17 日起算の API 値上げを同時公告。Google は値下げした Gemini 3.7 Flash を公開します(価格は半額) |
| 8 月 14 日 | 智譜が GLM-5.3 を公開。基盤は GLM-5.2 と同じ 7,430 億パラメータです |
| 8 月 17 日 0 時(北京時間) | DeepSeek の新料金が正式に発効します |
単位は 100 万トークンあたり、人民元です。キャッシュヒット入力の上げ幅が最大(最高で約 12 倍/約 1,100%)ですが、絶対額は小さく残ります。ヘビーユーザーの請求を動かす本丸は、出力(350%)とキャッシュミス入力です。
| 課金項目(100 万トークンあたり) | 値上げ前 | オフピーク(新) | ピーク(新) | 上げ幅(ピーク) |
|---|---|---|---|---|
| V4-Flash キャッシュヒット入力 | ¥0.02 | ¥0.05 | ¥0.10 | 約 400% |
| V4-Flash キャッシュミス入力 | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 出力 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro キャッシュヒット入力 | ¥0.025 | ¥0.15 | ¥0.30 | 約 1,100% |
| V4-Pro キャッシュミス入力 | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 出力 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
データの出典:DeepSeek 公式公告を、華爾街見聞、IT之家、V2EX などで突き合わせています。見出しの「約 1,100%」はピーク時のキャッシュヒット入力だけに対応します。出力の 350% こそ、多くの実請求の主項目です。
アリババが Max 級(旗艦)モデルの重みを公開するのは史上初です。これ以前の Qwen3.5/3.6/3.7 Max は、いずれもクローズド API でした。
| 項目 | データ |
|---|---|
| パラメータ規模 | 総パラメータ 2.4 兆、活性化 950 億(MoE、専門家 512、ルーティング 10+共有 1) |
| コンテキスト窓 | オープンウェイトはネイティブ 262,144 トークン、約 101 万まで拡張可能。クラウド Max 版の既定は 100 万トークンです |
| 公開リズム | 8 月 2 日予告 → 8 月 3 日 API 投入 → 8 月 12 日オープンウェイト |
| API 価格(国際サイト) | 入力 $2/100 万トークン、出力 $6/100 万トークン |
| ライセンス | Apache 2.0 ではなく、カスタム「Qwen3.8-Max License」です |
| 意味 | アリババ史上初めて、Max 級旗艦の重みを公開した点です |
以上は智譜の公式自己測定です。独立第三者の再測定はまだありません。GLM-5.3 は Terminal-Bench 3.0 で GPT-5.6 Sol(34.6%)と Claude Fable 5(33.7%)に遅れます。全面首位ではなく、「オープンモデルの第一集団」です。
| ベンチマーク | GLM-5.2 | GLM-5.3 | 変化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 |
| Agents' Last Exam(CLI) | 23.8% | 28.5% | +4.7 |
| CyberGym | 77.2% | 84.5% | +7.3 |
| AutomationBench | 26.2% | 48.2% | +22.0 |
今回の値上げは「追随値上げ」と読まれやすいですが、構造を見ると「計算資源の請求を透明化した」動きに近いです。これまで DeepSeek は時間帯を分けない一律の低価格を長く続け、低価格で利用者規模を取り、キャッシュヒット率とオフピーク分散でコストを薄めてきました。呼び出しが指数的に増え、GPU 供給が追いつかなくなると、この型は持ちません。値上げ公告の「より柔軟なワークロードスケジューリングを促す」は、「計算資源が足りないので、ピークをずらしてください」と読み替えられます。
注目すべき細部があります。値上げ後の DeepSeek 公式 API は、ピーク時に一部の第三者転売(GMI Cloud、Novita など。現行提示は公式ピークより安い場合があります)を上回っています。「公式が最安」という、かつての堀を支えた仮定が、初めて崩れます。
Qwen3.8-Max の公開は、単純な「慈善」ではありません。アリババは同時に 2 つのことをしています。2.4 兆パラメータの重みをダウンロード可能にし、同時に従来の Apache 2.0 とは異なるカスタムライセンスを付けています。直近 12 か月の当該事業売上が 5,000 万ドルを超える「モデル即サービス」または「AI 作業アシスタント」は、アリババと別途商用ライセンスを交渉する必要があります。月間アクティブユーザーが 1 億を超える、または月商が 2,000 万ドルを超える製品は、画面上でモデル名を目立つ形で示す必要があります。
この組み合わせの論理は、オープンウェイトで開発者生態系と評判を取り(とくに海外開発者向けに、「国産モデルは表舞台に出せない」印象を和らげる)、現金収入を生む大口顧客では交渉余地を残す、というものです。だから Meta の Muse Glimmer(完全な Apache 2.0、付加条項なし)とは、「オープンの度合い」が同じではありません。Kimi K3 のオープンウェイト条件との対照は、Kimi K3 全面オープン解説をご覧ください。
広く流れた噂を訂正します。アリババのライセンスが米国、欧州連合、英国、韓国のユーザーによるダウンロードを禁じている、という話は事実ではありません。公式ライセンス原文に地域制限条項はありません。こうした噂は、原文を一度読むより速く広がります。情報源を疑う価値があります。
GLM-5.3 で最も見るべきなのは点数そのものではなく、「どう取ったか」です。基盤は GLM-5.2 と完全に同一(7,430 億パラメータ)で、再事前学習はありません。強化学習環境の規模を広げた後学習だけで、Terminal-Bench 3.0 を 4.6% から 28.3% へ、約 6 倍に引き上げています。これは、事前学習のスケーリング則の限界収益が鈍るなか、「後学習の強化学習を規模化する」ことが新しい性能レバーになっている、という半年ほどの流れを裏付けます。このレバーの敷居は、千億級基盤を一から作り直すより明らかに低く、中小ベンダーも「内装の仕上げ」で先頭集団に追いつく余地があります。
換算は約 ¥7.15/$1 の参考値です。実際は公式公告に従ってください。値上げ後の DeepSeek V4-Pro オフピークは、Claude Opus 5 より明らかに安い一方、「全体で最安」ではなくなっています。アリババ国際サイトの Qwen3.8-Max と OpenAI の Luna は、DeepSeek のオフピークより安いです。「国産=最安」の等式は崩れ、価格競争は層に分かれています。
| モデル | 入力価格(100 万トークンあたり) | 出力価格(100 万トークンあたり) | オープンの度合い |
|---|---|---|---|
| DeepSeek V4-Pro(ピーク) | ¥9.0(約 $1.26) | ¥27.0(約 $3.78) | ウェイト未公開 |
| DeepSeek V4-Pro(オフピーク) | ¥4.5(約 $0.63) | ¥13.5(約 $1.89) | ウェイト未公開 |
| Qwen3.8-Max(国際サイト) | $2 | $6 | オープン(カスタムライセンス) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | クローズド |
| Claude Opus 5(アリババ開示の倍率関係からの推計) | 約 $5 | 約 $25 | クローズド |
これらを大きな物語に置くと、過去 1 か月の中国先頭ベンダーは「週に 3 回更新する」密度で公開しています。DeepSeek、アリババ、智譜に加え、月之暗面 Kimi K3(7 月 16 日、2.8 兆パラメータのオープンウェイト)や MiniMax H3 なども交代で登場します。国内の経済メディアは、この現象を「中国オープンモデルの密集公開が、世界の AI 業界に再価格設定を迫っている」と読むことが多いです。
同時に、米国ベンダーは別の道を進みます。OpenAI は 7 月 30 日に大幅値下げ(Luna は 80% 減)し、8 月 6–7 日には値下げ後の Luna を無料ユーザーの既定モデルにしてテキスト対話を無制限に開放しました。Google は 8 月 13 日、価格を半額にした Gemini 3.7 Flash を公開します。つまり中国側は「旗艦のオープンウェイト+段階的値上げ」、米国側は「消費側の無料化+値下げ防衛」です。二つの経路が同時に起き、2026 年 8 月を、大規模モデル業界の価格論理が組み変わる節目にしています。
もう一層の背景は地政学です。月之暗面 Kimi K3 の公開は、これ以前から米側の安全保障審査の関心を呼んでいました。アリババがこの窓口で 2.4 兆パラメータの旗艦を公開したことは、一部分析では「規制が締まる前に、国産モデルの国際的影響力と技術対等の物語を先に固める」と読まれます。この判断には推測が混じりますが、今回のオープンウェイトのタイミングを理解するうえで無視できない背景です。
見出しの百分率に引っ張られないでください。次の 6 ステップで、「高くなるか」を実行可能な請求とルーティング判断に落とします。
前提:DeepSeek 公式の 2026-08-17 00:00(北京時間)発効料金表を手元に置きます。直近 7〜30 日の API ログ(時刻、キャッシュヒット/ミス、入出力トークン)を取得できる状態にしてください。参考為替は ¥7.15/$1 です。Qwen 国際サイト($2/$6)と GPT-5.6 Luna($0.20/$1.20)の公式表も並べます。
# DeepSeek V4-Pro の概算です。出力項目だけを「ピーク対オフピーク」で比較します。
# 価格は 2026-08-17 発効の公式表(人民元 / 百万トークン)です。
PEAK_OUT, OFF_OUT = 27.0, 13.5
def monthly_output_bill(out_tokens_m, peak_share):
peak = out_tokens_m * peak_share * PEAK_OUT
off = out_tokens_m * (1 - peak_share) * OFF_OUT
return round(peak + off, 2)
print(monthly_output_bill(10, 0.8)) # ピーク比率 80% → ¥243.0
print(monthly_output_bill(10, 0.2)) # ピーク比率 20% → ¥162.0
8 月の 5 日間は、3 つの出来事を同じ料金表の上に重ねました。DeepSeek はピーク/オフピークで計算資源の不足を請求に書き込み、アリババはオープンウェイトで生態系を取り、カスタムライセンスで交渉余地を残し、智譜は後学習で「内装の仕上げ」でも第一集団に追いつけることを示しました。Agent とオープンウェイトを回しているチームには、次の 3 つの構造的な隘路が残ります。
オフピークのスケジューリング、オープンウェイト推論、API 請求の監査を、安定して隔離できる本番トポロジに置くなら、MACCOME の Mac クラウドホストは実 macOS、SSH 引き継ぎ、ネットワーク境界を制御できる環境を提供し、7×24 の常駐に向きます。公開プランはMac mini クラウドレンタル価格をご覧ください。
データの出典:DeepSeek 公式値上げ公告を、華爾街見聞、IT之家、AIGC ツール案内、V2EX コミュニティ議論で突き合わせています。アリババ Qwen 公式モデル倉庫(Hugging Face/ModelScope)と、南華早報(SCMP)のライセンス条項報道。智譜(Z.ai)GLM-5.3 公式技術ページと VentureBeat、StableLearn の関連報道。Meta AI Research 公式ブログと VentureBeat の Muse Glimmer 報道。第一財経、搜狐財経など、中国大規模モデルの密集公開リズムに関する総合報道。以上は原稿時点の公開情報です。価格、ライセンス条項、ベンチマーク点数は、公開前に最新の公式公告を再確認してください。チップ推論、セキュリティ脆弱性の発見、輸出規制の噂など、一部細部は本文で独立検証なしと明示しています。
よくある質問
DeepSeekの今回の値上げで、今後は必ず高くなりますか?
場面で分かれます。呼び出しの大半がオフピーク(北京時間 9–12 時・14–18 時以外)に落ち、キャッシュヒット率が高いヘビーユーザーなら、実際の請求増は見出しの「350%」「約 1,100%」より小さく、分析では約 1.8 倍程度に収まることがあります。ピークに集中し、キャッシュヒット率が低い場合は、見出し数字に近づきます。
アリババが公開したQwen3.8-Maxは、個人開発者が無料で商用利用できますか?
個人開発と社内利用は、ほぼ影響を受けません。ただし事業が「モデル即サービス」または「AI 作業アシスタント」で、直近 12 か月の当該事業累計売上が 5,000 万ドルを超える場合は、アリババへ別途商用ライセンスを申請する必要があります。月間アクティブユーザーが 1 億を超える、または月商が 2,000 万ドルを超える製品は、画面上でモデル名を明示する必要があります。
GLM-5.3とGLM-5.2は同じモデルですか?なぜ急に強くなったのですか?
基盤モデルは完全に同一(7,430 億パラメータ)で、智譜は再事前学習していません。点数が大きく伸びた理由は、後学習段階で強化学習環境の規模を大幅に広げたことです。いまの段階では「後学習の規模化」自体が独立した有効な性能レバーであり、より大きな基盤を再事前学習する必要は必ずしもありません。
ネット上で、Qwen3.8-Maxのライセンスは米欧ユーザーのダウンロードを禁じていると聞きます。本当ですか?
事実ではありません。公式ライセンス原文に地域制限条項はなく、主な制限は一定の売上規模を超える商用サービス向けです。ユーザーの所在地とは無関係です。
MetaがMuse Glimmerを公開したことは、Llama時代のオープンソース精神の復活ですか?
現時点では「部分的な回帰」にすぎません。Muse Glimmer 自体は 300 億パラメータの蒸留小型モデルで、Meta の旗艦クローズドモデル Muse Spark 1.2 は未公開です。ザッカーバーグは将来のウェイト公開を「予告」した段階です。それが本当に実現すれば、米国ベンダーが旗艦級クローズドモデルをオープンへ転じた初めての例になります。現時点では続報を追う必要があります。常駐 Mac でオープンウェイトやオフピークのバッチを回す場合は、MACCOME Mac クラウドレンタルプランをご覧ください。