時系列:5日間で何が起きたか

表面だけ見ると矛盾しています。DeepSeek は一部枠で最大約1100%の値上げを発表し、同じ週に Alibaba はこれまで公開していなかった 2.4兆パラメータの旗艦重みを出し、Zhipu は再学習なしでコーディング指標を約6倍伸ばした GLM-5.3 を出荷しました。3社の打ち手は、価格そのものではなく価格決定権を取りにいく動きとして読むと一貫します。

日付出来事
2026年7月16日Moonshot AI が Kimi K3(2.8兆パラメータ)を公開。米側の安全保障上の関心を招いていました
8月2日–3日Alibaba が Qwen3.8-Max を予告し、ホスト型 API を開始
8月10日Meta が Muse Glimmer(300億、Apache 2.0)を公開し、旗艦 Muse Spark 1.2 の重み公開を予告
8月12日Alibaba が Qwen3.8-2.4T-A95B を Hugging Face / ModelScope に公開。同日 xAI が Grok 4.6 を出荷
8月13日DeepSeek-V4-Pro が正式版になり、8月17日からの値上げを告知。Google は値下げした Gemini 3.7 Flash を出荷
8月14日Zhipu が GLM-5.3 を出荷。基盤は GLM-5.2 と同じ 7430億パラメータ
8月17日 0:00(北京時間)DeepSeek の新料金が発効

さらに引いて見ると、7月30日に OpenAI は最安帯 GPT-5.6 Luna を80%値下げし、8月6日–7日には無料ユーザーの既定モデルにしてテキスト無制限にしました。中国側が値上げと旗艦公開を進める同じ週に、米国側は消費層で無料と値下げを進めています。偶然ではなく、同じ価格戦争の両面です。

数字:何が変わったか

DeepSeek の値上げ(北京時間 8月17日 0:00 発効)

ピークは北京時間 9–12時と 14–18時です。下表は公開為替で換算した 100万 tokens あたりの米ドルです。

課金項目旧価格オフピーク(新)ピーク(新)ピーク上昇
V4-Flash キャッシュヒット入力$0.0028$0.007$0.014約400%
V4-Flash キャッシュミス入力$0.14$0.21$0.42200%
V4-Flash 出力$0.28$0.63$1.26350%
V4-Pro キャッシュヒット入力$0.0035$0.021$0.042約1100%
V4-Pro キャッシュミス入力$0.42$0.63$1.26200%
V4-Pro 出力$0.84$1.89$3.78350%

見出しの「1100%」はピーク時のキャッシュヒット入力に限った数字です。実請求を左右しやすい出力は350%です。第三者の試算では、月約8400万 tokens・主にオフピーク・ヒット率半分程度の重い負荷で、請求増は約1.8倍に近づくとされています。

Qwen3.8-2.4T-A95B の仕様

Qwen3.8-Max 公開チェックポイント
パラメータ総計 2.4兆 / 活性 950億
構成MoE、専門家512、ルーティング10+共有1
コンテキスト公開版 26.2万 tokens、約101万まで拡張可
ホスト版 Max 既定100万 tokens
公開ペース8月2日予告 → 3日 API → 12日重み
国際 API入力 $2 / 出力 $6(100万 tokens)
ライセンス独自 Qwen3.8-Max License(Apache 2.0ではない)

Alibaba が Max 級(旗艦)を公開したのは初めてです。Qwen3.5 / 3.6 / 3.7 Max は API のみでした。

GLM-5.3 と GLM-5.2:基盤は同じ、後訓練だけ

ベンチマークGLM-5.2GLM-5.3変化
Terminal-Bench 3.04.6%28.3%+23.7
DeepSWE v1.146.2%66.9%+20.7
Agents' Last Exam(CLI)23.8%28.5%+4.7
CyberGym77.2%84.5%+7.3
AutomationBench26.2%48.2%+22.0

数値は Zhipu の自己測定です。第三者の再測定はまだ公開されていません。Terminal-Bench 3.0 では GPT-5.6 Sol(34.6%)と Claude Fable 5(33.7%)に遅れています。全面首位ではなく、オープンウェイトの第一群です。

ピーク料金の外に、手元の実行環境を置く

ローカル評価、Agent、macOS ツールチェーンを、Root/sudo 付きの専有物理 Apple Silicon ノードで回すなら、RUVCLOUD の利用シーンから日単位レンタルを確認できます。

ユースケースを見る

3つの戦略を分解する

DeepSeek:一律安値から時間帯別へ。本質は容量不足の可視化です

「最安モデルがついに利幅を取りにきた」と読むのは簡単です。料金表の形を見ると、むしろ計算資源の制約を初めて価格に書いた動きです。従来の一律低価格は、GPU 供給が需要に追いついているあいだは獲得施策として機能しました。利用が指数的に伸び、供給が追いつかなくなると、「より柔軟なワークロードスケジューリングを奨励する」という公式表現は、「ピークの計算資源が足りないので、負荷をずらしてください」という意味になります。

国際報道で抜けやすい点もあります。ピーク時の公式 API は、GMI Cloud や Novita など一部再販の現行提示より高くなっています。「公式がいちばん安い」という前提は、初めて崩れました。

Alibaba:重み公開で生態系を取り、独自ライセンスで上限を守る

Qwen3.8-Max の公開は単純な厚意ではありません。2.4兆パラメータのチェックポイントを無料配布する一方、小型 Qwen で使っていた Apache 2.0 ではなく独自ライセンスを付けました。直近12か月で 5000万ドル超の「Model-as-a-Service」または「AI Work Assistant」事業は別途の商用許諾が必要で、月間アクティブ 1億超または月間売上 2000万ドル超の製品はモデル名の明示が必要です。

狙いは、開発者の心証(とくに海外)を取りつつ、推論事業を上に載せられるごく少数の大口に対しては交渉余地を残すことです。制限なしの Apache 2.0 で出た Meta の Muse Glimmer とは、「オープンウェイト」の中身が違います。

米国・EU・英国・韓国からのダウンロードを禁じる、という噂は誤りです。公開ライセンスに地理条項はありません。発表スレッドではなく LICENSE ファイルを読む方が速い、というだけの話です。

GLM-5.3:新しい基盤ではなく、後訓練の規模です

注目すべきは点数より手順です。基盤は GLM-5.2 と同じ 7430億、再学習なし、後訓練で強化学習環境を広げただけで Terminal-Bench 3.0 が 4.6% から 28.3% へ約6倍です。事前学習の限界収益が鈍るなか、後訓練の RL 規模が独立したレバーになり、新しい基盤を一から作るより敷居が低い、という半年越しの流れを裏付けます。

比較:値上げ後も DeepSeek は最安の旗艦か

モデル入力(100万 tokens)出力(100万 tokens)重み公開
DeepSeek V4-Pro(ピーク)$1.26$3.78なし
DeepSeek V4-Pro(オフピーク)$0.63$1.89なし
Qwen3.8-Max(国際 API)$2$6あり(独自ライセンス)
OpenAI GPT-5.6 Luna$0.20$1.20なし
Claude Opus 5(Alibaba 開示倍率からの推計)約 $5約 $25なし

答えは「いいえ」です。オフピークの V4-Pro は Claude Opus 5 よりまだ安い一方、国際向け Qwen3.8-Max と Luna はオフピークより安い面があります。「中国モデル=最安」は 2025年から 2026年前半までは概ね成り立ちましたが、今は安全な前提ではありません。

争点と未検証の細部

  • 「1100%」は正確でも文脈なしでは誤解を招きます。対象はピーク時キャッシュヒット入力だけです。実請求の中心になりやすい出力は350%です。
  • Qwen3.8-Max が自社製 Zhenwu M890 上で動くという報道は、Alibaba 自身の技術文書や第三者ベンチマークでは確認されていません。未検証として扱ってください。
  • GLM-5.3 が Cursor の重大な脆弱性を見つけたという話VentureBeat と Zhipu 側の開示に依ります。技術詳細は未公開で、ベンダー単独の主張です。
  • AI/半導体への対抗的輸出規制が準備されているという報道は公式発表ではなく、背景の推測として読んでください。

なぜ重要か:並行する二つの価格戦争

過去およそ1か月、中国の上位ラボは「週に3本」と評される密度で大型更新を出しています。DeepSeek、Alibaba、Zhipu に加え、7月16日公開の Kimi K3(2.8兆)と MiniMax H3 が先行しています。現地報道は「世界の AI 産業に再価格設定を迫っている」と強めに枠付けます。

米国側は消費層で逆を走っています。OpenAI は7月30日に最安帯を80%下げ、1週間後に無料・無制限へ。Google は8月13日、3週間前の先行モデルの半額でコーディング向けを出しました。上端では時間帯別の高い料金と旗艦公開、下端では無料と値下げです。どちらも本物の戦略で、最適化している漏斗の位置が違います。

地政学の層もあります。Kimi K3 の公開はすでに米側の審査関心を呼び、Alibaba がこの窓で 2.4兆旗艦を出したことは、「規制が締まる前に国際的な存在感と技術的対等の物語を固める」と読む分析があります。確定事実ではなく解釈です。Kimi K3 周辺の評価環境については、先の サンドボックス脱出の整理 も参照できます。

料金・ライセンス・ベンチマークは公開時点の情報です。再掲前に公式を再確認してください。一次の入口は Hugging FaceModelScope、ライセンス条項を報じた South China Morning Post です。

まとめ

DeepSeek は容量不足を料金表に書き、Alibaba は旗艦重みで開発者を取りつつ大口の許諾を残し、Zhipu は後訓練の規模だけで第一群に入りました。問いは「誰が一番安いか」から「誰が時間帯と許諾と請求を決めるか」へ移っています。

本物の macOS で Agent やローカル評価、オフピークのバッチを回すなら、ピーク API と自前ラックは同じ表の二行です。専有の物理 Apple Silicon と完全な Root/sudo は 料金ページ にあり、日単位で借りることもできます。

よくある質問

値上げ後も DeepSeek は GPT-5.6 や Claude より安いですか?

オフピークは Claude Opus 5 より安い一方、全体の最安ではなくなりました。GPT-5.6 Luna($0.20 / $1.20)と国際向け Qwen3.8-Max($2 / $6)は、少なくとも一軸でオフピークを下回ります。旗艦級としてはまだ相対的に安いですが、無条件の最安ではありません。

Qwen3.8-Max の公開重みを商用製品で無料利用できますか?

個人利用と社内利用はほぼ影響しません。直近12か月で 5000万ドル超の「Model-as-a-Service」または「AI Work Assistant」事業は、Alibaba との別途商用許諾が必要です。月間アクティブ 1億超または月間売上 2000万ドル超なら、モデル名の明示も必要です。

米・EU・英の利用者はダウンロード禁止ですか?

いいえ。公開ライセンスに地理制限はありません。制限は売上規模に紐づき、所在地には紐づきません。

GLM-5.3 と GLM-5.2 の実体的な違いは何ですか?

基盤は同じ 7430億パラメータです。Terminal-Bench 3.0 の約6倍は、後訓練で強化学習環境を広げた結果であり、基盤の再学習はありません。

Meta は旗艦も本当に公開しますか?

まだです。Muse Glimmer は 300億の蒸留モデルです。Zuckerberg 氏は閉じていた Muse Spark 1.2 の重みを「近く」出すと述べていますが、本稿時点では未実施です。意図であり、確定事実ではありません。