2026年8月12日〜17日に何が起きたかを時系列で確認する
三つの動きは表面では矛盾します。値上げ、旗艦重みの公開、同一基盤の後学習です。並べると一つの信号になります。中国の主要ラボは「安さ」だけでなく「価格を決める側」へ移っています。
7月16日 · Kimi K3:月之暗面が2.8兆パラメータのKimi K3を公開し、米側の安全保障上の関心を呼びました。
8月2日〜3日 · QwenのAPI:アリババがQwen3.8-Maxを予告し、続いてクラウドAPIを開始しました。
8月10日 · Metaの対照:MetaがMuse Glimmer(300億、Apache 2.0)を公開し、旗艦Muse Spark 1.2の重み公開を予告しました。
8月12日 · 重み公開:アリババがModelScope/Hugging FaceでQwen3.8-2.4T-A95Bを公開しました。同日、xAIがGrok 4.6を出荷しました。
8月13日〜14日 · 値上げと後学習:DeepSeek-V4-Proが正式版となり、8月17日からの値上げを告知しました。Googleは値下げしたGemini 3.7 Flashを出し、智譜は翌日GLM-5.3を、GLM-5.2と同じ7430億基盤で出しました。
8月17日0時(北京時間)· 新料金開始:7月30日にOpenAIは最安帯GPT-5.6 Lunaを80%値下げし、8月6〜7日には無料ユーザーの既定モデルにしてテキスト無制限にしました。中国側が値上げと公開を足す同じ週に、米国側は無料と値下げを足しています。
補足:中国の経済メディアは「開源モデルの連発が世界の再価格付けを迫る」と読むことが多いです。英語圏のテック報道は各発表を単体の製品ニュースとして扱う傾向があります。
DeepSeekの新料金、Qwen3.8-Maxの仕様、GLM-5.3の公式ベンチを表で見る
見出しの1100%は事実ですが、対象は狭いです。V4-Proのピーク時キャッシュヒット入力だけです。請求の大半を占める出力は350%です。ピークは北京時間9〜12時と14〜18時です。単位は100万トークンあたりです。
| 課金項目(100万tokens) | 旧料金 | オフピーク(新) | ピーク(新) | ピーク上昇 |
|---|---|---|---|---|
| V4-Flash キャッシュヒット入力 | ¥0.02 | ¥0.05 | ¥0.10 | 約400% |
| V4-Flash キャッシュミス入力 | ¥1.0 | ¥1.5 | ¥3.0 | 200% |
| V4-Flash 出力 | ¥2.0 | ¥4.5 | ¥9.0 | 350% |
| V4-Pro キャッシュヒット入力 | ¥0.025 | ¥0.15 | ¥0.30 | 約1100% |
| V4-Pro キャッシュミス入力 | ¥3.0 | ¥4.5 | ¥9.0 | 200% |
| V4-Pro 出力 | ¥6.0 | ¥13.5 | ¥27.0 | 350% |
第三者の試算では、月約8400万トークン・主にオフピーク・ヒット率約半分のヘビー利用で、請求増は約1.8倍に収まります。
Qwen3.8-2.4T-A95Bは、アリババがMax級を初めて公開した例です。Qwen3.5/3.6/3.7 MaxはAPI専用のままでした。
| 項目 | 内容 |
|---|---|
| パラメータ | 総計2.4兆、活性950億(MoE、専門家512、ルーティング10+共有1) |
| コンテキスト | 公開重みは原生26.2万tokens、約101万まで拡張可。クラウドMaxは既定100万 |
| 公開手順 | 8月2日予告 → 8月3日API → 8月12日重み公開 |
| 国際API | 入力$2/M、出力$6/M |
| ライセンス | Apache 2.0ではない。独自のQwen3.8-Max License |
GLM-5.3はGLM-5.2と同じ7430億基盤です。再事前学習はありません。次表は智譜の自己測定で、第三者の再実行は未公開です。
| ベンチマーク | GLM-5.2 | GLM-5.3 | 変化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6% | 28.3% | +23.7 |
| DeepSWE v1.1 | 46.2% | 66.9% | +20.7 |
| Agents' Last Exam(CLI) | 23.8% | 28.5% | +4.7 |
| CyberGym | 77.2% | 84.5% | +7.3 |
| AutomationBench | 26.2% | 48.2% | +22.0 |
注意:Terminal-Bench 3.0ではGPT-5.6 Sol(34.6%)とClaude Fable 5(33.7%)にまだ届きません。開源の第一集団であり、閉源の頂点ではありません。
値上げ後もDeepSeekは最安の旗艦か:三つの打ち手を並べる
答えは「いいえ」です。オフピークのV4-ProはClaude Opus 5よりまだ安いです。全体最安ではなくなりました。Qwen3.8-Maxの国際APIとOpenAI Lunaは、少なくとも一軸でDeepSeekのオフピークを下回ります。
値上げを「プレミアム転向」と読むと誤ります。終日一律の安値は、GPU供給が需要に追いついている間だけ成立します。利用が指数で伸び、供給が追いつかないと、価格表に制約を出す必要があります。公式文の「より柔軟なワークロードスケジューリング」は、「ピーク計算資源が不足しているので、負荷をずらしてください」という意味です。
国際報道がほとんど触れない点があります。ピーク時の公式APIは、GMI CloudやNovitaなど一部再販より高くなっています。「公式が常に最安」という前提は、初めて崩れました。
アリババは重みを無料配布すると同時に、Apache 2.0ではない独自ライセンスを付けました。直近12か月で売上が5000万ドルを超える「モデル即サービス」または「AI作業アシスタント」は、別途商用ライセンスが必要です。月間アクティブ1億超または月収2000万ドル超の製品は、画面にモデル名を明示する必要があります。MetaのMuse Glimmer(制限なしのApache 2.0)とは、開源の度合いが違います。
米欧英韓からのダウンロード禁止という噂は誤りです。公式文に地域条項はありません。
GLM-5.3で見るべきは点数より方法です。基盤は同じ7430億です。再学習はありません。後学習で強化学習環境を広げ、Terminal-Bench 3.0を4.6%から28.3%へ、約6倍伸ばしました。事前学習の限界収益が鈍るなか、後学習RLは新しい基盤を作り直すより低い敷居のレバーになっています。
| モデル | 入力(100万tokens) | 出力(100万tokens) | 重み公開 |
|---|---|---|---|
| DeepSeek V4-Pro(ピーク) | ¥9.0(約$1.26) | ¥27.0(約$3.78) | なし |
| DeepSeek V4-Pro(オフピーク) | ¥4.5(約$0.63) | ¥13.5(約$1.89) | なし |
| Qwen3.8-Max(国際API) | $2 | $6 | あり(独自ライセンス) |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 | なし |
| Claude Opus 5(アリババ開示倍率からの推計) | 約$5 | 約$25 | なし |
Beijing peak: 09:00-12:00 and 14:00-18:00 CST JST = CST + 1 hour FX ref ≈ ¥7.15 / $1
「中国モデル=最安」は2025年から2026年初頭まで成立していました。いまは既定値として使えません。
請求とライセンスを六ステップで点検する
見出し倍率だけでスタックを組み替えないでください。課金項目、時計、ライセンスのしきい値を先に分けます。
課金項目を特定する:1100%、350%、200%はいずれも正しいです。対象はキャッシュヒット入力、出力、キャッシュミス入力です。実請求を動かすのは後二者です。
自チームの勤務時間を北京ピークに重ねる:9〜12時と14〜18時(北京)。日本時間は各1時間遅れです。バッチと評価ループは明示的にオフピークへ移してください。
命中率で見積もる:オフピーク中心・ヒット率約半分なら約1.8倍の試算があります。ピークかつ低命中で350%や1100%が現実になります。
Qwenの売上しきい値を確認する:個人と社内利用は問題ありません。MaaS/AI作業アシスタントで直近12か月5000万ドル超なら別途商用ライセンスです。月間アクティブ1億超または月収2000万ドル超ならモデル名の明示が必要です。地域禁止はありません。
GLM-5.3を新基盤ではなく後学習結果として扱う:7430億は再学習していません。公式自己測定です。第三者再実行まで「開源第一集団、閉源頂点ではない」と書いておいてください。
公式API、再販、ローカル重みを分ける:ピークの公式はGMI CloudやNovitaより高くなり得ます。公開重みはトークン課金をホストのメモリと稼働へ移します。眠らない評価機が必要なら、MESHLAUNCHのMac Miniレンタル料金とヘルプセンターから始めてください。
未検証の主張、二つの価格戦争、引用できる三つの数字
次の四点は、一次資料が追いつくまで「確定」に入れないでください。
1100%の見出し:技術的には正しいです。ピーク時キャッシュヒット入力だけです。
震悟M890国産チップ:複数の中国経済メディアが、Qwen3.8-Maxの一部推論が自社製震悟M890と「盤古AL128」超ノード上だと報じています。アリババ公式の独立技術文書や第三者ベンチは未確認です。未検証として扱ってください。
Cursorの重大脆弱性:VentureBeatと智譜側の開示です。技術詳細は非公開です。ベンダー単独開示です。
商務部の対抗輸出規制:中国当局がAI/半導体で対抗規制を検討しているという報道は推測です。公式確認はありません。
中国の経済メディアは直近1か月を「週三更」と呼び始めています。DeepSeek、アリババ、智譜に加え、Kimi K3(7月16日、2.8兆)とMiniMax H3が続きます。米国側は逆です。Lunaは7月30日に80%値下げ、8月6〜7日に無料かつ無制限、Gemini 3.7 Flashは8月13日に前世代の半額です。
地政学の読みもあります。Kimi K3はすでに米側の審査関心を呼びました。一部分析は、アリババがこの窓で2.4兆を公開したことを、規制が締まる前に国際的な存在感と「技術的対等」の物語を固める動きだと見ます。確定事実ではなく解釈です。タイミングを読む材料にはなります。
引用できる三つの数字:① V4-Proピークキャッシュヒット入力 ¥0.025→¥0.30(約1100%)、出力 ¥6.0→¥27.0(350%)。② Qwen3.8-2.4T-A95B:総計2.4兆/活性950億、国際API $2/$6。③ GLM-5.3 Terminal-Bench 3.0:4.6%→28.3%(公式自己測定、同一7430億基盤)。
出典:DeepSeek公式値上げ告知(華爾街見聞、IT之家、AIGC、V2EXで照合)、アリババQwen公式リポジトリ(Hugging Face/ModelScope)とSCMPのライセンス報道、智譜(Z.ai)GLM-5.3公式ページとVentureBeat/StableLearn、Meta AI ResearchとVentureBeatのMuse Glimmer報道、第一財経・搜狐財経の連発報道。公開情報は執筆時点です。
ピーク料金は常時評価ループを罰します。公開重みは眠るホストを罰します。ノートの蓋閉じやMetalのない安価VPSでは、ローカル評価もエージェント耐久試験も歪みます。iOS CI/CDとAIエージェント自動化に向く安定した本番環境では、MESHLAUNCHのMac Miniクラウドレンタルが多くの場合より良い選択です。専用Apple Silicon、7×24、日/週/月の弹性契約です。料金は料金ページ、手順はヘルプセンターを参照してください。
時間帯とキャッシュ命中率で分かれます。北京時間9〜12時・14〜18時以外のオフピークで、命中率が高いヘビーユーザーなら、見出しの350%や1100%より小さく、試算では約1.8倍です。ピークかつ低命中なら見出し数字に近づきます。
個人開発と社内利用はほぼ影響しません。モデル即サービスまたはAI作業アシスタントで直近12か月の売上が5000万ドルを超える場合は、アリババとの別途商用ライセンスが必要です。月間アクティブ1億超または月収2000万ドル超なら、画面にモデル名を明示してください。
基盤は同じ7430億パラメータで、再事前学習はありません。伸びは後学習で強化学習環境を大幅に広げた結果です。より大きな基盤を作り直す必要はありません。
いいえ。公式ライセンスに地域制限はありません。制限は売上規模に基づき、所在地とは無関係です。