【速報・2026/05/08】中国オープンソースAI"4本同時着弾"の衝撃 — DeepSeek V4・Kimi K2.6・GLM-5.1・MiniMax M2.7が西側最前線に並んだ12日間【NotebookLM 50ソース速報】

速報ハイライト(24時間以内)

・コーディング系オープンウェイト中国モデル4本 — DeepSeek V4 Pro / Kimi K2.6 / GLM-5.1 / MiniMax M2.7 — がわずか12日の窓に集中投入され、SWE-Pro 56〜58%、Terminal-Bench 2 ~57% という"西側フロンティア相当"の領域に同時着弾。
・DeepSeek V4 Pro は1/6のコストで Claude Opus 4.7 と GPT-5.5 のすぐ近くまで詰める。さらに DeepSeek V4 Flash は GPT-5.5 比 35倍安いという破壊的価格帯。
・GLM-5.1(Z.ai)は短期間ながらSWE-bench Pro首位を獲得した瞬間があり、「オープンウェイトが初めて閉源最前線を抜いた」イベントとして記録された。
・速報×まとめ×NotebookLM 50ソース集約という観点から、本記事は「開発者が今日から判断材料にできる地図」を提示する。

何が起きたのか:12日間の同時着弾

直近12日間、中国系オープンウェイト系コーディングモデルが立て続けにリリースされた。並べると不気味なほど揃う。

・DeepSeek V4 Pro / V4 Flash — 入力 $1.74/M・出力 $3.48/M、Flashは $0.14/M・$0.28/M
・Kimi K2.6(Moonshot)— 1兆パラメータMoE、SWE-Pro 58.6%
・GLM-5.1(Z.ai)— SWE-Pro 58.4%、一時的にSWE-bench Pro首位
・MiniMax M2.7 — 230B sparse MoE、SWE-Pro 56.22%、Terminal-Bench 2 で 57.0%、価格 $0.30/$1.20
・補強として Qwen 3.6 Plus / GLM-5 / DeepSeek V4 Pro Max のリリースサイクルも重なる

注目点は「フロンティア性能」と「破格コスト」を同時に持ち込んだことだ。Claude Opus 4.7 は SWE-Pro 64.3% で依然トップだが、その下層 56〜58% 帯に4本のオープンウェイトが押し寄せている。この帯はちょうど「実務エージェントが回る最低ライン」と評されてきた。

なぜ「速報」として扱うべきか

毎日のAIニュースで個別モデルのリリースは飛び込んでくる。だが4本が12日に集中したのは構造的な事件だ。理由は3つ。

  1. インフラ仮説の崩壊 — 「最前線は10万H100級でないと届かない」という業界の暗黙前提が、4社が同等性能を別々のレシピで再現してしまったことで揺らいだ。

  2. 2. オープンウェイトが「性能引き上げの主役」に — 4月までは「オープンは閉源を後追い」だったが、GLM-5.1 が SWE-bench Pro でクラウンを掴んだ24時間で潮目が変わった。

  3. 3. 価格弾性ショック — DeepSeek V4 Flash の $0.14/$0.28 はトークン単価で GPT-5.5 の 1/35。インフラ単価の桁が変わると、エージェント設計の経済合理性そのものが書き換わる。

ベンチマーク比較(実装者向け要点)

・SWE-bench Pro / Verified:Claude Opus 4.7 が SWE-Pro 64.3% で再度クラウン、しかし56〜58%帯に中国4本が同時着地。Verified では Opus 4.7 が 87.6% で、DeepSeek V4 Pro 80.6% との差は実利用で「気にならないレベル」に縮まった。
・Terminal-Bench 2:GPT-5.5 が 82.7% で別格、Claude Opus 4.7 が 69.4%、DeepSeek V4 Pro が 67.9%、MiniMax M2.7 が 57.0%。
・WebDev Arena Elo(2026/04/26時点):Opus 4.7 が 1565、Opus 4.6 が 1548、GLM-5.1 が 1534、Kimi K2.6 が 1529 と、上位7位までで中国2本が食い込んだ。
・GDPval-AA(実務系エージェントベンチマーク):DeepSeek V4 Pro 1554 が中国オープンウェイトの先頭、GLM-5.1 1535、MiniMax M2.7 1514、Kimi K2.6 1484。
・VIBE-Pro(end-to-end プロジェクト完成):MiniMax M2.7 が 55.6% で Opus 4.7 の最良級ラインに肉薄。

選び方の最小ルール:閉源最前線が必須なら Opus 4.7。コスト1/6で実務エージェントが回るならDeepSeek V4 Pro。完全自社ホスト×ライセンス自由でいくなら GLM-5.1 / MiniMax M2.7 を試す、という3層に分解できる。

NotebookLM 50ソース活用:今日の運用ノート

本記事のために NotebookLM で5本の Fast Research を回し、合計50ソースの知識ベースを構築した。Audio Overview(Deep Dive 日本語、約20分)と Mind Map も生成済み。NotebookLM 本体の共有はオーナー限定運用としているため、ご希望の方は X からDMでアクセス権を個別共有する形をとっている。

NotebookLM のような知識集約ツールが今回特に効くのは、「同じ12日間に4本が同時着弾した」事象は単一記事では捉えきれず、複数のベンダー資料・ベンチマーク論文・価格表・市場分析を横断比較しなければ「だから何が起きるのか」が見えないからだ。50ソースをひとつのチャットコンテキストに格納すると、「DeepSeek V4 Flash の単価で月1億トークン回した場合、Opus 4.7 比較で月いくら浮くか」のようなビジネス計算が即座に走る。

Mind Map(4軸 × 11ノード以上)

本記事用に matplotlib で Mind Map を描き起こした(NotebookLM のスクリーンショット保存が時々届かない既知問題のフォールバック)。4軸は MODEL LINEUP / BENCHMARKS / PRICING SHIFT / STRATEGIC IMPACT。

・MODEL LINEUP:DeepSeek V4 Pro/Flash, Kimi K2.6, GLM-5.1, MiniMax M2.7, Qwen 3.6 Plus
・BENCHMARKS:SWE-Pro 56-58%, Terminal-Bench 2 ~57%, VIBE-Pro 55.6%, Arena WebDev Elo 1520+, GDPval-AA 1535-1554
・PRICING SHIFT:DeepSeek V4: $1.74/$3.48, DeepSeek Flash: $0.14/$0.28, MiniMax M2.7: $0.30/$1.20, GPT-5.5: $5/$30, Opus 4.7: $5/$25
・STRATEGIC IMPACT:1/6 cost vs Western, Open-weight = self-host, Agent stack rewrite, Inference cost arbitrage, Frontier convergence

実務者TODO 3ステップ(無料版・PRO版で5ステップに拡張)

  1. APIキーを発行して触る — DeepSeek V4 Flash と MiniMax M2.7 の無料枠で、自社の代表的エージェントタスクを1本走らせる。「気になる差」がコスト1/6で許容範囲か即判定できる。

  2. 2. A/B 評価ハーネスを準備 — 既存の Opus 4.7/GPT-5.5 ハーネスに中国系2本を差し込めるよう、ルーティング層を1日で整える。

  3. 3. コスト試算を経営に出す — 月100M〜1B トークン規模で、Opus/GPT 比 1/6〜1/35 のコスト差が単年でいくら浮くか、月次で算出してダッシュボード化。

読み解きのまとめ

・今回の「12日間4本着弾」は単発のリリースではなく、フロンティア性能の地図が一夜で再描画された事件。
・「西側最前線は依然 Opus 4.7 / GPT-5.5」「中国オープンウェイトは56〜58%帯で同時着地」「コストは1/6〜1/35で別世界」の3層構造は、当面の AI 開発戦略の前提になる。
・完全自社ホストのオプションが現実的に「使える性能」で初めて手に入った日。LLMアーキテクチャ選定の意思決定者は、今週中に試算を社内に出した方がいい。




🐦 最新情報はXでも毎日発信中

▶ https://x.com/MindOrbitAI

AI・業務効率化・最新トレンドのヒントを毎日お届けしています。
フォローいただけると励みになります。




#AI #NotebookLM #MindOrbitAI #DeepSeek #DeepSeekV4 #KimiK26 #GLM51 #MiniMaxM27 #Moonshot #Zai #Qwen #LLM #生成AI #ChatGPT #Claude #ClaudeOpus47 #GPT55 #オープンソース #OpenWeights #コーディング #SWEbench #エージェント #AIニュース

いいなと思ったら応援しよう!