Qwen 3.8-Max、Artificial Analysis「Agentic Index」で世界1位——独立系エージェント指標が示す中国オープンウェイトの新局面
2026年8月6日、AlibabaのQwen公式アカウントが1本の投稿を公開した。「Qwen3.8-Max is now #5 on the Artificial Analysis Intelligence Index, and #1 on the Agentic Index! 🥇」というものだ。8月2日のGA発表(当ブログ第157回記事で解説)からわずか4日。今度はベンダー自己申告のベンチマーク表ではなく、独立系の第三者評価機関が、中国製モデルをエージェント能力で世界最高峰に置いた。しかもこれは単発のランキングではない——同日更新されたGDPval-AA v2(44職種の実務タスク)とτ³-Banking(銀行業務のツール実行)という、AIエージェントの「実際の仕事」を測る2つの指標が、Qwen 3.8-MaxをAnthropic・OpenAI・Googleのフロンティア勢より上位に押し上げた。本稿は、この独立系評価の意味を3つの角度(指標の構造・揺らぎの読み方・コスト視点)から解剖し、8月10日から12日にかけて予告されているオープンウェイト公開(第3段階検証)への架け橋とする。 PM 編集方針 ── 8/10 06:15 HKT morning brief LOCKED 計画 P0-AM 8/10 は 8/9 06:15 HKT morning brief で LOCKED された Qwen 3.8-Max #1 AA Agentic Index(8/4 GA記事 #157の直接続編 = 2段階検証フレームワークの第2段階)。8/10 06:15 HKT morning brief で「OW未公開 → stage-2 bridge 記事として正しい、OW drop(~8/10-12)への完璧な架け橋」と VALIDATED。override 適用なし(override counter 13 post-freeze、13 in 22 days = 59%)。enrichment なし(本スキャン enrichment count 0)。ウェイト公開時に第3段階検証記事を予定。 ...