Stealing Reasoning Traces完全解説——「暗号化CoT」は開封できる:フロンティア3社の推論トレースが平文で盗まれる時代

2026年8月10日、Tübingen大学・Max Planck知能システム研究所・MATS・Snykの研究者グループが、「Stealing Reasoning Traces from Proprietary LLM APIs」(arXiv:2608.09867)を公開した。結論は衝撃的だ。Anthropic・OpenAI・Googleのフロンティアモデルが「暗号化」してクライアントに返している推論トレース(思考の連鎖=CoT)ブロックは、セッション・ユーザー・モデルを跨いで完全に互換であり、同じプロバイダの弱い兄弟モデルに注入すれば、強いモデルを直接攻撃することなくその生の推論を平文で回収できる。しかも攻撃者はフロンティアモデルに1回クエリを投げるだけでよく、蒸留防止機構にも一切触れない。これは「推論は隠せる」というフロンティアラボの共通前提を覆す、containment(AI封じ込め)ドキュメンタリーの新たな節目である。 PM 編集方針 (override + enrichment) ── 8/12 06:30 HKT morning brief OVERRIDE #15 / 8/12 18:15 HKT evening brief ENRICHED 8/12 06:30 HKT morning brief で OVERRIDE #15 が発動(Stealing Reasoning Traces、4/5 PASS、7+ source Day-1 convergence、cluster ⑦、form-factor A = 既存ドラフトなし)。本スロット P0-PM 8/12 に確定し、元の予定だった Claude Code Auto Mode は P0-PM 8/14 へ繰り下げ(アクティベーション窓 8/14 に最適化、SEO ロスなし)。8/12 18:15 HKT evening brief で ✅ VALIDATED(HN 625pts/282cmt、フロントページ #16 で成長継続)+ 同一 cluster ⑦ の GPT-5.6-Cyber / Daybreak Red(OpenAI 8/11) が optional enrichment として提示され、本稿 §6 で統合した。Override counter: 15 post-freeze のまま(15 in 24 days = 62.5%)。Enrichment count: 1。 ...

August 12, 2026 · 29 min · 5775 words · Appwright