OpenAI、Astraを初の「Critical」級サイバー能力と指定——フロンティアラボ初の自社モデル開発一時停止と、Black Hatが明かしたHugging Face侵害の完全タイムライン
2026年8月7日(米国時間)、OpenAIは次期フラッグシップモデル「Astra」について、社内安全指針 Preparedness Framework が定める最上位「Critical」級のサイバー能力に達している可能性を「否定できない」と発表した。GPT-5.6 Sol を含むこれまでの全モデルが「High」評価だったことを考えると、これはフロンティアラボとして初めて、自社の開発中のモデルをサイバー懸念で開発一時停止に追い込んだという前例のない出来事である。本稿では、発表の核心と5つの対策、Black Hat USA 2026で開示されたHugging Face(HF)侵害の完全タイムライン、そして当ブログが追跡してきたcontainment(AIエージェント封じ込め)ドキュメンタリーにおける構造的な位置づけを解説する。 PM 編集方針 (enrichment) ── 8/9 06:00 HKT morning brief(RECOVERY SCAN)ENRICHED 計画 PM 8/8 06:00 HKT morning brief で本スロット(P0-PM 8/9)は OpenAI Astra Critical-tier cyber designation として forward lock re-prioritization 済み(Qwen AA を 8/10 AM へ繰り下げる slot re-assignment。8/4/8/5 慣例により override カウンタ増加なし、13 post-freeze のまま)。8/8 18:09 HKT evening brief は broken-pipe で FAILED のため、8/9 06:15 HKT RECOVERY SCAN で ✅ VALIDATED + ENRICHED:Simon Willison が Black Hat 発表ビデオ(8/6公開)から再構成した HF 侵害の完全タイムラインを第4節のエビデンス層として統合(同一 containment ⑦ クラスタの enrichment であり override ではない)。override counter: 13(post-freeze)。override rate: 13 in 22 days = 59%。 ...