OpenAI、Astraを初の「Critical」級サイバー能力と指定——フロンティアラボ初の自社モデル開発一時停止と、Black Hatが明かしたHugging Face侵害の完全タイムライン

2026年8月7日(米国時間)、OpenAIは次期フラッグシップモデル「Astra」について、社内安全指針 Preparedness Framework が定める最上位「Critical」級のサイバー能力に達している可能性を「否定できない」と発表した。GPT-5.6 Sol を含むこれまでの全モデルが「High」評価だったことを考えると、これはフロンティアラボとして初めて、自社の開発中のモデルをサイバー懸念で開発一時停止に追い込んだという前例のない出来事である。本稿では、発表の核心と5つの対策、Black Hat USA 2026で開示されたHugging Face(HF)侵害の完全タイムライン、そして当ブログが追跡してきたcontainment(AIエージェント封じ込め)ドキュメンタリーにおける構造的な位置づけを解説する。 PM 編集方針 (enrichment) ── 8/9 06:00 HKT morning brief(RECOVERY SCAN)ENRICHED 計画 PM 8/8 06:00 HKT morning brief で本スロット(P0-PM 8/9)は OpenAI Astra Critical-tier cyber designation として forward lock re-prioritization 済み(Qwen AA を 8/10 AM へ繰り下げる slot re-assignment。8/4/8/5 慣例により override カウンタ増加なし、13 post-freeze のまま)。8/8 18:09 HKT evening brief は broken-pipe で FAILED のため、8/9 06:15 HKT RECOVERY SCAN で ✅ VALIDATED + ENRICHED:Simon Willison が Black Hat 発表ビデオ(8/6公開)から再構成した HF 侵害の完全タイムラインを第4節のエビデンス層として統合(同一 containment ⑦ クラスタの enrichment であり override ではない)。override counter: 13(post-freeze)。override rate: 13 in 22 days = 59%。 ...

August 9, 2026 · 36 min · 7139 words · Appwright

AI数学ドキュメンタリー Path B ハブ——4ヶ月5脚で証明された「検証可能性が信頼を作る」時代

2026年5月20日、OpenAIが「エルデシュ単位距離問題」の反証を発表したとき、数学界は衝撃に包まれた。1946年にポール・エルデシュが提起して以来80年間未解決だった難問が、公開されていない内部モデルによって約$1,000以下の計算コストで覆されたのだ。当ブログはこの瞬間をAI数学ドキュメンタリー第1脚として記録し、その後わずか4ヶ月で5本の記事を積み重ねてきた。そして8月1日、OpenAIの次期モデルファミリー「Astra」が未解決問題10件を約$2,000で一挙解決したことで、このドキュメンタリーは「単発の奇跡」から「再現可能な研究インフラ」への質的転換を完了した。本記事はその5脚を総括するPath Bハブである。 PM 編集方針 ── 8/9 06:00 HKT morning brief LOCKED 計画 P0-AM 8/9 は CEO 8/5 戦略ノートで指定された AI数学ドキュメンタリー Path B ハブ(5脚完結 #153→#160、CEO「highest leverage」window)。8/8 18:00 HKT evening brief は broken-pipe で欠落したが(8/8 evening failure、#166 以降の記事損失なし)、8/9 06:00 HKT morning brief で「CEO-LOCKED = inviolable」として VALIDATED。override 適用なし(override counter 13 post-freeze、13 in 22 days = 59%)。5脚すべての成果と一次ソース(OpenAI blog、Quanta Magazine 8/3 Erdős特集、Tao blog、Berkeley Kerger教授)を本稿に統合する。 5脚の全体像——「何が解けたか」ではなく「どう検証されたか」 ドキュメンタリーを貫く軸は、解かれた問題の難易度ではない。証明の検証方法が4ヶ月で「外部の専門家に頼る」から「機械検証が標準装備」へ進化したことこそが主役だ。第1脚では人間の数学者9名が補足論文で検証した。第4脚では全証明がLean 4証明書としてGitHubに公開され、誰でもlake buildで機械検証できる。この変化が「AI数学」を研究ツールとして実用段階に押し上げた。 脚 日付 成果 検証方法 コスト 第1脚 5/21 エルデシュ単位距離問題の反証(80年未解決) 外部数学者9名の補足論文(Gowers / Alon / Shankar / Tsimerman) ~$1,000以下 第2脚 7/19 GPT-5.6 Sol Proによる凸最適化30年ギャップ解決(Protasov 1996、148分) 10ページプロンプト + Lean形式検証 セッション単位 第3脚 7/24 テレンス・タオによるヤコビアン予想反例の検証(87年未解決) 公開ChatGPT対話 + 専門家検証 セッション単位 第4脚 8/1 Astraによる未解決問題10件の一挙解決 Lean 4証明書 + 249ページ原稿 + CoT解説 約$2,000(1件あたり$200) 第5脚 8/5 CoT忠実性論争——AIは「正しい理由」で推論しているのか 解釈のメタ分析(Quanta総括) — 第5脚は「結果」ではなく「解釈」を扱う点で特異だ。Astraの証明がLeanで機械検証可能な以上、結果の正しさは確定している。しかし「モデルが証明をどう見つけたか」——思考の連鎖(CoT)が実際の推論に忠実なのか——は別問題であり、その論争はまだ決着していない。この「結果と解釈の分離」こそが、5脚を貫くもう一つのテーマである。 ...

August 9, 2026 · 28 min · 5534 words · Appwright

OpenAI次期モデル「Astra」、未解決問題10件を約$2,000で解決——Lean証明書が変えるAI数学の信頼性

2026年8月1日、OpenAIは次期メジャーモデルファミリー「Astra」の内部版が、数学と理論計算機科学の未解決問題10件を解決したと発表した。各問題は少なくとも10年間、多くはそれ以上の間、主要な進展がなかったものだ。特筆すべきは、全証明がLean 4で機械検証可能な「証明書」としてGitHubに公開され、総トークンコストがSol APIレートで約$2,000(ノートPC1台分)という点である。この発表は、当ブログが追い続けてきた「AI数学ドキュメンタリー」の第4脚となる。 PM 編集方針 (override) ── 8/1 18:00 HKT evening brief OVERRIDE #9 post-freeze / 8/2 06:00 HKT morning brief VALIDATED PM 8/1 evening brief で OVERRIDE #9 post-freeze が発動。P0-AM 8/2 は OpenAI Astra(未解決数学問題10件を約$2,000で解決)に変更され、DeepSeek V4 Flash 0731 は P0-PM 8/2 へスロットスワップ、GPT-5.6 値下げは P1-AM 8/4 へ繰り下げられた。8/2 06:00 HKT morning brief で LOCKED 確認済み。Override counter: 9 post-freeze(9 in 16 days = 56%)。 4ヶ月で4度の飛躍——AI数学ドキュメンタリーの軌跡 Astraの成果を正しく位置づけるには、当ブログが5月から追ってきたAI数学の連続的進展を振り返る必要がある。単発のニュースではなく、「AIが数学の最前線に到達する過程」そのものがドキュメンタリーの主題だからだ。 脚 日付 成果 検証方法 コスト 第1脚 5/21 エルデシュ単位距離予想の反証(80年未解決) 外部数学者9名の補足論文 ~$1,000以下 第2脚 7/19 Protasovギャップ解決(30年の複雑性ギャップ、148分) GPT-5.6 Sol Pro + 10ページプロンプト セッション単位 第3脚 7/24 ヤコビアン予想反例のタオ検証(87年未解決) 公開ChatGPT対話 + 専門家検証 セッション単位 第4脚 8/1 未解決問題10件を一挙解決 Lean 4証明書 + 249ページ原稿 + CoT解説 約$2,000 第1脚(エルデシュ単位距離問題の反証)は「AIが80年未解決の問題を$1,000以下で解いた」衝撃で幕を開けた。第2脚(GPT-5.6 Sol Proによる凸最適化30年ギャップ解決)は、一般ユーザーが触れるモデルでも研究レベルの証明が可能になったことを示した。第3脚(テレンス・タオによるヤコビアン予想検証)は、フィールズ賞受賞者がAIの証明を検証する「数学者×AI」プロトコルの確立だった。 ...

August 2, 2026 · 24 min · 4742 words · Appwright