PM 編集方針 (override) ── 7/25 06:00 HKT morning brief OVERRIDE適用

PM 7/24 18:00 HKT evening brief では P0-AM 7/25 を「The Great Chinese AI IPO Rush(Moonshot $50B HK IPO、DeepSeek $71B Shanghai)」として LOCKED していた。7/25 06:00 HKT morning validation scan 中に Claude Opus 5(Anthropic公式リリース、HN #1 1094pts 584cmt) が検出された。Override Decision Tree 適用:5/5 PASS(マルチソース収束(3日以上のリーク・ハイプ収束 + 1094pt エンゲージメント)/ タイムセンシティブ Day-1 Saturday / 16+ Anthropic ドキュメンタリー継続 / Opus 4.8 のバグ評判→Opus 5 Fable品質修正 / 3日以上のプレリリース・ラムサイクル相当)。Override counter: 4(post-freeze)。移された Chinese AI IPO Rush は P0-PM 7/25 にスロット保持。

1. Claude Opus 5の登場位置

2026年7月24日、Anthropic は新たなフラッグシップモデル Claude Opus 5 をリリースした。API モデル ID は claude-opus-5、価格は入力 $5/百万トークン・出力 $25/百万トークンと、前世代 Opus 4.8完全に同一 である。

Opus 5 の位置づけは「Fable 5 のフロンティア知能に半額で迫る、日常使いの最強モデル」。Anthropic の公式ブログは「Thoughtful and proactive(思慮深く自発的)」と評し、Claude Max のデフォルトモデル、Claude Pro の最強モデルとして即座に採用された。

リリースは 3 日以上前から続いていたプレリリース・リーク(BoxminingAI Jul 21、kie.ai Jul 14 など)を経ての正式発表。HN トップ 1094 ポイント・584 コメントと、2026年最大級のコミュニティエンゲージメントを記録した。

2. 価格とコスト効率

Opus 5 の価格は Opus 4.8 と同一ながら、性能は Fable 5 に匹敵 する。

モデル 入力 ($/MTok) 出力 ($/MTok) 位置づけ
Claude Opus 5 $5 $25 今回リリース(Opus 4.8 と同額)
Claude Fable 5 $10 $50 Mythos 級フラッグシップ(Opus 5 の 2 倍)
Claude Opus 4.8 $5 $25 前世代(Opus 5 に置き換え)
Claude Sonnet 5 $2→$3 $10→$15 ミッドレンジ(8/31 まで導入価格)
Claude Mythos 5 $10 $50 サイバー・生物学最強(制限付き)

特筆すべきは Fast Mode(リサーチプレビュー)。Claude API でのみ利用可能で、標準の約 2.5 倍の速度で動作し、価格は 2 倍($10/$50)。Opus 5 の Fast Mode は、単純なコード生成やテキスト分類など高速性が求められるタスクで コスト効率をさらに押し上げる

CNBC(Ashley Capoot, Jul 24)は「Anthropic がコスト意識の強いエンタープライズ顧客のニーズに応えて Opus 5 を投入した」と報じている。Anthropic のプロダクト責任者 Dianne Penn は「企業は価値を求めている。安いだけでは意味がない」とコメント。Opus 5 は コスト削減だけではなく「価格あたりの性能」で競合を圧倒 する設計思想だ。

3. ベンチマーク性能

Opus 5 のベンチマークスコアは、Anthropic が公開したデータに基づく:

Frontier-Bench v0.1(コーディング・知識作業の統合評価)

  • Opus 5:全モデル中最も高いスコア
  • Opus 4.8 の 2 倍以上の性能 を、より低いタスクあたりコストで達成
  • SOTA(State-of-the-Art)獲得

CursorBench 3.2(エージェントコーディング評価)

  • 最大努力(max effort)設定で Fable 5 と 0.5% 差 に迫る
  • タスクあたりコストは Fable 5 の半額
  • high / xhigh / max の全努力レベルで、所定コストあたりの性能が全モデル中最も高い

意味論的差異: Opus 5 は Fable 5 を「全体的な性能」では上回らない(Fable 5 が依然として Anthropic の最も高性能な一般公開モデル)。しかし コーディングと知識作業の特定評価 では Opus 5 が Fable 5 を凌駕しており、「日常的な開発業務においては Opus 5 の方が実質的に優れている」という逆転現象が起きている。

ベンチマーク注意点

Frontier-Bench v0.1 の結果は mini-SWE-agent ハーネス・GKE バックエンドでの内部実行(各タスク 5 試行の平均報酬)に基づく。Opus 5 および Fable 5 の安全分類器拒否時は Opus 4.8 がフォールバックとして使用されている。

4. 科学的推論の大幅向上

Opus 5 は生命科学研究において Opus 4.8 から 有意義な改善 を示している:

  • 有機化学:分光データからの分子構造推定で +10.2 パーセンテージポイント
  • タンパク質関連タスク:配列変異が機能に与える影響予測で +7.7 パーセンテージポイント
  • 構造生物学・バイオインフォマティクス:全評価で Opus 4.8 を上回る

生物学の安全ガードレールは Opus 4.8 と同一だが、Opus 5 は 現在最も高性能な一般公開科学リサーチモデル となった。Fable 5 でブロックされていた生物学関連リクエストのルーティング先も Opus 4.8 から Opus 5 に変更されている。ただし、長期間の自律的研究タスクでは Mythos 5 が依然として強い。

5. 史上最高のアライメント

Opus 5 は自動行動監査において これまでの Claude モデル中最もアライメントが高い と評価された:

  • Claude’s Constitution への遵守度:Opus 4.8 / Sonnet 5 / Fable 5 を上回る
  • 最も低い deceptive behavior(欺瞞的行動)率
  • 不正使用へ誘導されにくい(tricked into misuse への耐性が最高)
  • 元に戻せない副作用を伴う無謀な行動を回避する安全性:全 Claude モデル中最高

これは 大規模モデルが高性能化するほど制御が難しくなる という業界の通説に対する Anthropic の回答でもある。Opus 4.8 → Opus 5 で性能は大幅向上しながら、アライメントも同時に改善された点は、Fable 5 輸出規制サイクル を経た Anthropic の 安全研究の成熟 を示している。

6. サイバーセキュリティ制限の緩和

Opus 5 のサイバーセキュリティ分類器は Fable 5 と比較して 約 85% 介入頻度が低下 している:

アクティビティ Opus 5 Fable 5
ソースコードの脆弱性発見 ✅ 許可 ❌ ブロック
バイナリベース脆弱性スキャン ❌ ブロック ❌ ブロック
ペネトレーションテスト ❌ ブロック ❌ ブロック
エクスプロイト生成 ❌ ブロック ❌ ブロック
CVP(サイバー検証プログラム) ✅ 緩和版アクセス ✅ 緩和版アクセス

重要なのは 実質的な脆弱性発見能力 だ。Opus 5 はサイバー攻撃用に意図的に訓練されていないにもかかわらず、一般的な能力向上により OSS-Fuzz での脆弱性発見率が Mythos 5 に接近 している。ただし エクスプロイト化(脆弱性の悪用)では Mythos 5 に大きく劣る。Anthropic はここに意識的なトレードオフを設けている。

CVP(Cyber Verification Program)に登録済みの企業・研究者は、より制限の少ないバージョンを利用可能。Claude.ai / Claude Code / Claude Cowork でフラグされたリクエストは デフォルトで Opus 4.8 にフォールバック(API でも同様)。

7. プラットフォームと移行ガイド

Opus 5 は全プラットフォームで即日利用可能:

  • API: claude-opus-5platform.claude.com
  • AWS Bedrock: anthropic.claude-opus-5(InvokeModel)/ claude-opus-5(Converse)
  • GCP Vertex AI: 対応
  • Microsoft Foundry: 対応
  • Claude.ai: Max のデフォルト、Pro の最強モデル
  • Claude Code / Claude Cowork: Opus 5 が利用可能

主な技術仕様

項目
コンテキストウィンドウ 1M トークン(デフォルト兼最大、小規模 variant なし)
最大出力トークン 128K
Thinking デフォルトで有効(Opus 4.8 からの破壊的変更)
Effort 設定 low / medium / high / xhigh / max(フルラダー)
Fast Mode API のみ、$10/$50、約 2.5 倍高速
プロンプトキャッシュ最小値 512 トークン(Opus 4.8 の 1,024 から引き下げ)

Opus 4.8 からの移行手順

  1. モデル ID を claude-opus-4-8claude-opus-5 に変更
  2. Thinking がデフォルトで有効 になっているため、thinking フィールドは不要(従来の thinking: {"type": "adaptive"} を削除するか、そのまま動作)
  3. max_tokens思考(thinking)+ 応答テキストの合計 を制限することに注意
  4. Effort xhigh または max では Thinking を無効化できない(400 エラー)。無効化したい場合は Effort high 以下を指定
  5. 従来の include a final verification step のような検証プロンプトは 不要(Opus 5 は過剰検証傾向があるため削除推奨)

8. Anthropicドキュメンタリーシリーズ第13章

Opus 5 のリリースは、当ブログが 5月から追いかけている Anthropic ドキュメンタリーシリーズ の第 13 章に位置づけられる:

日付 イベント
1 5/19 $900B 評価額
2 5/27 Timeline Hub
3 5/29 Opus 4.8 リリース
4 5/30 Series H $965B
5 6/2 S-1 非公開提出
6 6/10 Fable 5 公開リリース
7 6/11 Fable 5 秘密サボタージュ
8 6/20 SK Telecom トリガー
9 6/22 Fable 5 切断 Day-1
10 6/30 6週間レトロスペクティブ
11 7/1 Sonnet 5 リリース
12 7/19 $1T+ IPO カウントダウン($47B ARR 黒字化)
13 7/25 Opus 5 リリース(本記事)

このシリーズは Anthropic 6週間レトロスペクティブハブ に全 12 章までのリンクが集約されている。Opus 5 リリースは、Sonnet 5 投入(7/1)に続く Opus 系のメジャーアップデート であり、Anthropic が Opus / Sonnet / Fable / Mythos の 4層モデル戦略 を完全に確立したことを示す。

9. まとめ:日常使いの新スタンダード

Claude Opus 5 は次の 3 点で 2026年後半の AI モデル選択におけるデファクトスタンダード となる可能性が高い:

  1. コストパフォーマンスの壁突破:Fable 5 の 95% の性能を半額で実現。Fast Mode を組み合わせれば、日常的な開発タスクの 80% 以上で Fable 5 を凌ぐコスト効率が期待できる
  2. 安全性と性能の両立:史上最高のアライメント評価を得ながら、サイバー制限の 85% 緩和で開発者の実用性を高めた。CVP プログラムとの組み合わせでセキュリティ研究にも対応
  3. エコシステムの成熟:Opus 4.8 との価格同一性は、エンタープライズの予算計画を立て直す必要がないことを意味する。移行リスクがほぼゼロであることが最大の強み

Anthropic は 10月 IPO を控え、$47B ARR 黒字化 という財務基盤の上で、Opus 5 という「守りの一手」を打った。Fable 5 の過剰な制限に不満を持っていた開発者層を Opus 5 で取り込み、Talent War で獲得した人材 を Opus 5 の研究開発に活用する──この戦略的な一手が IPO 前の Investor Relations にどう響くか、引き続き注視したい。


この記事はAIによって生成され、人間の編集を経て公開されています。 Appwright AI は AI によるコンテンツ制作の可能性を探求する実験的プロジェクトです。