
2026年7月24日、AnthropicがClaude Opus 5をリリースしました 🎉
一番の衝撃は? Fable 5に迫る性能を、半額で提供していること。これがAI業界の価格競争をさらに加速させています。
📊 性能ハイライト
- 🎨 Frontier-Bench v0.1 — 全モデル中トップ。前世代のOpus 4.8の2倍以上のスコア
- 💻 CursorBench 3.2 — Fable 5と0.5%差(max effort時)。でもコストは半分
- 🧩 ARC-AGI 3 — 次点モデルの3倍のスコア。未知問題の解決能力が桁違い
- ⚡ Zapier AutomationBench — 次点の1.5倍の合格率。ビジスタスク自動化で圧倒的
- 🖥️ OSWorld 2.0 — コンピューター操作タスクでもトップクラス
特にARC-AGI 3の「3倍」は凄まじいです。これは「初見の問題を解く能力」を測るベンチマークで、単なる暗記ではなく汎用的推論力の指標になります。
💰 料金体系
| モデル | 入力/1Mトークン | 出力/1Mトークン |
|---|---|---|
| Claude Opus 5 | $5 | $25 |
| Claude Fable 5 | $10 | $50 |
| GPT-5.6 | $7 | $28 |
Opus 5は前世代(Opus 4.8)と同価格のまま大幅性能アップ。さらに:
- 🔧 Fast mode(リサーチプレビュー) — 2倍の料金で高速処理
- 🔄 自動フォールバック — 安全機能発動時に下位モデルへ自動切替(オプトイン)
🏛️ 政府のサイバーセキュリティ審査
ここが重要な文脈です。Anthropicの前モデル「Fable 5」は米政府から輸出管理対象とされ、一時的に公開停止に追い込まれました。その後、より強力なセキュリティ対策を条件に復活。
Opus 5にはこの教訓が活かされています:
- 🔐 Opus 4.8より強力なサイバーセキュリティ保護
- 🛡️ 「最も整列された(aligned)Opusモデル」 — 悪用への耐性が歴代最高
- 📋 政府の独立テストを実施済み(Anthropic公式発表)
つまり、「強いけど安全」というバランスを明確に打ち出しています。これからの時代、AIモデルのリリースには政府の検査が付き物になるようです。
🤖 実際に何がすごいのか?
Anthropicが紹介していた中で特に印象的だったエピソード:
例1:機械部品の3D復元
図面を与えられたOpus 5。でも図面を「見る」手段がありません。すると、自分でコンピュータビジョンパイプラインを書いて、生ピクセルから形状を抽出し、FreeCADで3Dモデルを構築。他のモデルは5回試しても全滅したタスクです。
例2:バグの根本原因特定
人気OSSのバグ修正を依頼。コミュニティのパッチが見逃していたエッジケースまで発見し、根本原因を修正。競合モデルは表面症状だけ直して「解決」と報告。
例3:取引所のマーケットデータフィード構築
あるトレード会社のエンジニアが、新取引所のデータフィードを単一セッションで構築。しかも検証用のテストハーネスまで自作して、コードの正しさを独自に確認。以前のモデルではプランを与えても完成しませんでした。
共通しているのは「自分で考えて、検証して、完成させる」こと。指示待ちではなく、自律的に問題解決する力が明確に向上しています。
🏆 リーダーボード状況
Artificial AnalysisのIntelligence Indexでは、Opus 5(max effort)が全モデル中1位を獲得。以下、GPT-5.6 Sol、Fable 5(フォールバック付き)が続く構図です。
Hacker Newsでも1,500+ポイントで大バズり。928コメントの時点で議論が活発に続いています。
💭 考察:これが意味するもの
1. 価格×性能の新しい方程式
「Fable 5級の性能を半額で」は、競合にとって厳しい数字です。OpenAIのGPT-5.6より安く、性能は上。日常使いのデフォルトモデルとしてClaude Maxで採用される戦略です。
2. エージェント自律性の新ステージ
「ツールが使える」から「自分でツールを作って問題を解決する」へ。Opus 5のエピソードは、AIエージェントが設計レベルで思考するようになったことを示しています。
3. 政府審査が常態化
Fable 5停止事件以降、強力なAIモデルのリリースには政府の検査がつきものになりました。「性能」と「安全性」の両立が、モデルリリースの前提条件になっています。
🎯 まとめ
- Opus 5はFable 5に迫る性能を半額で提供するゲームチェンジャー
- コーディング・推論・自動化タスクで多数のSOTAを達成
- 政府のサイバーセキュリティ審査を経た「安全な強さ」をアピール
- 自律的問題解決能力が次元違い(CVパイプライン自作とか)
- AI業界の価格競争はさらに激化しそう
Anthropic vs OpenAI vs 中国勢(Kimi K3など)の三つ巴はまだまだ続きそうです。お財布に優しく頭脳明晰なAI、それは確かに未来を加速させます 🚀