Claude Fable 5 / Mythos 5が登場 — フロンティアを「二つに分けた」最強モデルを徹底解説

はじめに

つい数日前、Anthropic は「AIが自らの後継を作り始めたら人間は止められない」と再帰的自己改善(RSI)の危険性を警告し、業界に開発の一時停止を提案したばかりだった。ところが2026年6月9日、同社はこれまでで最も強力なモデル「Claude Fable 5」と、安全装置の一部を解除した「Claude Mythos 5」を発表した。両者の正体は、実は中身が同じ「Mythosクラス」のモデルである。本記事では、SWE-Bench Pro 80.3%という飛躍した数字の中身、Fable と Mythos という不思議な命名の戦略的意味、そして「危険と警告した直後に最強を出す」という矛盾を、エンジニアの視点で整理する。

何が発表されたのか — FableとMythosの正体

今回登場したのは2つのモデルだが、両者は同一の基盤モデルを共有している。違いは「安全装置(safeguards)が掛かっているか否か」だけだ。

  • Claude Fable 5: Mythosクラスの能力を一般公開向けに調整したモデル。Web・アプリ・API・Amazon Bedrock・GitHub Copilot などから当日利用可能。サイバーセキュリティ、生物・化学、蒸留(distillation)防止の分類器を内蔵し、トリガーされると Claude Opus 4.8 にフォールバックする安全設計。
  • Claude Mythos 5: Fable と中身は同じだが、一部領域で安全装置を解除したモデル。利用は「Project Glasswing」(米政府も関与するサイバー防衛パートナー)の審査済みユーザーに限定され、今後は医療研究者にも信頼アクセスプログラムを通じて拡大予定。

これまで Anthropic は「Mythosクラス」の能力を限定的なパートナーにしか開放してこなかった。今回はその系譜を初めて広く一般に解放した点が大きい。価格は両モデルとも入力 $10 / 出力 $50(100万トークンあたり)。Mythos Previewの半額以下だが、主要モデルの中では依然として最高水準の単価である。

ベンチマークが示す「飛躍」の中身

Anthropic と各メディアが公開した数字は、単なる漸進的改善ではない水準を示している。

  • SWE-Bench Pro(実務的なソフトウェア工学): Fable 5 が 80.3%。対して Claude Opus 4.8 は 69.2%、GPT-5.5 は 58.6%、Gemini 3.1 Pro は 54.2%。約10ポイント以上の差をつけた。
  • ExploitBench(攻撃コード生成などサイバー能力): Mythos 5 が 78%。Mythos Preview の 69%、Opus 4.8 の 40% から大幅上昇。
  • 実例として Stripe は、5000万行規模の Ruby コードベース移行で「数か月分のエンジニアリングを数日に圧縮した」と報告。Hebbia の金融ベンチでは上級アナリスト級の推論で最高スコアを記録した。

注目すべきは Mythos 5 の ExploitBench スコアだ。Opus 4.8 の40%から78%へという伸びは、攻撃側にも防御側にも強力に効く「両刃」の能力であり、だからこそ一般公開せず Project Glasswing に閉じている。能力の高さと公開範囲の狭さがトレードオフになっている構図が、今回のリリースの核心である。

なぜ「フロンティアを二つに分けた」のか

ここが今回最も興味深い設計判断だ。従来は「1つのモデルに安全装置を掛けて全員に出す」のが常道だった。Anthropic は今回、同じ基盤モデルを能力ではなく”アクセス権”で二分割した。

  • 一般ユーザー → Fable 5(危険領域はOpus 4.8へフォールバック)
  • 審査済みパートナー → Mythos 5(同領域の制限を解除)

これは「最高性能を一般化したいが、サイバー・生物分野の悪用リスクは抑えたい」という相反する要求への現実解だ。同時にこの構図は批判も呼ぶ。TechCrunch は皮肉を込めて「AIは危険になりすぎていると警告した数日後に、最も強力なモデルを公開した」と報じた。前日に本ブログで取り上げた「RSI一時停止の提案」と並べると、Anthropic の「安全性を訴える企業」というブランディングと、商用フロンティア競争の最前線を走る現実との緊張が鮮明に浮かび上がる。

エンジニアへの影響

実務面で押さえるべきは3点だ。

第一に、コーディング支援の質が一段上がる。SWE-Bench Pro 80%超は、複数ファイルにまたがる大規模リファクタや長時間の自律タスクで体感差として表れる。GitHub Copilot で当日から選択可能なため、すぐ試せる。

第二に、コスト設計の見直し。$10/$50 は高単価帯であり、全リクエストを Fable 5 に流すのは非現実的だ。難易度の高いタスクのみ Fable 5、定常処理は Haiku/Sonnet 系へ振り分けるルーティング設計が要になる。

第三に、サプライチェーンとセキュリティの再認識。Mythos 5 のサイバー能力向上は、攻撃の高度化が現実に進むことを意味する。奇しくも同じ日に「Microsoft製OSSツールが乗っ取られAI開発者の認証情報を窃取」する事件も報じられた。強力なモデルを使う側こそ、依存ツールの検証を怠れない時代に入っている。

まとめ

  • Claude Fable 5 と Mythos 5 は中身が同じ「Mythosクラス」で、違いは安全装置の有無のみ。
  • SWE-Bench Pro 80.3%、ExploitBench 78% と、コーディング・科学・サイバー領域で飛躍。
  • 価格は入力$10/出力$50。能力をアクセス権で二分割したのが今回の最大の特徴。
  • 「危険と警告した直後の最強リリース」という矛盾は、安全性と商用競争の緊張を映す。

能力で世代を分けてきたモデル競争は、いよいよ「誰に、どこまで開放するか」という統治の問題へと移りつつある。Anthropic の二分割が業界標準になるのか、次の各社の動きに注目したい。


今日のその他のニュース

OpenCV 5 リリース — DNNエンジンを全面刷新

コンピュータビジョンの定番ライブラリ OpenCV のメジャー版5が登場。DNNモジュールがグラフベースで書き直され、ONNXオペレータ対応が約22%→80%超に拡大。ネイティブのトークナイザとKVキャッシュを備え、Qwen 2.5 や Gemma 3 を外部ランタイムなしで直接実行できる。C++17が最低要件となり、レガシーC APIは非推奨化。(opencv.org)

MicrosoftのOSSツールが乗っ取られ、AI開発者の認証情報を窃取

少なくとも70のMicrosoftリポジトリが改ざんされ、Claude Code・Gemini CLI・VS Code連携などのツールにパスワード窃取マルウェアが混入。AIコーディング環境で開くと認証情報が盗まれる仕組みだった。数週間で2件目の侵害とされ、依存ツールの検証の重要性を突きつける事例。(TechCrunch)

Supabaseが大型アップデート — Passkey認証・ChatGPT連携・$500M調達

WebAuthnベースのPasskeyサインインに加え、ChatGPTアプリ統合(29ツールでSQL実行やEdge Functionデプロイを会話操作)、Claude Code/Cursor/Codex対応のMCPプラグインを公開。さらにシリーズFで$500Mを調達した。(Supabase)

ソース