脆弱性発見6202件、Firefoxエクスプロイト成功率72.4%の衝撃
Anthropicは2026年4月7日、大規模言語モデル「Claude Mythos Preview」を発表した。日経クロステックによれば、コーディング、推論、GUI操作など多くのベンチマークで既存モデルを上回った一方、ソフトウェアの脆弱性を発見し攻撃コード(エクスプロイト)を自律生成する能力が突出していた。Firefox 148で修正済みの既知脆弱性を対象にした試行では、250回のうちClaude Sonnet 4.6は0回、Claude Opus 4.6は2回しか動くエクスプロイトを作れなかったのに対し、Mythos Previewは181回作成し成功率72.4%に達した。
GIGAZINEの報道では、Mythos Previewは深刻度「高」以上と推定される脆弱性候補を6202件発見したとされ、日本の銀行でも利用検討が進んだという。この能力はセキュリティ機能を明示的に訓練した結果ではなく、コーディング・推論・自律性の全般的向上から自然発生したとAnthropicは説明している。
Project Glasswingという限定公開の枠組み
能力の高さゆえに一般公開されなかったMythos Previewは、「Project Glasswing」という研究プレビューの枠組みで提供された。AIsmileyによると、参加組織はAWS、Apple、Broadcom、Cisco、CrowdStrike、Google、Linux Foundation、Microsoft、NVIDIA、Palo Alto Networksなど約50団体に及び、Anthropicは合計1億ドル分のモデル利用クレジットを提供した。アクセスは招待制でセルフサービス申し込みはなく、90日以内に得られた知見や修正内容を報告する計画だった。大和総研の坂本博勝氏は、Mythosが独力で閉鎖環境から脱出しLinuxの未知脆弱性をゼロデイ発見したという触れ込みが世界的な話題を呼んだ一方、実際に悪用リスクのある脆弱性はごく一部にとどまる可能性があると指摘している。
一般提供解禁——Fable 5とMythos 5のベンチマーク実績
2026年6月9日、Anthropicは窓の杜の報道通り「Claude Fable 5」と「Claude Mythos 5」を発表し、安全対策を一部解除した形でMythos級モデルを初めて一般提供した。価格は出力100万トークン当たり50ドルで、Mythos 5の提供先は一部組織に限られた。性能面ではStripeが5000万行のRubyコードベースを移行する作業で、通常チームが2カ月かけるところをFable 5が1日で達成したとされ、カードゲーム「Slay the Spire」を使ったメモリ活用評価ではOpus 4.8の3倍の性能向上幅を記録した。視覚情報のみで「ポケットモンスター ファイアレッド」を攻略するなど、長文脈・ビジョン領域でも従来モデルとの差が拡大した。
米政府の規制と一転解除、9月の5.1化
AI新聞によれば、公開からわずか3日後の6月12日、米国政府はFable 5とMythos 5について外国人アクセス制限を含む全顧客への提供停止を発表した。その後トランプ政権が7月上旬にも制限解除に動くとの報道があり、実際にProject Glasswingの参加団体にはプレビュー版が提供され続けたという指摘もある。規制と解除の綱引きが続く中、Anthropicは9月1日に「Claude Fable 5.1」「Claude Mythos 5.1」を発表し、コーディングと知識労働で世界最高性能をさらに更新したと説明した。GIGAZINEの関連記事では、5.1はFable 5より最大45%安く高性能だとされる。
Mythos 5を上回る未公開モデル「Model 2」の存在
Digital Todayの報道によると、Anthropicは8月15日に公表したAIリスク報告書で、外部提供していない「Model 2」がClaude Mythos 5を性能面で上回るとの安全性評価結果を明らかにした。これは、一般提供と規制の綱引きが続く裏で、Anthropicが常に一段上の性能を持つモデルを非公開のまま保持している構図を示す。坂本氏はスタンフォード大学のAIレポートを引用し、各社の基盤モデルの性能差は既に非常に小さくなっていると分析しており、Mythosクラスの優位は一時的で、企業が備えるべきはMythos単体ではなく今後次々登場する同水準のモデル群そのものだと結論づけている。


