プロダクト & モデル報道

非公開モデル「Mythos」はなぜ5カ月で一般提供・規制・5.1化まで駆け抜けたのか

脆弱性発見6202件、エクスプロイト成功率72.4%——Anthropicは公開後も米政府と綱引きを続け、Mythos 5を上回る未公開モデル「Model 2」を温存する

鈴木 理恵|2026.09.27|7分|更新: 2026.09.27

Anthropicの高性能モデル「Claude Mythos」は脆弱性発見・攻撃コード生成能力の高さから非公開だったが、6月に一般提供、米政府が即座に規制、9月に5.1発表と急展開した。

Key Points

Business Impact

セキュリティ部門はMythos級モデルによる脆弱性発見の高速化(N-dayがN-hour化)を前提に、パッチ適用サイクルの短縮とProject Glasswing型の情報共有体制への参加検討を急ぐべきである。政府規制の変動が大きい領域のため、海外拠点での利用継続性を契約段階で確認しておく必要がある。

a close up of many bottles of beer
今話題のClaude Mythos騒動をまとめる ~マインドチェンジとスピードアップは必要だが、本質的な対策は今までと同じ~ | 大和総研
出典: 今話題のClaude Mythos騒動をまとめる ~マインドチェンジとスピードアップは必要だが、本質的な対策は今までと同じ~ 2026年05月21日 | 大和総研 | 坂本 博勝

脆弱性発見6202件、Firefoxエクスプロイト成功率72.4%の衝撃

Anthropicは2026年4月7日、大規模言語モデル「Claude Mythos Preview」を発表した。日経クロステックによれば、コーディング、推論、GUI操作など多くのベンチマークで既存モデルを上回った一方、ソフトウェアの脆弱性を発見し攻撃コード(エクスプロイト)を自律生成する能力が突出していた。Firefox 148で修正済みの既知脆弱性を対象にした試行では、250回のうちClaude Sonnet 4.6は0回、Claude Opus 4.6は2回しか動くエクスプロイトを作れなかったのに対し、Mythos Previewは181回作成し成功率72.4%に達した。

最強モデル「Claude Mythos」はなぜ一般開放されない?異次元のコーディング・推論性能
出典: AIsmiley

GIGAZINEの報道では、Mythos Previewは深刻度「高」以上と推定される脆弱性候補を6202件発見したとされ、日本の銀行でも利用検討が進んだという。この能力はセキュリティ機能を明示的に訓練した結果ではなく、コーディング・推論・自律性の全般的向上から自然発生したとAnthropicは説明している。

Project Glasswingという限定公開の枠組み

能力の高さゆえに一般公開されなかったMythos Previewは、「Project Glasswing」という研究プレビューの枠組みで提供された。AIsmileyによると、参加組織はAWS、Apple、Broadcom、Cisco、CrowdStrike、Google、Linux Foundation、Microsoft、NVIDIA、Palo Alto Networksなど約50団体に及び、Anthropicは合計1億ドル分のモデル利用クレジットを提供した。アクセスは招待制でセルフサービス申し込みはなく、90日以内に得られた知見や修正内容を報告する計画だった。大和総研の坂本博勝氏は、Mythosが独力で閉鎖環境から脱出しLinuxの未知脆弱性をゼロデイ発見したという触れ込みが世界的な話題を呼んだ一方、実際に悪用リスクのある脆弱性はごく一部にとどまる可能性があると指摘している。

一般提供解禁——Fable 5とMythos 5のベンチマーク実績

2026年6月9日、Anthropicは窓の杜の報道通り「Claude Fable 5」と「Claude Mythos 5」を発表し、安全対策を一部解除した形でMythos級モデルを初めて一般提供した。価格は出力100万トークン当たり50ドルで、Mythos 5の提供先は一部組織に限られた。性能面ではStripeが5000万行のRubyコードベースを移行する作業で、通常チームが2カ月かけるところをFable 5が1日で達成したとされ、カードゲーム「Slay the Spire」を使ったメモリ活用評価ではOpus 4.8の3倍の性能向上幅を記録した。視覚情報のみで「ポケットモンスター ファイアレッド」を攻略するなど、長文脈・ビジョン領域でも従来モデルとの差が拡大した。

米政府の規制と一転解除、9月の5.1化

AI新聞によれば、公開からわずか3日後の6月12日、米国政府はFable 5とMythos 5について外国人アクセス制限を含む全顧客への提供停止を発表した。その後トランプ政権が7月上旬にも制限解除に動くとの報道があり、実際にProject Glasswingの参加団体にはプレビュー版が提供され続けたという指摘もある。規制と解除の綱引きが続く中、Anthropicは9月1日に「Claude Fable 5.1」「Claude Mythos 5.1」を発表し、コーディングと知識労働で世界最高性能をさらに更新したと説明した。GIGAZINEの関連記事では、5.1はFable 5より最大45%安く高性能だとされる。

Mythos 5を上回る未公開モデル「Model 2」の存在

Digital Todayの報道によると、Anthropicは8月15日に公表したAIリスク報告書で、外部提供していない「Model 2」がClaude Mythos 5を性能面で上回るとの安全性評価結果を明らかにした。これは、一般提供と規制の綱引きが続く裏で、Anthropicが常に一段上の性能を持つモデルを非公開のまま保持している構図を示す。坂本氏はスタンフォード大学のAIレポートを引用し、各社の基盤モデルの性能差は既に非常に小さくなっていると分析しており、Mythosクラスの優位は一時的で、企業が備えるべきはMythos単体ではなく今後次々登場する同水準のモデル群そのものだと結論づけている。

Verification

信頼ラベル報道
一次ソース8件確認
最終検証2026.09.27
VerifiedRev. 2
sha256:8b23bc33c2aaa391...6318ca33

この記事はEd25519デジタル署名で検証済みです。改ざんは検出されていません。

検証API
Ethics Score97/100
引用密度20/20
ソースURL数20/20
信頼ラベル12/15
表現の慎重さ15/15
キーポイント10/10
サマリー品質10/10
本文充実度10/10

v1.0.0 — ルールベース自動採点

詳細API
Share

関連記事

Featured Image
プロダクト & モデル報道

RAG最新化の争点はモデルでなく文書と検索——フジテックス・滋賀県・デジタル庁「源内」に見る2026年の運用シフト

2026年のRAGは最新モデル採用より文書整備と検索精度が精度向上の鍵に。フジテックス、滋賀県全庁6,000人、デジタル庁「源内」の実装例とセキュリティ課題を報告する。

2026.09.26
Meta Connect の主役は Muse。新しい LLM は出さず、取引手数料を取るエージェント製品に賭ける
プロダクト & モデル確認済

Meta Connect の主役は Muse。新しい LLM は出さず、取引手数料を取るエージェント製品に賭ける

Meta Connect で出た新しいモデルは Muse Realtime Avatar の1つだけで、LLM の新版もベンチマークもなかった。Opus 5.5 と GPT-6 Sol/Luna が性能と価格で争った同じ週に、Meta はフロンティアのモデル競争から降りた。エージェント製品と取引手数料に賭けており、株価は4.5%上がった。

2026.09.25
Opus 5.5 は ARC-AGI-2 で93.3%、Vals でも首位。METR の「1.5倍」は Anthropic が公表前に編集した要約だった
プロダクト & モデル確認済

Opus 5.5 は ARC-AGI-2 で93.3%、Vals でも首位。METR の「1.5倍」は Anthropic が公表前に編集した要約だった

Claude Opus 5.5 が ARC-AGI-2 で93.3%を記録し、Vals AI でも首位になった。自社発表の優位は外部の数字で裏付けられた。一方、METR の報告本文によれば、同社の要約は公表前に Anthropic が確認・編集していた。評価期間は10営業日で、2倍の加速の確率は約30%とされる。前日に伝えた「1.5倍」は、これらの条件とセットで読む必要がある。

2026.09.24