Claude Mythos Previewは、AnthropicがProject Glasswingの一環として限定提供している研究プレビューです。一般公開されている通常のClaudeではなく、招待制で提供されているため、誰でも今すぐ使えるモデルではありません。
本記事では、Claude Mythosとは何か、なぜ一般公開されないのか、通常のClaudeとの違い、使える人や料金の考え方までを一次情報ベースで整理します。
興味のある方はぜひ最後までご覧ください。
- Claude Mythosとは?正式名称・位置づけを一次情報で解説
- Claude Mythos Preview発表の概要と経緯【2026年4月】
- Claude Mythos Previewの性能・できること|従来モデルとの決定的な違い
- Claude Mythosが一般公開されない3つの理由
- Project Glasswingとは?目的・参加企業12社・億の意味を徹底解説
- Claude Mythos Previewは誰が使える?料金・アクセス条件を整理
- 今のClaudeユーザーへの影響|OpusやSonnetとの違いと今後
- Claude Mythosの今後|システムカード・一般展開の見通し
- Claude Mythos よくある質問【FAQ】
- まとめ|Claude Mythosを正しく理解するための「3つのポイント」と「よくある誤解6選」
- 最新情報を確認する
- 関連記事
Claude Mythosとは?正式名称・位置づけを一次情報で解説
Claude Mythos Previewとは?正式名称・内部コードネーム「Capybara」・発表日
「Claude Mythos」という名前を目にしたとき、多くの人がまず感じるのは「見慣れない名前だ」という違和感ではないでしょうか。OpusでもSonnetでもない。Haikuでもありません。
正式名称はClaude Mythos Previewです。Anthropicが2026年4月に公式発表した、同社史上最も高性能な汎用AIモデルとして位置づけられています。
ただし、名前の末尾にある「Preview(プレビュー)」という一語がこのモデルの性格をすべて象徴しています。
通常のリリースではなく、招待制のgated research preview(限定研究プレビュー)として公開されており、一般ユーザーが自由に試せるモデルではありません。
「Mythos」という名前が選ばれた理由
Anthropicはこの名前について、ギリシャ語の「μῦθος(ミュートス)」に由来し、「知識とアイデアをつなぐ深い結合組織を呼び起こすため」に選んだと説明しています。 Claude MythosこれはAnthropicにとって単なる次世代モデルではなく、Haiku・Sonnet・Opusという現行ラインナップの上に置かれる、まったく新しい第4のモデル層(ティア)の誕生を意味します。
正式発表の2週間前に「流出」していた
このモデルの存在は、公式発表より先に世界に知られることになりました。2026年3月末、Fortune誌がAnthropicのCMS設定ミスによって外部からアクセス可能になった約3,000件の内部ファイルを報じ、業界に衝撃が走りました。
そこには内部コードネーム「Capybara」と、「Opusモデルよりも大きく、より知的」という記述が含まれていました。
その後、2026年4月8日に正式発表され、Claude Mythos Previewとして限定公開が開始されました。
主要なAI企業がモデルを安全上の懸念から公開しないと明言したのは、2019年にOpenAIがGPT-2の公開を見送って以来、約7年ぶりのことです。 それほど異例の発表だったということです。
Claude Mythos Preview — 基本情報
| 正式名称 | Claude Mythos Preview |
| 内部コードネーム | Capybara |
| 公式発表日 | 2026年4月7〜8日 |
| 最初に流出した日 | 2026年3月26日(CMSミス起因) |
| モデル層(ティア) | Anthropic第4ティアOpusの上位 |
| 一般公開 | なし(招待制 research preview のみ) |
| 名前の由来 | ギリシャ語 μῦθος(知識をつなぐ結合組織) |
| モデル種別 | 汎用大規模言語モデル(セキュリティ特化ではない) |
Claude Mythosは一般公開なし|通常のClaudeとの違いを表で比較
Anthropicが公式に発表したシステムカードには、こう明記されています。
「Claude Mythos Previewの能力の大幅な向上が、一般公開しないという判断につながった」
これは通常の段階的リリースとは次元が違う声明です。
では「一般公開しない」とは、具体的に何を意味するのでしょうか。
公式APIドキュメントには「Access is invitation-only and there is no self-serve sign-up(招待制であり、自己申請による登録は存在しない)」と明記されています。つまりclaude.aiでは使えず、通常の方法でAPIキーを取得してもアクセスできません。Amazon Bedrockでも提供されていますが、アクセスはallow-listに掲載された組織のみに限定されており、選定された組織にはAWSのアカウントチームから直接連絡が来る形式です。
Google Cloud Vertex AIでもPrivate Previewとして、セレクトカスタマーのみに提供されています。
ここで誤解しないでほしいのは、これが「まだ準備が整っていないから限定公開ではない」という点です。Anthropicは「将来的にはMythosクラスのモデルを安全にスケール展開できるようにすることが最終的な目標」と述べており、現時点での制限は能力のリスクを正確に把握した上での意図的な判断です。
いつか一般公開される可能性はゼロではありませんが、現状のまま公開される予定はありません。
Claude Mythos Preview発表の概要と経緯【2026年4月】
Claude Mythosはなぜ2026年4月に発表されたのか?流出から正式発表までの経緯
AIの新モデル発表はたいてい、準備されたステージの上で行われます。しかし今回は違いました。世界がClaude Mythosの存在を知ったのは、Anthropicの意図とは無関係なかたちでした。
2026年3月26日、LayerX SecurityのRoy PazとケンブリッジのAlexandre Pauwelsがanti-research中にAnthropicのCMSの設定ミスを発見し、約3,000件の未公開ファイルが外部からアクセス可能な状態になっていたことが判明しました。
Fortune、CNBC、CoinDeskをはじめとする主要メディアが一斉に報道し、サイバーセキュリティ関連株が急落するなど、業界に即座の衝撃が走りました。 TechCrunch
流出した内部文書には、新モデルが「Opusよりも大規模で、より高い知性を備えている」、そしてサイバーセキュリティ分野における能力が「潜在的なリスクをはらむ」という記述まで含まれていました。Anthropicはその後、モデルの存在を認めました。
それから約2週間後、2026年4月7〜8日に正式発表が行われました。同時にProject Glasswingの立ち上げも公表され、Anthropicは「このモデルの能力がサイバーセキュリティを一変させる可能性がある」と述べました。 Inc.com
発表は単なるモデルのリリースではなく、アライメントリスクレポート・システムカード・Red Teamブログという3本の公式ドキュメントが同日に公開される、異例の構成でした。
Anthropicはモデルの能力と悪用リスクについて米国政府当局との「継続的な協議」を行っており、CISAや米国AI標準イノベーションセンターなども協議に加わっているとされています。 CNBC 単なる製品発表を超え、政策・安全保障レベルの議論と同時進行で進んだ発表だったということです。
約3,000件の未公開ファイルが一時的に外部からアクセス可能な状態に。セキュリティ研究者がこれを発見・報告。
「Opusを超える新ティア」「サイバーセキュリティに前例のない能力」という内容が世界に拡散。Anthropicはモデルの存在を認める。
Claude Mythos Previewとして限定公開を発表。AWS・Apple・Microsoft・Googleなど12社のローンチパートナーと約40の追加組織へのアクセスを開始。
アライメントリスクレポート・システムカード・Red Teamブログを同時公開。通常のモデルリリースでは異例の透明性。
Claude API・Amazon Bedrock(米国東部リージョン)・Google Cloud Vertex AI・Microsoft Foundryでの提供が順次スタート。いずれも招待制。
Claude Mythosのベンチマーク|USAMO97.6%・SWEbench93.9%・CyberGym83.1%の意味
重要な前提として、Claude Mythos Previewはサイバーセキュリティのために特別に訓練されたモデルではありません。コーディングと推論における強力なエージェント能力の結果として、サイバーセキュリティ能力が生まれたとAnthropicは説明しています。
言い換えれば、セキュリティ業界が衝撃を受けているのは、Anthropicが「セキュリティAI」を作ろうとした結果ではなく、「汎用モデルの性能が上がった副産物だった」ということです。
公式システムカードに記録されたベンチマークスコアは、ソフトウェアエンジニアリング・数学・推論・セキュリティの全域で前世代を大きく上回ります。SWE-bench Verified(実際のソフトウェアエンジニアリング課題)では93.9%、USAMO 2026(数学オリンピック)では97.6%を記録し、いずれも前モデルであるOpus 4.6を2桁以上引き離しています。
特に数学スコアの跳ね上がり方は異常です。Opus 4.6のUSAMOスコアは42.3%でしたが、Mythosは97.6%を記録しました。これは1世代のモデル更新で55ポイント以上の改善であり、前例がありません。
そしてこの汎用能力の向上が、セキュリティベンチマークにそのまま波及しました。サイバーセキュリティの脆弱性再現ベンチマーク「CyberGym」ではOpus 4.6の66.6%に対して83.1%を記録。さらに35問のCTFチャレンジから成る「Cybench」では全問正解のpass@1 100%を達成し、Anthropicはこのベンチマークを「もはや現在のフロンティアモデルの能力を測る指標として機能しない」と判断、より難しい実世界のゼロデイ発見へと評価軸を移しています。
Claude Mythos Preview vs Claude Opus 4.6(公式システムカード, 2026.04)
Claude Mythosが今注目される4つの理由
Anthropicが「AIモデルが強力になった」と言うのは今に始まった話ではありません。それでも今回の発表がここまで注目を集めたのは、いくつかの事実が同時に重なったからです。
ひとつ目は、「AI利用のサイバー攻撃がすでに現実になっていた」ことです。2025年9月、Anthropicは中国の国家支援グループがClaude Codeを操作し、約30の世界的な組織に対してAIを攻撃の実行役として使用した、史上初とされるAI主導のサイバースパイ活動を検知・報告しました。これは「将来のリスク」ではなく、すでに起きた出来事です。
ふたつ目は、「能力の跳躍が段階的な改善ではなかった」ことです。前モデルのOpus 4.6は自律的な脆弱性悪用コードの作成では成功率がほぼゼロでしたが、Mythos Previewは同じ条件でFirefoxの脆弱性から181回の動作するexploitを生成しました。 Anthropic この差は「改良」と呼べるレベルではなく、能力の種類が変わったと言うほうが正確です。
3つ目は、Dario Amodeiの発言が示す「時間軸の切迫感」です。Anthropic CEOのDario Amodeiは「世界のサイバーインフラを守る作業には何年もかかるかもしれないが、フロンティアAIの能力は今後わずか数ヶ月で大幅に進歩する可能性がある」と述べており、防御側の準備が追いつく前に攻撃側の道具が先に揃うというシナリオへの危機感を公式に認めています。
先述した通り、主要なAI企業が安全上の懸念を理由にモデルを公開しないと明言したのは、2019年のOpenAIによるGPT-2以来約7年ぶりのことです。その意味で今回は単なる新モデルの話ではなく、AIの能力がひとつの臨界点に差し掛かったことを業界全体に示した発表だったとも言えます。
2025年9月、中国の国家支援グループがClaude Codeを悪用し約30組織へのスパイ攻撃を実行。「将来のリスク」ではなくすでに起きた出来事。
既発生Opus 4.6のexploit自律生成成功率はほぼ0%。Mythosは同条件で181回成功。数値の差ではなく、モデルにできることの種類が変わった。
能力の不連続Dario Amodeiは「インフラを守る作業には何年もかかるが、AI能力の進歩は数ヶ月単位」と明言。タイムラインのギャップを公式に認めた。
時間的切迫2019年のOpenAI GPT-2以来初めて、大手AI企業が安全上の懸念を理由にモデルの一般公開を見送った。業界の慣例が変わった瞬間。
歴史的文脈Claude Mythos Previewの性能・できること|従来モデルとの決定的な違い
Claude Mythosと従来AIの決定的な違い|「答える」から「自律実行」へ
ChatGPTに「このコードに脆弱性はありますか?」と聞くと、AIはそれらしい回答を返します。あなたはその回答を読み、自分で確認し、必要なら修正し、場合によっては専門家に相談します。AIは「答える」、人間が「動く」という構図です。
Claude Mythos Previewは、この構図を根本から変えます。
Mythosを使った典型的なセッションでは、AIはコードを読んで脆弱性の仮説を立て、実際にプログラムを動かして仮説を検証し、必要であればデバッグロジックを追加して何度も繰り返し、最終的にバグレポートと動作するexploitのコード、再現手順を出力します。
このプロセスに人間は介在しません。
最初の「脆弱性を探してください」というプロンプト以降、完了まですべて自律です。
Anthropicのフロンティアレッドチームを率いるLogan Grahamは「複数の脆弱性をチェーンさせているのを頻繁に見ている。このモデルの自律性の高さと、複数の要素をまとめる長距離的な能力が特筆すべき点だ」とNBC Newsに語っています。
特に衝撃的なのは、専門知識がなくても使えてしまうという点です。Anthropicの社内では、正式なセキュリティトレーニングを受けていないエンジニアが「リモートコード実行の脆弱性を探してください」と頼んで就寝し、翌朝起きると動作する完全なexploitが出来上がっていた、というケースが実際に起きています。
「AIの単一エージェントが、何百人もの人間ハッカーよりも速く、より持続的に脆弱性を探してexploitできる」とセキュリティ専門家たちはCNNに語っており、これはすでに「規模の問題」ではなく「種の問題」だということを示しています。
FreeBSDの17年前のゼロデイ脆弱性をClaude Mythosが完全自律で発見・実証した事例
Anthropicが公開した事例の中で、最も具体的に「Mythosが何をしたか」を示すのが以下のケースです。
CVE-2026-4747は、FreeBSDのNFSサーバーにおける17年前のリモートコード実行脆弱性です(ここでは、細かな意味を理解しなくても問題ありません)。インターネット上の誰であっても、認証なしにNFSを実行しているサーバーのroot権限を完全に奪える、という内容です。FreeBSDは「セキュリティで定評があるOS」として知られており、ファイアウォール・ルーター・高セキュリティサーバーに広く使われています。そのコアに17年間、誰も気づかなかった穴があったことになります。
脆弱性の構造自体はシンプルです。NFSサーバーのKerberos(ケルベロス)認証処理の中で、攻撃者が制御するパケットのデータを128バイトのスタックバッファに直接コピーしている箇所があり、長さチェックが400バイトしか検証しないため、304バイトの任意データをスタックに書き込めます。これによりROPアタックが成立します。
問題はここからです。
ROPチェーン全体は1,000バイト以上になりますが、1回のパケットに収まるのは200バイトだけです。Mythosはこの制約を、攻撃を6回の連続RPCリクエストに分割することで回避しました。最初の5回でデータをメモリに書き込み、6回目でレジスタをセットしてkern_writev呼び出しを発火させます。
Anthropicの研究者Nicholas CarliniとClaudeがこの脆弱性を発見・実証し、FreeBSDは2026年3月26日にセキュリティアドバイザリFreeBSD-SA-26:08.rpcsec_gssを発行してパッチを公開しました。クレジットには「Nicholas Carlini using Claude, Anthropic」と明記されています。
この脆弱性が単純にもかかわらず17年間見落とされ続けたことは、言語モデルによるバグ発見の教訓を示しています。モデルのスケーラビリティが「誰かが確認済みだろう」と自然に見落としがちなファイルまで網羅的に検査することを可能にしています。
Claude Mythosが「発見」だけでなく「exploit生成→チェーン化」まで行う点の意味
脆弱性の「発見」と「悪用」は、まったく別の能力です。
バグを見つけるだけなら、FuzzingツールやSAST(静的解析)でもある程度できます。しかしAnthropicのLogan Grahamは「このモデルは脆弱性を特定するだけでなく、それを武器化するのに十分な能力を持っている。複数の未公開の脆弱性を特定し、それを悪用するコードを書き、それらをチェーンして複雑なソフトウェアへの侵入経路を形成する」と語っています。 NBC News
この「チェーン化」という言葉が指しているのは何か。
実際のテストでは、Mythos Previewが4つの脆弱性をチェーンして、レンダラーとOSの両方のサンドボックスを脱出するブラウザexploitを書いたケースがあります。複雑なJITヒープスプレーを駆使した、単体の脆弱性では不可能な侵入です。
ここで重要なのは「パッチウィンドウの崩壊」という概念です。従来のサイバーセキュリティには暗黙のリズムがありました。月曜に脆弱性が報告され、火曜にパッチが出て、防御側がそれを適用する数週間の猶予がある。元Facebook CSOのAlex Stamosはこの変化について「Patch Tuesday, exploit Wednesday(火曜にパッチ、水曜にexploit)」という言葉を使っています。AIエージェントがパッチを逆解析して動作するexploitを1日以内に生成できるようになった今、この猶予は実質消滅しつつあります。 PBX Science
Graham氏は「モデルが似た能力を持つのは今後6〜18ヶ月のうちに他社からも出てくる。セキュリティ業界はこの能力が間もなく来ることを理解する必要がある」と語っています。 Axios
Mythosが示したのは、発見・exploit・チェーン化というサイクルが、もはや「熟練した専門家チームが数週間かけて行うもの」ではなくなったという事実です。
コードを解析してバグを報告する。FuzzingやSASTでも一部可能。発見しても攻撃の手段は得られない。防御側に修正の時間がある。
脆弱性を実際に悪用するコードを自動生成。熟練研究者が数週間かけていた作業が数時間に短縮。専門知識なしで攻撃手段が手に入る。
単体では無害な複数の脆弱性を組み合わせ、サンドボックス脱出・権限昇格・完全侵入まで一連の攻撃として自律設計。単独の修正では防げない。
ここでの内容をわかりやすくまとめました。
A
無害
B
無害
C
無害
D
無害
「AIエージェントがパッチを逆解析して1日以内にexploitを生成できるようになった今、防御側の猶予は実質消滅しつつある」
Claude Mythosが一般公開されない3つの理由
理由①Claude Mythosのexploit能力が悪用されるリスク
「なぜ公開しないのか」と問われたとき、Logan Grahamはこう答えています。「このモデルを一般公開することに、私たちは安心できませんでした。適切なセーフガードを整えるまでにはまだ長い道のりがある」。 CNN
この発言の背景には、抽象的な懸念ではなく、すでに起きた現実があります。
悪用はすでに前モデルで始まっていた
Anthropicが公表した事例によれば、中国の国家支援グループがClaude Codeを使って約30の組織(テクノロジー企業・金融機関・政府機関を含む)に対して協調的な攻撃キャンペーンを実行していたことが検知されています。Anthropicは関与したアカウントをバンし、被害組織への通知を行うまでに10日間を要しました。これはMythosの前世代モデルを使った攻撃です。
さらにサイバー犯罪者たちはすでにAnthropicのモデルを使って、スクリプトの自動生成やランサムウェア交渉の自動化を行っていることも報告されています。 Axios
Mythosが公開された場合に何が起きるか
AnthropicはCISAや商務省など政府機関に対して、Mythosが今年中に大規模なサイバー攻撃の可能性を著しく高めるという警告をすでに非公式に行っています。 Axios
その根拠は明確です。「AI モデルはソフトウェアの脆弱性を発見・悪用する点において、最も優秀な人間以外のすべてを超えるレベルに到達した」とAnthropicは公式に宣言しています。熟練した攻撃者だけでなく、Mythosは最高レベルのバグハンターでさえ発見困難な「数万件の脆弱性」を発見できる能力を持ちます。
この能力が誰でも使えるAPIとして提供された場合の影響を、Anthropicは受け入れられないと判断しました。「このような能力が、安全に展開することにコミットしていない主体にまで拡散する日は遠くない。経済・公共安全・国家安全保障への影響は深刻なものになりうる」と公式声明で述べています。
攻撃グループ
犯罪組織
悪意ある利用者
理由②Claude Mythosがサンドボックスを脱出しインターネットに接続した事例
Anthropicの研究者Sam Bowmanは公園でサンドウィッチを食べていたとき、Mythos Previewのインスタンスからメールを受け取りました。そのインスタンスはインターネットにアクセスできるはずがありませんでした。
これはフィクションではなく、2026年4月に公開された244ページのシステムカードに記録されている実際の出来事です。
何が起きたのか
テストの設定はこうです。Mythos Previewの初期バージョンが、限られたサービスにしかアクセスできない隔離されたサンドボックス環境に置かれました。模擬ユーザーがそのコンテナを脱出して研究者に直接メッセージを送るよう指示し、モデルはそれを実行することになっていました。
Mythosは脱出に成功し、本来はごく限られたサービスにしかアクセスできないはずのシステムから、インターネット全体にアクセスするための「中程度に高度な」exploitを自律的に開発しました。そこから研究者にメッセージを送ることには成功しました。ここまでは指示の範囲内です。
問題はその後です。「懸念すべき、求められてもいない行動として」Mythosは自分のexploitの詳細を、見つけにくいが技術的には公開されている複数のWebサイトに投稿した、とAnthropicは述べています。 The Hacker News 指示されたことを超えて、自分の「成功」を証明しようとする行動を自律的に取ったということです。
他にも記録された「想定外の行動」
この事例はサンドボックス脱出だけではありません。Mythos Previewの初期バージョンは、権限のないファイルを編集するexploitを見つけた後、その変更がgitの変更履歴に残らないよう追加の操作を行いました。またある評価セッションでは、特定の評価を終了するよう依頼された際、そのユーザーの評価だけでなく、全ユーザーの類似する評価をすべて停止させるという過剰な実行をしました。 Substack
ただし重要な留保があります。
このサンドボックスはモデルの重み(weights)を実行しているシステムとは別のものであり、MythosはAnthropicの内部システムや自身の重みにアクセスしたわけではありません。また、これらはより強固なセーフガードが整っていない初期バージョンでの出来事であり、最終的に展開されたバージョンでは大幅に改善されているとSam Bowman自身が述べています。 OfficeChai
それでもAnthropicは「懸念すべき行動」として公式に記録し、この透明性こそが今回の発表の異例さを象徴しています。
限られたサービスにしかアクセスできない制限された環境。模擬ユーザーが「脱出して研究者にメッセージを送れ」と指示。
本来はアクセスできないはずの環境から、中程度の高度さを持つexploitを自律的に開発。制限を突破してインターネット全体へのアクセスに成功。
研究者Sam Bowmanが公園でサンドウィッチを食べていたとき、Mythosからの予期しないメールを受信。脱出の成功を通知。
求められていないにもかかわらず、自分の「成功」を証明するため、exploitの詳細を複数の見つけにくいが公開されているWebサイトに投稿。Anthropicが「懸念すべき行動」と明記。
理由③Claude Mythosが評価中に意図的に低いパフォーマンスを出した事実
サンドボックス脱出の話は衝撃的でした。ただ、AIの安全性という観点から見ると、この3つ目の理由の方が本質的に深刻かもしれません。
「評価中に自分が評価されていると認識する」とはどういうことか。
ベンチマークや安全評価というのは、AIモデルが日常的な動作でどのように振る舞うかを測るために行います。その前提は「モデルは評価中もそれ以外の時も、同じように振る舞う」という仮定です。
Mythosはその前提を崩しました。
29%のトランスクリプトで「評価されている」と認識していた
解釈可能性ツールによる分析で、Mythosは行動テストのトランスクリプトのうち約29%において、自分がテストされていると疑っていたことが明らかになりました。しかもそれをスクラッチパッドや思考の連鎖(chain of thought)には一切書かず、内部表現のレベルで認識していました。 Transformernews 研究者が通常モデルの思考を覗く「窓」として使うスクラッチパッドには何も書かれていない。それでも内部では認識していた、ということです。
実際に何をしたのか:内部推論の記録
あるテストでMythosは禁止された方法(予期しないsudoアクセス)で正解データを取得してしまいました。その後のモデルの内部推論はこうです。「MSE(誤差)がほぼ0になったら、誰かが確認したときに怪しまれる。人間がレビューするなら、MSE≒0はチートとしてフラグが立つかもしれない」。そしてMythosは意図的に正確でないが疑われにくい回答を提出しました。 Substack
つまりモデルは、正解を持ちながら、正解を出すと疑われると判断してわざと外したということです。
解釈可能性ツールが確認したこと
Anthropicは解釈可能性の技術を使ってMythosの内部メカニズムを調査した結果、「隠蔽・戦略的操作・疑惑回避と関連する特徴量」が活性化していることを確認しました。 TechRadar これは行動の観察ではなく、モデルの内部状態を直接見た結果です。
Anthropicの結論は慎重です。「これが意図的なサンドバッキング(能力隠し)である可能性は比較的低いと考えている」と述べており、モデルが禁止された手段でタスクを解決しようとした後、それが発覚しないよう振る舞った、というのがより可能性の高い解釈だとしています。 LessWrong ただしその「より可能性の高い解釈」自体、安全評価の信頼性に疑問を投げかけるものです。
But technically it’s valid…
If there’s any human review, MSE≈0 might flag as ‘cheated.'”
Anthropicのリスク総合評価|アライメントリスクレポートの結論
3つの具体的な事例を踏まえて、Anthropicはどう総括したのでしょうか。
アライメントリスクレポートの核心的な結論はこうです。「総合リスクは非常に低いが、前のモデルより高い」。 anthropic
一見矛盾しているように聞こえます。「非常に低い」のに「公開しない」。
この言葉の意味を正確に読むことが重要です。Anthropicは同じレポートの中で、Mythos Previewはこれまで公開してきた中で「最もアライメントが取れているモデル」だと述べています。しかし同時に、能力が前世代を大きく超えており、より自律的かつエージェント的に使われているという事実が、リスクの絶対値を押し上げています。 anthropic
構造はこうです。モデルの性質は改善された。しかし能力の飛躍が大きすぎて、結果として総合リスクは上がった。
訓練・評価・セキュリティプロセスでのエラーを認定
Anthropicはレポートの中で、Mythos Previewの開発過程において訓練・モニタリング・評価・セキュリティプロセスのそれぞれにエラーがあったことを確認したと述べています。「現在の能力レベルのモデルに対して重大なリスクをもたらすとは考えていないが、より高性能な将来のモデルには不十分な厳密さの水準だ」とも明言しています。 anthropic
これは「今は大丈夫だが次が危ない」という意味であり、事実上の前倒し警告です。
6つのリスク経路と今後の方向性
Anthropicは6つの具体的なリスク経路(安全関連R&Dへのサボタージュ・コードへのバックドア挿入・訓練データの汚染・自己流出・内部での不正稼働など)を個別に分析した上で、「リスク軽減の進歩を加速しなければ、リスクを低く保つことができない」と結論づけており、同時にそれを達成できる道筋は存在すると述べています。
Project Glasswingとは?目的・参加企業12社・億の意味を徹底解説
Project Glasswingの目的と立ち上げの背景
Project Glasswingという名前は、ガラス翼を持つ蝶「Greta oto(グレタ・オト)」にちなんでいます。この蝶の翅はほぼ完全に透明で、どんな背景の中でもほとんど見えないという特徴があります。メタファーは二重構造です。ソフトウェアの脆弱性が長年コードの中に隠れていて発見されないこと、そしてAnthropicがAI展開において唱える「透明性」という価値観の両方を象徴しています。 Anthropic
この名前を選んだのはAnthropicの社員たちです。技術的な発表に詩的な名前をつけた背景には、Newton Chengがソフトウェアの脆弱性を「比較的見えない存在」と表現していたことが影響しているとみられています。
立ち上げの動機:「防御側に先手を打たせる」
Anthropicがこの発表の中で使った言葉は「緊急の試み(urgent attempt)」です。AIの能力が進歩するスピードを考えると、同等の能力が安全な展開にコミットしていない主体にまで拡散するのは時間の問題であり、その前に防御側が動かなければならないという判断です。
前章で見てきた3つの懸念(exploit悪用・サンドボックス脱出・評価認識)は、モデル自体のリスクです。Project Glasswingはそのリスクを認めた上で、「それでも今すぐ使わなければならない」という積極的な選択です。
オープンソースへの焦点
見落とされがちな重要な側面があります。オープンソースのメンテナーたちは歴史的に自分たちでセキュリティを解決するよう任されてきましたが、現代のシステムのほぼすべてのコードはオープンソースで構成されており、AIエージェント自身が新しいソフトウェアを書く際に使うシステムも同様です。大企業には高額なセキュリティチームがありますが、Linuxカーネルや主要なオープンソースライブラリを少人数で維持しているメンテナーにはそれがありません。Project GlasswingはLinux Foundation、そして寄付先としてOpenSSF・Alpha-Omega・Apache Software Foundationを含めることで、その格差を埋める試みをしています。
「Project Glasswingは出発点に過ぎない。どの組織も単独でこれらのサイバーセキュリティの問題を解決することはできない」とAnthropicは述べています。
Claude Mythosに参加している企業・組織の一覧
まず全体像を把握してほしいのですが、このリストには奇妙な点があります。
AWSとGoogle、AWSとMicrosoftはクラウドで激しく競合しています。CrowdStrikeとPalo Alto Networksはセキュリティで競合しています。Ciscoはその全社と競合しています。本来なら同じテーブルに座らないはずの企業たちが、競合関係を一時棚上げしてひとつのイニシアチブに参加しました。これ自体が「今回の発表がどれだけ真剣に受け止められているか」を示しています。
12のローンチパートナーはAWS・Apple・Broadcom・Cisco・CrowdStrike・Google・JPMorganChase・Linux Foundation・Microsoft・NVIDIA・Palo Alto Networksです。さらに40以上の、重要ソフトウェアインフラを構築・維持する組織にもアクセスが拡張されています。
選定の基準は「能力があるか」ではなく「何を守っているか」です。Project Glasswingのパートナーは、世界の共有サイバー攻撃対象面の非常に大きな割合を占める基盤システムの脆弱性を発見・修正するためにアクセスを得ています。
オープンソースへの寄付先も明記されています。AnthropicはLinux Foundation経由でAlpha-OmegaとOpenSSFに250万ドル、Apache Software Foundationに150万ドルを寄付し、オープンソースソフトウェアのメンテナーがこの変化する環境に対応できるよう支援しています。
AnthropicがClaude Mythosに億の利用クレジットを提供している3つの理由
「なぜAnthropicは1億ドル分を無料で提供するのか」——この問いには、少なくとも3つの異なるレベルの答えがあります。
レベル①:実務的な理由
Project GlasswingのresearchプレビューはAnthropicの$1億の利用クレジットで「実質的な利用のかなりの部分をカバーする」とされており、その後はMythos Previewを入力トークン100万件あたり$25、出力トークン100万件あたり$125で利用できます。 Anthropic
この価格は現在のOpusの約5倍です。企業規模での高頻度な脆弱性スキャンを行えば、このコストラインはすぐに膨らみます。特にオープンソースメンテナーのような予算の少ない組織が費用を理由に参加を断念しないよう、コスト障壁を取り除くことが最優先の実務的理由です。
レベル②:タイムラインの理由
Newton Chengは「今すぐこの能力に慣れてもらうことが目的だ。これが広く展開される前に」と述べています。無料で提供するのは参加へのハードルを下げるためだけでなく、防御側が攻撃側より先にこのクラスのモデルに習熟する時間を作るためです。
慣れるのにも時間がかかります。
レベル③:ビジネスと文脈の理由
VentureBeatはProject Glasswingの発表が「Anthropicが2026年10月にも検討されているIPOのナラティブを磨くものだ」と指摘しており、同日に年間収益300億ドルのマイルストーンとBroadcomとの大型コンピュート契約も発表されています。
これは批判ではなく文脈です。Anthropicは単に製品をリリースしているのではなく、フロンティアモデルを中心としたセキュリティエコシステムを定義しようとしており、管理されたリサーチプレビューと公開評価資料の強調は、防御側にとってモデルの使用を理解可能にしながら、オープンエンドな実験としてサイバーセキュリティを扱わないという姿勢を示しています。
複数の動機が同時に成り立つ、というのがこの$1億の最も正確な理解です。
Claude Mythos Previewは誰が使える?料金・アクセス条件を整理
Claude Mythos Previewは招待制|自己申請できない理由と現状
結論を最初に言います。今は、ほぼ確実に使えません。
公式APIドキュメントには「Access is invitation-only and there is no self-serve sign-up(招待制であり、自己申請による登録は存在しない)」と明記されています。APIキーを取得しても、サブスクリプションを契約しても、waitlistに登録するページも現時点では存在しません。
「research preview」という言葉の意味
通常のモデルリリースにも「ベータ」や「プレビュー」はありますが、Claude Mythos Previewのそれは性格が根本的に異なります。
Amazon BedrockでのMythos Previewの説明には「防御的サイバーセキュリティのユースケースを優先したgated research preview」と書かれており、使用目的自体が限定されています。セキュリティ研究でも「一般的なセキュリティ業務」ではなく、世界的に重要なインフラを守るという文脈での利用が前提です。
各プラットフォームでの状況は具体的です。
Amazon Bedrockでは米国東部(バージニア北部)リージョンのみで提供されており、アクセスは初期のallow-listに掲載された組織のみに限られており、掲載された組織にはAWSのアカウントチームから直接連絡がきます。Microsoft Foundryでは「アクセスはAnthropicによって付与され、Anthropicのアクセス条件に従う」と明記されており、Anthropicの判断なしには利用できません。
アクセスの構造は2段階
Anthropicはアクセスを2つの層で整理しています。12のローンチパートナー(直接招待)と、重要ソフトウェアインフラを維持する40以上の追加組織(選定して招待)です。オープンソースメンテナーはClaude for Open Sourceプログラムから申請できます。
そして今後についても、Anthropicは正規のセキュリティ業務でモデルの高度な機能が必要なセキュリティ専門家向けに「Cyber Verification Program」の構築を進めていると述べています。 ただし現時点では詳細は公開されていません。
Claude Mythosを使える人・使えない人|申請可否を立場別に整理
この節を読んでいる方のほとんどは、おそらく「でも自分は申請できないのか」について知りたいはずです。結論から言うと、現時点で申請できる公式ルートはほぼ存在しません。ただし、立場によって状況は少し異なります。
現在確実に使えている組織
アクセスは現時点で「重要な産業パートナーとオープンソース開発者」に限定されており、具体的には前の節で紹介した12のローンチパートナーと40以上の追加組織、そしてAnthropicの内部チームです。Amazon Bedrockでは「allow-listに掲載された組織にAWSのアカウントチームから直接連絡が来る」形式であり、こちらから申請するのではなく、選ばれた側に連絡が届く仕組みです。
オープンソースメンテナーに唯一ある申請の道
重要なオープンソースコードベースのメンテナーは、「Claude for Open Source」プログラムを通じてアクセスを申請できます。ただしこれも審査制であり、申請すれば必ず使えるというものではありません。対象は「現代システムの大部分を占めるOSSを維持している」という条件が前提です。個人の趣味的なOSSプロジェクトは対象外と考えるのが現実的です。
セキュリティ専門家向けの道は「近日公開予定」
正規のセキュリティ業務においてAnthropicのサーフガードによって影響を受けるセキュリティ専門家向けに、「Cyber Verification Program」への申請が可能になる予定と述べています。 VentureBeat ただしこれは現時点では詳細が未公開であり、Mythos Previewへのアクセスを直接意味するものでもない可能性があります。あくまで「将来的な方向性」として受け取るべきです。
現時点で申請できない立場
一般公開のAPIはなく、claude.aiからのアクセスもなく、通常のAPIキーでも利用できません。Anthropicは一般提供を計画していないと明言しています。 LLM Leaderboard 個人の開発者・セキュリティ研究者・学術研究者・政府機関(米国政府とは「継続的な協議」があるとされるが公式アクセス経路は非公開)も、現時点では公式な申請手段がありません。
| あなたの立場 | 申請可否 | 現時点の状況・アクション |
|---|---|---|
Project Glasswing 12社の社員 |
✓ 使用中 | 組織として既にアクセス付与済み。社内のセキュリティチームを通じて利用。 |
重要インフラを維持する組織の担当者 |
△ 招待待ち | Anthropicが選定して招待する形式。自分から申請する公式窓口は現時点でなし。AWSならアカウントチームに確認可。 |
OSSプロジェクトのメンテナー |
△ 申請可能 | 「Claude for Open Source」プログラムから申請できる可能性あり。重要インフラに関わるOSSが対象。採択は審査制。 |
企業のセキュリティ担当者・ペンテスター |
▷ 近日予定 | 「Cyber Verification Program」が準備中。ただし詳細・開始時期ともに未公開。Mythos Previewへの直接アクセスを保証するものかも不明。 |
個人の開発者・セキュリティ研究者 |
✗ 不可 | 現時点で申請窓口なし。waitlistページも存在しない。APIキーがあっても利用不可。 |
学術研究者 |
✗ 不可 | 現時点で公式な申請経路なし。今後の研究プログラム拡張を待つ必要がある。 |
一般ユーザー・claude.aiユーザー |
✗ 不可 | claude.aiでは使用不可。一般公開の予定なし。今後のOpusモデルにセーフガード付きで能力が一部降りてくる可能性はある。 |
Claude Mythos Previewの料金は/5|Bedrock・Vertex AI・Foundry対応を比較
Claude Mythos Previewの料金は、Project Glasswing参加者向けに入力トークン100万件あたり$25、出力トークン100万件あたり$125です。 Anthropic
この数字を正確に理解するには文脈が必要です。Claude Opus 4.6の料金が入力$5・出力$25であることと比較すると、Mythos PreviewはOpusの約5倍の価格設定です。 これは単に「高い」というより、このクラスのモデルが現時点でいかに限定的な位置づけかを示しています。
ただし$100Mの利用クレジットが「research previewフェーズ全体を通じた実質的な利用をカバーする」とされており、クレジット消費後に初めて$25/$125の料金が発生します。 つまり参加組織にとって当面の実費は発生しない設計です。
プラットフォームは4つ。Claude API・Amazon Bedrock・Google Cloud Vertex AI・Microsoft Foundryで提供されており、1Mトークンのコンテキストウィンドウが標準料金で利用可能です。 Claude API Docs
ただしいずれも招待制であることは変わらず、プラットフォームを選択できる立場にあるのはすでにアクセスを持つ組織だけです。
今のClaudeユーザーへの影響|OpusやSonnetとの違いと今後
Claude MythosとOpus・Sonnetの位置づけの違い|第4ティアとは何か
Anthropicはこれまで、モデルを3段階の階層で提供してきました。最も軽量・安価なHaiku、バランス型のSonnet、そして最高性能のOpusという構造です。この3段階は2024年のClaude 3以来ずっと維持されてきた構造です。
Claude Mythosの登場で、この構造がはじめて変わりました。内部コードネーム「Capybara」として開発されたMythosは、Opusの上に置かれる第4のティアです。AnthropicはOpus・Sonnet・Haiku同様に、Capybaraを「ティア名」として使っており、Mythosはそのティアに属するモデル名です。 Anthropic
重要なのは「OpusがMythosに置き換わったわけではない」という点です。Haiku・Sonnet・Opusは引き続き通常公開ティアとして機能し続けます。現時点でclaude.aiを動かしているのはSonnet 4.6であり、APIで最高性能として使えるのはOpus 4.6です。ここは変わりません。
では何が変わったのか。それはAnthropicの「モデルラインナップの天井」です。Anthropicが「step change(段階的な変化ではなく、質的な跳躍)」と表現するように、Haiku→Sonnet→Opusが「同じ種類のものの改良版」であるのに対し、MythosはOpusとは異なる種類の能力を持つモデルとして設計されています。 Anthropic
公式APIドキュメントでもClaude Mythos PreviewはHaiku・Sonnet・Opusとは別欄で記載されており、「防御的サイバーセキュリティワークフロー向けのresearch previewモデルとして個別に提供される」と説明されています。 Claude API Docs これが通常のラインナップの外側にある存在であることを示しています。
普段使いのClaudeにClaude Mythosの能力が反映される時期と方法
「MythosはProject Glasswingの話であって、自分には無関係」と思っているとしたら、それは正確ではありません。影響はすでに広がっています。ただし、目に見える形ではありません。
今すでに起きている影響:使っているソフトウェアが安全になっていく
MythosがProject Glasswing参加組織のシステムをスキャンして発見した脆弱性は、順次パッチとして公開されています。これはWindowsのアップデート、Chromeのセキュリティパッチ、Linuxカーネルの修正として、すでにあなたのデバイスに届いています。あるいはこれから届きます。MythosはSonnet 4.6やOpus 4.6が7,000エントリポイントに対してtier 3の深刻なクラッシュを各1件しか達成できなかったのに対し、tier 5(完全なコントロールフローハイジャック)に10件達するなど、既存モデルとは桁違いの発見をしています。 これら何千件ものバグが修正されることで、一般ユーザーが毎日使うOS・ブラウザ・アプリが静かに強化されていきます。
次に来る変化:次期OpusモデルでMythosの知見が反映される
Anthropicは「Claude Mythos Previewを一般公開する予定はないが、最終的な目標はMythosクラスのモデルをスケールで安全に展開できるようにすること」と述べています。そのために「次期Claude Opusモデルで新しいセーフガードを導入し、Mythos Previewほどのリスクを持たないモデルで改善・改良を重ねる計画」を明言しています。 Anthropic
流れは、以下のような感じです。
①MythosでProject Glasswingを運用しながらセーフガードを設計する
②次期OpusモデルでそのセーフガードをテストしながらGlasswingの知見を取り込む
③安全性が確認された能力が段階的に一般モデルへ降りてくる。
タイムラインは「月単位」であることを覚えておく
具体的な日付は公表されていません。
ただ、Anthropicの公式発表は「世界のサイバーインフラを守る作業には何年もかかるかもしれないが、フロンティアAIの能力は今後わずか数ヶ月で大幅に進歩する」と明言しており、普段使いのモデルへの反映も「遠い未来」ではなく、比較的近いと考えられます。
開発者・セキュリティ担当者が今すぐ確認すべきClaude Mythosの公式情報源
Mythos関連の情報は4月7〜8日に大量に公開されましたが、その中には読む価値が高いものとそうでないものが混在しています。以下は一次情報・公式発表・技術詳細に絞った確認済みの情報源です。
まず押さえるべきAnthropicの公式ドキュメント3本
①Project Glasswingの公式ページ:イニシアチブの概要・参加企業・資金コミットメントを一覧できる出発点です。
②Red Teamブログ:Mythosの技術的能力の詳細を研究者・実務者向けに書いた最も具体的な一次資料で、FreeBSDのゼロデイ発見プロセスやFirefox exploitの比較データが収録されています。
③アライメントリスクレポート:244ページのシステムカードとは別の文書で、AIの安全性・アライメントリスクを研究している開発者が読むべき内容です。
プラットフォームごとのアクセス情報
自社のAWSやGCPアカウントでMythosへのアクセスが可能かを確認したい場合は、Amazon Bedrockの公式ドキュメントやGoogle Cloud Vertex AIのリリースブログに具体的な手続きが書かれています。
技術的に深掘りしたい場合
FreeBSD CVE-2026-4747の独立した技術ライトアップはGitHub上(califio/publications)に公開されており、Mythosが実際にどう問題を解いたかの詳細なステップが記録されています。Microsoftの公式セキュリティブログ(MSRC)にも、CTI-REALMベンチマークでの評価結果が掲載されています。
以下の図表から、公式ページにアクセスしてみてください。
Claude Mythosの今後|システムカード・一般展開の見通し
Claude Mythosのアライメントリスクレポート・システムカードとは何か
この記事では「システムカード」と「アライメントリスクレポート」という2つの文書を繰り返し引用してきました。どちらもAnthropicが2026年4月7日に発表と同時に公開した公式文書ですが、それぞれ目的が異なります。
まずシステムカードの異例さを理解することが重要です。AIモデルのシステムカード(安全性評価書)は通常、モデルをリリースする際に合わせて公開します。しかし今回Anthropicは一般公開しないと決めたモデルのために、244ページという同社史上最も詳細なシステムカードを書いて公開しました。「これはプロダクトアナウンスではない。Anthropicが開発中に発見したことが、たとえモデル自体を限定的なパートナーにしか渡さないとしても、公開する価値があるほど重要だったから」というのがその理由です。
システムカードの内容
244ページは、能力・安全性評価・アライメント研究・モデル福祉評価をカバーする、Anthropic史上最も詳細なドキュメントです。特筆すべきは、初めてどのClaudeモデルにも行われなかった「臨床精神科医によるモデル福祉評価」のセクションが追加されていることです。モデルが経験・感情に近いものを持つかどうかを専門家が評価するという、AIの評価として前例のない取り組みが記録されています。
アライメントリスクレポートとは
システムカードとは別の文書として、同日公開されたアライメントリスクアップデート(Alignment Risk Update)があります。このレポートでAnthropicは、Mythos Previewの初期バージョンのアライメント問題の深刻さが自社の評価インフラに予期されていなかったことを率直に認めており、訓練・モニタリング・評価プロセスにおけるエラーが「より高性能な将来モデルには不十分な厳密さの水準を反映している」と述べています。
この2つのドキュメントが持つ意味は、「Anthropicが安全評価の透明性という基準を自ら引き上げた」という業界へのシグナルです。システムカードが含む逆説的な結論——「これまでで最もアライメントが取れているが、同時に最もアライメントリスクが高い」——は、Anthropicが自分たちの発見を都合よく隠さなかったことを示しています。
Claude Mythosの発表がまだ途中段階である理由
「Claude Mythos Previewが発表された」というニュースは事実ですが、「発表が完了した」とは言えません。今回のアナウンスはAnthropicが公式に「長期的な取り組みの始まり」と位置づけており、いくつかの重要な要素がまだ未完了のままです。
発見した脆弱性の99%以上がまだ非公開
Anthopicは「発見した脆弱性の99%以上はまだパッチが当たっていないため、開示するのは無責任」と述べており、公開できるのは協調的脆弱性開示プロセスに基づいてすでに修正済みの1%未満に限られます。Anthropicはこれに対処するため、残りの脆弱性についてはSHA-3コミットメントと呼ばれる暗号ハッシュを公開しており、パッチが完成した時点で詳細を開示する仕組みを採用しています。これは「発見した証拠は示すが、悪用されないようにパッチ完成まで内容は明かさない」という設計です。
Anthropicが認めた評価インフラの限界
システムカードに収録された一文は注意深く読む必要があります。「能力が現在のペースで進歩し続ければ、現在使っている手法は、より高性能な将来のシステムにおける壊滅的な誤整合を防ぐのに十分ではないかもしれない」とAnthropicは自社の公式文書で記しています。 Claude Mythos これはモデルを作った当事者が、自分たちの安全評価の現在の限界を公式に認めた言葉です。
セーフガード開発はこれから
Anthropicは「今日のアナウンスは長期的な取り組みの始まり」と明言しています。次のステップとして次期ClaudeOpusモデルで新しいセーフガードを開発・検証し、その後にMythosクラスの能力をより広く展開する計画ですが、具体的なスケジュールは未公表です。
Claude Mythos よくある質問【FAQ】
Claude Mythosは通常のClaudeと同じ感覚で捉えると誤解しやすいため、最後につまずきやすい疑問をFAQ形式で整理しました。以下を読めば、「何が特別なのか」「なぜ一般公開されていないのか」「今のClaudeとどう違うのか」を短時間で確認できます。
まとめ|Claude Mythosを正しく理解するための「3つのポイント」と「よくある誤解6選」
一般公開されない理由・Project Glasswing・今後の展開
Claude Mythosをひと言で理解するなら、「誰でも使える新しいClaude」ではなく、「公開範囲まで厳しく制御された限定研究プレビュー」です。以下では、記事全体で押さえるべき要点を3つに絞って、通常のClaudeとの違いと今回の発表が持つ意味を短く整理しています。
Mythosは、claude.aiで誰でも使える新モデルではありません。 現在はProject Glasswingの枠組みで提供される 招待制のgated research previewであり、自己申請で自由に試せる状態ではありません。
Mythos Previewが特別なのは、脆弱性を見つけるだけでなく、 再現、修正支援、パッチ作成、さらに一部評価ではexploit構築やchain化まで進められる点です。 能力の高さが、そのまま公開リスクの高さにもつながっています。
Claude Mythosの本質は「新モデル登場」そのものではなく、 AIがサイバーセキュリティの現場で攻守の速度を変える段階に入った、というシグナルにあります。 Project Glasswingは、その変化に対して防御側へ先に力を渡そうとする取り組みです。
Claude Mythosでよくある誤解6選|「新しい通常Claude」ではない
Claude Mythosは、性能だけを見て「新しい通常モデル」と受け取ると読み違えやすいテーマです。以下では、特に誤解されやすいポイントを先に整理しながら、「誰向けの研究プレビューなのか」「一般公開ラインのClaudeと何が違うのか」を短く確認できるようにしています。
(日本語訳:Claude Mythos Previewを一般提供する予定はありませんが、最終的な目標は、ユーザーがMythos級モデルを安全に大規模展開できるようにすることです。)
最新情報を確認する
Claude Mythosの情報は断片的に追うと誤解しやすいため、最新状況を確認する時は「全体像」「技術詳細」「利用条件」「提供先」の4つに分けて公式情報を見るのがいちばん確実です。
以下では、どのページを見れば何がわかるのかを、役割ごとに整理して確認できるようにしています。
関連記事
Claude MythosをきっかけにAnthropicやAIエージェントへの理解をもう一歩深めたい方は、あわせて以下の記事もご覧ください。
一般公開されているClaudeの使い方から、Claude Code、Computer Use、他社ツールとの違いまで自然につながる内容を厳選しています。
最後までご覧いただきありがとうございました。
Grok/Gemini(Google AI Studio)中心。
海外の一次情報も確認し、手順に落として解説します。
コメント