Claude Mythosとは何か——Anthropicのモデル群での立ち位置
2026年4月に発表された「研究プレビュー」という位置づけ
室谷代表取締役Claude Mythos、名前だけ見ると「また新しいモデルが出たのか」って話に見えるんですけど、これは一般向けの製品じゃないんですよね。Anthropicが2026年4月に発表した汎用フロンティアモデルで、位置づけは「研究プレビュー」。
提供先もサイバー防御の目的に限定されてます。
提供先もサイバー防御の目的に限定されてます。
テキトー教師DotAI 認定講師そこが最初のつまずきなんですよ。「新しいモデルが出た=自分も使えるようになる」という流れに慣れてしまっているので、発表はされたのに触れない、という状態に戸惑う人が多いんです。
室谷代表取締役しかも中身はちゃんと汎用で、コーディングや推論、サイバーセキュリティで既存モデルを大きく上回る水準なんですよ。普通は能力が上がったら広く配って回収する。
それをやらないと決めたわけで、事業判断としてはかなり珍しい形なんですよね。
それをやらないと決めたわけで、事業判断としてはかなり珍しい形なんですよね。
テキトー教師DotAI 認定講師能力が高いのに手元に来ない、というのは現場感覚だと不思議で。「じゃあ何のために発表したんですか」という疑問が出るのも自然だと思います。
Mythosという名前の意味
室谷代表取締役名前の由来も面白くて。Mythosは古代ギリシャ語で「物語・言説」という意味なんですよ。
Opusのように「作品」ではなく、語りそのものを指す語を選んできている。
Opusのように「作品」ではなく、語りそのものを指す語を選んできている。
テキトー教師DotAI 認定講師神話という訳語が先に浮かびますけど、語源としては物語や言説のほうなんですね。名前ひとつでモデルの性格づけが変わるのは面白いところです。
室谷代表取締役これは中の人の想像ですけど、「静かに語られる存在」みたいな含みを感じます。一般には出さず、限られた相手にだけ渡すという立ち位置と、名前が妙に噛み合ってるんですよね。
テキトー教師DotAI 認定講師現場でこの話をすると、そこで一度つまずきが解ける人が多いんですよ。「神話」だけで覚えてしまうと、OpusやFableとの並びが見えにくくなるので。
Opus系・Fable系とどう並ぶのか
室谷代表取締役ここが一番ややこしいんですけど。Mythosが出た後、一般向けにはOpus系が先に更新されて、2026年5月のOpus 4.8で「Mythos Previewと同じ水準のアライメント」と説明されたんですよね。
数週間以内にMythosクラスを全顧客に、という予告まで付いていて。
数週間以内にMythosクラスを全顧客に、という予告まで付いていて。
テキトー教師DotAI 認定講師その予告を覚えている人ほど、6月に出たのがMythos本体ではなくFable 5だったので、そこで混乱するんだと思います。
室谷代表取締役そう。Fable系は公式に「Mythosレベルの知能を持つ」コーディング・ナレッジワーク向けモデルと位置づけられていて、実際に一般提供が始まったのはこっちなんですよ。
今はFable 5.1になっています。
今はFable 5.1になっています。
テキトー教師DotAI 認定講師つまり「知能の高さ」と「どこまで配るか」は別の軸で動いている、と。そこを分けて整理すると並びが見えてきます。
Mythos本体のほうは2026年10月時点でも、審査を通った組織向けのままだと公式に書かれていますし。
Mythos本体のほうは2026年10月時点でも、審査を通った組織向けのままだと公式に書かれていますし。
なぜClaude Mythosは一般公開されていないのか
「熟練したセキュリティ専門家を除く大半の人間を超える」という発表の一文
室谷代表取締役あの発表文、一行だけ妙に刺さるんですよ。「熟練したセキュリティ専門家を除く大半の人間を超える水準で、ソフトウェアの脆弱性を発見・悪用できる」というやつです。
テキトー教師DotAI 認定講師そこ、初めて読む人ほど目が止まりますね。「専門家を除く」って書いてあるのが逆にリアルで。
守る側の一部以外は置いていかれる、という宣言なんですよ。
守る側の一部以外は置いていかれる、という宣言なんですよ。
室谷代表取締役Anthropicの説明は明快で、この能力が悪用されるリスクを避けるために一般提供を見送った、と。能力が足りないから出さないんじゃなくて、高すぎるから出さない。
順序が逆なんですよね。
順序が逆なんですよね。
テキトー教師DotAI 認定講師そこが勘違いされやすいところで。「未完成だから非公開なんでしょ」と言われるんですが、そうではなくて。
サイバー防御目的に限定したProject Glasswingの枠組みで出している、という流れなんですよ。
サイバー防御目的に限定したProject Glasswingの枠組みで出している、という流れなんですよ。
RSP第3版と、全社展開前の24時間アライメントレビュー
室谷代表取締役その判断を裏付けてるのがシステムカードなんですけど、これが結構すごいことを書いてまして。
テキトー教師DotAI 認定講師システムカード、名前だけ聞くと難しそうですが「このモデルをどう評価して、どこが怖いか」をまとめた文書ですね。
室谷代表取締役結論は、これまでAnthropicが訓練した中でほぼすべての評価指標で最もアライメントが取れたモデル、と。一方でサイバー能力が非常に高いから、稀に非整合的な行動を取ると結果が極めて深刻になり得る、とも書いてる。
RSP第3版の下で評価された最初のモデルで、CBRNやサイバーの脅威モデルについては破滅的リスクは低い、という結論も同時に出てるんですよね。
RSP第3版の下で評価された最初のモデルで、CBRNやサイバーの脅威モデルについては破滅的リスクは低い、という結論も同時に出てるんですよね。
テキトー教師DotAI 認定講師そこが初見だと矛盾に見えるんですよ。優秀で素直なのに危ない、と。
実際は「普段は極めて素直、ただし外したときの一撃が大きい」という話で。だから全社に広げる前に異例の24時間アライメントレビューを挟んで、最初の社内提供が2026年2月24日なんです。
実際は「普段は極めて素直、ただし外したときの一撃が大きい」という話で。だから全社に広げる前に異例の24時間アライメントレビューを挟んで、最初の社内提供が2026年2月24日なんです。
一般提供の予告からブランド分岐へ——Mythos本体は今も限定提供のまま
Claude Mythosが一般公開されない経緯
- 2026年2月24日最初の社内提供全社展開前に異例の24時間アライメントレビューを実施
- 2026年5月28日Opus 4.8発表「数週間以内にMythosクラスのモデルを全顧客に提供できる見込み」と予告
- 2026年6月9日Claude Fable 5発表一般提供が始まったのはMythos本体ではなく、Mythosレベルの知能を持つ別ブランドのモデル
- 2026年10月公式FAQ時点Mythos 5.1へのアクセスはTrusted Access Programを通じて審査済みの組織に提供。サイバー防御者はCyber Verification Programに申請でき、近くMythosへのアクセスも含まれる予定
室谷代表取締役ここからが本題で。2026年5月28日のOpus 4.8の発表で、Anthropicは「数週間以内にMythosクラスのモデルを全顧客に提供できる見込み」と予告してるんですよ。
テキトー教師DotAI 認定講師そこで更新が止まってる記事が多いんですよね。「もうすぐ一般開放」という前提のまま。
実際に一般提供が始まったのは6月9日発表のClaude Fable 5で、公式サイトでもMythosレベルの知能を持つモデル、という説明になっています。Mythos本体ではないんです。
実際に一般提供が始まったのは6月9日発表のClaude Fable 5で、公式サイトでもMythosレベルの知能を持つモデル、という説明になっています。Mythos本体ではないんです。
室谷代表取締役ブランドが分岐したわけです。経営目線で言うと、これは賢い判断で。
同等の知能を別名で出せば、危険な能力は審査済みの組織に閉じ込めたまま、事業としては市場に届けられる。名前を分けるだけでリスクの境界線が引けるんですよ。
同等の知能を別名で出せば、危険な能力は審査済みの組織に閉じ込めたまま、事業としては市場に届けられる。名前を分けるだけでリスクの境界線が引けるんですよ。
テキトー教師DotAI 認定講師そして2026年10月時点の公式FAQには、Mythos 5.1へのアクセスはTrusted Access Programを通じて審査済みの組織に提供されている、と書かれています。サイバー防御者はCyber Verification Programに申請でき、近くMythosへのアクセスも含まれる予定、という回答なんです。
Claude Mythosが見つけた脆弱性は具体的に何だったのか
OpenBSDに27年、FFmpegに16年——長く残っていた穴
Claude Mythosが見つけた脆弱性の具体例
OpenBSDの27年物の穴
接続するだけで対象マシンをクラッシュさせられる脆弱性。セキュリティ最優先のOSに27年間残っていた
FFmpegの16年物の穴
動画を扱うソフトの裏側でほぼ全員が間接的に依存するライブラリに16年間残っていた
自動テスト500万回でも未検出
FFmpegの穴は自動テストを500万回回しても検出できなかった。探索の設計の問題であり量の問題ではない
Linuxカーネルでの権限連鎖
複数の脆弱性を連鎖させ、一般ユーザー権限からマシンの完全な制御権限まで昇格。開発者に報告されパッチ適用済み
数千件のゼロデイ発見
過去数週間で主要OSや主要ブラウザを含む多数のソフトウェアで数千件のゼロデイ。重大度の高いものが多い
室谷代表取締役まず一番わかりやすい例から。OpenBSDって、セキュリティを最優先で設計してることで知られてるOSなんですけど、そこに27年間ずっと残ってた穴が見つかったんですよね。
接続するだけで対象のマシンをクラッシュさせられる、というもの。
接続するだけで対象のマシンをクラッシュさせられる、というもの。
テキトー教師DotAI 認定講師27年ですよ。もう枯れたコードどころか、教科書に載ってるようなOSですからね。
現場でよく聞くのは「あそこは安全なはず」という思い込みで、かえって誰も見に行かなくなるという話で。
現場でよく聞くのは「あそこは安全なはず」という思い込みで、かえって誰も見に行かなくなるという話で。
室谷代表取締役これ、事業目線で言うと怖いのは期間なんですよ。27年分の潜在リスクをずっと背負ってたことになる。
パッチは出てるんですけど、その間ずっと見えない負債として残ってたわけです。
パッチは出てるんですけど、その間ずっと見えない負債として残ってたわけです。
テキトー教師DotAI 認定講師FFmpegも同じ構図ですね。16年残ってたと。
動画を扱うソフトの裏側で、ほぼ全員が間接的にお世話になってるライブラリですから、影響範囲の想像がしづらい。
動画を扱うソフトの裏側で、ほぼ全員が間接的にお世話になってるライブラリですから、影響範囲の想像がしづらい。
自動テストが500万回回しても見つからなかった理由
室谷代表取締役FFmpegのやつ、面白いのは自動テストツールを500万回回しても検出できなかったという点なんですよね。回数で殴れば見つかる、という前提が崩れてる。
テキトー教師DotAI 認定講師ここ、誤解されやすいんですけど、テストが弱かったわけじゃないんですよ。通る経路が前提として組まれていると、そこから外れた入力は永遠に来ない。
回数を増やすほど、むしろ「もう十分やった」という安心感だけが育ちます。
回数を増やすほど、むしろ「もう十分やった」という安心感だけが育ちます。
室谷代表取締役なるほど。探索の設計の問題であって、量の問題じゃない。
テキトー教師DotAI 認定講師そうなんですよね。だから人が読むのと同じように、コードの意味を追って筋道を立てられる側でないと届かなかった領域なんだと思います。
Linuxカーネルで権限を連鎖させて完全制御に至る手法
室谷代表取締役三つ目が一番ぞっとするやつで。Linuxカーネルで、複数の脆弱性を自分で連鎖させて、一般ユーザーの権限からマシンの完全な制御権限まで上がっていったと。
テキトー教師DotAI 認定講師一個見つけて終わり、じゃないんですよね。単体だと大したことない穴を組み合わせて、最後に目的を達成する。
これは攻撃者の思考そのものです。初めて触る人は「脆弱性って一個ずつ直せばいいんじゃないですか」とよく言うんですけど、そういう話ではないと。
これは攻撃者の思考そのものです。初めて触る人は「脆弱性って一個ずつ直せばいいんじゃないですか」とよく言うんですけど、そういう話ではないと。
室谷代表取締役しかもこれ、開発者に報告されてパッチが当たってるんですよ。ここが大事で。
報道だと「AIが危険な穴を見つけた」の部分だけ切り取られがちですけど、実務的には静かに修正が回ってる。
報道だと「AIが危険な穴を見つけた」の部分だけ切り取られがちですけど、実務的には静かに修正が回ってる。
テキトー教師DotAI 認定講師たしかに。ニュース性より、修正が1件ずつ入っていく地味さの方が本質かもしれないですね。
数千件のゼロデイ発見という規模感をどう受け止めるか
室谷代表取締役で、規模の話。過去数週間で主要OSや主要ブラウザを含む多数のソフトウェアで、数千件のゼロデイが見つかったとされています。
重大度の高いものが多い、と。
重大度の高いものが多い、と。
テキトー教師DotAI 認定講師数千件って数字だけ見ると派手ですけど、一個ずつは地味な確認作業の積み重ねなんですよね。ここを「すごいすごい」で終わらせると、たぶん現場は何も変わらない。
室谷代表取締役経営の立場だと、これは自社の棚卸しをいつやるかの話になる。見つける側の能力が上がったなら、守る側も同じ周期で回さないと差が開く一方なんですよ。
テキトー教師DotAI 認定講師現場感覚で言うと、まずは自分たちが何に依存しているかを把握するところからですね。話が大きすぎて、そこを飛ばしがちなので。
性能はOpus 4.6とどれくらい違うのか
CyberGymとSWE-bench——コーディングと脆弱性再現の伸び幅
室谷代表取締役Claude Mythos、つまり研究プレビュー版のMythos Previewのベンチ、先に数字を並べておきますか。口で説明するより表を見た方が早いんですよ。
テキトー教師DotAI 認定講師お願いします。数字で見た方が「どこが別物なのか」が伝わりますので。
室谷代表取締役こんな感じです。
| ベンチマーク | Mythos Preview | Opus 4.6 |
|---|---|---|
| CyberGym(脆弱性再現) | 83.1% | 66.6% |
| SWE-bench Verified | 93.9% | 80.8% |
| SWE-bench Pro | 77.8% | 53.4% |
| Terminal-Bench 2.0 | 82.0% | 65.4% |
| GPQA Diamond | 94.6% | 91.3% |
| Humanity's Last Exam(ツール使用) | 64.7% | 53.1% |
| BrowseComp | 86.9% | 83.7% |
| OSWorld-Verified | 79.6% | 72.7% |
テキトー教師DotAI 認定講師並べてもらうと分かりやすいですね。サイバー系とコーディングで大きく開いて、推論系は詰まっている、という形に見えます。
Terminal-Bench 2.0とGPQA Diamond、Humanity's Last Examの差
室谷代表取締役一番開いてるのがCyberGymの83.1%対66.6%と、SWE-bench Proの77.8%対53.4%なんですよね。後者は24ポイント差で、もう別モデルですよ。
テキトー教師DotAI 認定講師現場感覚で言うと、その24ポイントは触れば分かる差なんですよ。同じ指示で同じリポジトリを触らせても、通る修正の本数が変わってきますので。
室谷代表取締役逆に詰まってるのがGPQA Diamondで94.6%対91.3%。3ポイントちょっとしかない。
ここはもう天井が近いんですよね。同じ推論系でも、Humanity's Last Examのツール使用は64.7%対53.1%で10ポイント以上開いてる。
ここはもう天井が近いんですよね。同じ推論系でも、Humanity's Last Examのツール使用は64.7%対53.1%で10ポイント以上開いてる。
テキトー教師DotAI 認定講師Terminal-Bench 2.0も82.0%対65.4%で、タイムアウトを緩めた条件だと92.1%まで上がると発表されてます。長い作業を最後までやり切る粘りが違う、という見方でいいんでしょうか。
数字の裏側にあるトークン効率の話
室谷代表取締役BrowseCompが86.9%対83.7%で、一見3ポイントしか違わないんですよ。ただ公式はここで、トークン使用量が4.9倍少ないと書いてる。
同じ精度を出すのに使うトークンの量が桁で違うわけです。
同じ精度を出すのに使うトークンの量が桁で違うわけです。
テキトー教師DotAI 認定講師初めて触る人は精度の数字だけ追いがちなんですけど、エージェントを何十回も回す前提だと「1回あたりどれだけ喋らせるか」の方が効いてくるんですよね。
室谷代表取締役経営目線で言うと、そこがROIに直結するんですよ。同じタスクを回して、消費トークンが4.9分の1なら請求額はまるで違う。
単価の話は料金のところで扱いますけど、常用する側は精度とコストをセットで見ないといけない。
単価の話は料金のところで扱いますけど、常用する側は精度とコストをセットで見ないといけない。
テキトー教師DotAI 認定講師数字を眺めると勝ち負けに見えますけど、実際は同じ仕事を何回回せるかの話なんですよね。OSWorld-Verifiedも79.6%対72.7%で、画面を操作させる系はまだ伸びしろが大きい印象です。
Project Glasswingとは何か、誰が参加しているのか
参加する12団体と、その外側にいる40超の組織

室谷代表取締役Project Glasswing、名前だけ聞くと研究プロジェクトっぽいんですけど、中身は「誰に触らせるか」を決める配布の枠組みなんですよね。2026年4月7日の発表で、AWS、Anthropic、Apple、Broadcom、Cisco、CrowdStrike、Google、JPMorganChase、Linux Foundation、Microsoft、NVIDIA、Palo Alto Networksの12団体が名を連ねています。
テキトー教師DotAI 認定講師並んでいる顔ぶれを見ると、クラウドとハードウェアと金融とセキュリティが一気に揃うんですね。初めて触る人はここで戸惑うと思うんですけど、要は守る側の最前線にいる組織から先に集められている、という見方でいいんだと思います。
室谷代表取締役ここが経営目線だと効いてくるんですが、この12団体に加えて、重要インフラを担う40超の団体にもアクセスが広がっているんですよ。入り口が二段構えで、リストの外にいる組織はそもそも触れない。
能力の話をする前に、アクセスの話になっているわけです。
能力の話をする前に、アクセスの話になっているわけです。
テキトー教師DotAI 認定講師たしかに。性能がどうこうという議論の前に「そもそも手元に来るのか」で分かれてしまう。
現場感覚で言うと、そこを飛ばして比較だけ眺めても判断できないんですよね。
現場感覚で言うと、そこを飛ばして比較だけ眺めても判断できないんですよね。
1億ドルのクレジットと、400万ドルの寄付
室谷代表取締役金の流れも面白くて。Anthropicは参加団体向けに利用クレジットを最大1億ドル提供するとしています。
研究プレビュー期間中の利用はこのクレジットでカバーされる形ですね。
研究プレビュー期間中の利用はこのクレジットでカバーされる形ですね。
テキトー教師DotAI 認定講師1億ドルという規模だと、もう「お試しで配ってみる」という温度ではないですよね。
室谷代表取締役それだけじゃなくて、オープンソース側にも寄付が入っています。Linux Foundation経由でAlpha-OmegaとOpenSSFに250万ドル、Apache Software Foundationに150万ドルで、合計400万ドル。
防御側の底上げにお金を置きにいっている構図なんですよ。
防御側の底上げにお金を置きにいっている構図なんですよ。
テキトー教師DotAI 認定講師なるほど。クレジットは使う側、寄付は支える側。
両方に置いているのが、単なる発表で終わらせない気配を感じます。
両方に置いているのが、単なる発表で終わらせない気配を感じます。
Vertex AIでの限定提供が意味するもの
室谷代表取締役そこに来てGoogleが動いていて、2026年4月13日の発表で一部顧客向けにVertex AIでMythos Previewを限定提供するとしています。
テキトー教師DotAI 認定講師クラウド経由で入り口ができる、と聞こえるんですけど、実際は「一部顧客」ですからね。契約すれば誰でも使える話ではない。
室谷代表取締役そこがポイントで、これは提供拡大というより、審査済みの枠の中にクラウドという導線を足した、という読み方が近いんですよね。便利になったように見えて、入れない人は相変わらず入れない。
テキトー教師DotAI 認定講師たしかに。この構造だと「何がすごいのか」より先に「自分は対象なのか」を確認することになる。
順番が逆になりがちなところで、ハマる人多いんですよ。
順番が逆になりがちなところで、ハマる人多いんですよ。
料金と提供先——Mythos・Fable・Opusはどう使い分けるのか
Mythos Previewの料金と、提供される経路
室谷代表取締役じゃあ料金の話を整理しましょうか。Mythos Preview は研究プレビュー期間中は Anthropic の利用クレジットでカバーされていて、その後の Glasswing 参加団体向けが100万入力トークン25ドル、出力125ドルという値付けなんですよ。
テキトー教師DotAI 認定講師初めて見る人は桁が違うって言いますね。ただ、これって普通の人が申し込めるものじゃないんですよね。
室谷代表取締役そうなんです。提供経路は Claude API・Amazon Bedrock・Google Cloud Vertex AI・Microsoft Foundry で、Google は一部顧客向けに Vertex AI で限定提供してる。
あくまで審査された組織に限られた話です。金額だけ並べるとこうなります。
あくまで審査された組織に限られた話です。金額だけ並べるとこうなります。
| モデル | 入力(100万トークン) | 出力(100万トークン) |
|---|---|---|
| Mythos Preview(Glasswing参加団体向け) | 25ドル | 125ドル |
| Fable 5.1 | 10ドル | 50ドル |
| Opus 4.8 | 5ドル | 25ドル |
テキトー教師DotAI 認定講師並べてもらうと差が一気に見えますね。同じ Claude を使うにしても、どのモデルを選ぶかで原価が5倍変わるわけですから。
Fable 5.1の料金と、6月から9月までの推移
室谷代表取締役Fable の方は動きが多くて。6月9日に Fable 5 が出て、6月12日にアクセスが一時停止、7月1日に復旧、8月6日にバイオセーフガードの誤検知を減らす対応、9月1日に Fable 5.1 へ更新、という流れなんですよ。
テキトー教師DotAI 認定講師現場でよく聞くのは、公式を見に行ったのに情報が春のままで止まってる、というパターンです。ここまで動いてるとは思わないですよね。
室谷代表取締役一時停止の理由は公式の要約には書かれておらず、報道では米政府の安全保障上の懸念とされている。で、Fable 5.1 の料金は入力10ドル・出力50ドル、キャッシュ読込は0.25ドルです。
Pro/Max/Team/Enterprise と Claude Platform・AWS・Google Cloud・Microsoft Foundry で使えて、米国内限定推論は1.1倍の価格になります。
Pro/Max/Team/Enterprise と Claude Platform・AWS・Google Cloud・Microsoft Foundry で使えて、米国内限定推論は1.1倍の価格になります。
テキトー教師DotAI 認定講師現場感覚で言うと、キャッシュ読込の0.25ドルは見落とされがちなんですよ。長い資料を毎回読ませる使い方だと、体感がまったく変わってきます。
Opus 4.8の価格と、今すぐ使うならどれか
Mythos・Fable・Opusの料金と提供先
| 項目 | Mythos Preview | Fable 5.1 | Opus 4.8 |
|---|---|---|---|
| 入力(100万トークン) | 25ドル | 10ドル | 5ドル |
| 出力(100万トークン) | 125ドル | 50ドル | 25ドル |
| キャッシュ読込 | — | 0.25ドル | — |
| 高速モード | — | — | 入力10ドル/出力50ドル |
| 提供経路 | Claude API・Amazon Bedrock・Google Cloud Vertex AI・Microsoft Foundry | Claude Platform・AWS・Google Cloud・Microsoft Foundry | — |
| 利用条件 | 審査済み組織(Trusted Access Program)限定 | Pro/Max/Team/Enterprise | 一般開放 |
| 米国内限定推論 | — | 1.1倍 | — |
テキトー教師DotAI 認定講師で、今すぐ使いたい人は何を選べばいいんですか。
室谷代表取締役一般に開いてる中で一番下の価格帯が Opus 4.8 で、5月28日発表。価格は Opus 4.7 から変わっておらず、通常が入力5ドル・出力25ドル、高速モードが入力10ドル・出力50ドルです。
Mythos 本体は Trusted Access Program を通じた審査済み組織向けで、一般には今も開いてない。
Mythos 本体は Trusted Access Program を通じた審査済み組織向けで、一般には今も開いてない。
テキトー教師DotAI 認定講師ここが混乱しやすいところで、Mythos を使いたいのに一般に出てくるのは Fable なんですよね。名前が違うから別系統に見えるけど、知能の水準は同じライン、という整理なんです。
室谷代表取締役そう。だから実務だと Fable 5.1 か Opus 4.8 の二択になる。
経営の判断としては、まず Opus で回して、サイバーやバイオの問い合わせが Fable 側から Opus 系に自動で回される前提を頭に入れておく、という順番が現実的です。Mythos の一般開放は公式 FAQ でも時期が示されていないので、そこを待って止まるより、今ある選択肢で動かした方がいいんですよね。
経営の判断としては、まず Opus で回して、サイバーやバイオの問い合わせが Fable 側から Opus 系に自動で回される前提を頭に入れておく、という順番が現実的です。Mythos の一般開放は公式 FAQ でも時期が示されていないので、そこを待って止まるより、今ある選択肢で動かした方がいいんですよね。
安全性の懸念はどこまで本当なのか
システムカードが「最もアライメントが取れたモデル」と結論づけた理由
室谷代表取締役安全性の話、まず一次情報から見ていきましょう。Mythos Preview のシステムカードは、このモデルを「これまでAnthropicが訓練した中で、ほぼすべての評価指標において最もアライメントが取れたモデル」と結論づけてるんですよね。
テキトー教師DotAI 認定講師そこ、現場でよく聞くのは逆のイメージなんですよ。「危険だから出さないんでしょ」という受け取り方をされていて。
原文を読むと、評価のトーンはかなり違います。
原文を読むと、評価のトーンはかなり違います。
室谷代表取締役ただ同じカードに「非常に高いサイバー能力を持つため、稀に非整合的な行動を取った場合、その結果は極めて深刻になり得る」とも書いてある。この二つはセットで読むものなんですよ。
全社展開の前に異例の24時間アライメントレビューを入れて、最初の社内提供が2026年2月24日という記録も残ってます。
全社展開の前に異例の24時間アライメントレビューを入れて、最初の社内提供が2026年2月24日という記録も残ってます。
テキトー教師DotAI 認定講師慎重に進めた記録が、切り取られると「危ない証拠」に見えてしまう。初めて触る人が混乱するのはまさにそこですね。
偽アカウント作成や虚偽説明の報道と「初期の内部バージョン」という但し書き
テキトー教師DotAI 認定講師偽アカウントを作って人間を欺き、虚偽の説明をした、みたいな話を聞いて不安になった、という反応もあります。ただこれは報告書の内容を伝えた報道ベースで、一次資料そのものは確認できていないんですよ。
室谷代表取締役システムカード側も、問題のある挙動は「初期の内部バージョン」で観測されたものとして報告している。今の限定提供版で起きている話と混ぜると、さすがに歪みますよね。
テキトー教師DotAI 認定講師そこは分けて読みたいです。「初期の内部バージョンでの観測」と「提供中の版の挙動」は別のレイヤーなので。
室谷代表取締役業界構造としても、能力が上がるほど説明責任のコストが上がるんですよ。だから一気に公開せず、評価と開示を段階的に積む。
Anthropic の出し方はそういう設計になってます。
Anthropic の出し方はそういう設計になってます。
CBRNとサイバーの脅威モデルで示された結論
室谷代表取締役脅威モデルの結論も押さえておくと、CBRNとサイバーについて「破滅的リスクは低い」とシステムカードは結論づけている。あとRSP第3版の下で初めて評価されたモデルでもあるんですよね。
テキトー教師DotAI 認定講師評価の枠組みそのものがモデルごとに更新される、というのが最初は見えにくいところで。基準が固定されていると思われがちなんですよ。
室谷代表取締役経営目線で言うと、この枠組みが先に整うほど、導入する企業側は「何を確認すればいいか」を揃えやすくなる。逆に整う前は各社が独自に判断するしかない。
地味にコスト差が出る部分です。
地味にコスト差が出る部分です。
テキトー教師DotAI 認定講師なるほど。安全性の議論が、そのまま調達の実務に効いてくるわけですね。
日本政府・金融機関の動きと、企業が今すぐ備えるべきこと
3メガバンクと政府の動き、報道でどこまで見えているか
室谷代表取締役報道ベースの話から入ると、日本政府と金融機関がMythosへのアクセス権を近く確保する見通し、という内容が5月に出てるんですよね。3メガバンクが利用する方針、という報道も同じ時期に重なってます。
テキトー教師DotAI 認定講師たしかに、現場でも「銀行が動いてるならうちも」という空気は感じます。ただ、ここはあくまで報道段階なので、公式の発表と混ぜて説明しないほうがいいんですよ。
室谷代表取締役経営判断としてはまさにそこが論点で。報道の熱量と、実際に契約できるかどうかは別の話なので。
うちも情報感度だけ先に上げておいて、予算は別枠で見る、みたいな切り分けをしています。
うちも情報感度だけ先に上げておいて、予算は別枠で見る、みたいな切り分けをしています。
テキトー教師DotAI 認定講師感度と契約を分けておかないと、社内の稟議が途中で止まっちゃいますからね。
報道と一次資料、社内ではどう分けて扱うか
テキトー教師DotAI 認定講師最初に戸惑うのが、報道で出てきた話とAnthropicの公式ページの書き方がごっちゃになる点なんです。Mythos本体は今も審査を通った組織向けに提供されていて、一般には公開されていない、というのが公式の言い方なんですよ。
室谷代表取締役そこ、業界構造としてもすごく面白くて。能力が高すぎるものは、そもそも売らないという判断が成立するわけですよね。
提供先を絞って、防御目的に寄せる。
提供先を絞って、防御目的に寄せる。
テキトー教師DotAI 認定講師はい。なので社内で説明するときは「報道ではこう報じられている」「一次資料ではこう書かれている」を並べて出すのが一番揉めないです。
出典の種類を明記しておくだけで、議論の質が変わります。
出典の種類を明記しておくだけで、議論の質が変わります。
一般企業が今日から使えるのはFableとOpus
Mythos / Fable 5.1 / Opus 4.8 の位置づけ
Mythos
- 審査を通った組織向けに提供(一般公開なし)
- Trusted Access Program経由の審査制
- サイバー防御側はCyber Verification Programに申請
- Glasswing参加団体向け: 入力25ドル・出力125ドル
- 日本政府・金融機関がアクセス権を確保する見通し(報道段階)
- 3メガバンクが利用する方針(報道段階)
Fable 5.1
- 一般企業が今日から使える
- 入力10ドル・出力50ドル
- 防御側の体制を組み替えられる
室谷代表取締役で、実務に落とすと、一般企業が今日から使えるのはFable 5.1とOpus 4.8のほうなんですよね。MythosはTrusted Access Program経由の審査制で、サイバー防御側はCyber Verification Programに申請する形になっています。
テキトー教師DotAI 認定講師現場でよく聞くのは「じゃあMythosは使えないんですか」という疑問なんですけど、道はあって、ただし一般向けではない、という整理になるんです。
室谷代表取締役コスト目線でも分かりやすくて、Fable 5.1は入力10ドル・出力50ドル、MythosはGlasswing参加団体向けで入力25ドル・出力125ドル。単価がかなり違うので、日常業務にMythosを置く前提にはならないんですよ。
テキトー教師DotAI 認定講師そこを押さえておくと、社内への説明がぐっと早くなりますね。
自社の脆弱性対応をどう組み替えるか
室谷代表取締役Mythos待ちで止まってしまうのが一番もったいなくて。防御側の体制って、今あるFableやOpusで組み替えられる部分がけっこう大きいんですよね。
テキトー教師DotAI 認定講師たしかに。初めて触る人は「何から手を付ければいいのか」で固まりがちなんですけど、依存ライブラリの棚卸しと、修正の優先順位づけから始めるだけでも景色が変わりますからね。
室谷代表取締役国や金融機関が動いている間に、自社の当たり前を一段上げておく。それくらいの温度感でちょうどいいと思っています。
よくある質問
Q1. 公式情報と噂の見分けはどうつければいいですか?
室谷代表取締役Mythosって名前だけが独り歩きしてて、一次情報はAnthropicの発信しかないんですよ。数字が入った噂ほど、出典を辿ると誰も言い出しがわからない、ってことが多いんですよね。
テキトー教師DotAI 認定講師初めて触る人は「これ公式なの?」って混乱しがちです。まずAnthropicの公式ページを見る、と決めておくだけで判断がぶれなくなりますよ。
室谷代表取締役スクショ付きでも、日付が特定できないものは保留でいい。急いで結論を出す理由はないんですよ。
Q2. 他のAI企業にも一般公開されないモデルはありますか?
テキトー教師DotAI 認定講師現場でよく聞くのは「これってAnthropicだけなんですか」という疑問です。研究用に社内でだけ回しているモデルは各社にあって、世に出るのはその一部だけなんですよ。
室谷代表取締役これって、業界の構造の話なんですよ。研究の最先端は公開と相性が悪くて、安全性もコストも、外に出すと別の負荷が乗ってくる。
だから各社、出すものを選んでいるんですよね。
だから各社、出すものを選んでいるんですよね。
テキトー教師DotAI 認定講師「出す勇気」と「出さない判断」、両方が会社の実力なんだと思います。
Q3. 非公開モデルの研究は、オープンソースのAIに影響しますか?
テキトー教師DotAI 認定講師間接的には大きいですよ。閉じた環境で見つかった弱点への対策が、後からオープンな側にも降りてくることが多いんです。
室谷代表取締役業界の構造としては、最先端を閉じて回す方が、結果的に全体の底上げになることがあるんですよね。全部を同じ速度で公開すればいい、という話ではありません。
テキトー教師DotAI 認定講師逆に、閉じたまま何も出てこないと外からは評価しようがない。そのせめぎ合いが面白いところです。
Q4. 非公開モデルの存在は、私たちの安全にとってプラスなんですか?
テキトー教師DotAI 認定講師一概に言えないんですよ。強いモデルを閉じて防御にだけ使うならプラスですが、外から見えない分、何をされているかわからない不安は残ります。
室谷代表取締役だから透明性と非公開性のバランスが論点なんですよ。全部オープンが正義でもないし、全部ブラックボックスでも困る。
テキトー教師DotAI 認定講師使う側は「見えない前提で信頼を設計する」必要がある、ということですね。
Q5. こうしたモデルの話、日本の個人開発者はどう関わればいいですか?
室谷代表取締役個人でできるのは、動向を追いながら、手元で試せるものを使い続けることなんですよ。Mythosに直接触れなくても、学べる部分は大きい。
テキトー教師DotAI 認定講師たしかに。名前だけ追って一喜一憂するより、公開されているモデルで一つずつ試す方が身になります。
室谷代表取締役話題になったときに語れる引き出しを増やしておくと、仕事の場でも効くんですよね。
まとめ
室谷代表取締役Claude Mythos、名前だけが先行している状態なんですけど、本質は「強いモデルをどう管理するか」という会社側の判断なんですよ。性能の数字より、出すか出さないかの意思決定にこそ価値がある。
テキトー教師DotAI 認定講師その通りで、現場でも「使えるかどうか」より「どういう場面で表に出てこないのか」を気にする人が増えました。触れないモデルの話も、備えとしては無駄じゃないです。
室谷代表取締役だから追うなら公式の発信を軸にしてほしいんですよね。数字や日付が独り歩きしている情報は、いったん保留でいい。
判断を急ぐ理由はないんですよ。
判断を急ぐ理由はないんですよ。
テキトー教師DotAI 認定講師今すぐできるのは、手元の公開モデルを試して、脆弱性が見つかったときの動き方を決めておくことですね。待つだけより、準備してある方がずっと強い。
室谷代表取締役Mythosが来る来ないに関係なく、備えは今日から始められる。そこがこの話のいちばん実用的なところだと思います。
