AI・生成AI Anthropicの新型「Claude Fable 5.1」「Mythos 5.1」、価格据え置きで中身はどこまで伸びたのか。性能と安全策を確かめる コーディング系ベンチマークで前モデルを大きく上回りつつ、料金は据え置き。誤検知を6割減らしたという安全策の中身まで確かめた
30秒で分かる結論
AI開発企業のAnthropicは2026年9月1日(現地時間)、「Claude」シリーズの新版「Claude Fable 5.1」と「Claude Mythos 5.1」を公開しました。両モデルは中身が同じ大規模言語モデル で、安全対策(セーフガード)の強度だけが異なります。Fable 5.1は誰でも使える一般提供版、Mythos 5.1はサイバーセキュリティや生命科学分野の防御目的に限定した「信頼できる利用者向けプログラム」経由でのみ提供されます。料金は前バージョンの「Claude Fable 5」から据え置きで、入力100万トークンあたり10ドル・出力100万トークンあたり50ドルです。一方でキャッシュ読み込みの料金は1トークンあたり従来比75%引き下げられ、コーディング関連のベンチマークでは前バージョンを大きく上回るスコアを記録しています。あわせて、サイバーセキュリティや生物学分野に関する安全対策の誤検知(無害な質問をブロックしてしまう現象)が大幅に減ったとされています。
まず初めに
また新しいClaudeが出た。もはや「またか」という声が聞こえてきそうだが、今回の主役は数字ではなく空気を読む力だ。これまでのAnthropicのAI安全対策は、正直かなりの過保護気味だった。サイバー防御の専門家が自分のシステムを守るために質問しただけで弾かれる、なんて笑えない話も珍しくなかった。今回はその誤検知を大きく減らしたという触れ込みで、値段はそのまま、性能は上積み。企業のリリースとしては模範解答のような内容だが、「誤検知が減った」という主張を鵜呑みにできるかどうかは、また別の話だ。※個人の感想です
生成AIによるイメージ。実物や実際の画面ではありません。
何が起きているのか
Anthropicは2026年9月1日、Claudeシリーズの最新モデル「Claude Fable 5.1」と「Claude Mythos 5.1」を発表しました。両モデルは同一の基盤モデルで、違いは安全対策(セーフガード)の適用レベルのみです。Fable 5.1はAPIおよびAmazon Web Services(AWS)・Google Cloud・Microsoft Azureを通じて一般提供されます。Mythos 5.1は、サイバー防御や生命科学分野の研究といった防御目的の利用を想定した「信頼できる利用者向けプログラム」を通じてのみ提供され、一般提供はされません。両モデルとも最大100万トークンのコンテキストウィンドウこんてきすとうぃんどう (AIが一度に読み込める文章量の上限)に対応しています。
料金は、前バージョンの「Claude Fable 5」から据え置きで、入力100万トークンあたり10ドル・出力100万トークンあたり50ドルです。一方でキャッシュ機能の料金は引き下げられ、キャッシュ読み込みは1トークンあたり0.25ドルとなり、前バージョンの1ドルから75%引き下げられました。Anthropicは、こうした変更により、通常の利用では約25%、複雑なコーディングや自律的な作業(エージェント的な使い方)では最大約45%のコスト削減が見込めるとしています。
「安く強く」は宣伝文句の定番だが、今回は少なくとも入出力の基本料金は据え置きなので、値上げより値下げ寄りの発表ではある。
なぜ重要なのか
性能面では、コーディング関連のベンチマークで大きな伸びが報告されています。自律的にコーディング作業を行う能力を測る「Terminal-Bench 4.0」では、Fable 5.1が55.8%、Mythos 5.1が60.9%を記録し、前バージョンのFable 5(42.0%)や競合のGPT-5.6 Sol(37.3%)を上回ったとされています。コード生成能力を測る「LiveCodeBench」では首位の90.52%、別のベンチマーク「Terminal-Bench 2.1」では2位の85.02%(Fable 5の80.52%から上昇)を記録したと報告されています。
もう一つの焦点が、安全対策の誤検知の減少です。Anthropicによると、サイバーセキュリティ分野の安全対策は、従来より誤検知(悪意のない質問を誤ってブロックしてしまう現象)が60%減ったとされています。生物学・医学分野に関する質問でも、無害な内容を誤ってブロックする頻度が85%減ったと説明されています。あわせて、Fable 5.1はソフトウェアの脆弱性を発見する用途には使えるようになった一方、発見した脆弱性を悪用する攻撃コード(エクスプロイト)の開発には使えない設計になっているとされています。
私たちへの影響
生成AIによるイメージ。実物や実際の画面ではありません。
一般の利用者が直接Fable 5.1やMythos 5.1に触れる機会は、企業向けサービスの裏側で使われている場合を除けば限定的です。ただし、ClaudeのAPIを使って開発している国内の中小事業者やエンジニアにとっては、キャッシュ読み込み料金が75%下がったことは、開発・運用コストに直接影響する変更です。特に、同じ文脈を繰り返し読み込む長時間のコーディング作業や、資料を読み込みながら回答する用途では、キャッシュを多用するため恩恵を受けやすいとされています。
セキュリティ専門家にとっては、誤検知の減少とMythos 5.1の限定提供という組み合わせが意味を持ちます。従来の安全対策は、正規のセキュリティ担当者による質問まで弾いてしまうケースがあったとされており、これが緩和されれば、防御側の作業効率が上がる可能性があります。一方で、脆弱性の発見機能自体が悪用されるリスクをどこまで抑えられているかは、今回の発表だけでは第三者による検証結果が示されていません。
初心者が知っておくべきこと
「Mythos-class(ミトス級)」とは、Anthropicが自社のAIモデルの中でも、サイバー攻撃を大幅に容易にしうる高い能力を持つと判断したモデルに使う社内区分です。この区分に該当するモデルは、悪用を防ぐための追加の安全対策(セーフガード)を組み込んだ状態で一般提供され、対策を外した性能を持つ版は、限られた利用者にしか提供されない、という運用が今回も踏襲されています。
「エージェント的な使い方(エージェンティックタスク)」とは、AIが単発の質問応答にとどまらず、複数の手順を自分で計画・実行しながら一つの作業をやり遂げる使い方を指します。今回発表された「Terminal-Bench」のようなベンチマークは、こうした一連の作業をAIがどれだけ自律的にこなせるかを測るものです。
よくある質問
Q. Fable 5.1とMythos 5.1は、どちらが「強い」AIなのですか?
A. 基盤となるモデルは同じです。違いは安全対策の強度で、Mythos 5.1は対策が緩められている分、サイバーセキュリティ関連のタスクをより幅広くこなせるとされていますが、一般提供はされていません。
Q. 個人でも使えますか?
A. Fable 5.1はAnthropicのAPIやAWS・Google Cloud・Microsoft Azure経由で利用できます。ただし料金は従量課金制のため、無料で試せるサービスではありません。
IT Postの見方
IT Postでは、今回の発表で最も注目すべきは性能の伸びよりも「誤検知を6割減らした」という主張だと考えます。AIの安全対策は、厳しくすればするほど正規の利用者まで巻き添えにする副作用がつきものです。サイバー防御の担当者が、自分の会社を守るための質問をしただけでブロックされていたのでは、本末転倒もいいところです。その意味で、対策の的中率を上げる方向への改善は、素直に歓迎したい話です。
とはいえ、これはあくまでAnthropic自身の発表であり、誤検知がどれだけ減ったか、悪用のリスクがどれだけ抑えられているかは、今のところ第三者による独立した検証結果を伴っていません。「脆弱性は発見できるが攻撃コードは作れない」という線引きも、実際にどこまで厳密に機能するのかは、外部の研究者による突破の試みを経てはじめて信頼できる話になります。値段が下がって性能が上がったこと自体は素直に良いニュースだが、安全策の効き目についてはもう少し様子見が必要、というのがIT Postの立場です。※個人の感想です
今後どうなりそうか
Anthropicは、Mythos 5.1へのアクセスを引き続き「信頼できる利用者向けプログラム」経由に限定する方針を継続するとしています。IT Postでは、今回の安全対策の効果について外部の研究者やセキュリティ機関による検証結果が公表され次第、あらためて取り上げます。