Anthropic が Claude Fable 5 をリリース: 安全ガードレールを備えた初の Mythos クラス ユニバーサル モデル
Anthropic は、Mythos クラス モデルの Claude Fable 5 (安全ガードレール付きのユニバーサル バージョン) と Mythos 5 (サイバー防御の制限なしバージョン) をリリースします。価格は 100 万トークンあたり 10 ドル、50 ドルで、Stripe は 2 か月分の作業を 1 日で完了でき、Evozyne の医薬品設計は 10 倍スピードアップします。
Anthropic は、これまでで最も強力なクロード モデルを正式にリリースします。クロード フェイブル 5 は、一般ユーザーに公開された最初の Mythos レベルのモデル (安全ガードレール付き) です。ソフトウェア エンジニアリング、ナレッジ ワーク、ビジョン、科学研究などの分野のほぼすべてのテスト ベンチマークで SOTA に到達します。タスクが複雑で時間がかかるほど、リードはより明白になります。 Claude Mythos 5 はセキュリティ ガードレールのないバージョンであり、Project Glasswing を通じてサイバー防御組織のみが利用できます。セキュリティ分類器のアップグレード版も同時に発売され、公式テストによれば、危険媒介の 95% が除去されました。価格は 100 万トークンあたり 10 ドルまたは 50 ドルです。
!【Fable 5と競合機種ベンチマーク比較表】(https://res.aistarmap.com/uploads/images/news/temp/md_6a7066f783849/images/fable-5-benchmark.png)
オンライン評価 (チャットボット アリーナ): Fable 5 は、2 位 70 ELO を上回り、すべてのカテゴリで 1 位にランクされています。これは GPT-5.4 から GPT-5.5 までの差に相当します。勝率は86%と高く、引き分け・試合勝率は96%となっている。プログラミング能力ELOは1794に達し、コーディングスタイルタスクスコアは96.8。
価格: 入力 $10/100 万トークン、出力 $50/100 万トークン。
安全ガードレールの設計
Mythos レベルのモデルの機能にはリスクが伴います。サイバーセキュリティなどの分野における Fable 5 の機能は、悪意のある目的に悪用される可能性があります。したがって、Anthropic は Fable 5 にガード分類子 (Guard Classifier) を導入し、特定のカテゴリのクエリは Claude Opus 4.8 によって処理されます。これらの安全ガードレールは控えめに調整されており、平均してセッションの 5% 未満でトリガーされます。
アップグレードされたセキュリティ分類子
!【Fable 5安全性分類器評価結果表】(https://res.aistarmap.com/uploads/images/news/temp/md_6a7066f783849/images/fable-5-safety-classifiers.png)
新しい分類子は、無害なプロンプトの 92% 以上の合格率を維持しながら、公式テスト データ内の有害なベクトルの 95% を除去できます。これは、以前のレベルの 60% から大幅に改善されています。 AI Security Institute (AISI) は、十分に堅牢であると独自に評価しました。
Mythos 5 + プロジェクト Glasswing
Mythos 5 は Fable 5 と同じアンダーレイですが、セキュリティ ガードレールが削除されており、Project Glasswing パートナーシップ プログラムを通じて少数のサイバー防御組織とインフラストラクチャ プロバイダーのみが利用できます。 Anthropic は米国政府と協力して展開されます。
実際の応用例
- Stripe: 従来の 2 か月分の作業を 1 日で完了 (初めて「過剰な能力」により社内セキュリティアラームが作動しました)
- Evozyne Drug Design: 新しいタンパク質を 10 倍速く設計します
Claude Fable 5 は、Anthropic のこれまでで最も過激なモデル リリースです。 Mythos レベルの機能は、「セキュリティ分類子」ダウングレード メカニズムを通じて外部世界への普遍的なアクセスを提供しますが、無制限バージョンはネットワーク防御シナリオに限定されます。この「機能分類」戦略は、最先端の AI 導入のための新しいパラダイムを表します。 Stripe が 2 か月分の作業を 1 日で完了したり、Evozyne の医薬品設計が 10 倍高速化した実際の事例は、エンタープライズレベルのプログラミングと医薬品開発における AI の能力が急速に「代替レベル」に近づいていることを示しています。
現在、DeepSeek V4 Pro、GPT-5.5、および Claude Fable 5 がプログラミング機能の点で三者間競争を形成していますが、総合ベンチマークにおける Fable 5 の総合リードは、Anthropic が Mythos レベルで大きな優位性を確立していることを示しています。
フォローアップに値する指示:
- Guard Classifier の実際のパフォーマンス: 実際の運用シナリオにおける 5% のトリガー率の許容範囲
- Project Glasswing の拡張機能: Mythos 5 へのアクセスは拡張されますか?
- 輸出規制の影響: クロード ファミリーのモデルへの世界的なアクセスに対する米国政府の輸出規制の実際の影響
レビュー