Anthropicは2026年9月1日、AIモデルの新バージョン「Claude Fable 5.1」と「Claude Mythos 5.1」を発表した。コーディングや科学研究の性能が前世代から大きく向上しつつ、トークン課金の価格を最大25%引き下げた。安全対策の誤検知も大幅に削減されており、実用面での改善が多い。
- 価格:一般的な用途で約25%値下げ。エージェント用途では最大約45%のコスト削減
- 性能:科学研究ベンチマーク(Terminal-Bench-Science)で52.6%を達成し、前世代の24.7%から倍増以上
- 安全対策:サイバーセキュリティ領域で誤検知を60%削減。脆弱性発見が可能に
Fable 5.1とMythos 5.1の違い
Fable 5.1とMythos 5.1は同一のモデルだが、安全対策のレベルが異なる。Fable 5.1は一般提供されるのに対し、Mythos 5.1はサイバーセキュリティやライフサイエンス分野向けの信頼アクセスプログラムを通じてのみ利用できる。ベンチマーク上ではMythos 5.1のほうがエージェントコーディング(Terminal-Bench 4.0)で60.9%とやや高いスコアを出しており、これは従来の安全対策による介入が少ないためとされる。
価格とデータ保持の変更
価格引き下げの主な要因は、キャッシュ読み取り(すでに処理・保存された入力の再利用)の料金低減にある。トークン課金のすべてのプランが対象で、エージェント的な長時間タスクでは最大約45%の節約になるとされる。
データ保持については、新たに「Enterprise Frontier Safeguards(EFS)」を導入する。EFSは顧客が完全に管理するクラウド基盤にデータを保存する仕組みで、ゼロデータ保持と同等のプライバシーを確保しながら安全対策を維持する。エンタープライズ向けに今秋から段階的に提供開始予定。EFS提供開始前でも、対象顧客はゼロデータ保持でFable 5.1を利用できる。
主要ベンチマークでの結果
公式発表によるベンチマーク比較は以下のとおり。すべてFable 5.1の本番用安全対策を有効にした状態で測定されている。
- 科学研究(Terminal-Bench-Science 0.1):52.6%(Fable 5は24.7%、Opus 5は29.0%)
- エージェントコーディング(Terminal-Bench 4.0):55.8%(Fable 5は42.0%)
- 学際推論(Humanity’s Last Exam):ツールなし60.9%、ツールあり65.0%
- コーディング(CursorBench 3.2.0):73.4%(Fable 5は70.5%)
- ビジネスワークフロー(AutomationBench):31.4%(Fable 5は17.1%)
Low・Mediumの努力レベルではFable 5と同等以上の結果をより低コストで達成できるとしており、Claude CodeではデフォルトがHigh、Claude.aiやClaude CoworkではMediumに設定される。
日本での利用について
Fable 5.1はClaude.aiおよびAPI経由で一般提供されるため、日本からもこれまでのClaudeモデルと同様にアクセスできる見込みだ。一方、Enterprise Frontier Safeguards(EFS)の日本向け提供時期やMythos 5.1の信頼アクセスプログラムの日本での対応については、公式発表では言及されていない。価格引き下げはトークン課金ベースのため、APIを利用する日本の開発者や企業にも直接の恩恵がある。


コメント