Claude Fable 5.1とClaude Mythos 5.1を発表。長時間のエージェント作業やコーディングを強化

Anthropicは2026年9月1日、最新モデルとなる「Claude Fable 5.1」と「Claude Mythos 5.1」を発表しました。

両モデルは同じ基盤モデルを使用していますが、適用されるセーフガードが異なります。

Claude Fable 5.1は一般提供されるモデルで、コーディングや知識労働、長時間にわたるエージェント作業などを対象としています。

一方、Claude Mythos 5.1は、サイバーセキュリティやライフサイエンス分野でより高度な能力を利用できるよう、異なるセーフガードを適用したモデルです。現時点では、審査済みの組織などを対象としたTrusted Access Programを通じて限定的に提供されています。

Claude Fable 5.1とは?

Claude Fable 5.1は、AnthropicのFableシリーズにおける最新モデルです。

AnthropicはFable 5.1について、特に長時間にわたるエージェント作業や高度なコーディング、複数ステップの調査・分析などを想定しています。

主な用途として、以下が挙げられています。

  • 長時間にわたるAIエージェント作業
  • 大規模なコーディング
  • 複数ステップにわたる調査・分析
  • ドキュメント、スプレッドシート、スライドなどの作成
  • ブラウザ操作
  • 知識労働
  • 科学研究

Anthropicによると、Fable 5.1は複数のツールやアプリケーションを使いながら作業を進め、途中で問題が発生した場合にはリカバリーしながらタスクを継続することを想定して設計されています。

1Mトークンのコンテキストと128Kトークンの最大出力

Claude Fable 5.1は、1Mトークンのコンテキストウィンドウと128Kトークンの最大出力に対応しています。

また、Thinkingは「Adaptive」で常時有効です。Claude Platformの仕様ではデフォルトのeffortはHighに設定されています。

ただし、利用環境によってデフォルト設定は異なります。AnthropicはClaude CodeではHigh、Claude CoworkとClaude.aiではMediumをデフォルトとしていると説明しています。

長時間のエージェント作業に対応

Fable 5.1の大きな特徴の一つが、長時間にわたるエージェント型タスクへの対応です。

Anthropicは、数時間にわたって複数のアプリケーションを操作するような作業をFable 5.1の用途として挙げています。

具体的には、

  • ブラウザを操作する
  • Slack上の依頼を処理する
  • 複数のツールを利用する
  • コードを書いてテストする
  • 作業中に発生した問題から復旧する
  • 長時間にわたってタスクを継続する

といった作業が想定されています。

Anthropicによれば、Fable 5.1は作業を計画し、必要なツールを利用し、失敗したステップから復旧しながら作業を進めることができます。

コーディング性能を強化

Fable 5.1は、コーディング性能の向上も特徴です。

Anthropicが公開したベンチマークでは、エージェント型コーディングを評価する「Terminal-Bench 4.0」で、Fable 5.1は55.8%を記録しました。

比較対象はFable 5が42.0%、Opus 5が52.3%、GPT-5.6 Solが37.3%です。

また、同じ評価におけるClaude Mythos 5.1のスコアは60.9%でした。

ただし、このベンチマークではFable 5.1とMythos 5.1に適用されるサイバーセキュリティ関連のセーフガードが結果に影響しています。Anthropicは、両モデルは同じ基盤モデルであり、スコアの差はセーフガードが介入したタスクによるものだと説明しています。

CursorBench 3.2.0では73.4%

Anthropicは「CursorBench 3.2.0」の結果も公開しています。

Fable 5.1は最大effortで73.4%を記録しました。

比較対象はFable 5が70.5%、Opus 5が70.0%、GPT-5.6 Solが67.2%です。

AnthropicはFable 5.1について、生成したコードを検証する能力にも強みがあると説明しています。

科学研究にも利用

AnthropicはFable 5.1とMythos 5.1について、科学研究における能力も評価しています。

その一例がタンパク質設計です。

AnthropicはMythos 5.1にオープンソースのタンパク質設計・構造予測ツールを利用させ、その設計を2つの外部組織に送り、実験による検証を行いました。

Anthropicによると、12個のターゲットに対する評価で、生成した設計のhit rateは約50%に達しました。また、3つのターゲットでは、提出された設計の中で高い結合親和性を示す設計が確認されたとしています。

Terminal-Bench-Science 0.1

科学研究向けのエージェント能力を評価する「Terminal-Bench-Science 0.1」では、Fable 5.1が52.6%を記録しました。

比較対象はFable 5が24.7%、Opus 5が29.0%、GPT-5.6 Solが22.4%です。

なお、このベンチマークについてAnthropicは、モデルごとの標準誤差が±3.5~4.5ポイントあることを注記しています。そのため、数ポイント程度の差については評価上のばらつきを考慮する必要があります。

そのほかのベンチマーク

AnthropicはFable 5.1について、コーディングや科学研究だけでなく、知識労働やコンピューター操作など複数のベンチマーク結果も公開しています。

ベンチマークFable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8%42.0%52.3%37.3%
GDPval-AA v21853172318241711
OSWorld 2.0(Partial)77.9%72.9%75.4%
OSWorld 2.0(Strict)41.7%36.1%39.6%
Humanity’s Last Exam(ツールなし)60.9%57.8%56.6%
Humanity’s Last Exam(ツールあり)65.0%63.8%63.6%
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

これらはAnthropicが公開した評価結果です。

なお、OSWorld 2.0については2026年8月に公開されたタスクセットを使用しており、以前に公開されたOSWorld 2.0の結果とは直接比較できないとAnthropicは説明しています。

Claude Mythos 5.1とは?

Claude Mythos 5.1は、Fable 5.1と同じ基盤モデルを使用しています。

違いは、主に適用されるセーフガードと提供対象です。

AnthropicはMythos 5.1について、サイバーセキュリティやライフサイエンス分野での研究を対象に、Fable 5.1よりも制限の少ないセーフガードを適用すると説明しています。

Mythos 5.1は一般公開されておらず、現在は審査済みの組織などを対象としたTrusted Access Programを通じて提供されています。現時点では米国の一部組織が対象です。

Cyber Verification Program

Cyber Verification Programは、防御目的のサイバーセキュリティ作業を対象としたアクセスプログラムです。

現在は一部のOpusおよびSonnetモデルに対してセーフガードを緩和したアクセスを提供しており、Anthropicは今後、このプログラムにMythosモデルへのアクセスも含める予定だと説明しています。

Life Sciences Verification Program

Life Sciences Verification Programは、ライフサイエンス分野の専門家を対象とした招待制のベータプログラムです。

Mythos 5.1の生物学関連能力を、専門的な研究開発用途で利用できるようにすることを目的としています。

Anthropicは米国政府と協力してこのプログラムを開発しており、すでに最初の参加者を登録したと説明しています。今後、より広いライフサイエンスコミュニティへの拡大を予定しています。

セーフガードを改善

Fable 5.1では、サイバーセキュリティや生物学に関するセーフガードも改善されています。

Anthropicによると、サイバーセキュリティ向けのセーフガードでは、以前よりも誤検知を60%減らしています。

また、Fable 5.1ではソースコードからソフトウェアの脆弱性を発見する作業が可能になりました。

一方で、penetration testing、exploit generation、バイナリベースの脆弱性スキャンなど、一部のデュアルユースなサイバーセキュリティ作業は引き続き制限されています。

生物学分野でもセーフガードが改善されており、Fable 5.1とFable 5の生物学向けセーフガードは、以前のFable 5のセーフガードと比較して、初歩的な生物学や医学に関する無害なリクエストへの介入が85%少なくなっています。

一方、ライフサイエンスの研究開発に関する質問については、引き続きOpusモデルへルーティングされます。

データ保持にも新しい仕組み

Anthropicは今回、「Enterprise Frontier Safeguards(EFS)」も発表しました。

EFSでは、顧客が完全に管理するクラウドインフラストラクチャ上にデータを保存することで、Anthropicによるデータ保持を行わず、Zero Data Retentionと同等のプライバシーを実現するとしています。

EFSは企業顧客向けに段階的に提供され、2026年秋から展開が開始される予定です。

EFSが利用可能になるまでの間、対象となる顧客はFable 5.1およびFable 5をZero Data Retentionで利用できます。

コンテンツの出所を確認する仕組みも導入

Fable 5.1では、コンテンツの出所を確認するための「Content Provenance」にも対応しています。

AnthropicはClaudeが生成に関与したテキストを検出するための不可視のウォーターマーク技術について説明しており、生成コンテンツがClaudeによるものかを確認するための検出APIをプライベートプレビューとして提供しています。

この仕組みは、AIによって生成されたコンテンツの出所を確認するために利用されます。

Claude Fable 5.1の料金

Claude Fable 5.1の基本料金はFable 5から据え置かれています。

項目Claude Fable 5.1
入力$10 / 100万トークン
5分間キャッシュ書き込み$12.50 / 100万トークン
1時間キャッシュ書き込み$20 / 100万トークン
キャッシュ読み取り$0.25 / 100万トークン
出力$50 / 100万トークン
コンテキスト1Mトークン
最大出力128Kトークン

キャッシュ読み取りはFable 5の$1 / 100万トークンから$0.25 / 100万トークンへ引き下げられ、75%安くなっています。

Anthropicによると、この価格変更により、一般的なワークロードではFable 5と比較して約25%、複雑なコーディングや高度にエージェント化されたワークロードでは最大約45%のコスト削減が見込まれています。

これはAnthropicが2026年8月の実利用データをもとに算出した推定値です。

Claude Fable 5.1はどこで利用できる?

Claude Fable 5.1は2026年9月1日から一般提供されています。

個人・組織向けには、Pro、Max、Team、Enterpriseユーザーが利用できます。

開発者向けにはClaude APIから利用できるほか、Amazon Web Services、Google Cloud、Microsoft Azureなどでも提供されています。

Claude APIで利用するモデルIDは、

claude-fable-5-1

です。

Claude Platformの公式仕様では、Amazon Bedrockではanthropic.claude-fable-5-1、Google CloudやMicrosoft Foundryではclaude-fable-5-1がモデルIDとして案内されています。

Claude Mythos 5.1は限定提供

Claude Mythos 5.1は一般公開されていません。

現在はTrusted Access Programを通じて、審査済みのサイバーセキュリティ専門家やライフサイエンス研究者などに限定して提供されています。

Anthropicによると、現時点では米国の一部組織が対象で、今後さらにアクセス範囲を拡大する予定です。

また、Claude SecurityについてもMythos 5.1が利用されています。Claude Securityは、コードベースの脆弱性をスキャンし、修正案を人間によるレビュー向けに提示するサービスです。

まとめ

Anthropicが2026年9月1日に発表したClaude Fable 5.1とClaude Mythos 5.1は、同じ基盤モデルを異なるセーフガードで提供する2つのモデルです。

Fable 5.1は一般提供モデルとして、長時間にわたるエージェント作業、コーディング、知識労働、調査などを対象としています。

一方、Mythos 5.1は、サイバーセキュリティやライフサイエンス分野でより高度な能力を利用できるようにしたモデルで、現在はTrusted Access Programを通じて限定提供されています。

Fable 5.1は1Mトークンのコンテキストと128Kトークンの最大出力に対応し、入力料金は100万トークンあたり10ドル、出力料金は50ドルです。

また、キャッシュ読み取り料金は100万トークンあたり0.25ドルとなり、Fable 5から75%引き下げられました。Anthropicは、この変更によって一般的なワークロードでは約25%、高度にエージェント化されたワークロードでは最大約45%のコスト削減を見込んでいます。

コーディング性能では、Anthropicの評価においてTerminal-Bench 4.0で55.8%、CursorBench 3.2.0で73.4%を記録しました。また、科学研究向けのTerminal-Bench-Science 0.1では52.6%を記録しています。

さらに、セーフガードの改善によって、Fable 5.1では防御目的のソフトウェア脆弱性の発見が可能になったほか、サイバーセキュリティや生物学関連の無害なリクエストに対する誤検知も削減されています。

Claude Fable 5.1はすでに一般提供されているため、長時間のエージェント作業や高度なコーディングなどを必要とするユーザーは、Claude APIやClaudeの各サービスから利用できます。

タイトルとURLをコピーしました