Anthropicは9月1日にClaude Fable 5.1とClaude Mythos 5.1をリリースしました。両モデルとも、100万トークンのコンテキストを受け入れ、最大12.8万トークンの出力を可能にし、推論の深さを動的に調整できるようになりました。これらすべてを、呼び出しごとのコストを抑えながら実現しています。これらのアップグレードは、単にベンチマークのスコアを上げるためではなく、より安価で信頼性の高いAI支援コーディングや、極めて重要な研究(high-stakes research)をターゲットとしています。

新バージョンが重要である理由

以前のClaude世代ではコンテキストウィンドウが数千トークンに制限されており、開発者はコードやデータを手動で分割せざるを得ませんでした。また、ユーザーは推論の深さを手動で設定する必要があり、単純なプロンプトが試行錯誤のゲームになっていました。キャッシュ読み取り(Cache-read)の料金により、長いセッションや繰り返しのツール呼び出しが高コストになっていたほか、セキュリティチームからは、コードレビューを遅らせる誤検知(false-positive)の警告が大量に発生しているという不満もありました。

Claude Fable 5.1とClaude Mythos 5.1は、これらの課題に正面から取り組んでいます。両者は同じコア・エンジンを共有していますが、Anthropicはターゲットとするオーディエンスに合わせて、各モデルに異なるガードレールを適用しています。

変更による具体的な効果

  • コストの削減 – Anthropicはキャッシュ読み取りの価格を引き下げました。これにより、長時間の反復的なコーディングセッションや繰り返しのツール呼び出しのコストが大幅に抑えられ、スタートアップや社内開発チームにとって決定的な要因となります。
  • 適応型思考 – モデルがタスクに必要な推論量をその場で判断します。ユーザーはもはや「努力レベル(effort levels)」を切り替えたり、どれくらいの思考プロセス(chain-of-thought)のプロンプトが必要かを推測したりする必要はありません。
  • ターン単位のメッセージ(Turn-scoped messages) – システムレベルの指示が単一のやり取りにのみ適用されるようになり、古い指示が後のターンに混入するのを防ぎます。
  • セキュリティの向上 – Claude Codeのユーザーからは、サイバーセキュリティにおける誤検知が約60%減少したと報告されており、実体のない警告を追いかける時間が大幅に短縮されています。
  • 脆弱性検知 – Fable 5.1はソフトウェアの欠陥を特定しますが、エクスプロイト(攻撃)コードの生成は禁止されています。これにより、監査人の生産性を維持しつつ、悪意のある攻撃者に隙を与えることを防いでいます。
  • 重要度の高い研究へのフォーカス – Mythos 5.1は、サイバーセキュリティやライフサイエンス分野の信頼されたプログラム向けに提供されます。Anthropicは暗号設計などのタスクでモデルをストレス・テストし、そこで得られた知見を汎用モデルであるFableにフィードバックしています。

メリットを受ける層と、取り残される可能性がある層

IDEアシスタント、CIパイプライン、またはカスタムボットを構築する開発者は、コストを節約でき、セキュリティ上の妨げも減少します。Anthropicの信頼基準を満たすセキュリティアナリストやバイオテク研究者は、機密性の高いワークロードに対してMythos 5.1のより厳格なガードレールを活用できます。トレードオフとして、Mythosは一般公開されておらず、信頼されたプログラムとしての関係を持たない小規模なチームは、より制限の緩いFable 5.1に頼らざるを得ません。

潜在的なデメリットや未解決の疑問

エクスプロイトの生成をブロックすることは、防御策をテストするために現実的な攻撃コードを必要とするレッドチームのユーザーをフラストレーションさせる可能性があります。「信頼されたプログラム」というゲート(関門)は、資金力のある組織だけが最も安全で高機能なモデルを享受できるという、AI市場の階層化を生む可能性があります。キャッシュ読み取りの価格は下がりましたが、Anthropicは詳細なコストモデルを公開していないため、大規模なワークロードにおける純粋な節約額について、開発者は確信が持てない状況にあります。

今後の注目点

コスト削減とセキュリティの約束が、実際の生産性向上につながるかどうかは、採用率によって明らかになるでしょう。開発者が大規模なコードベースに対して100万トークンのウィンドウを好むようになれば、AnthropicはMythosレベルのガードレールをより広い層に開放するよう圧力を受ける可能性があります。誤検知の減少頻度や、脆弱性スキャン・パイプラインへの影響を追跡することで、新しいセキュリティ体制が攻撃の多い使用環境でどこまで耐えうるかを判断できます。

要点: Claude Fable 5.1とClaude Mythos 5.1は、単にベンチマークを更新することよりも、長時間のAIワークフローのコストを削減し、最も機密性の高いアプリケーション向けのセーフティネットを強化することを目指しています。