Claude API

Fable 5.1がArtificial Analysis Intelligence Index首位66を達成 — max effortでOpus 5・GPT-5.6 Sol・Grok 4.6を全て上回りフロンティア全指標で新記録

元記事を読む(artificialanalysis.ai)

Summary

Artificial AnalysisがFable 5.1の独立ベンチマーク結果を公開。max effortでIntelligence Index 66を記録し、Opus 5(63)・Fable 5(62)・GPT-5.6 Sol(61)・Grok 4.6(61)を全て上回り測定史上最高スコアを達成。effortダイヤル5段階で58〜66のスコア範囲を提供し、low effortでもFable 5 max effortを科学ベンチマークで上回りコスト4分の1。FourWeekMBAの分析ではタスクあたりコストがFable 5比約20%増だがキャッシュ読取75%値下げとの組み合わせで典型利用では25%コスト削減。OfficeChai・BenchLM・DataCamp・BuildFastWithAI等が詳細ベンチマーク解説を展開。

Key Takeaways

  • Artificial Analysis Intelligence Index max effort 66 — 測定史上最高スコアでOpus 5(63)を3pt上回る
  • effortダイヤル5段階(58〜66)でコスト対性能の精密制御が可能 — low effortがFable 5 max effortを科学ベンチで上回る
  • Terminal-Bench-Science 52.6%(Fable 5: 24.7%)で科学研究タスクが2倍超の性能向上
  • HLE 59.1%・Terminal-Bench v2.1 91.4%・SciCode 62.0%で複数指標で最高スコア
  • タスクあたりコストはFable 5比約20%増だがキャッシュ75%値下げで典型利用25%コスト削減
  • OSWorld 2.0 partial 77.9%・strict 41.7%でエージェントタスクも最高水準

Best Practice Updates

  • effortダイヤル最適化がFable 5.1のコスト削減最大レバーとして独立分析で確定 — low effortでFable 5 max effort超えの品質を4分の1コストで実現
  • max effortはIntelligence Index 66で全モデル首位だがコスト20%増 — 日常タスクはmedium/high、大規模リファクタリング・セキュリティ監査にmax effortの使い分けが推奨

Same Day Signals

すべて見る →

元記事の著作権は各著作者に帰属します。