Claude API
Fable 5.1がArtificial Analysis Intelligence Index首位66を達成 — max effortでOpus 5・GPT-5.6 Sol・Grok 4.6を全て上回りフロンティア全指標で新記録
元記事を読む(artificialanalysis.ai) ↗Summary
Artificial AnalysisがFable 5.1の独立ベンチマーク結果を公開。max effortでIntelligence Index 66を記録し、Opus 5(63)・Fable 5(62)・GPT-5.6 Sol(61)・Grok 4.6(61)を全て上回り測定史上最高スコアを達成。effortダイヤル5段階で58〜66のスコア範囲を提供し、low effortでもFable 5 max effortを科学ベンチマークで上回りコスト4分の1。FourWeekMBAの分析ではタスクあたりコストがFable 5比約20%増だがキャッシュ読取75%値下げとの組み合わせで典型利用では25%コスト削減。OfficeChai・BenchLM・DataCamp・BuildFastWithAI等が詳細ベンチマーク解説を展開。
Key Takeaways
- ▸ Artificial Analysis Intelligence Index max effort 66 — 測定史上最高スコアでOpus 5(63)を3pt上回る
- ▸ effortダイヤル5段階(58〜66)でコスト対性能の精密制御が可能 — low effortがFable 5 max effortを科学ベンチで上回る
- ▸ Terminal-Bench-Science 52.6%(Fable 5: 24.7%)で科学研究タスクが2倍超の性能向上
- ▸ HLE 59.1%・Terminal-Bench v2.1 91.4%・SciCode 62.0%で複数指標で最高スコア
- ▸ タスクあたりコストはFable 5比約20%増だがキャッシュ75%値下げで典型利用25%コスト削減
- ▸ OSWorld 2.0 partial 77.9%・strict 41.7%でエージェントタスクも最高水準
Best Practice Updates
- ✓ effortダイヤル最適化がFable 5.1のコスト削減最大レバーとして独立分析で確定 — low effortでFable 5 max effort超えの品質を4分の1コストで実現
- ✓ max effortはIntelligence Index 66で全モデル首位だがコスト20%増 — 日常タスクはmedium/high、大規模リファクタリング・セキュリティ監査にmax effortの使い分けが推奨
Same Day Signals
すべて見る →- Anthropic Anthropic IPOタイムラインが10月中旬に後退 — 目論見書は9月下旬に延期・$15Bクレジットファシリティが最終段階でIPOの財務基盤強化
- Claude Code Claude Code週間使用量25%恒久化まで残り8日(9月14日)— IPOタイムライン後退で「エキサイティングな変更」が9月14日前に発表されるか注目
- Anthropic Anthropic $15Bクレジットファシリティでインフラ投資・コンピュート契約の資金確保が加速 — SpaceX IPO戦略を踏襲しAI史上最大規模のIPO前ファイナンス
- Anthropic Anthropic IPOタイムライン後退の国際報道が拡大 — Japan Times・Seoul Economic Daily・Cryptopolitan等がNov上場・$130B超調達・$2T評価額の詳細を報道
元記事の著作権は各著作者に帰属します。