Claude API

【速報】Claude Opus 5正式リリース — Fable 5の半額でベンチマーク大半を上回り、full effortラダー(max含む)・thinking常時有効・512トークンキャッシュ最小長を搭載

元記事を読む(platform.claude.com)

Summary

7月24日にAnthropicがClaude Opus 5を正式リリース。モデルID `claude-opus-5`でClaude API・Amazon Bedrock・Google Cloud・Microsoft Foundryの全プラットフォームで即日利用可能。価格はOpus 4.8と同じ$5/$25 per MTokで、Fable 5($10/$50)の半額。Frontier-Bench 43.3%(Fable 5: 33.7%・Opus 4.8: 18.7%)でFable 5を大幅に上回り、SWE-bench Proでも1ポイント差に迫る。1Mコンテキスト(デフォルト・最大共に1M)、128K max output tokens。full effortラダー(low/medium/high/xhigh/max)をベータヘッダー不要で利用可能。thinkingが常時有効(adaptive thinkingがデフォルト)で、xhigh/maxではthinking無効化が400エラー(破壊的変更)。プロンプトキャッシュ最小長が1,024→512トークンに短縮。Fast Mode(Research Preview)はAPI直接のみ$10/$50。mid-conversation tool changes(ベータ)、default fallbacksモード(ベータ)も新機能として追加。

Key Takeaways

  • Opus 4.8からの「段階的改善」ではなく「ステップチェンジ」 — 深い推論・エージェンティックコーディング・テスト時間計算スケーリング・ビジョン・マルチエージェント協調が大幅向上
  • 破壊的変更2点: (1)thinkingが常時有効でmax_tokensがthinking+応答の合計上限に、(2)xhigh/max effortでthinking無効化が400エラー
  • 検証指示の過剰化に注意 — Opus 5は自発的にワークを検証するため「最終検証ステップを含めて」等の指示は過剰検証を引き起こす
  • デフォルト応答長が長くなり、エージェントセッションで進捗を頻繁にナレーションし、サブエージェントへのデリゲーションがより積極的に

Best Practice Updates

  • Opus 4.8→Opus 5移行はモデルID変更のみで可能だがmax_tokensの再検証が必須 — thinkingトークン分の余裕確保
  • Fable 5の半額で大半のベンチマークを上回るためコスト効率の最適構成が変化 — Sonnet 5(日常)+Opus 5(高難度)+Fable 5(フロンティア限定)の3層に更新

Same Day Signals

すべて見る →

元記事の著作権は各著作者に帰属します。