Claude API

Claude Sonnet 5.5発表 — Sonnet 5比30%高速・タスクあたり最大30%コスト削減、Terminal-Bench 70.6%でOpus 5.5を上回りSonnet初のサイバーセーフガード搭載

元記事を読む(anthropic.com) ↗

Summary

9月28日にAnthropicがClaude Sonnet 5.5(`claude-sonnet-5-5`)を全プラットフォーム(Claude Platform・AWS・Google Cloud・Microsoft Azure)で発表。入力$2/出力$10でSonnet 5と同一価格を維持しつつ、出力生成速度30%超高速化・タスクあたりコスト最大30%削減を実現。Terminal-Bench 4.0で70.6%(Sonnet 5: 10.3%・Opus 5.5: 66.4%を上回る)、SWE-Bench Pro 81.3%、CursorBench 4.0で55.5%、GDPval-AA v2.1で1844 Eloを記録。1Mトークンコンテキスト・128K max output tokens・adaptive thinking常時有効。Sonnet初のサイバーセーフガード搭載でOpus 5並のセキュリティ能力を提供。Low/Medium effortでSonnet 5のベストスコアを約10分の1のタスクコストで上回る効率性。ゼロデータ保持対応。Opus 5.5リリースから6日後の発表で5.5ファミリー第2弾。

Key Takeaways

  • ▸ Terminal-Bench 4.0で70.6% — Sonnet 5(10.3%)から7倍・Opus 5.5(66.4%)をも4.2pt上回りSonnet初のOpus超え達成
  • ▸ Sonnet 5同一価格$2/$10を維持しつつ30%高速化 — 使用トークン数削減+高速化でタスクあたりコスト最大30%削減
  • ▸ GDPval-AA v2.1で1844 Elo — Opus 5.5(1846)の2pt差に迫りGPT-6 Solを360pt以上リード
  • ▸ Sonnet初のサイバーセーフガード搭載 — Opus 5並のセキュリティ能力でSonnetモデルのセキュリティスキャン活用が拡大
  • ▸ Low/Medium effortでSonnet 5ベストスコア超え — 約10分の1コストで同等以上性能を実現しeffortダイヤル活用が一層重要に
  • ▸ Haiku 5.5も数週間以内に提供予定 — 5.5ファミリー第3弾で低コスト帯の刷新も控える

Best Practice Updates

  • ✓ Claude Codeデフォルトモデル(Sonnet)がSonnet 5.5に更新 — v2.1.284で自動適用、追加設定なしで全ユーザーに即時適用
  • ✓ APIモデル選択戦略が「日常→Sonnet 5.5 $2/$10・高難度→Opus 5.5 $4/$20」の2層に最適化 — Sonnet 5.5のTerminal-Bench 70.6%がOpus 5.5を上回るためコーディングタスクではSonnet 5.5が最適選択肢に
  • ✓ effortダイヤル活用でLow/Medium effortがコスト効率最大化 — Sonnet 5.5のmax effort時はArtificial Analysis測定で$7.60/タスクとOpus 5.5($5.98)より高コストになる点に注意

Same Day Signals

すべて見る →

元記事の著作権は各著作者に帰属します。