Daily Log

2026年9月29日(火)

3 signals received

Claude API

Claude Sonnet 5.5発表 — Sonnet 5比30%高速・タスクあたり最大30%コスト削減、Terminal-Bench 70.6%でOpus 5.5を上回りSonnet初のサイバーセーフガード搭載

9月28日にAnthropicがClaude Sonnet 5.5(`claude-sonnet-5-5`)を全プラットフォーム(Claude Platform・AWS・Google Cloud・Microsoft Azure)で発表。入力$2/出力$10でSonnet 5と同一価格を維持しつつ、出力生成速度30%超高速化・タスクあたりコスト最大30%削減を実現。Terminal-Bench 4.0で70.6%(Sonnet 5: 10.3%・Opus 5.5: 66.4%を上回る)、SWE-Bench Pro 81.3%、CursorBench 4.0で55.5%、GDPval-AA v2.1で1844 Eloを記録。1Mトークンコンテキスト・128K max output tokens・adaptive thinking常時有効。Sonnet初のサイバーセーフガード搭載でOpus 5並のセキュリティ能力を提供。Low/Medium effortでSonnet 5のベストスコアを約10分の1のタスクコストで上回る効率性。ゼロデータ保持対応。Opus 5.5リリースから6日後の発表で5.5ファミリー第2弾。

Claude Code

Claude Code v2.1.284リリースでSonnet 5.5がデフォルトSonnetモデルに — Auto Mode読み取り確認改善・effortスライダーキーバインド追加で53連続安定化リリース

9月28日にv2.1.284リリース。Claude Sonnet 5.5(`claude-sonnet-5-5`)がデフォルトSonnetモデルに変更され、1Mコンテキスト・$2/$10・キャッシュ読取$0.20/MTokで利用可能。Auto Modeにワーキングディレクトリ外読み取り時の「Yes, but ask again next time」応答オプションが追加され一時的許可の粒度が向上。effortスライダーのキーバインドアクション追加でキーボードからのeffort切替が効率化。v2.1.224以降53連続安定化リリースでCI/CDターゲットはv2.1.284に更新推奨。

Claude API

Sonnet 5.5独立ベンチマーク初期評価 — Artificial Analysis Intelligence Index #2・BenchAlign #5でフロンティア性能を独立確認、max effort時コスト効率にはOpus 5.5との逆転あり

9月28日のSonnet 5.5リリースから24時間以内にArtificial Analysis・BenchAlign・Vellum・OfficeChai・Kingy AI等が独立ベンチマーク評価を公開。Artificial AnalysisではIntelligence Index max effort 56でOpus 5.5(58)に次ぐ#2、BenchAlignでは201モデル中#5(80.49/100)を記録。ただしArtificial Analysisのmax effort測定でタスクあたりコスト$7.60・193K出力トークン/タスクとなりOpus 5.5($5.98)より高コストとなるケースが判明。Low/Medium effortでの効率性がAnthropicの「30%コスト削減」主張の根拠であり、effortダイヤル活用がコスト最適化の鍵。OfficeChai分析ではGPT-6 Solの一部ベンチマークを上回ることも確認。