Claude API

Claude障害(7月20日): Opus 4.8で約3時間エラー率上昇 — 月内3度目のインシデントでマルチプロバイダーフェイルオーバーの構造的必要性がさらに強化

元記事を読む(isdown.app)

Summary

7月20日18:03 UTC〜21:08 UTCにClaude Opus 4.8でエラー率が上昇。claude.ai・Claude API(api.anthropic.com)・Claude Code・Coworkの全サービスが影響を受け、特にClaude Code on Web・Claude Code Review・Cowork Remote・Claude Tagで障害が顕著。修正実装後に復旧し約3時間の影響。7月6日のサブエージェント暴走障害(約6時間)、7月17日のSonnet 5・Haiku 4.5エラー率上昇(約4時間)に続く月内3度目のインシデント。7月だけで3回の有意なサービス障害が発生しており、`fallbackModel`設定またはBedrock・Vertex AI・Foundryへのフェイルオーバー設計の構造的必要性がさらに裏付けられた。

Key Takeaways

  • 月内3度目のインシデント: 7月6日(サブエージェント暴走・6時間)→7月17日(Sonnet 5/Haiku 4.5・4時間)→7月20日(Opus 4.8・3時間)と頻度が高い
  • Opus 4.8はMax/Team Premium/Enterprise pay-as-you-goのデフォルトモデルであり影響範囲が広い
  • Claude Code・Cowork・Claude Tagを含む全サービスに波及 — エージェントワークフローの中断リスクが顕在
  • IPO準備段階でのサービス安定性は投資家・エンタープライズ顧客双方の評価指標

Best Practice Updates

  • `fallbackModel`設定(最大3モデル順次試行)を全本番環境で有効化し、特定モデルの障害時にSonnet 5等への自動フォールバックを設計すべき
  • マルチプロバイダーフェイルオーバー(Bedrock・Vertex AI・Foundry・API直接接続の4経路)を標準アーキテクチャとして初日から実装
  • 月内3度のインシデントパターンを踏まえ、エージェントワークフローにリトライ+中間チェックポイント保存を組み込むべき

Same Day Signals

すべて見る →

元記事の著作権は各著作者に帰属します。