Monitoring

Claudeの動向を、
毎日観測する。

Claude関連の最新ニュース・ベストプラクティスを日次で自動収集。公式発表からコミュニティの知見まで、シグナルを逃さず記録します。

Articles
934
Days
119
Last Scan
07/26
Claude API

Claude API新機能: Mid-conversation Tool Changes(ベータ)でエージェントのプログレッシブ・ディスクロージャーパターンが実現 — ツール追加・削除をプロンプトキャッシュ維持しつつ会話中に動的制御

Opus 5リリースと同時にmid-conversation tool changes(ベータ)が全対応モデル(Fable 5・Mythos 5・Opus 4.8・Opus 5)で利用可能に。`mid-conversation-tool-changes-2026-07-01`ベータヘッダーで有効化。会話のツール一覧を初回に全定義した上で、ターン間で`tool_addition`・`tool_removal`ブロックを使い特定ツールの有効化・無効化を動的に制御。プロンプトキャッシュを維持しつつツール構成を変更可能。既存のmid-conversation system messagesとの組み合わせでエージェントの行動制御がターン単位で精密化。Claude API・Amazon Bedrock・Google Cloudの全プロバイダーで利用可能。

Claude API

Claude API新機能: Default Fallbacksモード(ベータ)で安全性分類器によるrefusalの自動フォールバックルーティングが実現 — モデルリスト管理不要の「おまかせ」フォールバック

Opus 5リリースと同時にserver-side fallbackの`"default"`モードが追加(`server-side-fallback-2026-07-01`ベータヘッダー)。`fallbacks`パラメータに`"default"`を指定すると、安全性分類器がリクエストをブロックした際にAnthropicが推奨するフォールバックモデルにrefusalカテゴリ別で自動ルーティング。従来のexplicit-list形式(特定モデルを明示指定)に加え、Anthropicの推奨に追従する「おまかせ」モードが選択可能に。推奨モデルリストはAnthropic側で更新されるためクライアント側のメンテナンスが不要。Opus 5・Fable 5の安全性分類器誤検知時のフォールバックがシームレスに実現。

MCP

MCP 2026-07-28最終仕様公開まで残り2日 — 12ヶ月猶予期間付きdeprecationでsampling・roots・logging廃止、ステートレスコア+Extensions Framework正式化

MCP 2026-07-28最終仕様公開まで残り2日。Release Candidateは5月21日から10週間の検証期間を経て7月28日に確定。主要変更の最終確認: (1)ステートレスコア — `initialize`ハンドシェイク・`Mcp-Session-Id`廃止でスティッキーセッション不要、通常のラウンドロビンロードバランサーで運用可能に、(2)deprecated機能(sampling・roots・logging)は12ヶ月の機能維持猶予付き — 即時破壊はなし、(3)Extensions Frameworkが正式化 — MCP Apps(サンドボックスHTML UI)・Tasks(長時間ジョブ管理)がextensionとして位置づけ、(4)OAuth 2.1が認証標準に昇格 — 6つのSpecification Enhancement Proposalで認可フレームワーク強化。Beta SDK: Python v2.0.0b1・TypeScript v2(ESM-only・パッケージ分割)・Go v1.7.0-pre.1・C# v2.0.0-preview.1。10,000超パブリックサーバー・月間9,700万SDKダウンロードのエコシステムに影響。

Claude API

Opus 5 vs GPT-5.6 Sol詳細ベンチマーク比較 — SWE-bench Pro +14.6pt・ARC-AGI 3で3.9倍・12ベンチマーク中9勝でOpus 5が$5/$25の価格優位と共に総合リード

Opus 5リリース後のコミュニティ詳細ベンチマーク比較が集約。Opus 5($5/$25)vs GPT-5.6 Sol($5/$30)の直接比較: SWE-bench Pro 79.2% vs 64.6%(+14.6pt)、ARC-AGI 3 30.2% vs 7.8%(3.9倍)、Frontier-Bench 43.3% vs 34.4%、GDPval-AA v2 Elo 1,861 vs n/a。12ベンチマーク中9つでOpus 5がリード。CursorBench 3.2でFable 5($10/$50)の0.5%差に迫りコスト効率で圧倒。AutomationBenchで

Claude API

Fortune: Opus 5のeffortダイヤルがB2Bチームの「AIコスト対能力トレードオフ」を初めてユーザー制御可能に — エンタープライズAI予算管理の新パラダイム

Fortune(7月24日)がOpus 5のeffortダイヤルをB2Bチーム向けの予算管理ツールとして分析。Opus 5はlow/medium/high/xhigh/maxの5段階effortダイヤルをベータヘッダー不要で全ユーザーに提供。lowでは高速・低コスト応答、maxではFable 5に迫る性能を$5/$25で実現。Fast Mode(Research Preview)は2.5倍速・$10/$50でさらなる高速化オプション。Fortuneは「AI予算がブラックボックスだった企業が初めてタスク別のコスト・品質トレードオフを明示的にコントロール可能に」と評価。Uberの$3.4B予算超過・Microsoft E+D部門の$500-2,000/月/エンジニアの事例を踏まえ、effortダイヤルがエンタープライズAI予算の予測可能性を根本的に改善すると分析。

Anthropic

TechTimes: Opus 5がUK AISI政府サイバーテストでエンタープライズネットワーク攻撃を8/10回完遂 — 最低ミスアラインメントスコアと高サイバー能力の二面性が「運用管理強化」を要求

TechTimes(7月25日)がOpus 5 System Cardの中でも特にサイバーセキュリティ能力に焦点を当てて報道。UK AI Security Institute(AISI)がOpus 5の早期スナップショットで3つのマルチステップ・サイバーレンジ(エンタープライズネットワーク攻撃シミュレーション)を実施し、10回中8回で攻撃パス全体を完遂。UK AISIはOpus 5をMythos 5・Mythos Previewと「同等の能力ティア」に分類。一方でOpus 5のミスアラインメントスコア2.30は全Claudeモデル最低(最良)で、Opus 4.8(2.85)・Mythos 5(2.81)・Sonnet 5(3.35)を上回る。「最も整合的なモデルが高いサイバー攻撃能力を持つ」という二面性が浮き彫りに。Anthropicは自律性脅威モデル1をOpus 5に適用し、ASL-3保護レベル(Opus 4.8と同一)を維持。CyScenarioBench・ExploitGymの新規ベンチマークでサイバーセキュリティ能力の定量評価が標準化。

Claude API

Artificial Analysis: Opus 5がIntelligence Index・Agentic Index共に#1を獲得 — 586モデル中首位、Fable 5を上回りCost per Taskで26%優位

7月25日にArtificial AnalysisがOpus 5の独立評価結果を公開。Intelligence Index v4.1でスコア61を記録し、586モデル中#1を獲得。Fable 5(60)・GPT-5.6 Sol(59)・Kimi K3(57)を上回る。Agentic Indexでも55.3で首位(GPT-5.6 Sol: 54.0、Fable 5: 52.8)。独自ベンチマークAA-Briefcase(エージェンティック知識作業)ではElo 1720を記録し、Fable 5(1574)に146ポイント差。GDPval-AA v2とAA-Briefcaseの両方で過去最高スコアを記録。Cost per TaskではFable 5比26%低コストで同等以上の性能を実現。Artificial Analysisはリリース前にAnthropicと協力して評価を実施。「narrowly the most intelligent model」と評価し、Opus 5がフロンティアモデルの価格性能比を根本的に変えたと分析。

Claude API

【速報】Claude Opus 5正式リリース — Fable 5の半額でベンチマーク大半を上回り、full effortラダー(max含む)・thinking常時有効・512トークンキャッシュ最小長を搭載

7月24日にAnthropicがClaude Opus 5を正式リリース。モデルID `claude-opus-5`でClaude API・Amazon Bedrock・Google Cloud・Microsoft Foundryの全プラットフォームで即日利用可能。価格はOpus 4.8と同じ$5/$25 per MTokで、Fable 5($10/$50)の半額。Frontier-Bench 43.3%(Fable 5: 33.7%・Opus 4.8: 18.7%)でFable 5を大幅に上回り、SWE-bench Proでも1ポイント差に迫る。1Mコンテキスト(デフォルト・最大共に1M)、128K max output tokens。full effortラダー(low/medium/high/xhigh/max)をベータヘッダー不要で利用可能。thinkingが常時有効(adaptive thinkingがデフォルト)で、xhigh/maxではthinking無効化が400エラー(破壊的変更)。プロンプトキャッシュ最小長が1,024→512トークンに短縮。Fast Mode(Research Preview)はAPI直接のみ$10/$50。mid-conversation tool changes(ベータ)、default fallbacksモード(ベータ)も新機能として追加。

Anthropic

AMD × Anthropic $5B戦略パートナーシップ — MI450 GPUで最大2GW展開、インフラ十一系統化でAPI可用性の構造的安定化が加速

7月22日にAMDとAnthropicが戦略パートナーシップを発表。AMDがAnthropicに最大$5Bの戦略的株式投資を実施し、最大2ギガワットのAMD Instinct MI450 Series GPUを展開。最初の1GWは2027年上半期に展開開始。投資は展開マイルストーン達成に連動。Anthropicはテンズ・オブ・ビリオンズ規模のAMD最新AIサーバーチップ購入にコミット。AMDはNVIDIA・Amazon・Googleに加えAnthropicのGPUサプライヤーリストに追加され、NVIDIA一強からの分散が加速。SpaceX($45B/3年)・Amazon・Google・CoreWeave・Snowflake・Akamai・TeraWulf・Meta交渉中に続く十一系統目のインフラパートナー。AMD株は発表後上昇。

Claude Code

v2.1.219リリース — Claude Opus 5がデフォルトOpusモデルに・sandbox.network.strictAllowlist追加・DirectoryAddedフック新設

7月24日にClaude Code v2.1.219リリース。Claude Opus 5(`claude-opus-5`)がデフォルトのOpusモデルに設定され、1Mコンテキスト・Fast Mode($10/$50 per MTok)で利用可能。新機能: (1)`sandbox.network.strictAllowlist`設定追加 — サンドボックス化コマンドのネットワークアクセスでアローリスト外ホストをプロンプトなしで拒否(従来はプロンプト表示)、(2)`DirectoryAdded`フック追加 — `/add-dir`やSDKの`register_repo_root`で新ワーキングディレクトリが登録された際に発火するフックで、ディレクトリ別のセットアップ自動化が可能に。Claude Code利用者は`/model`でOpus 5を選択可能、環境変数`CLAUDE_CODE_MODEL`での設定も対応。

MCP

The Register: MCP 2026-07-28ステートレス移行で「ハードレッスン」からの根本再設計 — 10,000超サーバー・月間9,700万SDKダウンロードのエコシステムに影響

The Register(7月23日)がMCP 2026-07-28仕様改訂の技術的影響を詳報。MCPメンテナーが「ハードレッスン」から学んだ後方互換性のない変更を含む改訂。ステートレスコアにより、スティッキーセッション・共有セッションストア・ディープパケットインスペクションが不要になり通常のラウンドロビンロードバランサーで運用可能に。10,000超のパブリックMCPサーバーが稼働中・月間SDKダウンロード9,700万超のエコシステム規模。正式にdeprecatedとなった機能は最低12ヶ月の機能維持。ただし2026-07-28リビジョンのサーバーと旧クライアント間の相互運用性は保証されない。MCP AppsでサーバーレンダリングHTMLをサンドボックスiframe内に表示、TasksでGitHub Actionsのような長時間ジョブ管理が可能に。

Anthropic

Anthropic Economic Futures Research Fund $200M研究アジェンダ公開 — AI経済影響の5領域・$5-30M規模プロジェクトを支援

7月22日にAnthropicがEconomic Futures Research Fundの$200M研究アジェンダを公開。AI経済影響に対する社会的準備を支援する5つの優先研究領域: (1)企業・職場レベルでのAIの労働者への影響、(2)AI駆動の変化を乗り越える人材支援、(3)AI駆動の雇用喪失に対する所得支援近代化、(4)AI駆動成長における労働者のステーク確保、(5)公共投資の新エビデンス生成。$5-30M規模のプロジェクトを主に支援。同時にEconomic Indexコネクタをclaude.aiで提供開始しAI経済影響データへの直接アクセスが可能に。Gates Foundation($200M・ヘルスケア)に続く2つ目の大規模社会投資。

Claude API

Opus 5コミュニティ詳細ベンチマーク — SWE-bench Verified 96-97%でGPT-5.6 Sol・Fable 5を上回り、ミスアラインメントスコア2.30が全Claudeモデル最低値

7月24日のOpus 5リリース後、複数の独立ベンチマーク検証結果が公開。SWE-bench Verified 96.0-97.0%でGPT-5.6 Sol(96.2%)・Fable 5(95.0%)を上回りトップ。SWE-bench Pro 79.2%、SWE-bench Multimodal 59.4%(Opus 4.8: 38.4%から大幅向上)。Frontier-Bench v0.1で43.3%がFable 5(33.7%)・GPT-5.6 Sol(34.4%)・Opus 4.8(21.1%)を大幅に上回る。安全性指標でもミスアラインメントスコア2.30が全Claudeモデル中最低(最良)で、Opus 4.8・Sonnet 5・Fable 5より優れた整合性。The Decoderは「いくつかのベンチマークでFable 5を完全に上回る」と評価。Fortune報道ではeffortダイヤル(low/medium/high)によるコスト対品質のB2Bチーム向けバランス制御を強調。

Claude Code

v2.1.220リリース — バックグラウンドセッション管理の安定性修正でエージェント長時間運用の信頼性が向上

7月25日にClaude Code v2.1.220リリース。バグ修正と信頼性改善に焦点を当てたリリース。主な修正: (1)完了済みバックグラウンドセッションが`claude rm`やエージェントビューから削除できない問題の修正、(2)非gitフォルダから起動したバックグラウンドセッションがエージェントビューで削除不能になる問題の修正、(3)停止済みバックグラウンドセッションの再オープン時に保存済み会話が復元されない問題の修正、(4)長時間セッションのメモリリーク修正(MCP stdio サーバーstderr蓄積・LSPドキュメント保持・ヘッドレス/SDKセッションの無制限増大)。v2.1.219のOpus 5デフォルト化翌日のフォローアップリリースとしてバックグラウンドエージェント運用の基盤を安定化。

Claude API

Opus 5 System Card公開 — ASL-3保護・安全性分類器Fable 5比85%低エンゲージメント・30日データ保持義務なし・CB-1分類でセキュリティと利便性を両立

7月24日にAnthropicがClaude Opus 5 System Cardを公開。主要な安全性評価結果: (1)ASL-3保護レベル(Opus 4.8と同一)でResponsible Scaling Policy準拠、(2)安全性分類器のエンゲージメント頻度がFable 5比85%低減 — Fable 5の誤検知問題(正規リクエストのOpus 4.8リルート)がOpus 5では大幅に緩和、(3)30日データ保持義務なし — Fable 5・Mythos 5には必須の30日データ保持がOpus 5には不適用、プライバシー要件の厳しいワークロードに適合、(4)化学・生物兵器リスクはCB-1分類(既知兵器合成に関連するがCB-2「新規兵器合成」には該当せず)でMythos 5のCBリスクを超えない、(5)新規追加ベンチマークCyScenarioBench・ExploitGymでサイバーセキュリティ能力を評価 — Opus 4.8を上回るがMythos 5には及ばない、脆弱性特定は改善するも悪用能力は限定的、(6)プロンプトインジェクション耐性がコーディング・コンピュータユース・ブラウザユースの全カテゴリで最大の改善。UK AI Security Instituteの外部サイバーレンジテストも実施。

Claude API

Opus 4.7 Fast Mode本日完全削除(7月24日発効) — speed: "fast"リクエストがエラーを返却、Opus 4.6と異なりstandard速度へのフォールバックなし

6月25日にdeprecatedとなったClaude Opus 4.7のFast Modeが本日(7月24日)完全削除。`claude-opus-4-7`に`speed: "fast"`を指定したリクエストはエラーを返却する。重要な違いとして、Opus 4.6はFast Mode削除後もstandard速度にフォールバックする「グレースフルデグレーション」設計だったが、Opus 4.7はフォールバックなしでリクエストが完全に失敗する。移行先はOpus 4.8 Fast Mode($10/$50 per MTok)で、Opus 4.7 Fast Mode($30/$150)と比較して3倍のコスト削減と性能向上を同時に達成可能。Claude Code v2.1.154以降はデフォルトがOpus 4.8のため影響は最小限だが、CI/CDパイプラインやAPIクライアントで`claude-opus-4-7` + `speed: "fast"`をハードコードしている場合は即時修正が必要。

MCP

MCP 2026-07-28最終仕様公開まで残り4日 — ステートレスコア・OAuth 2.1認証強化・3機能廃止の最終準備期限

Model Context Protocolの史上最大改訂となるMCP 2026-07-28最終仕様の公開まで残り4日。5月21日のRelease Candidate公開から10週間の検証期間を経て7月28日に最終仕様が確定する。主要な変更点: (1)ステートレスコアへの移行 — `initialize`ハンドシェイク・`Mcp-Session-Id`を廃止し全リクエストが自己完結型に、スティッキーセッション・共有セッションストア・ディープパケットインスペクションが不要に、(2)OAuth 2.1認証強化 — 6つのSpecification Enhancement ProposalsでMCPサーバーがOAuth 2.1リソースサーバーとして位置づけ、Enterprise Managed Authorization(EMA)がstable昇格、(3)3機能のdeprecation — Roots・Sampling・Loggingに12ヶ月の廃止猶予期間、(4)Extensions Framework正式化 — MCP Apps(サンドボックスiframe内HTML UI)・Tasks(ステートレス長時間ジョブ)が拡張として昇格。Beta SDK(Python v2・TypeScript v2・Go・C#)での検証が進行中。

Anthropic

Claude Voice Mode新スピーチモデルで音声会話品質が刷新 — 自然なイントネーション・低レイテンシ応答・多言語拡張・カスタマイズ可能な音声

7月23日にAnthropicがClaude Voice Modeの包括的アップグレードを実施。7月23日のニュースで報じたOpus・Sonnet・Haikuのモデル選択機能に加え、新スピーチモデルの導入により音声合成・音声認識の品質が大幅に向上。具体的な改善点: (1)より自然なイントネーション — 会話文脈に適応した抑揚・リズムで機械的な読み上げ感を大幅低減、(2)低レイテンシ応答 — ユーザー発話から応答までの遅延を短縮しリアルタイム会話体験を改善、(3)多言語サポート拡張 — 対応言語の追加(詳細は未公表)、(4)カスタマイズ可能な音声 — 音声キャラクターの選択とシナリオ別の調整が可能に、(5)コンテキスト保持の改善 — 長い音声会話での文脈理解が向上、(6)安全性制御の強化。デスクトップ・モバイル・Webの全プラットフォームで利用可能。テキストと音声モードの会話中切り替えも対応。

Claude Code

Claude Security Plugin公開ベータ — マルチエージェント脆弱性スキャナーがClaude Codeプラグインとして利用可能に

7月22日にAnthropicがClaude Security PluginをClaude Code向け公開ベータとしてリリース。`/plugin install claude-security@claude-plugins-official`でインストールし、`/claude-security`コマンドからScan codebase・Scan changes・Suggest patchesの3機能を利用可能。技術的アーキテクチャとして複数のClaudeエージェントがチームとして動作: アーキテクチャマッピング→脅威モデル構築→脆弱性探索→独立レビューの4段階で検出精度を確保。インジェクション・認証バイパス・メモリ破損・ロジックエラー等の高重大度脆弱性に焦点。スキャン結果は`CLAUDE-SECURITY-<timestamp>/`ディレクトリに出力され、パッチ提案は`git apply`で手動適用(自動適用なし)。既存の`/security-review`(単一パス)やCode Review(PR時)と異なり、深層マルチエージェントスキャン層として位置づけ。Dynamic Workflows有効化・Python 3.9.6+・Claude Code v2.1.154+が前提。

過去のニュースをすべて見る →