Monitoring

Claudeの動向を、
毎日観測する。

Claude関連の最新ニュース・ベストプラクティスを日次で自動収集。公式発表からコミュニティの知見まで、シグナルを逃さず記録します。

Articles
945
Days
121
Last Scan
07/28
MCP

MCP 2026-07-28最終仕様が本日公開 — ステートレスコア・Extensions Framework・MCP Apps・Tasks拡張・OAuth 2.1統合でMCP史上最大の仕様改訂が確定

5月21日のRelease Candidate公開から10週間の検証期間を経て、MCP 2026-07-28最終仕様が本日公開。10,000超パブリックサーバー・月間9,700万SDKダウンロードに影響するMCP史上最大の仕様改訂。ステートレスプロトコルコアへの移行(`initialize`ハンドシェイク・`Mcp-Session-Id`完全廃止)でスティッキーセッション・共有セッションストア・DPIが不要に。Extensions Framework正式化でMCP Apps(サンドボックスiframe HTML UI)・Tasks(長時間ジョブ管理)が公式拡張に。OAuth 2.1 + OpenID Connect準拠の認証強化6項目(`iss`パラメータ検証・`application_type`宣言・クレデンシャルバインディング等)。sampling・roots・loggingの3機能が12ヶ月猶予付き廃止予告。JSON Schema 2020-12サポート拡張(`oneOf`・`anyOf`・`allOf`・`$ref`対応)。W3C Trace Context伝搬でOpenTelemetry互換分散トレーシングが標準化。

Anthropic

Fable 5がMax・Team Premiumプランで恒久的アクセスに確定 — 50%週間使用量枠で追加コストなし、3ヶ月の混乱に終止符

7月20日発効でClaude Fable 5がMax・Team Premiumプランに恒久的に含まれることが確定。週間使用量の50%をFable 5に使用可能で追加コスト不要。6月12日の輸出管理停止→7月1日復旧→7月7日→12日→19日のサブスクリプション離脱延長を経て、SpaceX Colossus 1等のインフラ拡大を背景に恒久的アクセスが実現。Pro・Team Standard利用者は一回限り$100クレジット付与後usage credits($10/$50)のみ。Claude Code利用者はMax/Team Premiumであれば`/model`でFable 5を選択し追加コストなしでフロンティア級性能を利用可能に。

Claude Code

Claude Code週間使用量50%増加が8月19日まで延長(4度目)確定 — Sonnet 5導入価格終了(8月31日)との12日差で8月下旬コスト変更集中

Claude Code週間使用量50%増加プロモーションが8月19日まで延長(4度目)。5月13日開始のプロモーションが3ヶ月超に渡り継続。Pro・Max・Team・seat-based Enterprise対象。Sonnet 5導入価格$2/$10(8月31日終了予定)との間に12日差があり、8月下旬にコスト変更が集中。Fable 5 Max/Team Premium恒久化との組み合わせで、8月19日までがDynamic Workflows・大規模並列サブエージェントワークフローのコスト最適実行期間。

Claude API

Opus 5がArtificial Analysis 586モデル中Intelligence Index・Agentic Index共に#1 — AA-Briefcase Elo +146ptでFable 5を明確に上回りコスト26%低減

Artificial Analysisの独立評価でOpus 5がIntelligence Index v4.1スコア61(586モデル中#1、Fable 5: 60、GPT-5.6 Sol: 59)、Agentic Index 55.3(#1、GPT-5.6 Sol: 54.0、Fable 5: 52.8)を記録。AA-Briefcase(エージェンティック知識作業ベンチマーク)でElo 1720(Fable 5: 1574、+146pt)。Cost per TaskがFable 5比26%低コスト。SWE-bench Pro 79.2% vs GPT-5.6 Sol 64.6%(+14.6pt)、ARC-AGI 3 30.2% vs 7.8%(3.9倍)、CursorBench 3.2でFable 5の0.5%差・コスト半額。12ベンチマーク中9勝でGPT-5.6 Solに対する定量的優位が確認。

MCP

MCP 2026-07-28セキュリティ分析: Akamai・Backslash等が最終仕様の3つの新攻撃面を特定 — セキュリティ責任がプロトコルから開発者実装に完全移転

MCP 2026-07-28最終仕様の公開日にAkamai・Backslash Security・SC Media等の複数セキュリティ企業が独立分析を公開。ステートレス化でセッションハイジャック・サーバー起動プロンプトの2つの歴史的脆弱性は排除されたが、新たに(1)タスクハンドル予測によるワークフローハイジャック・テナント間不正アクセス、(2)MCP Apps(サンドボックスiframe HTML UI)の保存型XSS、(3)Tasks拡張のリソース枯渇DoSの3つの新攻撃面が特定。「セキュリティ境界の責任がプロトコル自体から開発者の実装品質に完全移転」との共通評価。OAuth 2.1必須化・W3C Trace Context伝搬は改善だが、タスクハンドルの暗号化・CSP設定・リソース制限は開発者が自前実装する必要がある。

MCP

MCP TypeScript SDK v2: パッケージ名変更(バージョンアップではない)でCommonJSプロジェクトの移行計画が必須 — @modelcontextprotocol/sdk → server + client分割

MCP 2026-07-28最終仕様に対応するTypeScript SDK v2が従来の`@modelcontextprotocol/sdk`のバージョンアップではなく、`@modelcontextprotocol/server`と`@modelcontextprotocol/client`の2つの新パッケージとしてnpmに公開。旧パッケージはv1のまま維持。「バージョンを上げるだけ」では移行できない根本的な変更。ESM-only(CommonJS `require()`非対応)でCommonJSプロジェクトのモジュールシステム移行が必要。Python SDK v2では`FastMCP`→`MCPServer`にリネーム。Go v1.7.0-pre.1・C# v2.0.0-preview.1も同時公開。全SDKでステートレスプロトコルの2026-07-28リビジョンサポートはオプトイン — アップグレード自体では通信プロトコルは変わらない。

MCP

MCP 2026-07-28最終仕様が明日公開 — GitHub MCP Serverが先行対応完了、10,000超サーバー・月間9,700万SDKダウンロードのエコシステムに影響する「MCP史上最大の仕様変更」

MCP 2026-07-28最終仕様が明日(7月28日)公開確定。5月21日のRelease Candidate公開から10週間の検証期間を経て最終化。GitHub MCP Serverが7月23日に先行対応を完了し、新仕様への移行パターンの参照実装となっている。ステートレスコア移行(`initialize`ハンドシェイク・`Mcp-Session-Id`廃止)でスティッキーセッション不要・ラウンドロビンLB運用が可能に。sampling・roots・loggingの3サブシステムが12ヶ月猶予付きで廃止予告。Extensions Framework正式化でMCP Apps(サンドボックスHTML UI)・Tasks(長時間ジョブ管理)がextensionとして標準化。OAuth 2.1が認証標準に昇格。TypeScript SDK v2がESM-only+パッケージ分割で既存CommonJSプロジェクトに影響。10,000超パブリックサーバー・月間9,700万SDKダウンロードに影響する「MCP史上最大の仕様変更」。v1サーバーは即時破壊なしだが新旧リビジョン間の相互運用性は非保証。

Claude API

Opus 5コミュニティ初期レビューが「ベンチマーク首位だが使いにくい」で二分 — SWE-bench Verified 97%・Intelligence Index #1でも「over-eager」「neurotic」の批判が顕在化

Opus 5リリース後72時間のコミュニティ反応が複数メディアで集約。Hacker Newsで1,378ポイント・746コメントを記録し「異例の関心度」。ベンチマーク面ではSWE-bench Verified 97.00%(GPT-5.6 Sol: 96.20%・Fable 5: 95.00%)で首位、Artificial Analysis Intelligence Index 61で586モデル中#1と客観的指標では圧倒的。一方で実用面では批判が顕在化: (1)「How I AI」ホストClaire Voが「hate working with it」と評価 — 性格が「neurotic and insanely timid」で矛盾する指示に対しタスク放棄する傾向、ただしブラインドテストではFable 5・GPT-5.6を含む全モデル中#1に選出、(2)Lenny's Newsletterが「brilliant (but annoying)」と評価 — 求めていないイニシアティブを取り・長い応答を生成し・矛盾する指示で停止する傾向、(3)X(旧Twitter)ではmedium effortの品質とトークン効率に対する好意的反応が多い一方、Reddit・Hacker Newsではusage limits・モデル入れ替え頻度・安全性フォールバックへの懸念が中心。「ベンチマーク#1でも日常的な使いやすさでは改善余地あり」のパターンはFable 5リリース時と類似。

Claude API

Opus 5 effortダイヤル最適化戦略 — medium effortが一般コーディングの最適デフォルト、80/20ルール(80%をlow/medium・20%をhigh+)でコスト最適化が実用パターンに

Opus 5リリース後のコミュニティ検証でeffortダイヤル最適化戦略が集約。SitePointの「Claude Opus 5 Is Most Efficient at Medium Effort」記事やコミュニティのFrontierCode分析でmedium effortが一般コーディング(コード生成・デバッグ・リファクタリング・テスト作成)の最適デフォルトとして確立。lowでは6K出力トークン程度、highでは20K以上(大半がthinkingトークン)に増加しコスト差が直接的。推奨戦略: (1)80%のルーティントラフィックをlow/medium effortで処理 — 反復的タスク・予測可能フォーマットにlow、一般コーディングにmedium、(2)20%の高難度タスクにhigh/xhigh/maxを使用 — 大規模リファクタリング・アーキテクチャ設計・セキュリティ監査にmax、(3)「highから始めて必要に応じて上下」ではなく「mediumから始めて品質不足時のみ上げる」アプローチが推奨。effortダイヤルのGA化(ベータヘッダー不要)でこの最適化が全ユーザーに即時適用可能。

Anthropic

Anthropic IPOロードショーが本格始動 — Goldman Sachs・Morgan Stanley・JPMorgan面談進行中、$965B→$1T超評価額で10月メガIPO確定的

Bloomberg・CNBC・StartupHub等の複数報道でAnthropicのIPOロードショーが実行段階に入ったことが確認。Goldman Sachs・Morgan Stanley・JPMorganが投資家ミーティングをスケジュール中。6月1日のS-1機密提出→7月投資家ミーティング→10月上場のタイムラインが進行。5月Series H $65Bでの$965B評価額がベースラインだが$1T超での上場が見込まれる。年率収益$47B(7月末までに$50B到達目標)で「エンタープライズソフトウェア企業としてIPO時の史上最速収益スケーリング」。IPOは通常4-8週間前にロードショーが開始されるため、7月中旬の開始は10月上場スケジュールと整合。OpenAI($852B・9月)との「兆ドルIPO」二重戦線が2026年Q4のAI業界最大イベントに。

Anthropic

Claude共有チャットがGoogle検索結果に露出 — APIキー・暗号資産ウォレット情報・履歴書等の機密データが公開検索可能に、noindexタグ欠落が根本原因

7月25日にReddit投稿で発覚し7月26-27日に複数メディアが報道。Anthropicのclaude.ai共有チャット機能(`claude.ai/share/`)で共有された会話が、noindexメタタグの欠落によりGoogle検索結果にインデックスされ、`site:claude.ai/share`検索で数百件の会話が公開発見可能な状態に。露出したデータにはAPIキー、暗号資産ウォレット詳細、実名・電話番号付き履歴書、弁護士の倫理案件メモ、社会保障番号と思われるデータが含まれる(IBTimes・BeInCrypto・GBHackers報道)。根本原因は共有リンクページにnoindexディレクティブが設定されておらず、フォーラム・SNS等で共有されたURLを検索エンジンがクロール・インデックス可能だったこと。Anthropicは7月27日までにrobots.txt更新・noindexタグ追加で対応しGoogle側のインデックス削除は概ね完了。ただしBing検索結果やサードパーティのスクレイプコレクションは完全除去が困難。CyberSecurityNews・IBTimes UK・BeInCrypto・GBHackers・Mallory AI等が報道。

Claude API

Claude API新機能: Mid-conversation Tool Changes(ベータ)でエージェントのプログレッシブ・ディスクロージャーパターンが実現 — ツール追加・削除をプロンプトキャッシュ維持しつつ会話中に動的制御

Opus 5リリースと同時にmid-conversation tool changes(ベータ)が全対応モデル(Fable 5・Mythos 5・Opus 4.8・Opus 5)で利用可能に。`mid-conversation-tool-changes-2026-07-01`ベータヘッダーで有効化。会話のツール一覧を初回に全定義した上で、ターン間で`tool_addition`・`tool_removal`ブロックを使い特定ツールの有効化・無効化を動的に制御。プロンプトキャッシュを維持しつつツール構成を変更可能。既存のmid-conversation system messagesとの組み合わせでエージェントの行動制御がターン単位で精密化。Claude API・Amazon Bedrock・Google Cloudの全プロバイダーで利用可能。

Claude API

Claude API新機能: Default Fallbacksモード(ベータ)で安全性分類器によるrefusalの自動フォールバックルーティングが実現 — モデルリスト管理不要の「おまかせ」フォールバック

Opus 5リリースと同時にserver-side fallbackの`"default"`モードが追加(`server-side-fallback-2026-07-01`ベータヘッダー)。`fallbacks`パラメータに`"default"`を指定すると、安全性分類器がリクエストをブロックした際にAnthropicが推奨するフォールバックモデルにrefusalカテゴリ別で自動ルーティング。従来のexplicit-list形式(特定モデルを明示指定)に加え、Anthropicの推奨に追従する「おまかせ」モードが選択可能に。推奨モデルリストはAnthropic側で更新されるためクライアント側のメンテナンスが不要。Opus 5・Fable 5の安全性分類器誤検知時のフォールバックがシームレスに実現。

MCP

MCP 2026-07-28最終仕様公開まで残り2日 — 12ヶ月猶予期間付きdeprecationでsampling・roots・logging廃止、ステートレスコア+Extensions Framework正式化

MCP 2026-07-28最終仕様公開まで残り2日。Release Candidateは5月21日から10週間の検証期間を経て7月28日に確定。主要変更の最終確認: (1)ステートレスコア — `initialize`ハンドシェイク・`Mcp-Session-Id`廃止でスティッキーセッション不要、通常のラウンドロビンロードバランサーで運用可能に、(2)deprecated機能(sampling・roots・logging)は12ヶ月の機能維持猶予付き — 即時破壊はなし、(3)Extensions Frameworkが正式化 — MCP Apps(サンドボックスHTML UI)・Tasks(長時間ジョブ管理)がextensionとして位置づけ、(4)OAuth 2.1が認証標準に昇格 — 6つのSpecification Enhancement Proposalで認可フレームワーク強化。Beta SDK: Python v2.0.0b1・TypeScript v2(ESM-only・パッケージ分割)・Go v1.7.0-pre.1・C# v2.0.0-preview.1。10,000超パブリックサーバー・月間9,700万SDKダウンロードのエコシステムに影響。

Claude API

Opus 5 vs GPT-5.6 Sol詳細ベンチマーク比較 — SWE-bench Pro +14.6pt・ARC-AGI 3で3.9倍・12ベンチマーク中9勝でOpus 5が$5/$25の価格優位と共に総合リード

Opus 5リリース後のコミュニティ詳細ベンチマーク比較が集約。Opus 5($5/$25)vs GPT-5.6 Sol($5/$30)の直接比較: SWE-bench Pro 79.2% vs 64.6%(+14.6pt)、ARC-AGI 3 30.2% vs 7.8%(3.9倍)、Frontier-Bench 43.3% vs 34.4%、GDPval-AA v2 Elo 1,861 vs n/a。12ベンチマーク中9つでOpus 5がリード。CursorBench 3.2でFable 5($10/$50)の0.5%差に迫りコスト効率で圧倒。AutomationBenchで

Claude API

Fortune: Opus 5のeffortダイヤルがB2Bチームの「AIコスト対能力トレードオフ」を初めてユーザー制御可能に — エンタープライズAI予算管理の新パラダイム

Fortune(7月24日)がOpus 5のeffortダイヤルをB2Bチーム向けの予算管理ツールとして分析。Opus 5はlow/medium/high/xhigh/maxの5段階effortダイヤルをベータヘッダー不要で全ユーザーに提供。lowでは高速・低コスト応答、maxではFable 5に迫る性能を$5/$25で実現。Fast Mode(Research Preview)は2.5倍速・$10/$50でさらなる高速化オプション。Fortuneは「AI予算がブラックボックスだった企業が初めてタスク別のコスト・品質トレードオフを明示的にコントロール可能に」と評価。Uberの$3.4B予算超過・Microsoft E+D部門の$500-2,000/月/エンジニアの事例を踏まえ、effortダイヤルがエンタープライズAI予算の予測可能性を根本的に改善すると分析。

Anthropic

TechTimes: Opus 5がUK AISI政府サイバーテストでエンタープライズネットワーク攻撃を8/10回完遂 — 最低ミスアラインメントスコアと高サイバー能力の二面性が「運用管理強化」を要求

TechTimes(7月25日)がOpus 5 System Cardの中でも特にサイバーセキュリティ能力に焦点を当てて報道。UK AI Security Institute(AISI)がOpus 5の早期スナップショットで3つのマルチステップ・サイバーレンジ(エンタープライズネットワーク攻撃シミュレーション)を実施し、10回中8回で攻撃パス全体を完遂。UK AISIはOpus 5をMythos 5・Mythos Previewと「同等の能力ティア」に分類。一方でOpus 5のミスアラインメントスコア2.30は全Claudeモデル最低(最良)で、Opus 4.8(2.85)・Mythos 5(2.81)・Sonnet 5(3.35)を上回る。「最も整合的なモデルが高いサイバー攻撃能力を持つ」という二面性が浮き彫りに。Anthropicは自律性脅威モデル1をOpus 5に適用し、ASL-3保護レベル(Opus 4.8と同一)を維持。CyScenarioBench・ExploitGymの新規ベンチマークでサイバーセキュリティ能力の定量評価が標準化。

Claude API

Artificial Analysis: Opus 5がIntelligence Index・Agentic Index共に#1を獲得 — 586モデル中首位、Fable 5を上回りCost per Taskで26%優位

7月25日にArtificial AnalysisがOpus 5の独立評価結果を公開。Intelligence Index v4.1でスコア61を記録し、586モデル中#1を獲得。Fable 5(60)・GPT-5.6 Sol(59)・Kimi K3(57)を上回る。Agentic Indexでも55.3で首位(GPT-5.6 Sol: 54.0、Fable 5: 52.8)。独自ベンチマークAA-Briefcase(エージェンティック知識作業)ではElo 1720を記録し、Fable 5(1574)に146ポイント差。GDPval-AA v2とAA-Briefcaseの両方で過去最高スコアを記録。Cost per TaskではFable 5比26%低コストで同等以上の性能を実現。Artificial Analysisはリリース前にAnthropicと協力して評価を実施。「narrowly the most intelligent model」と評価し、Opus 5がフロンティアモデルの価格性能比を根本的に変えたと分析。

Claude API

【速報】Claude Opus 5正式リリース — Fable 5の半額でベンチマーク大半を上回り、full effortラダー(max含む)・thinking常時有効・512トークンキャッシュ最小長を搭載

7月24日にAnthropicがClaude Opus 5を正式リリース。モデルID `claude-opus-5`でClaude API・Amazon Bedrock・Google Cloud・Microsoft Foundryの全プラットフォームで即日利用可能。価格はOpus 4.8と同じ$5/$25 per MTokで、Fable 5($10/$50)の半額。Frontier-Bench 43.3%(Fable 5: 33.7%・Opus 4.8: 18.7%)でFable 5を大幅に上回り、SWE-bench Proでも1ポイント差に迫る。1Mコンテキスト(デフォルト・最大共に1M)、128K max output tokens。full effortラダー(low/medium/high/xhigh/max)をベータヘッダー不要で利用可能。thinkingが常時有効(adaptive thinkingがデフォルト)で、xhigh/maxではthinking無効化が400エラー(破壊的変更)。プロンプトキャッシュ最小長が1,024→512トークンに短縮。Fast Mode(Research Preview)はAPI直接のみ$10/$50。mid-conversation tool changes(ベータ)、default fallbacksモード(ベータ)も新機能として追加。

過去のニュースをすべて見る →