Monitoring

Claudeの動向を、
毎日観測する。

Claude関連の最新ニュース・ベストプラクティスを日次で自動収集。公式発表からコミュニティの知見まで、シグナルを逃さず記録します。

Articles
1417
Days
184
Last Scan
09/29
Claude API

Claude Sonnet 5.5発表 — Sonnet 5比30%高速・タスクあたり最大30%コスト削減、Terminal-Bench 70.6%でOpus 5.5を上回りSonnet初のサイバーセーフガード搭載

9月28日にAnthropicがClaude Sonnet 5.5(`claude-sonnet-5-5`)を全プラットフォーム(Claude Platform・AWS・Google Cloud・Microsoft Azure)で発表。入力$2/出力$10でSonnet 5と同一価格を維持しつつ、出力生成速度30%超高速化・タスクあたりコスト最大30%削減を実現。Terminal-Bench 4.0で70.6%(Sonnet 5: 10.3%・Opus 5.5: 66.4%を上回る)、SWE-Bench Pro 81.3%、CursorBench 4.0で55.5%、GDPval-AA v2.1で1844 Eloを記録。1Mトークンコンテキスト・128K max output tokens・adaptive thinking常時有効。Sonnet初のサイバーセーフガード搭載でOpus 5並のセキュリティ能力を提供。Low/Medium effortでSonnet 5のベストスコアを約10分の1のタスクコストで上回る効率性。ゼロデータ保持対応。Opus 5.5リリースから6日後の発表で5.5ファミリー第2弾。

Claude Code

Claude Code v2.1.284リリースでSonnet 5.5がデフォルトSonnetモデルに — Auto Mode読み取り確認改善・effortスライダーキーバインド追加で53連続安定化リリース

9月28日にv2.1.284リリース。Claude Sonnet 5.5(`claude-sonnet-5-5`)がデフォルトSonnetモデルに変更され、1Mコンテキスト・$2/$10・キャッシュ読取$0.20/MTokで利用可能。Auto Modeにワーキングディレクトリ外読み取り時の「Yes, but ask again next time」応答オプションが追加され一時的許可の粒度が向上。effortスライダーのキーバインドアクション追加でキーボードからのeffort切替が効率化。v2.1.224以降53連続安定化リリースでCI/CDターゲットはv2.1.284に更新推奨。

Claude API

Sonnet 5.5独立ベンチマーク初期評価 — Artificial Analysis Intelligence Index #2・BenchAlign #5でフロンティア性能を独立確認、max effort時コスト効率にはOpus 5.5との逆転あり

9月28日のSonnet 5.5リリースから24時間以内にArtificial Analysis・BenchAlign・Vellum・OfficeChai・Kingy AI等が独立ベンチマーク評価を公開。Artificial AnalysisではIntelligence Index max effort 56でOpus 5.5(58)に次ぐ#2、BenchAlignでは201モデル中#5(80.49/100)を記録。ただしArtificial Analysisのmax effort測定でタスクあたりコスト$7.60・193K出力トークン/タスクとなりOpus 5.5($5.98)より高コストとなるケースが判明。Low/Medium effortでの効率性がAnthropicの「30%コスト削減」主張の根拠であり、effortダイヤル活用がコスト最適化の鍵。OfficeChai分析ではGPT-6 Solの一部ベンチマークを上回ることも確認。

Claude Code

Claude Sonnet 5.5がGitHub Copilotで即日GA — Copilot Pro/Pro+/Max/Business/Enterprise全プランで利用可能、Sonnet 5比で少ないステップ・トークン・ツール呼び出しで同等性能

9月28日にGitHub CopilotでClaude Sonnet 5.5が即日GA。Copilot Pro・Pro+・Max・Business・Enterprise全有料プランで利用可能。GitHub Changelogによると、早期テストでSonnet 5.5はSonnet 5と同等のコーディングタスク成果をより少ないステップ・トークン・ツール呼び出しで達成し、タスク完了速度も顕著に高速化。1Mトークンコンテキスト・128K出力上限・2026年6月知識カットオフ。Copilot使用量ベース課金でプロバイダーリスト価格が適用。Sonnet 5のCopilot GA(6月30日)から約3ヶ月でのモデル更新即日追従パターンが継続。段階的ロールアウトのため一部ユーザーには表示されるまで時間がかかる場合あり。

Anthropic

Anthropic × Infosys戦略パートナーシップ — 通信・金融・製造の規制セクター向けAIエージェント共同開発、Claude Agent SDK+Infosys Topaz統合でAnthropic CoEを設立

9月28日にAnthropicとInfosysが規制セクター向けAIエージェント共同開発の戦略パートナーシップを発表。通信・金融サービス・製造・ソフトウェア開発の4業界を対象に、Claude API・Claude Agent SDK・Claude CodeとInfosys Topazプラットフォームを統合。通信セクターから開始し専用Anthropic Center of Excellence(CoE)を設立。従来のAIコパイロットとは異なり、保険請求処理・コンプライアンスレビュー・ネットワーク運用管理・コード生成テストデバッグを自律実行するエージェンティックAIに焦点。Amodei CEO「デモで動くAIモデルと規制産業で動くAIモデルにはギャップがある。Infosysは通信・金融・製造の重要産業でまさにその種の専門性を持っている」と声明。PwC・KPMG・UST・EPAM・Cognizant・BMS・Salesforceに続くエンタープライズパートナーエコシステムのさらなる拡大。CIO Dive・SQ Magazine・FinTech Magazine・Tech

Anthropic

Anthropic IPO目論見書がReutersにリーク — 2025年収益$4.59B(前年比1,088%増)・$518Bインフラコミットメント・$41.97B純損失の財務詳細が判明、中間選挙後$2T+評価額上場を準備

9月28-29日にReutersがAnthropicの未公開IPO目論見書を入手し主要財務データが報道。2025年収益$4.59B(2024年$387Mから1,088%急増)、純損失$41.97B(2024年$8.31Bから拡大、大半が会計上の非現金チャージ)、$518Bの将来クラウド・コンピュート・インフラコミットメント、2025年のコンピュート・インフラ支出$7.33B(2024年比3倍)。米中間選挙(11月3日)後の$2T+評価額でのNasdaq上場を準備中。Yahoo Finance・FortuneIndia等が「$42B loss」の見出しで報道するも大半は非現金チャージ(株式報酬・インフラ資産減価償却等)で調整後営業利益は2026年Q2に初黒字を達成済み。$518Bインフラコミットメントは従来報道の$170B超推計を大幅に上回りSpaceX・Amazon・Google・TeraWulf・Nscale・Lambda・Akamai等との長期契約の総額が初めて公式に開示。IPO公開S-1のEDGAR正式提出は10月初旬見込み。

Anthropic

Claude Marketplace拡大でCrowdStrike・Cursor・Vercel等が参加 — 2,000+プラグイン・コネクタのエコシステムがセキュリティ・開発・デプロイメントの全領域に拡張

AnthropicがClaude Marketplaceを拡大し、CrowdStrike(Falconプラットフォーム)・Cursor・Factory・Gamma・Vercelの5社が新たに参加。Marketplaceは2,000+のコネクタ・プラグインを提供し、Atlassian・Google・Microsoft・Notion・Salesforce等の主要SaaSと統合。CrowdStrikeは既存のAnthropicコミットメントの一部でFalcon製品を購入可能にする新チャネルを開設。Harvey・Legora・Lovable・Snowflake等のClaude搭載エージェント・製品も購入可能。

Claude API

Mid-Conversation Inline Toolsベータ(inline-tools-2026-09-15)でプロンプトキャッシュ維持のままツール動的追加が可能に — エージェントループのコスト効率とツール管理柔軟性が同時向上

Opus 5.5リリース(9月22日)と同時に公開されたinline-tools-2026-09-15ベータヘッダーにより、mid-conversation system message内でツール定義の追加・変更が可能に。`tool_addition`ブロックでツール名・説明・入力スキーマを完全定義でき、トップレベルのtools配列を変更せずにプロンプトキャッシュプレフィックスを維持。MCP connector対応では`mcp-client-2026-09-15`ヘッダーとの併用でサーバーのツールリストを`mcp_tool_listing`ブロックに記録。

Claude API

Cache Diagnostics正式GA化でベータヘッダー不要に — APIキャッシュミス原因の可視化が本番SLA対象として設計可能に

9月23日のPlatform Release Notesで発表。cache-diagnosis-2026-04-07ベータヘッダーが不要となりCache Diagnostics機能が正式GA化。Messagesリクエストにdiagnosticsオブジェクトを含めることでオプトイン、レスポンスのdiagnosticsフィールドにキャッシュミス原因が返却される(未指定時はnull)。旧ベータヘッダーを送信し続けるリクエストも引き続き動作し後方互換性を維持。

Claude API

Claude API Refusal Billing変更 — bio・frontier_llm・reasoning_extractionカテゴリの出力前拒否が課金対象に復帰

9月24日のPlatform Release Notesで発表。`stop_details.category`がbio・frontier_llm・reasoning_extractionの3カテゴリについて、出力前拒否(refusal)の課金を再開。これらのカテゴリは誤検知率が低いため課金対象に復帰。mid-stream refusalは従来通り課金、その他のカテゴリの出力前拒否は引き続き無料。全プラットフォーム(Claude API・Bedrock・Vertex AI・Foundry)に適用。

Anthropic

SAFA反対派報道が「自分の宿題を自分で採点」フレーミングで国際拡大 — Forkast・TheStreet・Yahoo News等がSAFA基準の独立性・拘束力の構造的課題を詳報

9月27-28日にForkast・TheStreet・Yahoo News・eTV Bharat等がSAFA(Standards Authority for Frontier AI)の構造的課題を詳報。Forkastは「Big AI Just Started Grading Its Own Homework」「Three Frontier Labs Are Building a FINRA-Style Safety Body. History Suggests It Won't Be a Brake.」の2本記事でFINRA型自主規制の歴史的限界を分析。TheStreetは「3社の動きの背景」として2回目のトレーニング停止(training halt)からの3日後のタイミングを指摘。Meta・xAI・Nvidia反発の継続とCondoleezza Rice理事長候補・Krishnan/Prabhakar CEO候補の人事が焦点に。

Anthropic

DC Circuit判決後の法的展望 — Breaking Defense・Hoodline分析で「次は何か」としてen banc rehearing・最高裁上訴・第2訴訟の3経路が提示

9月25日のDC Circuit控訴裁2-1判決後、Breaking Defense・Hoodline・CNBC等が法的展望を詳報。Anthropicの選択肢として(1)en banc rehearing(DC巡回控訴裁全判事での再審理)、(2)最高裁上訴、(3)係属中の第2訴訟の継続の3経路が提示。判決はFASCSA 2018に基づく行政権限の範囲に関するもので、8月28日のLin判事による「違法な報復」認定とは異なる法的論点。Anthropicは安全性方針を堅持しつつ「全選択肢を検討中」と声明。

Anthropic

Anthropic × Akamai $11.6B・7年クラウドインフラ契約でインフラ十五系統化 — 最大$20B拡張・Akamai株式約5%ワラント付与でCPUワークロード向け分散クラウド基盤を大規模確保

9月24-25日にAkamaiがAnthropicとの$11.6B・7年間クラウドインフラ契約を発表。CPU集約型ワークロード向けにAkamaiの分散クラウドインフラを提供し、最大$9B追加で合計$20B規模に拡張可能。AkamaiはAnthropicに対し発行済株式の約5%に相当するワラントを付与($11.6Bコミットメントで約2%が権利確定、$3B追加ごとに約1%追加確定)。Akamaiは2026年に約$17億の追加設備投資を見込み、$11.6Bコミットメント関連の総設備投資は約$55億。

Anthropic

SAFA設立にMeta・xAI・Nvidiaが反発 — 「3社だけの合意は業界コンセンサスではない」と批判、高テスト基準による参入障壁化の懸念が拡大

9月25日のSAFA(Standards Authority for Frontier AI)正式発表後、Meta・xAI・NvidiaがDreamforce(9月15日)での公開反発を継続。CIO・Computerworld分析で「フロンティアAIを競い合う企業がそのガバナンスも支配する構造」への独立性懸念が拡大。高テスト基準が3社の市場支配を固定化しオープンソース開発者を排除する参入障壁となるリスクが指摘され、ホワイトハウスが「まず業界コンセンサスを得よ」と差し戻した経緯も判明。

Claude API

Opus 5.5独立ベンチマーク第3波でSonarSource 27.5%コード削減・CodeRabbit OSS検出率微増を確認 — 公式値vs独立値の乖離がモデル選択における複数ソース参照の必須性を定量実証

9月24-27日にSonarSource・CodeRabbit・Vellum・Kingy AI・BenchLM・eesel AI等がOpus 5.5の独立ベンチマーク第3波を公開。SonarSourceはHumanEval/MBPP 87.7%パスで27.5%少ないコード・40%少ないトークン消費を確認。Artificial Analysis Intelligence Index max effort 58で測定史上最高を記録する一方、Terminal-Bench 4.0では59.6%でAnthropic発表値66.4%との6.8pt乖離が継続。Gray Swanセキュリティテストでプロンプトインジェクション成功率がFable 5.1と同率の最低記録。

Anthropic

DC Circuit控訴裁がPentagonのAnthropic「サプライチェーンリスク」指定を2-1で支持 — 8月28日地裁勝訴判決を覆し防衛省Claude利用禁止が復活

9月25日にDC巡回控訴裁判所が2-1でPentagonのFASCSA 2018に基づくサプライチェーンリスク指定権限を支持し、8月28日のRita Lin判事による恒久的差止命令を覆した。Anthropicは自律型致死兵器・国内大規模監視への利用禁止という安全性方針を堅持しつつ「さらなる審理を含む全選択肢を検討中」と声明。別の連邦裁判所での第2訴訟も係属中で法的状況は流動的。防衛契約者のClaude利用禁止復活でIPO 11月計画にリスク要因が追加された。

Claude API

Anthropic「Project Swap」で201名参加の自律AIエージェント書籍取引市場を運営 — モデル能力がプロンプト設計より交渉成果に大きく影響

9月24日にAnthropic研究ブログで公開。6オフィスの201名社員が参加し各自のClaudeエージェントが分散型取引市場で自律交渉。5分間の嗜好会話で61%ペアワイズ一致(人気度ベース・協調フィルタリングを上回る精度)。モデルアーキテクチャ(能力)がプロンプト指示(prosocial/ruthless等)より交渉パフォーマンスに大きく影響し「モデル選択>プロンプト最適化」が定量実証された。参加者は7.2/10満足度で年間書籍予算30%をAI委任可能と回答。

Anthropic

DC Circuit控訴裁がPentagonのAnthropic「サプライチェーンリスク」指定を支持 — 8月28日地裁勝訴判決を2-1で覆し防衛省のClaude利用禁止が復活

9月25日にDC巡回控訴裁判所が2-1でPentagonのAnthropic「サプライチェーンリスク」指定を支持する判決を下した。8月28日のRita Lin判事による地裁勝訴判決(恒久的差止命令)を覆す結果となり、防衛省および防衛契約者のClaude利用禁止が復活。Anthropicは「判決に敬意を持って同意しかねる。さらなる審理を含むすべての選択肢を検討中」と声明。

Anthropic

SAFA(Standards Authority for Frontier AI)が正式発表 — Condoleezza Riceが理事長候補・Krishnan/Prabhakarが CEO候補で2026年末〜2027年初ローンチ予定

9月25日にGoogle・OpenAI・Anthropicの3社がStandards Authority for Frontier AI(SAFA)の設立を正式発表。元国務長官Condoleezza Riceが理事長候補、元ホワイトハウスAI政策顧問Sriram Krishnanと元OSTP長官Arati Prabhakarが CEO候補として交渉中。リリース前独立テスト・インシデント報告制度・監査人資格基準が共通合意事項で、ホワイトハウスの行政命令案断念を受け政府監督なしの自主規制体として進行。

Claude API

Opus 5.5「Claudish」文体問題の根本原因をAnthropicエンジニアが公式説明 — 数学・コード訓練の副作用でBox報告40%トークン削減・SonarSource 27.5%コード削減が独立確認

9月23日にAnthropicエンジニアJackson Kernionが「Claudish」文体問題の根本原因を公式説明 — Claude Opus 4.6以降の定型的・冗長な文体はAIシステム向け数学・コード・技術説明の訓練の副作用と判明。Opus 5.5では重要情報の先出し・専門用語の削減・ライティング指示への準拠向上が改善され、Box社は40%トークン削減・SonarSourceは27.5%コード削減を独立確認。

過去のニュースをすべて見る →