Monitoring

Claudeの動向を、
毎日観測する。

Claude関連の最新ニュース・ベストプラクティスを日次で自動収集。公式発表からコミュニティの知見まで、シグナルを逃さず記録します。

Articles
1400
Days
181
Last Scan
09/26
Anthropic

DC Circuit控訴裁がPentagonのAnthropic「サプライチェーンリスク」指定を支持 — 8月28日地裁勝訴判決を2-1で覆し防衛省のClaude利用禁止が復活

9月25日にDC巡回控訴裁判所が2-1でPentagonのAnthropic「サプライチェーンリスク」指定を支持する判決を下した。8月28日のRita Lin判事による地裁勝訴判決(恒久的差止命令)を覆す結果となり、防衛省および防衛契約者のClaude利用禁止が復活。Anthropicは「判決に敬意を持って同意しかねる。さらなる審理を含むすべての選択肢を検討中」と声明。

Anthropic

SAFA(Standards Authority for Frontier AI)が正式発表 — Condoleezza Riceが理事長候補・Krishnan/Prabhakarが CEO候補で2026年末〜2027年初ローンチ予定

9月25日にGoogle・OpenAI・Anthropicの3社がStandards Authority for Frontier AI(SAFA)の設立を正式発表。元国務長官Condoleezza Riceが理事長候補、元ホワイトハウスAI政策顧問Sriram Krishnanと元OSTP長官Arati Prabhakarが CEO候補として交渉中。リリース前独立テスト・インシデント報告制度・監査人資格基準が共通合意事項で、ホワイトハウスの行政命令案断念を受け政府監督なしの自主規制体として進行。

Claude API

Opus 5.5「Claudish」文体問題の根本原因をAnthropicエンジニアが公式説明 — 数学・コード訓練の副作用でBox報告40%トークン削減・SonarSource 27.5%コード削減が独立確認

9月23日にAnthropicエンジニアJackson Kernionが「Claudish」文体問題の根本原因を公式説明 — Claude Opus 4.6以降の定型的・冗長な文体はAIシステム向け数学・コード・技術説明の訓練の副作用と判明。Opus 5.5では重要情報の先出し・専門用語の削減・ライティング指示への準拠向上が改善され、Box社は40%トークン削減・SonarSourceは27.5%コード削減を独立確認。

Anthropic

DC Circuit判決でAnthropic IPO 11月計画にリスク要因が追加 — Pentagon利用禁止復活・反トラスト訴訟・SAFA設立の3要因が同週集中

Anthropic IPOの11月上場計画に対し、9月25日のDC Circuit控訴裁判決(Pentagon「サプライチェーンリスク」指定支持)が新たなリスク要因として追加。同週に反トラスト訴訟(Buist v. Anthropic)の国際報道拡大、SAFA設立発表も重なり、IPOロードショー中に安全性・法務・ガバナンスの3領域でリスク要因が集中。Forbes分析ではリテール投資家のプレIPOファンド流入が加速し$2T評価額への需要は維持。

Claude API

Anthropic「Project Swap」で自律AIエージェントが書籍取引市場を運営 — 201名参加・5分会話で嗜好61%一致、モデル能力がプロンプト設計より交渉成果に大きく影響

9月24日にAnthropicが「Project Swap」研究を公開。201名の社員が参加し、各自のClaudeエージェントが書籍取引市場で自律的に交渉。5分間の会話で嗜好の61%ペアワイズ一致を達成し、モデルアーキテクチャ(能力)がプロンプト指示よりも交渉パフォーマンスに大きく影響することが実証された。Opusが効率0.88、Haikuが0.75と、モデル能力と市場効率が強く相関。

Claude Code

Claude Code v2.1.283でゲートウェイprompt-idヒントヘッダー・availableModelsMatch exact・/doctor prompt-audit追加 — 52連続安定化リリースでCI/CDターゲットはv2.1.283に更新推奨

9月25日にv2.1.283リリース。`x-claude-code-prompt-id`ゲートウェイヒントヘッダーで1ユーザープロンプトに紐づくリクエスト群をLLMゲートウェイがグループ化可能に(`CLAUDE_CODE_GATEWAY_HINT_HEADERS=1`でオプトイン)。`availableModelsMatch: "exact"`で新モデルリリース時の自動利用を防止、`deniedModels`でモデル個別ブロックが可能に。`/doctor prompt-audit`(`/checkup prompt-audit`)でCLAUDE.md・スキル・エージェント・コマンドの旧モデル向けプロンプトパターンを自動検出。

Claude API

Anthropic研究ブログ「Yes, Claude can do Nine Loops」— Fable 5.1がN=4超対称Yang-Mills理論の9ループ振幅を世界初計算、96 CPU・1週間・$1,000-$2,000で人類未到達の理論物理学フロンティアに到達

9月25日にAnthropic研究ブログでゲスト投稿として公開。元理論物理学者Matt von Hippelが8月7日にAI企業に公開チャレンジとして提示した「N=4超対称Yang-Mills理論の6粒子散乱振幅を9ループで計算せよ」に対し、AnthropicのLiam FitzpatrickとSiddharth Mishra-SharmaがFable 5.1(Claude Science経由)で世界初の計算に成功。Lance Dixon教授(SLAC/スタンフォード)が独立検証。従来の人間による記録は8ループ(Dixon & Liu, 2023)で、37年間の進歩を単一プロンプトで超越。

Claude Code

Claude Code v2.1.282リリースでmaxProseWidth設定・テレメトリ変数可視化・Chrome MCP共存設定が追加 — 51連続安定化リリースでCI/CDターゲットはv2.1.282に更新推奨

9月24日にv2.1.282リリース。`maxProseWidth`設定でワイドターミナルにおけるClaude散文出力の幅を制限可能に(テーブル・コードブロックはフルターミナル幅を維持) — 大画面での可読性が向上。プロジェクト・ローカル設定ファイル内のOpenTelemetry変数(エクスポート有効化・エンドポイント設定・コンテンツキャプチャ)を自動無視し起動時通知+`/status`+`claude doctor`で可視化 — Enterprise環境のテレメトリガバナンスが強化。`allowClaudeInChromeWithManagedMcp`管理設定で`claude --chrome`が排他的`managed-mcp.json`と共存可能に。Web検索結果の復号不能エントリによる400エラー修正、continued/resumedセッションのメッセージ変形によるthinking消失修正、コンパクションフォールバック修正、Fable usage-credits プロンプト修正、Vim モードカーソル修正多数等を含む大規模バグ修正リリース。v2.1.224以降51連続安定化リリース。

Anthropic

Anthropic・OpenAI・Google DeepMindが「Standards Authority for Frontier AI」設立を協議 — 自主的業界安全基準団体が2026年末〜2027年にローンチ予定、政府監督なしの独立評価体制を構想

9月24-25日にPYMNTS・CryptoBriefing・Kingy AI・Superpowerdaily等が報道。Anthropic・OpenAI・Google DeepMindの3社が7月以降のワーキンググループ会議で「Standards Authority for Frontier AI」の設立を協議中。フロンティアモデルのリリース前独立テスト・安全性インシデント報告制度・自主的安全性コミットメントの定義・独立監査人の資格基準を策定予定。Google DeepMind CEO Hassabisは「FINRA型(業界資金・連邦監督)」、Amodeiは「FAA型」、Altmanは「業界自主」のビジョンで分岐するが、リリース前独立評価・安全性テスト・標準化リスク評価は3社共通合意。2023年設立のFrontier Model Forumとの連携も検討。9月23日の国連安保理でのAI安全性議論と連動し、業界自主基準の制度化が加速。

Anthropic

Amodei国連安保理で「AIリリース速度を安全性確保に必要なだけ減速する」と公式宣言 — France24・CNN・CNBC等が追加詳細を報道、AIインシデント国際通報制度とAI能力の共通テスト基準を提言

9月23日の国連安保理AI公式討議について、France24・CNN・CNBC・Gizmodo・San.com等が9月24-25日に追加詳細を報道。Amodeiは「安全性確保に必要なだけ新技術のリリース速度を減速する」と公式宣言し、具体的提言として(1)AIモデルの制御喪失リスク・悪用リスクをテストする共通グローバル基準、(2)グローバルセキュリティに重大なAIインシデントの国際通報システムの2点を提示。Altmanも「I agree with Dario」と追従しAI能力測定ベンチマークと安全対策の独立評価制度を支持。CNBCはトランプ大統領の「globalist scheme」拒否との対比を報道。France24は「Anthropic chief pledging to slow down」と見出しでAmodeiの減速コミットメントを強調。

Anthropic

Anthropic Instituteが「AI開発ペース測定メトリクス」を公開 — 30,000同時稼働エージェント・10億決定中0.002%ブロック・R&D 26%リードの3指標で再帰的自己改善の進行度を定量化

9月17日にAnthropic Instituteが公開し9月24-25日にDigital Applied・CellCog・Mixed News・PANews・Implicator等が追加分析を展開。3つの公開メトリクスを提案: (1)AI主導R&D — ClaudeがAnthropicのAI R&Dの26%を「リード」(2月は1%未満から急上昇)・90%以上で「協業」、(2)エージェント監視 — 最大利用プラットフォームで約30,000エージェントが同時稼働・8月に10億超の決定のうち0.002%(約47,000件に1件)をオンラインモニターがブロック、(3)安全性コンピュート配分 — AI R&Dコンピュートの6%・AI駆動R&Dコンピュートの12%が安全性研究に配分。完全自律(AL5)動作は未達成と明言。他AI企業にも同様メトリクスの定期公開を呼びかけ。全データはAnthropic自己報告で外部監査なし。Digital Appliedは「Coverage(監視範囲)・Latency(レビュー遅延)・Escalation Rate(エスカレーション率)」の3メトリクスフレームワークを詳細分析。

Claude API

Opus 5.5独立ベンチマーク評価の第2波 — Artificial AnalysisがIntelligence Index 58でmax effort首位を確認もTerminal-Bench 59.6%でAnthropic発表値66.4%との乖離を指摘、独立検証の重要性が再確認

9月24-25日にVellum・OfficeChai・Orcarouter・Technology Org・Trendingtopics.eu等がOpus 5.5の独立ベンチマーク詳細分析を公開。Artificial AnalysisはIntelligence Index max effortで58の測定史上最高スコアを確認しHumanity's Last Exam 61.4%・SciCode 66.9%等10評価中6でリード。一方Terminal-Bench 4.0では59.6%と測定しAnthropic発表値66.4%との間に6.8pt乖離が存在 — テスト条件(effort設定・セットアップ)の違いが原因の可能性。Vellumは「独立測定値がAnthropic発表値より控えめ」と明示的に指摘しベンチマーク評価には独立第三者検証が重要と強調。OfficeChai・Orcarouterも各ベンチマークスコアのソースを網羅的に整理。

Anthropic

AnthropicがDRCエボラ出血熱対応にClaudeを実戦投入 — 状況報告書作成を1日から1時間未満に短縮、Claude Scienceによるゲノム解析・系統解析・ワクチン候補追跡で公衆衛生AIエージェントの実用性が実証

9月19日にAnthropicが公式特集記事として公開。2026年5月以降のコンゴ民主共和国(DRC)でのBundibugyo型エボラウイルス病アウトブレイク(確認症例7,672件・死亡3,699件・致死率48.2%)への対応にClaudeが実戦投入。WHO・CEPI・INRBとのパートナーシップで4つの主要領域に活用: (1)状況報告書(Situation Report)の生成 — PowerPointデータからの報告書作成を「丸1日」から「1時間未満」に短縮、(2)治療センター配置のための疾病モデリング — 複数シナリオの同時シミュレーション、(3)ワクチン候補の追跡・分析、(4)Claude Scienceによるバイオインフォマティクス — ゲノムアセンブリ・ウイルス系統解析。AIエージェントが現実の公衆衛生緊急事態で組織的に活用された初の大規模事例として、エージェント設計の「ドメイン特化+人間専門家協働」パターンが確立。

Anthropic

Anthropicが生命科学研究グループと実験室を設立しClaude主導でCRISPR様リピートを持つ新規酵素システム「ART」を発見 — 950エージェント・21時間・2.1億トークンでバクテリオファージの未知タンパク質ファミリーを同定

9月23日にAnthropicが生命科学研究グループと実験室の設立を発表し、Claudeが自律的に発見した新規酵素システム「array-associated reverse transcriptases(ART)」の初期成果を公開。ARTはバクテリオファージ(細菌に感染するウイルス)に存在し、逆転写酵素・アクセサリータンパク質・CRISPR配列に類似した等間隔のDNAリピート配列の3コンポーネントで構成。約950のClaudeエージェントが21時間稼働しDNA配列データベースから20万以上の逆転写酵素を解析し3,500の候補システムを特定。ベイエリアの実験室(BSL-1/BSL-2レベル、ヒト病原体は取り扱わず)で人間の科学者が物理的実験を実施。CRISPR遺伝子編集のパイオニアであるMITのFeng

Anthropic

Dario Amodei CEOが国連安全保障理事会でAIリスクを警告 — OpenAI Altmanと共にAI能力・安全性の独立ベンチマーク導入を提言、フランス議長下で初のAI安全保障公式討議

9月23日にフランスのBarrot外相が議長を務める国連安全保障理事会の高レベルブリーフィングにAnthropic CEO Dario Amodei、OpenAI CEO Sam Altman、Hugging Face共同創業者Clément Delangue、AIゴッドファーザーの一人Yoshua Bengioが出席。Amodeiは「管理が不適切であればAIは人類全体へのリスクとなりうる」と発言、Altmanは「AIの未来に対する制御を失う可能性がある」と警告しAI能力の測定ベンチマークと企業の安全対策を評価する制度の採用を世界のリーダーに提言。AP通信・Semafor・CoinTelegraph・JPost・ClickOnDetroit・KSAT・Mezha等が一斉報道。安保理でAI企業CEOが直接ブリーフィングを行った初の公式事例。

Claude API

Opus 5.5独立ベンチマーク評価が複数機関から公開 — SonarSourceがHumanEval/MBPP 87.7%で27.5%少ないコード生成を確認、CodeRabbit・Cosmic JS・OfficeChai・Vellum等が詳細分析

9月22日のOpus 5.5リリースから48時間以内に複数の独立ベンチマーク評価が公開。SonarSourceはHumanEval/MBPP 544タスクでOpus 5.5が87.7%パス(Opus 5: 88.6%)ながら27.5%少ないコードで同等品質を達成し40%少ないトークン消費と報告。Artificial AnalysisはIntelligence Indexでmax effort 58のトップスコアを確認しHumanity's Last Exam 61.4%・SciCode 66.9%等10評価中6でリード。CodeRabbit・Cosmic JS・OfficeChai・Kingy AI・Coursiv・Codersera・Vellum等がベンチマーク比較記事を公開。Opus 5.5はSWE-bench Pro 89.9%・Terminal-Bench 66.4%でAnthropic発表値を裏付け。GPT-6 Astra(57.9%)との直接比較で8.5pt優位が独立確認。

Claude API

OpenAI GPT-6 Sol/LunaとClaude Opus 5.5の90分差同時リリースがAPI価格戦争を加速 — Simon Willison・DEV Community・SiliconANGLE・WCCFTech等がコスト影響を詳細分析

9月22日のClaude Opus 5.5($4/$20)とOpenAI GPT-6 Sol($2/$10)・GPT-6 Luna($0.10/$0.50)の90分差同時リリースについて、Simon Willison・DEV Community・AI Weekly・Business Standard・KuCoin・SiliconANGLE・WCCFTech・Tech-Insider・Shattered等が詳細分析を公開。GPT-6 Sol $2/$10はSonnet 5と同価格帯でClaude Opus 5.5 $4/$20の半額に位置づけ。GPT-6 Luna $0.10/$0.50はDeepSeek V4.1 Flash以下の超低コスト帯を開拓。WCCFTechは「オープンウェイトモデルの価格根拠を無効化」と分析。SiliconANGLEは「AnthropicがOpus 5.5をリリースしOpenAIが2つの安価なGPT-6モデルで対抗」と構図を報道。AI価格戦争が全価格帯で同時進行する前例のない展開。

Anthropic

Buist v. Anthropic反トラスト訴訟が国際報道でさらに拡大 — Bloomberg Law・TNW・TradingKey・Eastern Heraldが法的詳細を分析、11月IPOへの影響に注目

9月19日提起のBuist v. Anthropic反トラスト訴訟(Buist v. Anthropic PBC, N.D. Cal., No. 3:26-cv-10693)について9月23-24日に国際報道がさらに拡大。Bloomberg LawがAnthropic・OpenAI・Google・SpaceXAIの4社被告を確認。TradingKeyが「Anthropic IPO November Amid New AI Slowdown and Antitrust Lawsuits」と題し11月IPO前のリスク要因として分析。TNWは「Buist v. Anthropic: antitrust waiver evidence of public agreement」と法的証拠構造を詳報。Big Newsletter(Matt Stoller)が「Just Stop the Anthropic IPO Already」とIPO停止論を展開。The Eastern Heraldが「AI Slowdown Antitrust Lawsuit」として国際展開。シャーマン法第1条違反で3倍損害賠償+差止命令+陪審裁判を請求する構図は不変。

Claude Code

Claude Code v2.1.281リリースでClaude Apps Gatewayポリシー拡張・Bedrock IAMロール引き受け・Amazon Guardrails統合が追加 — 50連続安定化リリースでCI/CDターゲットはv2.1.281に更新推奨

9月23日にv2.1.281リリース。Claude Apps Gatewayに`blockReadsOutsideWorkingDirectories`と`disableBypassPermissionsMode`ポリシーが追加されEnterprise環境のファイルアクセス制御が強化。Bedrock upstreamsに`assume_role`が追加されIAMロール引き受け(STS経由)に対応。Amazon Bedrock Guardrailsの`guardrail: {id, version}`サポートが追加されAWSの安全性ガードレールとの統合が実現。`"attribution": false`設定でコミット・PRの帰属フッター非表示が可能に。MCP URL-modeエリシテーション対応(2026-07-28プロトコル)。API リクエストリトライ時のクラッシュ修正・`--max-turns`での無限リトライ修正・プロンプトキャッシュ損失修正等多数の安定性改善。v2.1.224以降50連続安定化リリース。

Claude API

【速報】Claude Opus 5.5発表 — Fable 5.1レベルの性能をOpus価格帯で実現、入力$4/出力$20でOpus 5比40%コスト削減、Terminal-Bench 66.4%・CursorBench 57.8%でフロンティア級

9月22日にAnthropicがClaude Opus 5.5(モデルID: `claude-opus-5-5`)を発表。「Fable 5.1レベルの性能をOpus価格帯で」をコンセプトに、入力$4/出力$20(Opus 5: $5/$25から20%値下げ)・キャッシュ読取$0.20(Opus 5: $0.50から60%値下げ)で典型ワークロード40%コスト削減を実現。Terminal-Bench 4.0で66.4%(Opus 5: 52.3%・Fable 5.1: 55.8%を上回る)、CursorBench 4.0で57.8%(Opus 5: 46.6%)、FrontierCode v1.1で54.4%(Opus 5: 48.0%)、GDPval-AA v2.1で1846 Elo(Opus 5: 1708)。出力生成速度がOpus 5比30%高速化。アライメントスコアが自動行動監査で最高評価、境界回避試行がOpus 5比85%低減。Thinking mode常時有効化(無効化不可)に変更。Claude Platform・AWS・Google Cloud・Microsoft Azureで即日利用可能。Sonnet 5.5・Haiku 5.5が「今後数週間で」リリース予定。TechCrunch・Digital Applied・APIMaster・Coursiv等が一斉報道。

過去のニュースをすべて見る →