Anthropic

【速報】Anthropic Institute「When AI builds itself」公開 — Claudeがモデル研究開発の26%を「リード」、90%で「協業」と定量開示、再帰的自己改善の進捗を業界初の公開メトリクスで追跡

元記事を読む(anthropic.com)

Summary

9月18日(木)にAnthropic Instituteが「When AI builds itself」ブログを公開し、Claudeが同社のモデル研究開発の26%を「リード」(高レベルプロンプトからエンドツーエンドでタスクを完遂、人間監督下)していることを初めて定量的に開示。また90%のR&Dが「協業」モード(人間の密接な指示の下でClaudeが大きな作業チャンクを遂行)で行われている。2月時点では「リード」は0%で、わずか6ヶ月で26%に急上昇。Anthropicのエンジニアは2021-2025年比で四半期あたり8倍のコードを出荷しており、Claudeがマージされるコードの80%超を記述。再帰的自己改善(AIが自律的に後継モデルを設計・開発する段階)にはまだ到達しておらず、完全自律で動作するポイントはないと明言。Anthropicは他のAIラボにも同様のメトリクスの定期公開を呼びかけ、公開方法論による比較可能性を提案。Dario Amodei CEO「We Must Pace the Frontier」エッセイとの連動で、AI安全性ペーシング議論にデータドリブンな根拠を提供。AP通信配信でABC News・Bloomberg・Scientific American・Detroit News・数十の地方紙が一斉報道し国際的に拡大。

Key Takeaways

  • Claudeがモデル研究開発の26%を「リード」 — 2月の0%から6ヶ月で急上昇
  • R&Dの90%がClaude「協業」モード — 人間の指示下で大規模作業を遂行
  • Anthropicエンジニアのコード出荷量が8倍増、マージコードの80%超がClaude記述
  • 再帰的自己改善には未到達 — 完全自律動作のポイントはないと明言
  • 他AI企業にも同様メトリクスの定期公開を呼びかけ — 業界横断比較を提案

Best Practice Updates

  • Claude自身がAI開発を加速させる実績データがエージェント型ワークフローの投資効果を裏付け — Dynamic Workflows・Skills・Dreaming等への投資が正当化
  • 再帰的自己改善の進捗メトリクスが公開されたことで、AIエージェントの自律行動範囲制限設計がさらに重要に — CLAUDE.mdでの行動制約明記が必須

Same Day Signals

すべて見る →

元記事の著作権は各著作者に帰属します。