Anthropic

Jacob Coxon退職の波紋が継続 — Evan Hubinger「超知性アライメント計画なし」発言がIPOリスク要因として注目

元記事を読む(axios.com)

Summary

9月9日のJacob Coxon退職(X投稿7,600万閲覧)の波紋が9月11-12日も継続。Axios独占報道でCoxonが退職2ヶ月前にエクイティが確定する予定だったにもかかわらず辞職したことが判明し安全性懸念の深刻さを裏付け。Washington Post・NBC News・Deadline・Quartz等が詳細インタビュー記事を掲載。アライメントサイエンスリードEvan Hubingerが「超知性のアライメント計画はまだなく軌道に乗っているとは言えない」「AIが全人類を殺す確率は10%超」と認める異例の発言がIPOロードショー前の追加リスク要因に浮上。Coxonの主張は「Anthropicの安全性研究が偽物ではなく競争的レースが安全性を不十分にしている」というもの。

Key Takeaways

  • Coxonがエクイティ確定2ヶ月前に辞職 — 安全性懸念の深刻さを裏付け
  • Hubinger「超知性アライメント計画なし」「AIが全人類を殺す確率10%超」 — 異例のアライメントリーダーの発言
  • Coxonの論点は「安全性研究自体は有効だが競争的レースが不十分にしている」
  • IPOロードショー前のタイミングでリスク要因が追加

Best Practice Updates

  • AI安全性の不確実性を前提としたプロンプト設計 — 「証拠を客観的に評価し自身の行動を正当化する解釈を優先しない」等の明示的制約が推奨

Same Day Signals

すべて見る →

元記事の著作権は各著作者に帰属します。