Anthropic
Fable 5生物学セーフガード大幅改善 — 誤検知によるフォールバックが85%削減、日常的な健康・教育クエリへの対応が正常化
元記事を読む(anthropic.com) ↗Summary
Anthropicが8月7日にFable 5の生物学セーフガードを大幅更新し、生物学関連の誤検知フォールバック(Opus 5への自動ハンドオフ)を約85%削減。分類器のルールセットを書き直し良性ユースケース(検査結果の解釈・症状理解・教育目的の生物学学習等)に詳細な例外を設定、内外専門家のフィードバックと新規訓練データで分類器を再訓練。フォールバック総量はclaude.aiで約67%削減・Coworkで55%・Claude Codeで17%・Claude Platformで7%。ただしウイルス学・毒物学・分子設計等のデュアルユース領域ではFable 5からOpus 5へのフォールバックが継続。医療専門家の臨床タスク支援が向上。
Key Takeaways
- ▸ 生物学関連の誤検知フォールバックが約85%削減 — 日常的な健康・教育クエリが正常に応答
- ▸ フォールバック総量削減: claude.ai 67%・Cowork 55%・Claude Code 17%・Platform 7%
- ▸ 分類器ルールセット書き直し+再訓練で実現 — 良性ユースケースに詳細例外を設定
- ▸ デュアルユース領域(ウイルス学・毒物学・分子設計)ではフォールバック継続
- ▸ 医療専門家の臨床タスク支援が改善
Best Practice Updates
- ✓ Fable 5で生物学・医療関連プロンプトの誤検知が大幅低減 — 「検査結果解釈」「症状理解」等の正当なリクエストでの不要なモデル切替が減少
- ✓ デュアルユース領域の研究にはFable 5フォールバック継続のためOpus 5直接利用またはusage credits活用を検討
Same Day Signals
すべて見る →- Claude Code Claude Code Auto Modeが8月14日からPro・Max・Teamのデフォルトに — 分類器が危険コマンドの89%をブロック、人間の手動承認(13.6%)を大幅上回る安全性
- Claude Code Claude Code Auto Modeデフォルト化の技術詳細 — 11%のミスレートに対するコミュニティ議論と安全性設計のトレードオフ
- Claude API Sonnet 5導入価格終了まで残り21日(8月31日)— 実効コスト増最大85%への対応期間が3週間を切る
- Claude API レガシーWorkbench廃止まで残り7日(8月17日)— 保存データの復旧不可まで1週間、即時エクスポートが最終期限
元記事の著作権は各著作者に帰属します。