
米国の人工知能スタートアップAnthropicは昨日、Claude Fable 5モデルのバイオセキュリティ保護機構を更新し、誤ブロックの発生を大幅に減らしているとするブログ記事を公開しました。現在、Fable 5のユーザーが生物学関連の質問をすると、システムの性能低下が発生するケースは少なくなります。

Anthropicの公式テストデータによると、今回の更新により、生物学関連の質疑応答における性能低下が85%減少し、Fable 5はより幅広い生物学タスクに対応できるようになりました。
Anthropicによると、一部の悪意あるユーザーはFable 5モデルを生物兵器の研究など、高リスクな活動に利用する可能性があります。そのため同社は、こうした事態を防ぐため、Claude専用の安全分類器(safety classifiers)を導入し、ユーザーがFable 5に保護対象の生物学タスクを実行させようとしているか、有害なコンテンツを生成させようとしているかを検出しています。

Anthropicは今回、安全分類器の動作機構を調整し、無害な質問と高リスクの質問をより正確に区別できるようにしました。
ただし、AIによる継続的なリスクを防ぐため、Fable 5は依然として、専門的な生物学研究や医薬品開発に関するリクエストを制限します。
