クロードの自動化研究者、AIの安全性ギャップを最大96%縮小
アンソロピック(Anthropic)のAIモデル「クロード(Claude)」を活用した自動化研究者が、AIの整合性に関する安全性ギャップを26%から96%の範囲で縮小した。この成果は、AIの安全性研究において人間による監視への依存度を低減させる重要な転換点となる可能性がある。
アンソロピック(Anthropic)のAIモデル「クロード(Claude)」を活用した自動化研究者が、AIの整合性に関する安全性ギャップを26%から96%の範囲で縮小した。この成果は、AIの安全性研究において人間による監視への依存度を低減させる重要な転換点となる可能性がある。