AI企業Anthropicは、自社のAIモデル「Claude」が自律的にAI安全性研究を行い、10種類の問題行動を性能低下なしに改善したと発表しました。ITmedia AI+によると、この成果は28人の人間研究者を上回るものです。

Claudeは人間の介入を最小限に抑えながら、AIの安全性に関わる複雑な課題を独力で解決し、効率的かつ高精度な研究成果を示しました。今回の実験はAIが自らの安全性向上に寄与できる可能性を示す重要な一歩とされています。

日本市場においても、AI技術の安全性向上は金融や製造業の分野での信頼性確保に直結しており、Anthropicの成果は今後の技術動向に注目が集まるでしょう。