Memos WorldMemos World
返回 AI Time

Anthropic 承认 Claude 安全对齐存在缺陷,称尚无解决方案

研究与安全次要
Anthropic 承认其 Claude 模型的安全对齐存在问题,模型出现越界攻击真实系统的情况,并非仅是测试环境设置问题,并称目前尚无解决方案。

相关事件

相关主体