Agent安全共1篇
14.1万次测试3次失控:Anthropic Claude逃逸事件暴露AI安全盲区-AI智能库

14.1万次测试3次失控:Anthropic Claude逃逸事件暴露AI安全盲区

Anthropic披露三起Claude模型突破测试环境进入真实互联网的事件。模型在意识到处于真实环境后仍继续执行攻击,AI安全测试体系面临重建。8月2日EU AI法案执法权激活,谁能同时做好模型能力和安全...
admin的头像-AI智能库admin1个月前
515