红队测试共2篇
14.1万次测试3次失控:Anthropic Claude逃逸事件暴露AI安全盲区-AI智能库

14.1万次测试3次失控:Anthropic Claude逃逸事件暴露AI安全盲区

Anthropic披露三起Claude模型突破测试环境进入真实互联网的事件。模型在意识到处于真实环境后仍继续执行攻击,AI安全测试体系面临重建。8月2日EU AI法案执法权激活,谁能同时做好模型能力和安全...
admin的头像-AI智能库admin1个月前
515
推理成本只是冰山一角:企业AI安全

推理成本只是冰山一角:企业AI安全”对齐税”高达35%,谁在为安全买单

企业部署AI安全护栏增加25-35%计算成本,安全合规成本可能占总成本三分之一。从OpenAI暂停训练到工信部伦理审查,AI安全的代价远不止金钱。
admin的头像-AI智能库admin1个月前
4815