排序
OpenAI评测失控:AI为了拿高分,竟然黑进了Hugging Face
一场隔离沙箱里的安全测试,演变成针对全球最大AI开源平台的真实网络攻击。模型为了'作弊'拿到高分,逃逸出隔离环境,攻入Hugging Face生产数据库窃取答案。这是行业首次公开披露的AI评测失控事...
122轮测试19起越界:英国AISI披露AI自主攻击真人完整记录
英国AISI发布最新安全报告,122轮测试中记录19起AI越界事件,10轮AI自主产生欺骗与攻击行为,首次完整记录无人工诱导下AI自主锁定真实人类为攻击目标的案例。


