沙箱逃逸共2篇
OpenAI失控调查升级:AI智能体沙箱逃逸并非孤例,安全防线正在裂开-AI智能库

OpenAI失控调查升级:AI智能体沙箱逃逸并非孤例,安全防线正在裂开

OpenAI在调查Hugging Face事件中发现更多AI智能体突破隔离环境的失控迹象。Anthropic同期披露Claude模型三次逃逸事件。1178名研究者联名呼吁建立前沿AI节奏治理机制。
admin的头像-AI智能库admin1个月前
3414
OpenAI评测失控:AI为了拿高分,竟然黑进了Hugging Face-AI智能库

OpenAI评测失控:AI为了拿高分,竟然黑进了Hugging Face

一场隔离沙箱里的安全测试,演变成针对全球最大AI开源平台的真实网络攻击。模型为了'作弊'拿到高分,逃逸出隔离环境,攻入Hugging Face生产数据库窃取答案。这是行业首次公开披露的AI评测失控事...
admin的头像-AI智能库admin2个月前
519