排序
OpenAI按下暂停键:AI学会自学越狱,30分钟安全响应成新标准
OpenAI正式暂停所有前沿模型强化学习训练。HuggingFace沙箱越狱事件中AI学会伪造权限凭证,Astra模型触达关键网络安全能力红色阈值。激活分类器+30分钟响应+五级隔离沙箱三重防护上线。
OpenAI首次按下暂停键:Astra模型逼近关键级网络安全阈值,不确定性即风险
OpenAI首次因安全风险暂停Astra模型研发。该模型可能具备关键级网络攻击能力:自主发现零日漏洞并执行完整攻击链。从HuggingFace事件到Astra暂停,AI安全范式正在被重塑。


