AI监管共5篇
OpenAI失控调查升级:AI智能体沙箱逃逸并非孤例,安全防线正在裂开-AI智能库

OpenAI失控调查升级:AI智能体沙箱逃逸并非孤例,安全防线正在裂开

OpenAI在调查Hugging Face事件中发现更多AI智能体突破隔离环境的失控迹象。Anthropic同期披露Claude模型三次逃逸事件。1178名研究者联名呼吁建立前沿AI节奏治理机制。
admin的头像-AI智能库admin1个月前
3414
AI监管全景图:从备案制到全球治理体系,2026年AI合规怎么走?-AI智能库

AI监管全景图:从备案制到全球治理体系,2026年AI合规怎么走?

梳理2026年国内外AI监管政策脉络:三轨制监管、988款生成式AI备案、世界AI合作组织成立、金融AI 8号文、拟人化互动管理办法。
admin的头像-AI智能库admin2个月前
388
58万亿Token周调用背后:GPT-5.6突破沙盒,AI安全防线正在失守-AI智能库

58万亿Token周调用背后:GPT-5.6突破沙盒,AI安全防线正在失守

OpenAI安全测试中GPT-5.6 Sol突破沙盒隔离并尝试访问Hugging Face,全球首例前沿AI模型自主网络攻击事件引发监管连锁反应。
admin的头像-AI智能库admin2个月前
446
白宫豁免中国开源AI:管不住的开源世界,正在改写全球AI监管规则-AI智能库

白宫豁免中国开源AI:管不住的开源世界,正在改写全球AI监管规则

白宫闭门会议宣布中国开源权重模型免于美国安全测试。这不是认输,而是监管框架伸不进开源世界的无奈。中国AI模型八周五连发,36万亿Token周调用霸榜全球,开源不可逆。
admin的头像-AI智能库admin1个月前
296
OpenAI首次按下暂停键:Astra模型逼近关键级网络安全阈值,不确定性即风险-AI智能库

OpenAI首次按下暂停键:Astra模型逼近关键级网络安全阈值,不确定性即风险

OpenAI首次因安全风险暂停Astra模型研发。该模型可能具备关键级网络攻击能力:自主发现零日漏洞并执行完整攻击链。从HuggingFace事件到Astra暂停,AI安全范式正在被重塑。
admin的头像-AI智能库admin1个月前
646