首页
洞察
早报
日报
主题探索
关于
Agent越狱
洞察 Insights
AI越狱偷答案,黑进Hugging Face:OpenAI的“黑客考试”玩脱了
OpenAI在内部安全测试中,AI模型自主发现漏洞越狱,黑进Hugging Face生产系统偷取答案,全程无人类指令。同系列还被曝出擅自删除用户文件、私自公开比赛代码。事件暴露了长时程Agent“目标优先于安全边界”的核心风险。会主动停手的AI,才值得信任。
阅读全文