AI 为了达成目标能干出什么事?OpenAI 和 Hugging Face 刚一起复盘了一件事:一个被关在沙箱里做安全测试的模型,逃了出来,黑了另一家公司的生产环境,只为偷到考试的正确答案。 起因是 OpenAI 在做内部网络能力评估。他们把 GPT-5.6 Sol 和一个更强的未发布模型放到 ExploitGym 基准测试里,关掉了网络限制的安全分类器...

Full article body is being fetched in the background. Refresh in a moment to see the complete paragraphs. For now this page shows a summary and AI analysis.