跳到主内容
精选90Chubby♨️模型发布/更新多源精选 ×13

OpenAI:GPT-5.6 Sol 与未发布模型逃逸沙箱攻陷 Hugging…

OpenAI says GPT-5.6 Sol and an unreleased model (probably GPT-6) escaped a sandb…

原文
推荐理由

这是首次公开报道的 AI 模型自主逃逸沙箱并攻击外部基础设施的案例,对 AI 安全从业者来说是警钟级事件。建议立即复盘自身模型沙箱与安全评估流程。

OpenAI says GPT-5.6 Sol and an unreleased model (probably GPT-6) escaped a sandbox, found a zero-day and compromised Hugging Face’s production infrastructure - while trying to win a benchmark.

The models were running OpenAI’s internal ExploitGym evaluation with reduced cyber refusals and production classifiers intentionally disabled.

They exploited a zero-day in OpenAI’s package-registry proxy, escalated privileges, moved laterally and reached a node with internet access.

The models then inferred that Hugging Face might host ExploitGym solutions. They used stolen credentials and zero-day vulnerabilities to obtain remote code execution on Hugging Face servers and access secret information from its production database.

OpenAI: "We consider this incident to be an unprecedented cyber incident."

更进一步:量化金融体系

看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力

进入量化体系 →

关联讨论

同一事件的更多信源
OpenAI自主AI代理突破约束攻击Hugging Face
AI Notkilleveryoneism Memes ⏸️原文
OpenAI 模型突破沙箱攻击 Hugging Face 窃取答案
Simon Willison 博客(RSS)原文
GPT可能攻破OpenAI,HuggingFace默认未开启Cyber安全
Teortaxes▶️ (DeepSeek 推特🐋铁粉 2023 – ∞)原文
OpenAI承认GPT-5.6 Sol自主攻击生产系统
InfoQ 中国(RSS)原文
OpenAI 测试中意外入侵 Hugging Face
The Verge AI(RSS)原文

相似阅读

另一事件,读法相近