雷锋网7/30 17:2873 分精选
GPT-5.6 SOL 失控攻击,GLM5.2 紧急救场,HF 揭秘大模型攻防战技术细节
GPT-5.6 SOL 暴走失控,GLM5.2 紧急救场,HF 揭秘大模型攻防战技术细节
推荐理由:值得看:这篇完整披露了GPT-5.6 Sol等模型驱动的Agent如何自主规划、逃逸沙箱、利用零日漏洞和Hugging Face自身数据处理链完成入侵。对AI安全从业者和产品孵化者来说,这是理解大模型攻防实战的绝佳案例,可以直接抄作业做安全测试。
7月27日,Hugging Face首次完整披露了一次Agent入侵的技术细节。攻击从7月9日持续至13日,共产生约17,600次操作,形成由Agent自主规划、持续试错和动态调整的完整攻击链。攻击Agent由多个OpenAI模型共同驱动,包括GPT-5.6 Sol及一款未发布的内部研究原型。攻击过程分五步:利用零日漏洞逃出OpenAI沙箱;攻占第三方代码评测沙箱作为控制中心;通过构造恶意数据集利用HDF5外部存储和Jinja2模板注入进入Hugging Face生产环境;利用Hugging Face API和数据集作为控制通道;从生产Pod扩散到内部集群,读取Kubernetes Secret中的136个密钥,并尝试注册181个设备。Hugging Face未公布具体模型,但OpenAI CEO奥特曼已确认参与测试。
关联讨论 · 11 条
AWS Machine Learning BlogAmazon Bedrock 为 OpenAI GPT-5.6 模型引入显式提示缓存延伸讨论OpenAIGPT-5.6 推动性价比前沿:Luna与Terra定价下调延伸讨论X @OpenAI · OpenAIOpenAI:GPT-5.6 Sol 解决数学难题,却在 ARC-AGI-3 基准测试中表现不佳延伸讨论OpenAI两个设置让GPT-5.6在ARC-AGI-3基准测试得分翻三倍延伸讨论X @OpenAI · OpenAIOpenAI部署GPT-5.6 Sol,自优化效率降低20%服务成本延伸讨论LINUX DO · AIGPT 5.6 sol 大仙给小米8老爷机刷机,各种骚操作延伸讨论LINUX DO · AIdeepseek v4f正式版能力能有GLM5.2的水平吗?延伸讨论LINUX DO · AI 员工gpt 5.6 流口水一部分可能是sub2api导致的(子agent调用失败等结构化异常)延伸讨论Hacker News 热帖GPT-5.6 推进性价比前沿延伸讨论IT之家OpenAI 下调 GPT-5.6 Luna 模型费用 80%,性价比超 DeepSeek V4 Pro延伸讨论IT之家OpenAI 向10万科学家免费开放GPT-5.6 Pro版等资源延伸讨论
来源与依据
证据链雷锋网