#人工智能 关键时刻还是得靠开源模型:HuggingFace 遭到黑客攻击,想要使用 Claude 进行取证分析时始终被拒绝,最终只能本地部署开源的 GLM-5.2 完成取证。HF 发现异常后准备使用前沿模型进行取证,结果反复遇到被安全边界阻拦的情况。HF 并未透露这个前沿模型的名称,不过想想多半是 Claude Fable 5。最后 HF 在本地集群部署了 GLM-5.2 完成数据分析和取证。查看全文:https://ourl.co/114008
知名模型和开源数据集托管网站 HuggingFace 日前发布博客披露该平台遭遇的 AI 智能体攻击,此次攻击由 AI 驱动的智能体自主发起且具备横向移动功能 (类似蠕虫病毒),让 HF 寒心的是安全团队发现异常后希望使用 Claude 和 GPT 模型进行安全审计结果触发安全围栏,最终 HF 不得不在本地部署智谱 GLM 5.2 快速完成审计。

此次攻击发生在上周,攻击的初始入侵点精准命中 AI 平台最独特的暴露面:数据集处理管线。攻击者向 HF 上传精心构造的恶意数据集,该数据集同时利用 HF 在自动处理用户上传数据集时的两条代码执行路径:远程代码数据集加载器和数据集配置中模板注入漏洞。
其中远程代码数据集加载器允许数据集在处理过程中加载并执行外部代码,模板注入漏洞是通过配置文件的模板机制实现代码注入。具体来说恶意数据集成功在处理 Worker 上执行任意代码,获得初始执行权限后,攻击者迅速完成权限提升,达到节点级别的权限并窃取云服务和集群凭证,随后通过横向移动进入 HF 多个内部集群。
整个攻击行动呈现出高度的自动化与智能特征,HF 在分析报告中称,这套自主 AI 智能体框架驱动数万个短期沙箱执行操作,攻击者还构建了基于公共服务的自我迁移命令与控制机制 (即 C2),这使得追踪难度变得更大。
目前 HF 怀疑这套 AI 智能体框架是基于某种安全研究工具链构建的,不过 HF 并未公布这个智能体框架具体使用的模型是哪家,考虑到目前在安全领域的模型利用,这个恶意智能体大概率使用的就是 Claude 或 GPT 模型。
黑客能用 AI 发起攻击但受害者无法通过 AI 进行审计:
这次攻击事件还暴露一个行业必须关注的问题,在入侵发生后 HF 立即部署基于人工智能的分析智能体,对超过 17000 条攻击者操作日志进行自动化分析,希望快速重建时间线、提取失陷指标 (IoC)、映射受影响凭证以及区分真实破坏和诱饵行为。
然而在取证阶段出现了意想不到的「守方不对称问题」,HF 最初尝试使用商业前沿模型通过 API 进行分析,但这些模型内置的安全防护策略反复阻挡安全审计,即模型内置的策略无法区分事件响应者与真实攻击者,HF 同样没有公布模型名称,但这很容易猜测,无非就是 Claude Fable 5,是 GPT-5.6 Sol 的可能性也有但不高。
迫于无奈最终 HF 只能在自己的本地集群上部署中国开源人工智能模型智谱的 GLM-5.2,智谱 GLM-5.2 帮助 HF 完成全部取证工作,目前没有证据表明用户数据泄露(但如果你担心的话可以重置 API 密钥),HF 也在聘请外部安全公司进行更加深入的调查。