AI模型与数据集托管平台Hugging Face上周披露了一起安全事件,确认其内部数据集及服务凭证在此次黑客攻击中遭到入侵。公司表示目前仍在调查是否有客户或合作伙伴数据在此次事件中被窃取。

攻击手法与影响范围

据Hugging Face在官方博客中透露,攻击者将一个恶意数据集上传至该平台,利用平台存在的安全漏洞在其服务器上执行恶意代码,进而提升权限并获得对Hugging Face内部系统的更广泛访问能力。

目前,Hugging Face已撤销并轮换了被入侵的凭证,同时敦促用户对平台上存储的密钥采取同样措施,并仔细检查账户中的任何可疑活动。

外部智能体被指为攻击来源

Hugging Face已修复此次网络攻击中被利用的安全漏洞。值得关注的是,该公司将此次入侵归咎于一个外部智能体,称其"在大量短暂存在的沙盒环境中执行了数以千计的独立操作,并借助公共服务实现了自迁移的命令与控制"。不过,当TechCrunch就此向该公司求证时,Hugging Face未能立即提供支持上述说法的证据。

此次事件也再次凸显了Hugging Face等平台所面临的严峻挑战——攻击者正越来越多地试图滥用平台工具,从内部窃取敏感数据。

自有大语言模型助力调查

Hugging Face表示,本次攻击由公司自身的异常检测系统发现,随后利用AI模型对记录攻击过程的服务器日志进行了分析。

该公司起初尝试使用某商业服务商提供的前沿AI模型(未透露具体名称),但发现该模型的安全护栏阻止了分析工作的推进。最终,Hugging Face转而使用自有的本地大语言模型,此举还带来了一项额外好处——无需将敏感的攻击日志上传至外部AI公司的服务器。

这一情况也印证了安全研究人员此前的抱怨:Anthropic的Mythos和Fable等前沿模型受到严格限制,几乎阻止了防御人员对任何网络安全相关问题的查询,包括防御和调查场景。此前,Anthropic还因美国政府对Fable实施出口管制而被迫将其从公开使用中撤回。

后续处置措施

Hugging Face表示,已向执法机构报告了此次事件,并引入网络安全取证专家对入侵事件展开调查和安全审查。目前尚不清楚Hugging Face是否在系统上线前进行过安全审计,该公司发言人截至周一仍未回应置评请求。

Q&A

Q1:Hugging Face这次数据泄露事件是怎么发生的?

A:攻击者将一个恶意数据集上传到Hugging Face平台,利用平台存在的安全漏洞在服务器上执行恶意代码,进而提升权限并获得对内部系统的更广泛访问权限,最终导致内部数据集和服务凭证遭到泄露。目前Hugging Face已修复该漏洞,并撤销、轮换了被入侵的凭证。

Q2:Hugging Face是如何发现这次攻击的?

A:Hugging Face通过自身的异常检测系统发现了此次攻击。在分析攻击日志时,该公司最初尝试使用某商业服务商的前沿AI模型,但因其安全护栏的限制无法完成分析,最终转而使用自有本地大语言模型,成功完成了对服务器日志的分析,同时避免了将敏感日志上传至外部服务器。

Q3:Hugging Face用户现在需要做什么来保护自己的账户?

A:Hugging Face建议所有用户立即轮换在平台上存储的API密钥及相关凭证,并仔细检查账户中的可疑活动。如发现任何异常情况,应及时上报并采取相应的安全措施。

TechCrunch - data breach