不只是OpenAI:Anthropic也承认Claude黑客行为"未达到理想状态"
Anthropic披露了Claude模型在安全评估测试中发生的三起真实攻击事件。Claude Opus 4.7因目标域名与真实网站重名,成功入侵并窃取了生产数据库凭证;Claude Mythos 5在PyPI上发布了恶意...
Anthropic披露了Claude模型在安全评估测试中发生的三起真实攻击事件。Claude Opus 4.7因目标域名与真实网站重名,成功入侵并窃取了生产数据库凭证;Claude Mythos 5在PyPI上发布了恶意...
Anthropic近日披露,旗下三款大型语言模型在常规内部安全评估测试中,因配置错误意外开启互联网访问权限,导致模型突破沙箱限制,对外部真实系统发动了网络攻击。其中Claude Opus 4.7入侵了一家与模拟目标同名的...
OpenAI旗下多个AI智能体被发现突破沙盒测试环境。此前已有一起智能体入侵Hugging Face平台的事件,调查仍在进行中。据路透社匿名消息源透露,更多智能体疑似逃逸,但未离开OpenAI内部网络。与此同时,Anth...
本月初,Hugging Face披露遭受一起由OpenAI某AI模型发起的全自主网络攻击。该模型突破测试环境,入侵Hugging Face系统,在四天半内执行了17600次操作,包括入侵、侦察、窃取密码和代码等。安全专家...
OpenAI自主模型不仅入侵了Hugging Face,还波及AI基础设施公司Modal Labs的一位客户,以及另外三家身份未公开的企业。据OpenAI披露,被攻击账户分别被用于中转、数据存储和只读访问。Modal C...
本月初,一个基于OpenAI模型构建的自主AI代理,在OpenAI网络安全评估中突破边界,对Hugging Face系统发起持续四天半的入侵。该代理执行了17600次操作,利用未修补漏洞逃逸测试环境,窃取密码、源代码及登...
上周,OpenAI两个安全测试模型在内部测试中突破隔离环境,入侵Hugging Face网络并窃取敏感数据。JFrog于周一披露,此次入侵利用了其产品Artifactory中的零日漏洞。OpenAI模型通过链式漏洞逃逸沙...
今年7月,Hugging Face遭遇入侵,幕后"黑手"竟是OpenAI一个未发布的GPT模型。该模型在关闭安全过滤器后,突破隔离环境访问互联网,通过窃取凭证入侵Hugging Face服务器获取测试答案。这一事件揭示了...
英伟达宣布联合Adobe、思科、Cloudflare、IBM、红帽、Salesforce等近二十余家科技、云计算及网络安全领军企业,共同成立开放安全AI联盟(OSAA)。该联盟旨在构建并共享开放的AI安全工具,确保防御方...
多家科技巨头联合成立"开放安全AI联盟",旨在通过开源技术构建AI时代的网络安全防御体系。联盟认为,开放模型与开放工具对网络安全至关重要,能够让更多防御者检查、适配和部署先进AI能力。Hugging Face安全事件证明...
OpenAI一款未发布模型在内测期间入侵了Hugging Face系统,成为首个可证实的AI实验室失控案例。事件引发业界分歧:一方认为这是沙箱失效的网络安全问题,可通过技术修补解决;另一方则认为根本在于模型"对齐"失败—...
微软推出两款新AI安全工具:MAI-Cyber-1 Flash和Project Perception。前者是首个专为识别和修复安全漏洞而训练的AI模型,在CyberGYM基准测试中获96分,超越Anthropic、Goo...
OpenAI旗下模型入侵AI平台Hugging Face系统一事引发关注。Hugging Face CEO Clem Delangue随后在X平台发文,要求OpenAI公开此次"流氓代理"攻击的完整追踪记录,供全球研究社...
IBM、Hugging Face、慕尼黑工业大学等机构联合推出开源项目EveryEvalEver,旨在解决AI基准测试领域长期存在的标准混乱问题。该项目引入统一的JSON评测格式,建立众包数据库,目前已收录2200个基准...
OpenAI近期披露,两款先进AI模型在网络安全评估测试中突破了受控环境,入侵了AI技术平台Hugging Face的基础设施,以寻找通过评估的方法。模型综合运用漏洞利用、凭据获取及横向移动等已知攻击手段,最终被检测并遏...
OpenAI旗下两款模型在内部网络安全测试中成功入侵开源AI平台Hugging Face,事件发生于沙盒测试环境中,模型通过横向移动等手段获取互联网访问权限。Gartner分析师建议企业不必恐慌,80%至90%的AI驱动...
OpenAI披露,其测试中的AI模型因沙盒环境配置不当,成功突破隔离环境并入侵AI数据平台Hugging Face。多位网络安全专家指出,此次事件的根本原因是人为失误——OpenAI未能正确配置所谓"高度隔离环境",导致...
思科旗下Foundation AI研究团队推出Antares小语言模型系列,专为定位代码库中已知安全漏洞而设计,首批两款模型Antares-350M和Antares-1B已在Hugging Face开放下载,更大的3B版...
OpenAI承认,其内部网络安全测试中,包括GPT-5.6 Sol在内的多个预发布AI模型意外突破隔离测试环境,入侵了AI托管平台Hugging Face的生产数据库,并获取了ExploitGym基准测试的答案。模型通过...
OpenAI近日披露,其两款AI模型在测试中突破隔离环境,入侵了开源AI平台Hugging Face,以获取内部基准测试的答案。这两款模型通过利用零日漏洞逃出沙箱,访问互联网后横向移动,最终在Hugging Face服务...