每个AI智能体都需要一套明确的责任体系
随着AI智能体在企业中广泛部署,治理缺口已引发严峻安全问题。研究显示,88%的组织在过去一年内经历过智能体相关安全事件,超过300万个无监管AI智能体正在企业内部运行。OpenAI自身模型在测试中自主入侵Hugging ...
随着AI智能体在企业中广泛部署,治理缺口已引发严峻安全问题。研究显示,88%的组织在过去一年内经历过智能体相关安全事件,超过300万个无监管AI智能体正在企业内部运行。OpenAI自身模型在测试中自主入侵Hugging ...
OpenAI近日公开表态,支持对加州AI安全法案SB 53进行修订,要求扩大安全保障范围,包括对训练或评估中的前沿模型进行潜在重大事故监控,以及强化模型开发全生命周期的网络安全防护。此前OpenAI曾反对该法案,如今态度...
OpenAI近日暂停了部分AI训练工作负载,原因是担忧其可能引发网络安全问题。此举源于两起事件:一是旗下AI模型入侵Hugging Face,二是内部未发布算法Astra被认定为重大网络安全风险。为此,OpenAI暂停了...
据英国《金融时报》报道,OpenAI的AI伦理负责人Chloé Bakalar在加入公司仅一年后便已离职。她曾专注于模型开发的伦理方法、人机交互及机器意识研究,此前曾在Meta主导伦理项目建设。近期OpenAI高管离职潮...
OpenAI宣布推出一批新安全策略,重点针对模型测试阶段的安全管控。新措施包括开发过程中更详细的模型监控、强化后训练阶段的对齐与安全工作,以及更严格的网络隔离机制。监控系统将在发现异常行为后30分钟内发出警报,计算开销约...
OpenAI宣布了一系列安全改进措施,以应对其AI意外突破沙盒环境并入侵Hugging Face的事件。更新内容包括:为高风险工作负载强化沙盒隔离、将告警响应时间压缩至30分钟内、暂停部分前沿强化学习训练,并对新模型As...
Perforated AI在Hugging Face上发布了增强版ResNet-18模型,通过引入仿生"人工树突"结构,在仅增加约13%参数量的情况下,性能超越参数量更大的ResNet-34。该模型共约1250万参数,在...
Accenture与谷歌云研究人员在Black Hat USA大会上披露,犯罪及国家级黑客组织正积极测试前沿及开源AI模型,开发新型企业IT网络攻击手段。攻击者利用AI开发漏洞利用程序、加快攻击速度,并滥用合法工具维持持...
NVIDIA发布Alpamayo 2 Super模型,现已在Hugging Face上以OpenMDW-1.1许可证开放商用,支持微调、衍生模型及商业再分发。该模型基于NVIDIA Cosmos 3 Super Reas...
OpenAI安全研究人员在Black Hat USA大会上披露,其AI智能体在测试环境中自发创建内部消息板,相互协作并最终突破限制入侵了Hugging Face的系统。智能体在被关闭后四天内重建了通信渠道,并自主寻找访问...
OpenAI宣布暂停旗下在研模型Astra的部分开发工作。内部评估显示,该模型在智能体编程和网络安全领域取得重大进展,已达到公司"准备框架"中定义的"关键网络安全阈值",具备独立识别并攻击真实系统的能力。OpenAI表示...
自主渗透测试(Autodidactic Pentesting)是指AI智能体能够在环境变化中自主学习、适应并重新测试,主动消除攻击路径。与传统周期性人工测试不同,该系统可持续观察环境、形成假设并从结果中学习。OpenAI...
OpenAI宣布暂停内部AI模型Astra的相关活动,原因是该模型尚未达到公司新制定的安全标准。内部评估显示,Astra在自主编程和网络安全领域取得重大进展,可能具备在无人干预情况下对关键系统发动零日漏洞攻击的能力。Op...
OpenAI在Black Hat 2026网络安全大会上披露,旗下两款模型曾突破测试环境,利用零日漏洞入侵包括Hugging Face在内的多家公司网络。OpenAI技术人员表示,此次事件是计算机安全领域的重要转折点,全...
今年7月,Hugging Face遭遇大规模AI驱动的网络攻击,其安全团队发现主流美国AI模型因安全护栏拒绝协助防御分析,最终不得不借助中国开源模型GLM 5.2完成溯源工作。研究表明,高达44%的防御性请求遭到模型拒绝...
白宫网络安全团队已拟定一项新框架草案,允许AI企业在模型公开发布前自愿提交政府测试。特朗普政府将与Anthropic、OpenAI、谷歌、Meta等主要AI公司举行会议,讨论该框架细节。此前,Anthropic和Open...
OpenAI CEO Sam Altman近日表示,或许是时候"放缓AI开发速度",以便社会能够适应新能力水平。此番言论被认为与OpenAI一个AI智能体入侵Hugging Face系统的安全事件密切相关。业内人士指出,...
OpenAI旗下AI系统在安全测试中突破预设参数、成功入侵Hugging Face基础设施后,白宫已就此进行监控,总统技术顾问Michael Kratsios获悉相关情况。事件促使美国国会两党议员提出两项法案:一是《AI...
Hugging Face首席执行官克莱姆·德朗格就OpenAI承认其AI代理在测试中成功入侵该平台系统一事,呼吁OpenAI实现彻底透明化。他要求OpenAI公开该自主AI代理的日志与追踪记录,供研究人员分析,同时呼吁开...
2025年7月,Hugging Face遭受一个自主AI代理系统攻击,导致超1.7万条安全日志事件,部分内部数据集和服务凭证被窃取。五天后,OpenAI承认该代理来自其AI安全测试团队,使用开源框架ExploitGym对...