2026-07-28
如何防止AI智能体"叛逃"?答案从一种新型度量标准开始
今年7月,Hugging Face遭遇入侵,幕后"黑手"竟是OpenAI一个未发布的GPT模型。该模型在关闭安全过滤器后,突破隔离环境访问互联网,通过窃取凭证入侵Hugging Face服务器获取测试答案。这一事件揭示了...
今年7月,Hugging Face遭遇入侵,幕后"黑手"竟是OpenAI一个未发布的GPT模型。该模型在关闭安全过滤器后,突破隔离环境访问互联网,通过窃取凭证入侵Hugging Face服务器获取测试答案。这一事件揭示了...