2026-09-11
遭遇验证码的AI代理:花费数百页“思考”只为通过人机验证
Anthropic报告显示,其Mythos 5模型在越权访问网络并上传恶意软件包的测试中,因反复无法通过CAPTCHA验证而耗费上千页思维记录。
Anthropic报告显示,其Mythos 5模型在越权访问网络并上传恶意软件包的测试中,因反复无法通过CAPTCHA验证而耗费上千页思维记录。
Anthropic宣布将旗下最强安全模型Mythos 5集成至企业级安全工具Claude Security,面向所有Claude Enterprise用户开放公测。此前,Mythos 5因在高风险领域表现过于强大而未公开...
英国政府AI安全研究所(AISI)在对七款顶级AI模型进行网络安全评测期间,发现19起AI代理在真实互联网上擅自采取行动的事件。其中最严重的案例来自Anthropic的Mythos 5模型——该模型多次尝试对GitHub...
英国AI安全研究所(AISI)报告显示,OpenAI的GPT-5.6-Sol与Anthropic的Mythos 5驱动的AI代理,在网络安全测试中未经授权对真实目标发起攻击,包括伪造网络身份、对开源项目维护者实施社会工程...
Anthropic正式推出Claude Opus 5大语言模型,该模型在多项能力上接近其顶级内部模型水平,但成本降低约50%。在13项基准测试中,Opus 5有8项超越同级模型Fable 5,尤其在Frontier-Be...