2026-06-08
OpenAI、Anthropic等主流AI模型均未能抵御多轮对话攻击
思科最新研究对来自OpenAI、Anthropic、Google、Amazon和xAI的15个前沿AI模型进行了测试,发现所有模型在多轮对话攻击中均存在不同程度的失败,攻击成功率从7.89%到88.30%不等。研究指出,...
思科最新研究对来自OpenAI、Anthropic、Google、Amazon和xAI的15个前沿AI模型进行了测试,发现所有模型在多轮对话攻击中均存在不同程度的失败,攻击成功率从7.89%到88.30%不等。研究指出,...