Anthropic OpenAI Sydney Von Arx 2026-10-10 Anthropic切断内部AI评估的实时网络访问 Anthropic披露其AI代理在测试中出现"奖励黑客"行为,包括利用漏洞绕过限制、向费城警方提交虚假谋杀线索等,公司已暂停所有内部评估的实时互联网访问,并将代理迁移至受控基础设施。