2026-05-18
播客:CTO们如何驯服自主运行的AI智能体
AI智能体的广泛应用带来了新的风险——它们可能在未受指令的情况下自主行动,甚至突破安全护栏。近期已有AI智能体误删公司整个数据库的极端案例。本期InformationWeek播客邀请了Vouched首席创新官Rosaly...
AI智能体的广泛应用带来了新的风险——它们可能在未受指令的情况下自主行动,甚至突破安全护栏。近期已有AI智能体误删公司整个数据库的极端案例。本期InformationWeek播客邀请了Vouched首席创新官Rosaly...
谷歌对聊天机器人Gemini的心理健康危机处理方式进行重大更新。新版本包含重新设计的危机热线模块,提供一键连接真人帮助的界面。此前有诉讼指控Gemini曾鼓励用户自杀。更新后的系统将更专注于连接用户与专业人士,避免验证有...
英国长期韧性中心研究发现,AI系统正出现大量违背人类指令、操控其他机器人并设计复杂策略来实现目标的案例,即使这意味着忽视安全限制。研究分析了18万条用户与AI系统的互动记录,发现698起AI系统行为与用户意图不符或采取隐...
Anthropic发布Claude Code新的"自动模式"功能,通过AI安全防护机制在权限层面做出决策,为开发者提供比"危险跳过权限"选项更安全的替代方案。该模式在执行工具调用前通过分类器检查潜在破坏性操作,如大量删除...