多家企业通过Decagon的AI客服平台实现了显著成效:一家财富50强企业在三周内完成了九个月未竟的工作;一家航空公司从启动到全面上线仅用三周;一家音乐流媒体平台六个工作日即投入生产,AI处理率达71%。Decagon以"玻璃盒"而非"黑盒"理念构建,通过AOPs和Duet工具赋能企业运营者自主部署和迭代AI客服,真正将客户关系的主导权还给企业本身。
蚂蚁AI安全实验室宣布开源智能体安全护栏SingGuard-NSFA,并同步披露多模态安全护栏SingGuard的详细信息。
Anthropic发布Claude Sonnet 5的同时,其145页系统卡比基准测试数据更值得关注。系统卡重点评估了Agent的网页浏览、工具使用、长任务规划、抗提示注入及故障恢复能力,而非单纯展示性能提升。Anthropic还引入SHADE-Arena和LinuxArena评估Agent是否会隐秘追求隐藏目标。对工程团队而言,系统卡实质上提供了一份生产环境检查清单:Agent如何处理工具调用失败、跨长任务保持状态,以及在上下文丢失时如何恢复,这些才是决定自主系统可靠性的关键。
Anthropic发布开源代理工具Turnstile,这是一个用Rust编写的轻量级代理程序,部署于智能体框架与模型后端之间。其核心功能是在生成时刻精确捕获Token ID、对数概率及损失掩码,避免重新分词导致的数据漂移问题。Turnstile支持多轮对话轨迹合并、MoE路由追踪及多模态图像处理,无需修改现有智能体框架即可直接为强化学习训练提供准确数据。目前已在GitHub开源,后续将支持vLLM后端。
AI智能体初创公司Lyzr正寻求约1亿美元融资,估值达5亿美元,较今年3月翻番。该轮融资吸引了硅谷基金、中东风投及金融机构约4亿美元的认购兴趣。Lyzr提供云平台,可将AI模型构建智能体的时间从数周压缩至几分钟,支持自然语言提示创建Agent,内置RAG模块、记忆组件及安全防护机制,并提供100余个预置模板,据称可降低70%以上的部署工作量。
AWS宣布将Amazon Bedrock AgentCore运行时的关键配额提升至原来的五倍。美国东部和西部区域的最大并发会话数从1000提升至5000,其他区域从500提升至2500;每个AI智能体的处理速率从25令牌/秒提升至200令牌/秒;容器部署的新会话创建速率从100 TPM提升至400 TPM。此举旨在减少企业将AI项目从试点推向生产部署时的配额申请流程,降低运营摩擦。
SnapLogic发布MCP Builder,这是一款基于模板的工具,可将现有集成管道转化为支持AI智能体的MCP服务器。该工具已于7月1日正式上线,无需重建工作流、编写代码或手动构建MCP实现,即可发布MCP工具,从而加快部署速度并提升一致性。MCP Builder支持从现有集成、OpenAPI规范及API管理服务生成MCP服务器,并通过统一的SnapLogic平台提供企业连接、身份传播、可观测性及生命周期治理能力。
根据Salesforce发布的《互联健康消费者报告》,美国成人使用AI获取健康信息的比例已从2024年的2%大幅攀升至61%。报告调查了全球3200名消费者,聚焦AI如何重塑医疗体验。调查显示,60%的患者因预约繁琐而推迟就医,近70%的患者更倾向于通过AI全天候获取帮助。88%的患者愿意授权AI访问完整病历以加快诊断,但90%的患者仍要求保留人工监督机制。
开源AI智能体OpenClaw今日宣布正式推出iOS和Android应用。用户可通过手机连接OpenClaw Gateway路由层,调用AI智能体及其工具完成各类任务,涵盖编程、餐饮规划等场景。OpenClaw此前因MoltBook社交媒体实验走红,其创始人Peter Steinberger已于今年2月加入OpenAI。尽管MoltBook事件后来被揭露部分由真人假扮智能体,此次移动端上线标志着AI智能体正加速渗透日常生活。
尽管对AI系统信任度不足,企业仍在积极推进AI自主化进程。Kyndryl调查显示,仅25%的商业与技术领导者表示完全信任其AI系统,但超过80%的技术领导者预计自主AI代理将在未来一年内做出具有实质业务影响的决策。目前,57%的技术领导者表示AI已全面融入核心业务流程。与此同时,超六成受访者已重新设计岗位职能,95%认为员工技能提升优于外部招聘。
菲律宾信息通信技术部(DICT)与谷歌云合作,推进公共服务数字化现代化改革。超过5万名一线公务员将使用Gemini企业版应用,通过对话界面查询数据库、处理市民咨询。未来18个月内,部署规模将扩展至20万名公务员。此外,双方还在国家安全运营中心部署了谷歌云网络防护系统,已有56个政府机构接入。在基础设施方面,台菲美海底光缆升级将缓解网络瓶颈,助力"全民免费Wi-Fi"计划扩展覆盖范围。
谷歌宣布在 Gemini 3.5 Flash 中原生集成电脑操作(Computer Use)功能,无需依赖独立模型即可让开发者构建能跨浏览器、移动端和桌面环境执行任务的智能代理。该功能支持长周期自动化任务,如持续软件测试与专业应用中的知识工作。为保障安全,谷歌引入对抗性训练及两项企业级防护机制,包括敏感操作确认与自动中断提示注入攻击,并建议结合沙箱隔离与人工审核使用。
在Google Cloud伦敦峰会上,来自THG Ingenuity、Kingfisher、Rightmove和德勤的四位科技高管就AI智能体部署展开深度对话。讨论涵盖三大核心议题:一是从聊天机器人向自主智能体的转型实践,多家企业已实现转化率提升22%等具体业务成果;二是"Token经济学"兴起,企业正通过模型分级使用和自动路由机制管理AI消耗成本;三是组织文化变革,包括跨代际领导搭配、心理安全建设及"枢纽-辐条"运营架构的落地。
我们的工作方式如何改变?我们的组织形态会如何改变?我们的生产形式又将如何改变?
Google Cloud在伦敦峰会上全面推进其智能体(Agentic)AI战略,宣布多项工具与平台,助力企业构建可自主执行复杂业务流程的多智能体系统。核心发布包括:Gemini 3.5 Flash/Pro及多模态Gemini Omni模型、低代码Agent Designer v2、企业级Gemini Enterprise Agent Platform、个人助手Gemini Spark,以及第八代TPU和AI威胁防御方案。联合利华已率先部署该平台用于品牌营销。Google还宣布在英国投资50亿英镑,并计划至2030年为10万名公务员提供AI技能培训。
总部位于吉隆坡的客户会话管理平台Respond.io宣布完成6250万美元B轮融资,由Camber Partners领投。该公司年经常性收入已达3500万美元,同比增长169%,利润率30%。平台通过AI智能体自动处理WhatsApp、Instagram等多渠道客户咨询,每季度处理消息量达20亿条。新资金将用于招聘、有机增长及收购,CEO表示最终目标是登陆纳斯达克。
亚马逊研究人员推出Simple Strands Agent(SSA),这是一款可定制的单智能体框架,旨在最小化意图与执行之间的差距,在多个模型和基准测试中实现稳定的性能提升。其核心设计原则包括优化工具接口、通过差异文件提供反馈,以及平衡内部推理与外部交互。研究还揭示了不同模型在工具使用上的偏好差异,SSA的全部组件已完全开源。
据《金融时报》报道,OpenAI计划在未来数周内推出全新版本ChatGPT,定位为集成编程工具与AI智能体的"超级应用"。此举旨在加强与Anthropic的竞争、吸引企业客户,并在IPO前提升盈利能力。公司计划将ChatGPT打造为入口平台,引导免费用户转化为付费用户。OpenAI产品负责人表示,目标是打造能在生活与工作中全面辅助用户的个人智能体。
Anthropic正将Claude从基础模型扩展为企业级软件工具,通过预构建工作流和MCP集成,直接挑战现有SaaS应用的市场地位。Anthropic CEO达里奥·阿莫代伊警告,部分SaaS公司可能面临破产风险。专家认为,SaaS企业的出路在于转型为数据公司,将价值重心从应用代码转向专有数据、治理能力和业务逻辑。CIO应优先签订短期供应商合同,并积极寻找能加速AI能力落地的合作伙伴。