AI合规初创公司ZeroDrift近日推出Guard for Agents服务,允许开发者将企业书面政策转化为可执行规则,在智能体生成的消息触达用户之前进行合规审查。

该服务通过API及连接器扩展了公司的合规技术,支持从Notion、Linear和谷歌云端硬盘导入政策文件。ZeroDrift按每次验证收取0.01美元的费用,覆盖电子邮件、短信和Slack消息等多种渠道。

Guard for Agents基于该公司原有产品Command构建——Command是一个用于查看、测试和管理合规执行的控制中心。Guard为开发者提供了将合规检查嵌入应用程序的途径,填补了文档中存储的政策与智能体实际生成消息之间的鸿沟。

"我们处于消息发送前的拦截层,"ZeroDrift创始人兼首席执行官Kumesh Aroomoogan在采访中表示,"在消息生成的那一刻,我们就介入了。"

开发者将智能体的输出发送至验证端点,服务将对文本进行规则核查,并返回违规信息(包括严重程度)。根据策略配置,系统可提供替代内容、建议拦截消息,或将问题上报人工审核。

该控制机制作用于智能体的出向响应,而非用户的输入提示。客户可自行决定如何处理违规情况。例如,包含机密财务信息或承诺"保证投资回报"的消息可被直接拦截;客户也可配置为无需人工干预、自动处理违规。

政策连接器采用模型上下文协议(MCP)将文档导入ZeroDrift的执行系统。该公司的专有小型语言模型能够从文本中识别规则,例如禁止传输社会安全号码的条款。客户可在可视化界面中查看提取的规则,并选择执行哪些规则以及如何执行。

"我们的小型语言模型能够从所有文本中梳理出规则,并判断哪些规则应当被执行,"Aroomoogan表示。

ZeroDrift表示,该方案无需开发者使用专有语言重写政策。规则可在应用运行时随时启用或禁用,并可针对不同智能体进行配置。系统会记录每次执行决策,包括原始消息、触发规则、所采取的行动以及最终输出。

每次检查均使用Anchor 3.0-Preview模型,该模型专为检测策略违规和生成合规改写内容而设计。Aroomoogan透露,ZeroDrift基于律师标注数据对一个开源模型进行了后训练,同时利用客户元数据和决策反馈持续优化模型。

Guard提供OpenAPI规范,开发者可用于生成Python、TypeScript、Go和Java等语言的客户端,集成只需向验证端点发起请求。

ZeroDrift正将业务拓展至书面沟通之外的场景。Aroomoogan表示,正在开发语音智能体的企业——尤其是金融服务和医疗健康领域——迫切需要对系统语音内容进行合规审查。

面向受监管行业的AI初创公司是另一大需求来源。"初创公司需要快速推进,他们只想把我们作为合规层直接接入,"他说。

该技术同样适用于传统营销和客户关系管理系统发出的消息,不依赖大语言模型即可运行。自动改写功能面向机器生成内容,不适用于人工编写的消息。

Aroomoogan表示,检查运行仅需毫秒级时间,但目前尚未提供具体延迟数据或第三方性能测试结果。ZeroDrift计划改进模型,并与其他语言模型进行第三方基准测试,以验证其"比使用通用模型审查另一个模型输出更快、更经济"的说法。

Q&A

Q1:Guard for Agents是什么,有什么用?

A:Guard for Agents是ZeroDrift推出的一项合规审查服务,专门用于在智能体生成的消息发送给用户之前,自动检测是否符合企业政策。开发者可以将公司书面政策导入系统,由小型语言模型自动提取规则,并对每条待发消息进行实时校验,发现违规时可自动拦截、改写或上报人工审核。

Q2:Guard for Agents怎么收费?

A:按每次验证收取0.01美元(即一美分),支持电子邮件、短信、Slack等多种消息渠道的合规检查。

Q3:Anchor 3.0-Preview模型是怎么训练的?

A:Anchor 3.0-Preview是ZeroDrift专有的合规检测模型,基于一个开源模型,使用律师标注的数据进行后训练,使其能够识别政策违规并生成合规替代内容。ZeroDrift还会利用客户的使用数据和决策反馈持续改进该模型。

SiliconANGLE