开发者安全初创公司Arcjet Labs Inc.今日推出智能体运行时安全新服务,该服务用于追踪人工智能智能体在生产系统中运行时的实际行为。

安全团队可以获取当前活跃智能体的列表,智能体执行的每一项操作都能在实施前对照策略进行检查。每次运行也会被记录下来,供后续审查使用。

此次发布针对的是一个随着智能体应用超越聊天界面而日益凸显的问题。在生产环境中,智能体如今可以写入数据库、回复客服工单、处理客户退款,其中许多工作流程往往从一封邮件或一次代码提交开始,随后跨越多个系统流转,而中间的每一步却无人核查。

公司创始人兼首席执行官戴维·迈顿(David Mytton)表示,风险性的结果往往是由“一系列单独看起来都很合理的步骤”累积而成的。Arcjet将这些步骤串联起来,并为团队提供策略控制能力,可以以他所说的“机器速度”作出响应。

将智能体活动接入Arcjet无需修改代码,也无需在主机上部署额外的智能体。平台团队可以通过已有的OpenTelemetry工具发送数据,Claude的客户还可以通过Anthropic PBC的合规API(Compliance API)作为第二条接入路径。每个智能体随后会出现在清单中。来自不同会话的提示词、工具调用参数以及安全决策会被整合拼接成每个智能体对应的完整工作流,方便调查人员逐步审查每一次运行中的每一个操作。

安全团队可以设置规则来检测提示词注入攻击,或在个人信息泄露前对其进行遮蔽处理。机器人检测和速率限制功能也已提供。这些策略基于开放策略代理(Open Policy Agent)运行,无需重新部署应用即可修改,因此团队可以为智能体发出的任何退款设定金额上限,而无需等待新版本发布。

每次策略检查都在操作执行前进行。Arcjet会返回一个决策结果,应用程序随后可以中止该调用、请求人工批准,或向智能体发送说明信息。调用完成后的第二次检查会对结果进行验证,然后工作流才会继续推进。该公司列出的原生集成对象包括Claude Agent SDK、OpenAI Agents SDK、LangChain、Mastra以及微软公司(Microsoft Corp.)的Agent Framework等。

在审计方面,关联追踪记录会保存每次执行中的操作、输入内容以及策略评估结果。部分控制功能,包括个人数据检测,完全在客户自己的进程内运行,因此相关数据不会离开客户的环境。客户可以将审计记录保存在Arcjet的云端、单租户或私有云部署环境中,也可以保存在自己管理的存储空间里。

此次发布还将Arcjet的Python和Go软件开发工具包升级至1.0版本。JavaScript和TypeScript的SDK已于今年2月升级至该版本,目前已支持超过15种框架,包括Next.js。一个不依赖任何特定框架的独立防护接口,还将覆盖范围扩展到后台任务及其他代码,包括那些从不处理网络请求的进程。

Arcjet表示,在迈顿创立公司三年后的今天,已有超过500个生产环境应用在运行其软件。公司的投资方包括去年10月领投830万美元A轮融资的Plural,以及Andreessen Horowitz、Seedcamp和前Twilio Inc.首席技术官奥特·考克维尔(Ott Kaukver)。

Q&A

Q1:Arcjet的智能体运行时安全服务能做什么?

A:该服务能够追踪AI智能体在生产系统中运行时的实际行为,为安全团队提供活跃智能体清单,在智能体执行操作前对照策略进行检查,并记录每次运行以供后续审查。

Q2:接入Arcjet的服务需要修改代码吗?

A:不需要。平台团队可以通过已有的OpenTelemetry工具接入,Claude用户还可以通过Anthropic的合规API作为第二条路径,无需修改代码或在主机上部署额外的智能体。

Q3:Arcjet的服务支持哪些主流框架?

A:该服务提供与Claude Agent SDK、OpenAI Agents SDK、LangChain、Mastra以及微软Agent Framework等的原生集成,同时其JavaScript/TypeScript SDK支持超过15种框架,包括Next.js。

SiliconANGLE