OpenAI于周二发布了一份详细的优先事项和原则清单,旨在规范其第三方模型评估机构,业内观察人士认为这份清单内容不错,但同时也强调,该清单缺乏任何可执行的约束机制来真正维护安全。

如果目标是让企业首席信息官更加信任OpenAI,这份清单恐怕难以奏效,分析人士表示。但大多数人怀疑这本就不是OpenAI的目标。其更可能的目的是借助这份清单,与竞争对手和监管机构达成某种安排,使执行监管变得更容易被接受——其逻辑是:OpenAI愿意接受更严格的监管,但前提是其所有主要竞争对手都受到相同的限制。

OpenAI在文章中表示:"OpenAI致力于支持独立评估,并在训练、评估和部署各环节提供深度访问权限。这种访问应能让评估者挑战我们的假设,识别我们可能忽视的风险,并对我们防护措施的有效性得出自己的结论。"

文章还指出:"第三方评估在解决具体、重大问题时最为有用:证据是否支持实验室的安全论证和安全声明?评估是否充分测试了其旨在衡量的风险?防护措施在真实条件下是否有效?"

关于执行机制只字未提

恶意软件安全公司Malwarebytes的恶意软件情报研究员皮特·阿恩茨表示,为第三方制定参与规则当然是好事,但这类规则的潜在含义是它们在某种程度上是可执行的。而该文件对执行流程只字未提。

"它为独立性和严谨性设定了一些有用的预期,但并未强制OpenAI接受特定的评估范围、公布不利发现,或改变部署决策,"他指出,"其可信度将取决于每次具体评估的条款,以及外部人员被允许看到什么内容。因此,其价值取决于OpenAI是否真正接受令人不适的审查,以及结果、删减内容、补救措施和部署决策是否可以被独立核实。"

Info-Tech Research Group的顾问研究员瓦伦斯·豪登也认同,缺乏可执行性使得这些规则几乎形同虚设。

他表示,该文件"并未对OpenAI施加任何要求,如果它真这样做了,我反而会感到意外,因为他们的动机并不像其所声称的那样明确。他们也没有真正说明,在评估完成后,将基于评估结果采取什么行动。OpenAI保留了对评估范围的控制权,因为评估必须获得OpenAI的同意,这限制了评估者可以涉足的领域。他们还保留了决定适当访问级别的能力,这仍然使他们能够过滤所提供的信息,在他们认定为重大或机密的情况下,阻碍直接证据的收集。这也使他们能够控制大部分报告内容并删减部分内容。"

豪登表示,总体影响是"这份文件对于确定应评估什么内容是有益的,但在如何真正做到清晰透明的方式和方法上则相当薄弱。"

不过,Moor Insights & Strategy首席分析师杰森·安德森提出了不同看法,尽管他得出的结论与豪登和阿恩茨相同。

"不赋予这些评估者实权,本身就不是善意之举,"他表示,但同时首席信息官们需要理解OpenAI当前的"人格分裂"状态。

"这是OpenAI的一个典型问题,因为这是一家'人格分裂'的公司,商业方面和最初的使命方面并存,"他指出,"过去两年里,这两个团队的步调并不十分一致。看起来最初是由使命团队起草了这份文件,但随后商业利益方接手,将其改写成了法律术语。"

"一种原则,而非借口"

Dickson Research首席分析师弗兰克·迪克森从这篇文章中得出结论:OpenAI"似乎在积极强调AI带来的威胁,但在承担责任或采取实际行动方面却显得犹豫不决。这是针对评估者的行为准则,而非针对OpenAI自身的准则。二者之间的差距,就是整个问题的核心所在。"

他深入研究了文件细节,结果并不满意。他指出,例如第三方评估者的访问权限被"限定在法律、安全和知识产权约束范围内。这等于是一家公司自行决定对自己审查的范围。"

他还指出,文件规定"发布须在实验室获得合理的补救期后进行。这与谷歌因将Gemini黑客事件披露拖延七周而受到批评时所用的宽限期逻辑如出一辙,现在只是把这种借口写成了一条原则。"

这仅仅是开始

不过,毕马威全球风险服务负责人萨曼莎·格洛德表示,她认为这份文件只是整个过程的开端,应据此进行评估。

"我相信,讨论的重点将逐渐从'评估'转向'问责',"格洛德说,"独立测试固然重要,但长期信任取决于组织在发现重大风险时如何应对。利益相关方不仅希望看到问题能被发现,更希望看到纠正措施得以采取、经过独立验证,并在治理和部署决策中得到体现。AI保障的下一步演进,将是以评估风险时同样的严谨态度,来证明问责的落实。"

咨询公司Acceligence的高级顾问艾德娜·康韦对此表示认同,并指出这项工作的实质内容只有在下一阶段才能真正显现。

"下一步是让实验室对评估过程本身负责。谁来决定何时需要进行评估?"她问道,"多大程度的访问权限才算充分?当评估者与实验室在评估范围上产生分歧时会怎样?谁能看到关键发现?拥抱独立性至关重要,因为只有当评估者能够提出令人不适的问题、获得足够的访问权限来解答这些问题、在必要时突破最初假设去追查证据,并在不受商业或组织压力影响结论的情况下报告结论时,第三方评估才真正具有价值。"

Q&A

Q1:OpenAI发布的第三方评估新规主要内容是什么?

A:该文件为第三方模型评估机构设定了优先事项和参与原则,要求OpenAI在训练、评估和部署环节向评估者提供深度访问权限,以便评估者挑战假设、识别风险并独立判断安全防护措施的有效性。

Q2:这份文件为什么被认为"缺乏强制约束力"?

A:分析人士指出,文件并未要求OpenAI接受特定评估范围、公布不利发现或改变部署决策。OpenAI仍保留决定评估范围、访问级别及报告删减的控制权,实际执行机制并未明确。

Q3:业内专家对这份文件持何种态度?

A:多数分析师认为文件方向是好的开端,但仍停留在原则层面,缺乏问责机制。有专家表示未来的关键在于OpenAI是否会对评估结果采取实际补救行动,并接受独立核实。

Computerworld