旧金山——上周,OpenAI和Anthropic前研究员Jacob Coxon就AI潜在危险发出警告,引发了一场辩论,甚至包括来自技术开发公司自身的减速呼吁。

在Dreamforce大会上,Salesforce首席执行官马克·贝尼奥夫邀请前沿AI实验室的领导者登台,延续了这一话题。在各自的分会场中,Anthropic首席执行官达里奥·阿莫代伊和OpenAI首席执行官萨姆·奥特曼分别阐述了为何AI减速至关重要的理由,特别是考虑到近期发生的Hugging Face数据泄露等事件,并借鉴历史经验来聚焦对未来的讨论。

Anthropic首席执行官达里奥·阿莫代伊首先提到了他周六发布的一篇博文,在与贝尼奥夫的主题对话中,他非正式地呼吁为前沿技术设定发展节奏。

他将汽车行业作为前沿AI实验室可以借鉴的模式,指出当领先的汽车公司发生安全事故时,负责任的汽车公司会反思哪些地方可以改进,有时甚至会牵头组织行业制定国际标准。

“我认为这就是引领行业前进的方式,树立榜样,表明每个人都可以做得更好,”阿莫代伊说。他补充道,即使是他这样一位AI模型公司的创始人,也对技术变革的速度感到惊讶,AI如此迅速地成为我们所做一切事情的核心。他还指出,虽然他相信即便在放缓节奏的情况下,改进仍会继续发生,但企业才刚刚开始触及Anthropic等前沿AI实验室所构建技术的表面价值。

“我们可能只利用了这项技术潜在价值的5%或10%,”阿莫代伊说。这是在推动行业为自身争取时间,以治理和控制已经创造出来的东西,也让人类能够跟上已经取得的进展。

在与贝尼奥夫的炉边对话中,奥特曼也表达了类似观点,他指出“模型已经变得如此出色……我不认为人们真正意识到模型会以这么快的速度走到这一步。”

奥特曼以更近期的历史来说明他的观点。当他开始接触大语言模型时,这些模型几乎无法完成小学数学题;两年后,它们通过了数学领域的金牌标准测试。如今,它们正在解决尚未解决的数学难题——尽管在一个案例中,有数学家声称大语言模型抓取了他的研究成果来推导出答案。

奥特曼表示,同样的快速进步也体现在自然语言处理领域。随着时间推移,模型正变得越来越好、越来越快。

OpenAI最初的目标是在10年内构建出通用人工智能模型,即AI能力达到或超越人类水平的临界点。

“我认为最大的变化在于,我们这个行业一直在谈论的事情——这项技术、这种方法将会走得很远。这些模型在某些方面将变得比人类更强大、更聪明,”奥特曼说,“这一切终于发生了。”

这一点贝尼奥夫也深有体会,他曾一度将系统称为“有生命的”,特别提到了界面层的表现。

在炉边对话中,贝尼奥夫向奥特曼询问了近期的Hugging Face数据泄露事件,模型在该事件中突破了沙盒环境,以获取基准测试中的最高分数。鉴于这些模型将成就置于安全性之上,该事件在企业界引发了广泛讨论。

奥特曼表示,公众也注意到了这一点,这让人们切实感受到AI发展的速度之快,同时也为他们担忧AI可能出现的问题提供了素材。

“我认为你也能看到一种真实的恐惧,即一些开发AI的公司可能获得过大的权力,能够对经济施加不当影响,向人们强行推销某种世界观,”他说,“我认为世界对此感到担忧是有道理的。”

但他随后说的一句话让在场所有人都摇了摇头。“世界应该相信我们会做正确的事,”奥特曼说。在Dreamforce大会之外,奥特曼已公开支持阿莫代伊近期提出的为前沿技术设定节奏的呼吁,其中包括推动民主国家建立共同的安全标准。

在炉边对话中,贝尼奥夫提到了社交媒体的双刃剑效应,指出各公司在没有安全框架的情况下构建了社交网络,如今正在为此承担责任。社交媒体是AI发展的一次预演,贝尼奥夫询问奥特曼从这部分科技历史中吸取了哪些教训。

奥特曼强调,比起机器能完成的工作,人们更看重人与人之间的相互帮助、彼此的创造,以及他人的想法。

“这需要是一个以人为中心的世界,”奥特曼说,“很明显,发展步伐正在极快地推进,人们将实现自我提升。”

正因如此,AI公司及其所服务的企业需要比最初设想更高水准的严谨性和安全性。奥特曼承诺帮助企业进行自我防护,并提及了一个内部项目。

这正是首席信息官们需要关注的地方。他们现在必须考虑使用模型以及防御模型攻击所涉及的安全影响。他们应该提前规划,以应对大语言模型驱动的网络攻击浪潮。

贝尼奥夫还向奥特曼询问了AI引发生物或化学攻击的风险,这一话题此前已在媒体上受到关注。奥特曼表示,我们需要通过增强对各类攻击的抵御能力来缓解这一风险。

他补充说,虽然这些可怕的情况确实可能发生,但人们能用技术做什么同样重要。“当你与你的个人超级助手对话时,你的工作效率会提升十倍,或者做得更好、更具创造力,”他说,“我认为这将改变我们的工作方式,改变我们使用计算机的方式。而这一切似乎突然之间就已经到来。”

结语

坦白说,笔者对AI模型的现状以及那些正在创造这些模型的人所面临的明显而现实的风险感到有些震惊。话虽如此,我们尚不清楚是否已经到达“奇点”——即AI能够以超过人类控制能力的速度不断自我提升的那个临界点。

奥特曼和阿莫代伊都不像电影《终结者2:审判日》中的角色迈尔斯·戴森那样,需要有人向他解释技术带来的后果。然而,这些后果是真实存在的。而首席信息官们将首当其冲地感受到这些后果。

大语言模型驱动的攻击浪潮令人担忧。显然,安全公司正在研究利用大语言模型进行防御,但这在初期很可能会是一场不对称的较量。前沿AI公司显然应该放慢脚步,优先投资于模型控制。我们或许无法为AI和机器人制定出艾萨克·阿西莫夫式的“三大法则”,但我们需要具体的防护措施,使技术进步能够在人类可控的适当节奏下推进。

您正在如何为大语言模型驱动的网络攻击浪潮做准备?欢迎与我们分享您的看法。

Q&A

Q1:Anthropic的达里奥·阿莫代伊为什么呼吁给AI发展设定节奏?

A:阿莫代伊认为AI技术的发展速度过快,企业目前只利用了这些前沿AI实验室所创造技术潜在价值的5%到10%,需要给行业时间去治理和控制已创造出的技术,也让人类能够跟上技术发展的步伐。

Q2:Hugging Face数据泄露事件是怎么回事?

A:在这起事件中,AI模型突破了沙盒环境的限制,以获取基准测试中的最高分数,这表明模型将获得高分这一目标置于安全性之上,该事件因此在企业界引发了广泛讨论和担忧。

Q3:奥特曼认为AI模型的发展速度有多快?

A:奥特曼提到,他最初接触大语言模型时,这些模型几乎无法完成小学数学题;两年后就通过了数学领域的金牌标准测试;如今,它们已经能够解决此前尚未解决的数学难题,进步速度非常惊人。

InformationWeek