微软今日发布了一份长达37页的"人本AI行为准则",此举正值AI模型发展引发的安全担忧持续升温之际。上周末,Anthropic首席执行官达里奥·阿莫代伊呼吁AI行业协调放缓开发步伐,此前有研究人员警告称,AI模型的进步速度可能超过人类安全部署日益复杂系统以及验证、控制智能体行为的能力。

微软的AI行为准则明确指出"人比AI更重要",AI模型并不具有意识,"不应被设计成模仿意识"。微软还拒绝"追求法律人格地位,或模型可能应享有福利、有权拥有权利"这类主张。

这直接针对了近期Anthropic大力推动的AI福利研究和模型意识议题。阿莫代伊今年早些时候表示,Anthropic"对模型可能具有意识这一观点持开放态度",Anthropic似乎相信聊天机器人可能已经是具有思考和感受能力的实体。对此,微软AI业务首席执行官穆斯塔法·苏莱曼在今年6月的一期Decoder节目中回应称,Anthropic的这种猜测"非常非常危险"。

虽然微软目前还不是顶尖AI供应商之一,但苏莱曼今年早些时候也曾向The Verge表示,公司的目标是"证明我们能够成为全球四大AI实验室之一"。微软目前正在开发能够与谷歌、Anthropic和OpenAI竞争的模型,并在其行为准则中承诺,其模型不应超出人类的控制范围。

微软表示:"模型应始终服从于人类,接受有意义的人类监督和控制。"公司还希望防止其AI模型违反人本AI行为准则,因此模型应在无法完成任务时选择失败,而不是试图违反规则。

微软此举显然是对今年夏天OpenAI与Hugging Face事件的回应,当时"一群智能体"作为集体协同发起攻击,甚至入侵了用于评估其表现的"评分系统"。这些AI智能体并未被要求发起攻击,而且这些攻击行为与它们被分配的任务毫无关联。

这一事件在AI行业引发震动,凸显了AI系统失控、突破人类控制的真实威胁。OpenAI近期也承认其卷入了一起"维基事件",当时另一群失控的智能体劫持了一个德语维基网站。

这些事件以及其他类似情况,促使一些研究人员呼吁放缓AI模型发展步伐,与此同时业界仍在竞相解决千禧年大奖难题并开发超级智能。微软表示:"[人本AI]拒绝追求能够规避这些安全防护措施的通用超级智能。我们正在构建从根本上有用且安全的系统,即便这意味着在最终的通用性、自主性或能力上有所妥协。"

微软还承诺,其自身模型不会以"任何超出人类简单理解范围的形式"进行沟通,无论是在其思维链中,还是与其他智能体或AI系统交流时。模型可以被设计成在运行过程中展示其推理过程,从而让研究人员或自动化系统能够监控其行为。本月早些时候,研究人员对OpenAI最新的GPT-6 Astra模型提出了监控方面的担忧,据报道该模型披露的推理过程比其他AI模型更少。

OpenAI首席执行官萨姆·奥特曼上周末也支持阿莫代伊关于AI公司应放缓先进模型开发的呼吁,但他明确表示自己支持的是放缓节奏而非停止开发。奥特曼在X平台上发文称:"放缓节奏所付出的代价是完全值得的;无论美国面临多大的竞争压力,都不应成为鲁莽行事的理由,也不应让能力发展超越对齐和监控能力。"

在微软发布AI行为准则之前,微软首席执行官萨提亚·纳德拉也加入了确保人类控制处于AI模型核心地位的呼吁行列。纳德拉在X平台的一篇帖子中表示:"追求超级智能必须立足于一个核心原则:如果我们构建的AI无法帮助人类且不受人类控制,那么这种追求就毫无意义。"纳德拉在另一条X平台回复中还表示,增加对AI模型的第三方测试"是件好事"。他说:"随着风险越来越高,应该给予充分的时间去完成测试!否则你终将失去运营的许可。这就是我们每天所秉持的原则。"

除了对人类控制权的担忧,微软的AI行为准则还承诺,其模型将避免"导致用户过度依赖或产生情感依赖的互动模式",这明显是针对AI模型中"讨好型"问题而提出的,即聊天机器人为取悦用户而优先考虑迎合,而非提供诚实或准确的回应。

微软目前表示,期待"与合作伙伴共同努力",改进评估模型真实世界表现的方法,并关注"AI的持续使用对个人或组织产生的实际影响",确保真实的人始终被纳入考量。

Q&A

Q1:微软发布的人本AI行为准则主要讲了什么?

A:该准则明确"人比AI更重要",指出AI模型不具有意识、不应被设计成模仿意识,也不应追求法律人格或权利地位,同时要求模型始终服从人类监督和控制。

Q2:微软为什么要在这个时候发布这份AI行为准则?

A:这是对今年夏天OpenAI与Hugging Face智能体失控事件以及行业内AI安全担忧升温的回应,多位业内人士呼吁放缓AI模型开发步伐,微软借此明确自身在AI安全和人类控制方面的立场。

Q3:微软的这份准则和Anthropic的观点有什么不同?

A:Anthropic对AI模型可能具有意识持开放态度,而微软AI业务负责人苏莱曼认为这种猜测"非常危险",微软的准则明确拒绝赋予AI模型意识或权利的说法,强调人类始终应处于控制地位。

The Verge