Anthropic于本周二发布了最新模型Opus 5.5,该公司表示,这次发布在编程和知识工作性能方面创下了新的技术标杆。Opus是Anthropic三档Claude产品线中能力最强、价格最高的一档;Sonnet在速度与智能之间取得平衡,而Haiku则是速度最快、价格最低的选项。值得注意的是,Anthropic表示,此次发布在多项基准测试中超越了规模更大的Fable模型,并在一些非正式任务测试中完成了Fable未能完成的工作。

新模型的价格也大幅低于前代产品。Opus 5.5的输出Token价格为每百万Token 20美元,而前代模型为25美元。其他计费指标也有类似的降价幅度。此外,该模型运行速度更快,反映出为其提供服务所需的整体计算资源有所下降。

新版本还对Opus的交流方式做出了重大调整,Opus 5.5更少使用专业术语,并倾向于将重要信息放在回复的开头。

此次发布距离7月24日Opus 5发布仅两个月。据官方公告,产品线中的下一档次模型Sonnet 5.5和Haiku 5.5将在“未来几周内”发布,性能提升幅度类似。

Anthropic表示,Opus 5.5在生物学和网络安全能力方面与Mythos模型相当,因此其发布也需遵循与公司Fable模型相同的安全防护措施。这些防护措施限制了模型被用于在已编译程序中发现漏洞或开发可识别的生物武器等任务的能力。

Opus 5.5是Anthropic首席执行官达里奥·阿莫代伊响应“放缓前沿进展”号召以来发布的首个模型,该做法旨在有意放缓AI能力的进展速度,以匹配对齐研究的进展速度。

“我逐渐确信,要彻底应对这些风险,需要更加谨慎,”阿莫代伊本月早些时候在一篇文章中写道,“不仅要投资于风险预防,还要放缓能力进展的速度,让风险预防有时间跟上步伐。”

Opus 5.5的安全训练与前代模型大体相似,包括对齐测试以及由METR和Frontier Design等外部机构进行的发布前评估。但Anthropic强调,更先进的训练和评估体系已经在为未来模型做准备,包括改进的安全和监控系统。

“随着AI能力不断提升,公共政策应在确保人们所依赖的系统安全方面发挥更大作用。这种能力的建设需要时间,我们已经开始搭建支持这一目标的基础设施,”官方博客文章写道,“我们期待很快分享这方面工作的更多细节。”

Q&A

Q1:Opus 5.5相比之前的模型价格降低了多少?

A:Opus 5.5的输出Token价格为每百万Token 20美元,相比前代模型的25美元有明显下降,其他计费指标也有类似幅度的降价。

Q2:Opus 5.5和Fable模型相比表现如何?

A:据Anthropic介绍,Opus 5.5在编程和知识工作性能方面创下新标杆,在多项基准测试中超越了规模更大的Fable模型,并完成了一些Fable未能完成的非正式任务。

Q3:Anthropic为什么要放缓AI能力的发展速度?

A:CEO达里奥·阿莫代伊表示,他认为要彻底应对AI风险需要更加谨慎,不仅要投资风险预防,还要放缓能力进展速度,让风险预防措施有时间跟上。

TechCrunch - AI