Anthropic PBC今日宣布推出Claude Sonnet 5.5,这是该公司AI家族中能力最强的中端模型,专为日常任务设计,相较上一代实现明显升级,运行速度提升超过30%,同时成本更低。
Sonnet一直是Anthropic旗下Claude系列模型中承担日常使用任务的主力,Sonnet 5.5在文档生成、内容摘要、电子表格处理以及代码错误修复等任务上经过了良好训练。该公司补充说,它还具备“出色的设计眼光”,能够为用户界面增添细节打磨,并能按照模板制作出几乎无需再编辑的幻灯片。
此次发布紧随9月22日推出的该系列旗舰模型Opus 5.5之后,新模型采用了更清晰的写作风格。
尽管该公司表示新版Sonnet 5.5的写作更清晰、更接近人类表达方式,但它也包含了不可见的文本水印技术。该公司在宣布这项新水印技术时表示,这不会影响文本质量或整体可读性,但会提高AI生成文本被检测出的可能性。Anthropic补充说,加入这一功能是为了遵守包括欧盟《人工智能法案》在内的全球监管要求。
与Opus 5.5一样,Sonnet 5.5在写作和沟通表达上的清晰度使其成为更出色的协作伙伴。Anthropic表示,早期测试人员反馈称,该模型在处理不太复杂的任务时迭代速度更快,整体表现也比上一代更智能。
该模型定价与Sonnet 5保持一致,为每百万输入Token 2美元,每百万输出Token 10美元,每百万缓存读取20美分。该公司表示,由于完成同样的工作通常所需Token数量大幅减少,实际成本比上一代降低了30%。
“我们向Claude Sonnet 5.5输入了数百个涵盖回复和升级请求的真实客服使用案例,”Zendesk Inc.人工智能总监阿比奈·卡图里亚表示,“它做出的错误决策更少,解决工单的速度也比我们目前在生产环境中使用的Claude模型更快。工单处理速度提升了20%,能让客户更快得到所需帮助,无需等待。”
在性能方面,该公司表示新模型在智能体编程评测Terminal-Bench 4.0中的得分为70.6%,而上一代模型的得分仅为10.3%。在衡量真实职业工作和任务表现的GDPval-AA测试中,其得分比Opus 5.5低两分。Anthropic补充说,这是首款仅依靠截图就能通关《宝可梦:红》这款常用于测试长周期任务处理和图像理解能力的电子游戏的Sonnet模型。
Anthropic指出,Sonnet 5.5在输出速度上比上一代快超过30%,是迄今为止速度最快的Sonnet模型。该公司还表示,计划在未来几周内发布Haiku 5.5,这将是Claude系列中体积最小、速度最快、效率最高的模型,专为高并发量和成本敏感型应用而打造。
由于该模型与Opus 5.5基于相同的基础架构构建,它也是首款具备显著网络安全能力的Sonnet模型。该公司表示,因此,这也是首款在发布时就配备了此前仅用于更高能力模型(如Mythos系列模型和Fable)的网络安全防护和应急机制的Sonnet模型。当提示词或问题涉及网络安全、生物学或其他敏感内容时,这些机制可能会被触发,但大多数软件开发和生命科学相关工作不会受到影响。
Q&A
Q1:Claude Sonnet 5.5相比上一代有哪些主要提升?
A:Sonnet 5.5运行速度提升超过30%,成本更低,在智能体编程评测Terminal-Bench 4.0中得分70.6%,远超上一代的10.3%,同时具备更清晰的写作风格和网络安全防护能力。
Q2:Claude Sonnet 5.5的定价是多少?
A:定价与Sonnet 5相同,为每百万输入Token 2美元、每百万输出Token 10美元、每百万缓存读取20美分,但由于所需Token数量减少,实际使用成本比上一代降低约30%。
Q3:Claude Sonnet 5.5适合用来做什么任务?
A:它适合处理日常任务,如文档生成、内容摘要、电子表格处理、代码错误修复,还具备出色的设计能力,能优化用户界面并按模板制作幻灯片。
