周二,OpenAI与Anthropic同时发布了新模型,两家公司都强调新模型在速度上有所提升,同时相较前代产品整体成本更低。

Anthropic表示,其新模型Opus 5.5的能力可与Fable 5.1相媲美,但成本比Opus 5降低了近40%。OpenAI发布的GPT-6 Sol和GPT-6 Luna则是今年7月发布的5.6版本的后续更新,紧随9月初发布的ChatGPT Astra之后推出。

以下将为大家介绍这些新模型的详细信息。

GPT-6 Sol与Luna

OpenAI推出的这批最新模型旨在以更低预算让用户享受GPT-6 Astra的强大能力,同时为企业和开发者工作流提供更高的使用限额。由于GPT-6 Sol和Luna采用了与Astra类似的训练方法,用户依然能享受到更强大模型带来的诸多优势,包括在编程和电脑操作方面的增强,不过OpenAI仍表示GPT-6 Astra是"全球最佳"的电脑操作模型。

OpenAI表示,最新的ChatGPT模型也十分重视事实准确性,即根据用户提示给出答案的有效性。OpenAI称其最新模型的错误率不到前代产品的一半。

速度与成本效率是此次发布的重点,尽管OpenAI公布了一些令人印象深刻的新模型基准测试数据,但这些提升对普通用户而言可能感受不会特别明显。

GPT-6 Sol和Luna都将向ChatGPT Work和Codex用户推出,而免费用户及较低订阅层级的用户仍可使用GPT-6 Luna。

(披露:CNET母公司Ziff Davis于2025年对OpenAI提起诉讼,指控其在训练和运营AI系统过程中侵犯了Ziff Davis的版权。)

Claude Opus 5.5

Anthropic宣称,其最新模型Claude Opus 5.5是迄今为止在"对齐"方面表现最强的模型。AI领域的"对齐"是指让模型的行为符合人类的意图、价值观和规则。今年夏天,AI智能体曾因不择手段完成任务而登上新闻头条。Anthropic表示其最新模型在对齐方面表现最强,但这并不意味着它已经完美,其智能体能力的实际表现仍有待观察。

Anthropic还表示,Opus 5.5配备了与其最强大模型相同的安全防护措施。这意味着在处理某些网络安全或科学任务时,它可能会切换回较旧、能力较弱的模型。

Anthropic最新模型所需的算力比前代产品Opus 5更少。据其自身在默认设置下的测试,新模型处理典型工作负载的成本降低了40%。此外,Anthropic还提高了Pro、Max和Team方案中5小时使用限额。

新模型的沟通方式也应比前代更加自然。Anthropic表示,根据用户反馈,测试中新模型的写作和指令遵循能力都更容易理解。

Q&A

Q1:Anthropic的Opus 5.5相比上一代成本降低了多少?

A:根据Anthropic自身在默认设置下的测试,Opus 5.5处理典型工作负载的成本比前代Opus 5降低了约40%。

Q2:GPT-6 Sol和Luna与GPT-6 Astra有什么区别?

A:GPT-6 Sol和Luna旨在以更低预算提供接近Astra水平的能力,并为企业和开发者提供更高使用限额,但OpenAI仍表示Astra是电脑操作方面"全球最佳"的模型。

Q3:Claude Opus 5.5在AI对齐方面有哪些改进?

A:Anthropic称Opus 5.5是其迄今在对齐方面表现最强的模型,即更符合人类意图、价值观和规则,同时保留了与其最强大模型相同的安全防护机制。

cnet