美国公司Anthropic扩展了其人工智能模型产品线,推出了Claude Opus 5。这款新品旨在将编程、文档处理和自主智能体管理方面的高性能与比现有旗舰模型Claude Fable 5低得多的成本相结合。

Anthropic将Claude Opus 5描述为Opus系列的重大代际飞跃,主要面向长期复杂任务、深度推理和专业工作场景。尽管Fable 5仍是该公司性能最强的广泛可用模型,但Opus 5在多项测试中与其不相上下,甚至超越了它,而价格仅为后者的一半。

新模型能够同时处理文本和图像素材,提供100万token的上下文窗口,并可生成长达12.8万token的回复。这使其能够在单次请求中分析大型文档、完整软件项目、文本数据库或大量图片。

开发者可在五个推理强度级别之间进行选择——低、中、高、超高和最大。默认设置采用自适应推理,模型根据任务难度自动调整所用的计算资源。此外,该模型还配备了文件处理、编程、网络搜索、记忆、计算机控制以及通过MCP协议进行互联等工具。

人工智能测试中的佼佼者

Claude Opus 5发布后,在Artificial Analysis公司的智能指数排行榜中跃居首位。在最高推理级别下获得61分,以微弱优势超越了Claude Fable 5。该模型在智能体工作、多模态推理以及复杂知识任务解决等测试中表现尤为突出。

其在ARC-AGI-3基准测试中的成绩同样引人瞩目。该测试衡量模型学习未知交互环境规则的速度。据公布结果,Claude Opus 5的得分为30.2%,几乎是此前最佳模型的四倍。ARC-AGI-3与普通知识测试的不同之处在于,它不向模型提供明确指令,而是主要评估其发现规则、制定计划以及有效应对新情境的能力。

该模型在编程、工作流自动化和长期任务处理方面也取得了优异成绩。据Anthropic介绍,它能够更好地在辅助智能体之间分配工作,监控自身进度,并在规划阶段而非最终回复生成后才发现错误。

价格更低,但仍属高端模型

Claude Opus 5通过API使用时,输入token的价格为每百万token 5美元,输出token为每百万token 25美元。将已处理的请求片段缓存的费用为每百万token 50美分。该价格与此前的Claude Opus 4.8相同,但与Fable 5相比降低了一半。

Anthropic还提供快速模式,可提供显著更快的响应速度。该模式仅可通过Claude API使用,价格为每百万输入token 10美元、每百万输出token 50美元。更快的处理速度因此以双倍价格为代价。

Claude Opus 5可通过Claude API以及Amazon Bedrock、Google Cloud和Microsoft Foundry等云服务使用。对于Claude Max订阅用户,它已成为默认模型,而更低价位的Claude Pro套餐用户则可获得有限访问权限。

这款新品解决了用户对价格更高的Fable 5的一些顾虑。Opus 5对普通科学或安全类问题的拒绝频率更低,并在价格与性能之间提供更为均衡的比例。然而,Fable 5在某些需要精确事实检索或最高可用能力级别的任务上仍保持优势。

Anthropic由此延续了其专注于面向专业部署的高性能、相对高价模型的战略。Claude Opus 5主要面向需要处理大型文档、开发软件或长期运行自主智能体的开发者、企业和用户。

deeplearning.ai/gnews.cz - GH