Claude Opus 5.5通过更便宜的Tokens和更智能的任务降低成本
Anthropic的Claude Opus 5.5于2026年9月22日发布,为其AI代码生成模型的用户带来了显著的成本降低,不仅提供了更低的token价格,还提高了每项任务的效率。初步估计显示,根据任务类型和会话配置,Opus 5.5上的任务成本可能比其前代Opus 5低多达31%。
Opus 5.5的定价模型相比Opus 5,输入和输出token成本分别降低了20%,输入token现在的费用是每百万$4,输出token费用是每百万$20。缓存读取(对于减少冗余token使用至关重要)的成本降低了60%,从输入token成本的10%降至仅5%。这些成本降低使Opus 5.5对较长的会话或高度依赖缓存数据的任务特别有吸引力。
更智能的任务执行减少了Token使用
除了价格下降,Opus 5.5通过优化处理和推理请求的方式,减少了每项任务使用的tokens数量。模型现在默认在响应之前进行“思考”,这提高了准确性,但可能会增加输出token的使用量。然而,每个token的降低成本抵消了这种潜在的增加。以前需要多次重试的复杂或开放式任务可能会从这些改进中受益最大,因为Opus 5.5被设计成能够更少轮次内完成任务。
例如,一个包含40轮、平均上下文大小为70,000 tokens的任务在Opus 5.5下的输入token成本约为$1.62,而在Opus 5下则约为$2.24。同样,较高的缓存命中率(90%或以上)可以进一步降低输入成本,这突显了保持稳定会话的重要性,避免重置缓存的中断。
使用场景和迁移建议
Opus 5.5被定位为大多数开发者的新“日常驱动工具”,在成本和性能之间达到平衡。对于诸如调试、代码审查和小型功能实现等日常任务,Opus 5.5提供了足够的推理能力,而无需支付像Fable 5.1这样更大模型的更高成本。然而,对于高度复杂或无人监督的任务,建议用户切换到Fable 5.1,它提供更强的推理能力,但输入token每百万$10、输出token每百万$50的价格较高。
为了充分利用Opus 5.5的成本节约和效率提升,Anthropic建议用户在迁移期间采取以下措施:
- 审核提示,去除增加token使用的多余指令。
- 为任务选择合适的努力级别,“中等”推荐用于大多数日常工作。
- 使用/usage命令监控会话指标,以评估token消耗和缓存效率。
- 有策略地压缩或清除对话历史,以控制上下文大小并避免不必要的缓存写入。
对开发者的成本影响
根据Anthropic的内部数据,平均Claude Code用户每天的活跃成本约为$13,90%的用户低于$30的水平。Opus 5.5的引入预计将降低这些平均成本,特别是对于运行大规模或依赖缓存的工作负载的组织而言。在支持任务的早期基准测试中,从Opus 4.8切换到Opus 5.5显示出18%的成本降低,通过提示审核可以实现进一步的节约。
鼓励用户在自己的工作负载上测试Opus 5.5,以衡量其影响。对于企业,Anthropic提供了诸如Claude Code Analytics API之类的工具,可以按用户、模型和token类型细分成本,提供对使用模式和优化机会的详细洞察。
通过结合降低的token费率与任务级效率,Claude Opus 5.5有望成为开发者寻找精简其AI驱动代码工作流的一个具有成本效益的解决方案。