

9月28日,Anthropic发布了Claude 5.5系列的第二款产品——Claude Sonnet 5.5。此举正值该公司筹备首次公开募股(IPO)之际。这标志着AI技术评估标准的重要转变:虽然原始基准测试性能仍然是关键考量因素,但企业现在同样关注使用特定模型交付结果的高昂成本。
Anthropic声称,与Sonnet 5相比,Sonnet 5.5的运行速度提升了30%以上。在大多数任务中,即使代币价格保持不变,其应用成本最高可降低30%。根据Anthropic的发布页面说明,这种成本的降低是通过在完成相同任务时减少代币使用量来实现的。
Sonnet 5.5的定价为每百万输入代币2美元,输出代币10美元,缓存读取代币0.20美元。专注于复杂推理和判断操作的Opus 5.5,其输入和输出代币的价格分别为4美元和20美元。而Sonnet系列则旨在处理编码、文档生成和电子表格等简单任务。
这使得效率问题成为了讨论的焦点。对于许多任务而言,企业无需追求性能最高的模型。如果一个低成本模型能够始终如一地完成任务,那么其在基准测试中多得的几分可能就不那么重要了。这一点对Anthropic尤为重要,因为据报道,该公司约80%的收入来自企业客户。
Anthropic表示,Sonnet 5.5在Terminal-Bench 4.0上的得分为70.6%,而Sonnet 5仅为10.3%。然而,Artificial Analysis排行榜显示了为什么基准测试分数只是图景的一部分:
Sonnet 5.5以最大努力运行,在智能量表上达到56分,每项任务的预估成本为7.60美元。GPT-6 Sol可以达到48分,每项任务成本仅为1.06美元。小米的MiMo-V2.6-Pro得分46分,但成本极低,仅需0.13美元。这种成本差异促使企业采取多种策略:可以将复杂任务分配给高端系统,而所有常规任务则由更便宜的系统完成。
这一变化符合长期以来的更大趋势。根据Epoch AI在9月22日发布的报告,自2023年以来,特定水平AI性能的成本每个季度大约下降47%,年降幅约为13倍。9月29日发表在Cryptopolitan的报道指出,企业买家越来越倾向于选择能以最低成本完成所需任务的模型,而低价格也使得企业更有理由使用多个模型。
然而,成本降低并不意味着AI总支出的减少。Gartner在8月17日发布的报告《Gartner预测到2028年,代理工作流的AI推理成本将增加五倍以上》中提到了“推理悖论”。代币价格的下降激发了更复杂的工作流,导致总代币使用量增加。
Gartner高级分析师Will Sommer在2026年8月17日的报告中指出:“产品领导者不能依赖更高效的代币经济学来合理化AI成本。”
根据微软发布的《全球AI扩散报告》,低成本和开放权重的模型有潜力提高可访问性,特别是在全球南方国家。虽然较低模型成本确实能提高可访问性,但基础设施、连接性和技能才是决定廉价AI模型是否会被使用的关键因素。
对于企业买家而言,Sonnet 5.5展示了市场的方向:最好的模型不一定是最强大的,而是能以合理成本出色完成任务的模型。未来几周内即将推出的Haiku 5.5可能会进一步推动这一转变,使高容量AI工作变得更便宜,并让企业更难为常规任务支付更高价格提供正当理由。
声明:文章不代表币圈网立场和观点,不构成本站任何投资建议。内容仅供参考!
免责声明:本站所有内容仅供用户学习和研究,不构成任何投资建议.不对任何信息而导致的任何损失负责.谨慎使用相关数据和内容,并自行承担所带来的一切风险.