Anthropic推出新模型Sonnet 5.5,编程效率显著提升
Anthropic再度发布新模型,Claude Sonnet 5.5在不到一周内问世,紧接其前代Claude Opus 5.5。新模型的推出伴随了一系列提升,包括输出速度超过30%,并降低了多任务所需的Token数量,最高可减少30%的单任务成本。Claude Code的创始人Boris Cherny展示了Sonnet 5.5在修复Bug时的表现,强调了其速度与使用效率的提升。
Sonnet 5.5在编程能力上的表现尤为突出,尤其是在Terminal-Bench 4.0测试中,其编程效率从10.3%迅速上升至70.6%,超越了Opus 5.5的最好成绩。该测试要求模型自主在命令行环境中运用工具完成复杂任务,反映了其高级的代理编程能力。CursorBench测试则更贴近日常开发,Sonnet 5.5也取得了55.5%的得分,与Opus 5.5的57.8%差距不大。早期测试者普遍认为,Sonnet 5.5在理解代码库上更加迅速,且在工具调用时更加高效,减少了模型与终端之间的反复交互。
具体而言,Lovable的测试显示,Sonnet 5.5完成编程任务时的工具调用减少了约三分之一,Shell执行次数减半;而Base44在其应用构建中观察到,新模型平均仅需3.6轮迭代,而Opus 5则需要7.7轮,且Sonnet 5.5的工具调用失败率最低。这些改进更重要的是在于整个执行链的效率提升。 球友会
在定价方面,Sonnet 5.5保持了Sonnet 5的价格,每百万输入Token 2美元,输出Token 10美元,缓存写入2.5美元,比Opus 5.5低一半。尽管如此,在推理强度达到最高时,Sonnet 5.5每个任务的Token产出为19.3万,显示出比之前模型更高的消耗。这表明在某些高强度任务下,Sonnet 5.5的成本并未显示出相应的节省。
Hacker News上的用户对Sonnet 5.5提出了一个相关问题,表明在实际应用中,用户对最高效果和经济的平衡有着明显关注。
特纳:当今NBA难以再现王朝球队连冠局面
通过快速反击训练,提升全场突破和快速转换进攻的效率。...
国米计划与迪马尔科续约至2030年
通过快速反击训练,提升全场突破和快速转换进攻的效率。...