【太平洋科技快讯】据腾讯科技报道,继旗舰模型 Claude Opus 5.5 发布仅一周之后,Anthropic 又推出了 Claude 5.5 家族的第二款模型 Claude Sonnet 5.5。
当地时间 9 月 28 日,Anthropic 正式发布 Claude Sonnet 5.5,该模型主要面向日常办公、软件开发等主流应用场景,提升了内容生成速度与任务处理效率。数据显示,模型输出生成速度提升超 30%;在涉及持续工具调用、多步骤执行的任务中,通过削减冗余推理与无效工具调用,单项任务综合成本最高可下降 30%。
性能测试层面,在软件工程、知识处理、计算机操作等多项基准测试里,Sonnet 5.5 已经接近甚至超越 Opus 5.5 ( 关于 Opus 5.5 模型可查看此前太平洋科技的报道内容:《 Anthropic 新模型 Claude Opus 5.5 发布,性能对标 Fable 5.1 》 )部分配置下的表现,编程能力显著升级。
在自主智能体编程测试 Terminal-Bench 4.0 当中,Sonnet 5.5 得分达到 70.6%,而上一代 Sonnet 5 仅为 10.3%。该结果也优于一周前 Opus 5.5 高算力档位 ( Xhigh ) 66.4% 的得分。
成本架构是 Sonnet 5.5 另一核心变化。该模型输入、输出以及缓存写入的标价均为 Opus 5.5 的一半:输入为每百万 Token 2 美元,输出每百万 Token 10 美元,价格水平与 GPT-6 Sol 相当。作为参照,Claude Opus 5.5 输入每百万 Token 4 美元、输出 20 美元;轻量模型 GPT-6 Luna 输入每百万 Token 0.1 美元、输出 0.5 美元。
Anthropic 指出,单纯对比每百万 Token 定价不足以反映真实开销,完成任务所消耗 Token 数量、工具调用频次、耗时,同样会左右实际成本。第三方机构 Artificial Analysis 的统计图表显示,Sonnet 5.5 虽然单任务输出 Token 偏高,但依靠任务完成效率优势,单任务整体成本保持低位,这一点在 Agent 类任务上体现尤为明显。
除标价之外,模型通过精简执行步骤、减少冗余推理降低实际开销,同时优化批处理工具调用,削减智能体运行的额外消耗。产品经理 Theo Chu 在 CNBC 采访中提到,Sonnet 面向对成本敏感、不需要顶级推理能力的客户,适配大量常规重复性工作。
同时提示词缓存功能可提供最高 90% 折扣,针对重复上下文、长文档处理场景,能够进一步压低开发者实际使用成本。
随着 Sonnet 5.5 落地,Claude 5.5 产品矩阵分工已经明确:Opus 5.5 负责复杂推理等高难度任务,Sonnet 5.5 适配软件开发、办公自动化、Agent 日常任务,尚未发布的 Haiku 5.5 将主打高吞吐、低成本的轻量化业务。官方披露,Haiku 5.5 会在未来几周内上线。


粤公网安备 44010602000162号
网友评论