
对于广大企业开发者和生产力工具追求者而言,兼具顶尖推理性能与合理使用成本的模型,始终是落地 Agent(智能体)应用的最佳选择。2026年9月28日,人工智能领军企业 Anthropic 再次发力,正式推出了其主力模型线的重大升级版——Claude Sonnet 5.5。
作为定位在极速与旗舰之间的“甜点级”大模型,Sonnet 5.5 并非简单的轻微迭代。根据 Anthropic 官方关于 Claude Sonnet 5.5 发布的技术公告 显示,新模型在底层引擎架构上进行了深度优化。在维持基础 API 单价不变(输入每百万 Token 2 美元,输出每百万 Token 10 美元)的基础上,Sonnet 5.5 的文本生成速度相比前代 Sonnet 5 实现了超过 30% 的提升。更重要的是,得益于更精准的上下文理解能力,模型在完成复杂推理任务时所需的思考与生成 Token 总量明显减少,使得单次任务的综合计算成本降低了近 30%。
终端控制与知识工作暴涨:基准测试成绩直逼旗舰 Opus 5.5
在技术能力演进方面,Sonnet 5.5 最引人瞩目的突破体现在自动化终端操作与复杂知识密集型工作流中。
在评估 AI 模型在 Linux/Unix 命令行环境中执行系统管理、Shell 脚本编写及自动化运维能力的 Terminal-Bench 4.0 基准测试中,上一代 Sonnet 5 仅获得了 10.3% 的成绩,而全新的 Sonnet 5.5 却一举冲上了 70.6% 的高分,实现了跨越式的能力飞跃。此外,在衡量模型综合知识理解与推理精度的 GDPval-AA 基准测试中,Sonnet 5.5 砍下了 1844 的高分,其表现几乎追平了 Anthropic 几天前发布的顶尖旗舰 Opus 5.5(1846 分)。这意味着开发者能以低得多的成本,获得接近顶尖旗舰模型的推理品质。
全平台同步上线:主打日常开发与文档办公自动化
Anthropic 官方将 Sonnet 5.5 定位为旗舰 Opus 5.5 的高性价比、高并发补充方案。
对于大多数不需要进行极限算法推演的日常场景——例如日常代码编写、复杂 Bug 排查分析、自动化撰写报告、制作演示文稿幻灯片以及处理海量电子表格数据,Sonnet 5.5 能够提供响应更快、开销更省的综合体验。为了让开发者能够无缝接入这一生产力工具,Claude Sonnet 5.5 在发布当天便实现了全渠道铺开:除了上线 Claude 网页端、桌面端及移动应用外,该模型还同步登陆了 Amazon Web Services(AWS Bedrock)、Google Cloud(Vertex AI)以及 Microsoft Azure 三大云计算巨头平台,开发者可在 API 调用的模型参数中直接使用 claude-sonnet-5-5 进行接驳部署。
本报道由 圈小蛙(qxwa.com) 科技资讯站特约撰稿。🐸️
圈小蛙