Anthropic 发布 Claude Sonnet 5.5,速度提升 30% 且成本降低
Anthropic 今日发布 Claude Sonnet 5.5,官方称其运行速度快 30% 以上,多数任务成本降低最多 30%,定价与 Sonnet 5 相同但基准测试全面胜出。该模型已用于 claude.ai 免费层,作者实测其生成 3D 鹈鹕骑自行车页面表现扎实,并指出其编码能力接近 Opus 5.5。Haiku 5.5 预计数周内推出。
Anthropic 今日发布 Claude Sonnet 5.5,官方称其运行速度快 30% 以上,多数任务成本降低最多 30%,定价与 Sonnet 5 相同但基准测试全面胜出。该模型已用于 claude.ai 免费层,作者实测其生成 3D 鹈鹕骑自行车页面表现扎实,并指出其编码能力接近 Opus 5.5。Haiku 5.5 预计数周内推出。
AWS 宣布 Claude Sonnet 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。该模型面向聚焦编码和知识工作,多数任务成本更低、速度更快,能完成功能或缺陷修复并对照需求检查结果,生成的文档和图表也更精致。
推荐理由:原文给出了 Sonnet 5.5 的能力提升、适用场景和接入方式,读者可据此判断它适合哪些编码与知识工作负载。
Anthropic 发布 Claude Sonnet 5.5,输出速度提升超 30%,单任务成本最高降低 30%,在多项基准上接近 Opus 5.5。编码能力较前代大幅跃升,Terminal-Bench 4.0 得分从 10.3% 升至 70.6%,CursorBench 4.0 得分 55.5%,仅比 Opus 5.5 低约两分。
推荐理由:原文给出了 Sonnet 5.5 与 Opus 5.5 及前代的基准对比和定价,读者可据此判断中端模型的实际性价比。
Anthropic 发布其中端模型 Sonnet 5.5,称其比前代快 30%,token 消耗率显著降低,适合编码和办公文档等日常任务。Anthropic 的基准测试显示,Sonnet 5.5 在智能体编码上表现优于 Opus 5.5,且具备与 Opus 5 相当的网络安全能力,成为首个适用同等网络安全防护措施的 Sonnet 模型。公司还计划在未来几周发布最小模型 Haiku 的新版本。
Anthropic 发布 Claude Opus 5.5,称多数任务性能接近 Fable 5.1,运行成本比 Opus 5 低 40%,速度提升约 30%,并成为 Claude Code 和 Claude 应用的默认模型。
推荐理由:原文梳理了 Claude Opus 5.5 与 GPT-6 Sol/Luna 同日发布的定价、评测与安全争议,读者可据此对比两家实验室的竞争策略。
Anthropic 发布 Claude Opus 5.5,OpenAI 随后发布 GPT-6 Sol 和 GPT-6 Luna。GPT-6 Luna 定价 $0.10/$0.50,为 GPT-5.6 Luna 的一半,成为 OpenAI 最便宜模型之一;GPT-6 Sol 输入输出价也较 GPT-5.6 Sol 减半。
推荐理由:作者对比了多款新模型的定价与实测表现,读者可据此判断价格战下的模型选型。
Anthropic 发布 Opus 5.5,声称相比 Opus 5 在默认设置下典型工作负载成本降低约 40%,因 token 价格下降且完成任务所需 token 更少,并在网络安全和生物学等高风险领域能力突出,相关请求可能被自动路由到旧模型。OpenAI 发布 GPT-6 Sol 和 Luna,作为 Astra 的迭代版本,部分基准测试中比前代能力提升几个百分点,但使用成本减半。
Claude Opus 5.5 现已在 Amazon Bedrock 和 Claude Platform on AWS 上线,是 Claude 5.5 系列的首个模型。相比 Opus 5,它用更少 token 完成任务,平均单任务成本更低,并首次配备生物、网络安全和 AI 开发领域的安全分类器。模型支持自适应思考,可通过 effort 控制推理量,适用于智能体编码和长文档知识工作。
推荐理由:原文给出了新模型的效率、定价与安全分类器变化,读者可据此评估其在长任务和智能体编码场景的适用性。