AI导航

Anthropic 发布 Claude Sonnet 5.5:输出提速超 30%,单任务成本最多降 30%

AI资讯
3 min read
1 次阅读

2026 年 9 月 28 日,Anthropic 正式发布 Claude Sonnet 5.5——Claude 5.5 家族的第二款模型。相比前代 Sonnet 5,它的输出速度提升超过 30%,官方测试中,单个任务的总成本最多下降 30%。但 API 标价没变:每百万输入 token 依然 2 美元、输出 10 美元,降本来自更少的 token 消耗和工具调用,而非降价。

这次发布的指向很清晰:做企业日常任务的主力模型。Anthropic 把它定位在“边界清晰的日常工作”:修 bug、写代码、做文档、做幻灯片和表格,外加界面打磨这类设计活。同一天,GitHub 宣布 Sonnet 5.5 已在 GitHub Copilot 全面上线;模型同步登陆 AWS、Google Cloud 和 Azure,模型 ID 为 claude-sonnet-5-5。Sonnet 5 发布才三个月,迭代速度明显在加快。

价格没变,变的是“做完一件事”的总账

单看价目表,这次发布平平无奇:输入 2 美元、输出 10 美元、缓存读取每百万 token 0.20 美元,和 Sonnet 5 完全一致。但 Anthropic 换了算法:不谈 token 单价,谈“完成一个任务的总成本”——干同样的活,用的 token 更少、调的工具更少,总账最多省 30%。

第三方评测也印证了这套逻辑:Artificial Analysis 智能指数给 Sonnet 5.5 打出 56 分,仅次于旗舰 Opus 5.5;GitHub 实测称,相同编程任务下它的步骤、token 和工具调用都明显少于 Sonnet 5。对按量付费的 API 用户来说,这比单纯降价更实在——账单降的是真金白银,不用等折扣。

第一批换的人:写代码和做文档的高频团队

最直接的受益者是 Claude Code 和 GitHub Copilot 用户。Sonnet 5.5 强在“把活干完”:持续追踪计划、调用工具、验证结果,减少做到一半停下的情况。日常修 bug、跨文件改动、资料检索可以优先拿它试;需要审慎判断的复杂工作,Anthropic 自己也承认仍是 Opus 5.5 的地盘。

另一个卖点是设计:做幻灯片能按模板出稿、界面打磨更精细。对经常出方案、做汇报的团队,从“生成初稿”到“能直接用”的距离又缩短了一截。

容易被忽略的两个变化

第一,安全护栏第一次下放到 Sonnet。Anthropic 称它的网络安全能力与 Opus 相当,是第一款采用旗舰级网络安全防护和兜底机制的 Sonnet。结合 9 月这波智能体越狱事件看,这不是装饰:企业接入浏览器和终端时权限最小化依然不能省,但模型侧的底线确实抬高了。

第二,发布节奏本身值得品味。路透社提到,Anthropic 在筹备 IPO 前加速扩张产品线,Haiku 5.5 还在路上。中端模型三个月一迭代,企业选型“买新不买旧”的窗口期越来越短:刚测完 Sonnet 5 的团队,任务成功率和总 token 消耗可能又要重测一轮了。

接下来看两件事:Haiku 5.5 何时上线,补齐 5.5 家族最后一块;以及“单任务成本”会不会成为各家的新标配——当大家不再拼 token 单价,拼的是谁用更少步骤把事办成,评测的权重也该跟着变了。

推荐工具

NVIDIA Chat with RTX AI聊天 Chat with RTX 是 NVIDIA 面向 RTX 电脑的本地 AI 聊天工具,可围绕本地文档和视频资料做问答,适合重视隐私、离线检索并具备硬件条件的用户更适合资料不便上传云 HuggingChat AI聊天 HuggingChat 是 Hugging Face 的开源模型聊天应用,支持 Omni 自动选模型,也可手动选社区开放模型对话。它适合体验开源模型、技术探索和问答,结果可能不稳定,重要内容需复核。 纳米AI搜索 AI搜索 纳米AI 是 360 旗下 AI 搜索和智能体入口,支持文字、语音、拍照提问、多模型协作与内容创作,适合中文用户做日常搜索、学习问答、移动查询、热点追踪、生活决策、知识整理和轻量创作。 Qwen Chat(通义千问) AI聊天 Qwen Chat 是Qwen 大模型聊天助手,支持Qwen 模型聊天、写作和编程问答,适合中文用户和开发者完成 AI 对话、资料问答和任务协作,适合上线前核对权限、成本和资料质量。 DuckDuckGo AI Chat AI聊天 DuckDuckGo AI Chat 适合重视隐私的普通用户使用,围绕隐私 AI 聊天、免账户使用和多模型问答提供对话式 AI 支持和任务协作能力,适合上线前核对权限、成本和资料质量。 Goody-2 AI聊天 Goody-2 是以极端安全和伦理对齐为特色的 AI 聊天助手,常用于观察模型拒答边界、内容安全策略、保守输出体验和 AI 风险讨论,更适合作为安全边界样本使用前应理解它偏实验性质,不适合。