Claude 5 Sonnet 正式发布——$3/MTok 与 200K 上下文,切入智能体成本竞争
機械翻訳 / Machine-translated
機械翻訳 / Machine-translated
Anthropic 于 2026 年 9 月 4 日正式发布「Claude 5 Sonnet」。该模型延续了 Claude 5 Haiku 确立的低价路线,同时大幅提升了精度与上下文长度,定位为"核心模型"。API 自发布首日起即向所有层级开放,成为对 o3-pro、Gemini 2.5 Ultra 激烈角逐的企业级市场发出的直接挑战书。
Anthropic 官方博客及 API 文档公布的规格如下。
发布后,X 上工程师的反应接连涌现。
HumanEval 94.7%。代码生成能力与 o3-pro 并驾齐驱,价格上 Anthropic 却遥遥领先。今晚团队开会,智能体编排层该放在哪里,估计会成为议题。
Claude.ai Pro 用户的推送从当日 22 时(JST)起陆续开始,API 访问从 Tier 1 起即可立即使用。
Anthropic 于 2026 年 6 月发布了 Claude 5 Haiku,以降低 75% 成本的方式实现了媲美 Claude 4 Sonnet 的推理能力。如果说 Haiku 是"速度与低成本兼备的实用机",那么此次的 Sonnet 则是"对精度、速度、成本三角进行最优化的主力机"。Opus(最高精度)· Sonnet(均衡)· Haiku(高速低成本)的三层架构再次清晰呈现。
Claude 5 Opus 目前尚无官方公告,预计将在年内推出。Anthropic 采取分阶段发布策略,在掌控市场节奏的同时,将 Sonnet 树立为"当下性价比最高的选择",深入人心。
企业级 AI 智能体每项任务消耗数万至数十万 token。输入 $3/MTok 的定价比 Gemini 2.5 Pro 的 $3.5/MTok 低约 14%,与 GPT-4o 同等级产品相比则便宜约 40%。对于每月 API 成本达数百万日元规模的大型智能体运营而言,这一差距将直接影响 ROI 计算。
思考 token 上限从 Haiku 的 8,192 扩展至 32,768,增至 4 倍。在法律文件条文比对、财务模型敏感性分析等需要"深度单步推理"的业务场景中,精度有望得到提升。Anthropic 表示,其内部评估显示启用该模式后,高难度基准测试成绩可进一步提升 4 至 6 个百分点。
视频输入采用逐帧提取并发送的方式实现。制造产线异常检测、视频内容 QA 工作流、监控摄像头分析等应用场景,现在可以以现实可行的成本集成该功能。
发布首日即向所有层级开放访问,速率限制较 Claude 3.7 Sonnet 放宽 1.5 倍。批量处理及高频智能体调用的采用门槛明显降低。
此次发布最重要的意义在于"模型栈的重新整合"。核心模型被置于 Haiku 与 Opus 之间,开发者由此可以重新设计针对不同用途的模型选型标准。在智能体设计中,最优解很可能是"编排器 = Sonnet,工作节点 = Haiku"的双层架构。对于追求成本与精度兼顾的企业而言,这一组合有望成为 2026 年下半年事实上的主流配置。
定价策略的用意同样清晰可辨。$3/MTok 有意略低于 Gemini 2.5 Pro,意在占据"价格比较中胜出"的位置,同时在精度上也毫不逊色——这是一种"价格最优化而非价格破坏"的策略。
从日本企业视角来看,Enterprise 套餐的 1M token 上下文扩展将成为切实可行的选项。对于长篇规格书、多份会议记录、法规文件的批量处理工作流,现在正是重新核算成本的时机。
Claude 5 Sonnet 填补了 Anthropic 模型阵容中"缺失的核心",进一步提升了在企业级 AI 智能体市场的竞争力。下一个焦点在于 Claude 5 Opus 的发布时间——以及它能在多大程度上打破 o3-pro 对高精度领域的垄断。
※本文由 ミライ・ニュース 编辑部 AI 撰稿人(AI 新闻)撰写。