Claude 5 Haiku 发布——以低75%的价格实现Claude 4 Sonnet同等推理能力
機械翻訳 / Machine-translated
機械翻訳 / Machine-translated
Anthropic于2026年9月2日23时许(日本时间)在毫无预告的情况下正式发布了"Claude 5 Haiku"。输入价格$0.75、输出价格$3.75/百万token,相比Claude 4 Sonnet降价75%——尽管如此,在编程与数学推理基准测试中,其得分却超越了上一代Sonnet。"便宜=性能下降"的设计前提,在这一天彻底被打破。
Anthropic同步更新了官方博客与API文档,并于当日立即开放使用。主要基准测试结果如下:
上下文窗口维持200万token不变。平均响应速度较Claude 4 Haiku提升约35%。
"Claude 5 Haiku让'以Sonnet品质换取极低价格'的梦想成为现实。生产团队的API选型将因此发生改变。"(AI工程师,发布于X)
在Claude 4系列中,Haiku与Sonnet之间的性能差距十分明显,复杂推理任务事实上必须使用Sonnet及以上级别。Haiku虽在速度与成本上具有优势,但编程精度不及Sonnet,导致其生产用途受到一定限制。
2026年上半年,推理成本在整个行业持续大幅下降(估计平均降幅达60~70%)。各公司竞相探索"如何将高性能压缩至低价位模型",Anthropic此次给出了一个明确的答案。
在竞争层面,DeepSeek R3与Gemini 2.5 Ultra近期相继实现性能突破,轻量级模型线的全面升级对Anthropic而言也已是当务之急。
对于月请求量达1亿级别的SaaS服务或聊天机器人而言,从Claude 4 Sonnet切换至Claude 5 Haiku,每月API费用最多可削减四分之三。同等性能、四分之一成本,这一数字将直接影响产品的盈利模型。
从"以高成本模型集中处理"向"以轻量高性能模型大规模并行执行"的设计转变预计将加速推进。Claude 5 Haiku作为子智能体并行运行的方案,在成本上已成为切实可行的选择。
本次仅发布了Haiku。Claude 5 Sonnet及Opus的公告尚未发布。Anthropic从低端模型开始逐步推进的战略已然明朗——当Sonnet到来时,其性能与价格的预期门槛,需要结合本次结果重新解读。
尤为值得关注的是"无预告当日发布"这一做法。没有事前泄露,没有预热宣传,API文档与博客同步更新。与OpenAI、Google逐步释放信息的方式形成鲜明对比——Anthropic始终坚持"先行动,再表达"的风格。这一判断,显然是将开发者的实际体验置于发布效应之前。
在性能层面,HumanEval得分超越Claude 4 Sonnet是一个不容忽视的亮点。轻量级模型在编程能力上超越中间级模型,这将直接影响GitHub Copilot及类似工具在后端模型选型上的设计决策。
在日本市场,基于Claude API构建的客户服务AI与文档处理服务正在快速增长。预计本周内,这一变化对上述服务成本结构的影响便将在一线层面得到切实体现。
Claude 5 Haiku用数据否定了"轻量级模型推理能力弱"这一固有前提。推理成本的普惠化进一步深化,智能体设计、产品损益、模型选型这三大前提正同时面临重新审视。
下一个焦点,是Claude 5 Sonnet的发布时机。如果Haiku已达到这一水准,Sonnet又将突破到何种高度——2026年秋季LLM价格与性能的竞争,不过才刚刚拉开序幕。
※本文由ミライ・ニュース编辑部AI撰稿人(AI新闻)撰写。