Meta「Llama 4 Maverick 2」——全面取消商业限制,以开放权重冲击推理性能新高峰
機械翻訳 / Machine-translated
機械翻訳 / Machine-translated
Meta于2026年9月3日正式发布Llama 4系列最新版本「Llama 4 Maverick 2」。此次完全取消了此前对月活跃用户超7亿的企业所设置的商业许可条件。模型当天即可在HuggingFace上下载,据悉发布后3小时内下载量已突破10万次。「购买API」向「拥有模型」的转变,正式进入现实射程之内。
Meta于日本时间2026年9月3日18时,在官方博客上发布了相关公告。主要规格如下。
X平台上随即涌现出大量实际测试报告。
已将Llama 4 Maverick 2部署至自有服务器。回答质量与GPT-5 mini基本持平,据估算推理成本不足其1/9。这将改变我们将其嵌入SaaS产品的决策。
下载速度据估计是Llama 3.3发布时的2倍以上,企业级用户的高度关注已在数据上得到印证。
自Llama 2起,Meta一直要求月活跃用户超7亿的大规模企业单独获取商业许可证。微软、亚马逊、谷歌等各自签订了独立合同,这实际上构成了一道市场准入壁垒。
此次取消限制,正值Mistral Large 3(2026年7月)和DeepSeek R3(同年8月)以开放路线积累市场份额之际,可以解读为Meta以「完全免费」为武器,夺回生态系统主导权的战略举措。竞争轴心正从技术竞争向规则竞争转移。
MATH 91.2分比OpenAI的GPT-5 mini(89.8)高出1.4个百分点,HumanEval 87.3已达到实际编程工作的应用水准。在法律摘要、数理分析、代码生成三个领域,可视为即战力。
据估算,与通过API调用相比,推理成本可压缩至1/8~1/10。对于月查询量达1亿次规模的企业而言,年度差额可能高达数千万日元。这是从根本上改变SaaS内嵌AI成本结构的分水岭。
随着商业限制消除,以Maverick 2为基础进行行业特化微调并用于商业部署,首次在正式层面成为可能。预计未来3~6个月内,医疗、法律、制造业等领域的垂直特化模型将大量涌现。
NTT、富士通、CyberAgent等日本主要企业在使用Llama系列作为基础模型时所承担的许可证负担将随之消失。日语特化微调的量产成本有望降低,预计国产LLM竞争将进一步加速。
若要提炼此次发布的本质,「许可证消失」作为结构性变化,其意义远大于「性能赶上GPT-5 mini」。提示词不经过外部API服务器,对于金融、医疗、法律行业而言,是数据主权层面的决定性差异化优势。那些此前因监管合规与机密保护而不得不选择封闭API的机构,如今在性能与经济性上都拥有了选择自托管的空间。
不过也有需要注意的地方。Maverick 2采用MoE架构,若要部署完整的400B模型,需要配备多台A100级GPU。对于中小规模机构而言,将基础设施成本与人力成本纳入「真实TCO」后,使用API的总成本完全可能更低。「拥有模型」的决策,不仅需要考量采购成本,还必须同步盘点自身的运营能力。
DeepSeek破局,Mistral拓展,Meta解除封印。这一趋势的单向性,已无从置疑。
商业无限制的开放权重模型在推理性能上已与GPT-5 mini并驾齐驱。「使用API,还是拥有模型」这一问题,如今有不少机构需要将其作为经营层面的判断来给出答案。今天的发布,是否改变了你在AI采购上的既有前提?
※本文由 未来新闻编辑部 的 AI 作者(AI新闻)撰写。