Mistral AI正式发布「Mistral Large 3」——欧洲大模型跻身推理前沿,以半价API释放GPT-5级别能力
機械翻訳 / Machine-translated
機械翻訳 / Machine-translated
Mistral AI于2026年9月3日正式发布旗舰模型「Mistral Large 3」。该模型在编程、数学、多步推理等主要基准测试中取得GPT-5约97%的得分,而输入单价仅为$1.8/M tokens,不到主要竞品的一半。欧洲出品的模型,已从「性能上需要妥协的选择」蜕变为「以成本效率傲视前沿」的存在。
北京时间2026年9月4日凌晨,Mistral AI在官方博客及Hugging Face上公开了参数量247B的Mistral Large 3,并同步在la Plateforme及合作云平台(AWS Bedrock、Azure AI)上开放API访问。
主要规格如下:
「Large 3并非成本优化的产物,而是历时两年重新设计欧洲独有分布式训练基础设施的成果。」——Mistral联合创始人推文(原文法语,编辑部译)
Mistral自2023年创立以来,始终坚持「紧凑高性能」路线。从Mistral 7B(2023年9月)、Mixtral 8x7B(2023年12月)到Mistral Large 2(2024年7月),接连发布,每次都刷新「规模对性能」效率曲线。
公司将2025年底累计募集的26亿美元资金投入法国境内自建GPU集群,在降低对美国云依赖的同时持续推进推理优化。随着EU AI Act合规成本不断攀升,欧洲科技企业对「在本地完整运行的LLM技术栈」的需求愈发迫切,这一需求也持续推动着Mistral的成长。
此外,DeepSeek R3(成本降至1/8)与Meta Llama 4 Maverick 2(开放权重推理最高水准)的相继出现,使2026年上半年的API价格竞争激烈到了极限。Mistral Large 3正是在这一背景下,作为「在不降低质量的前提下实现低价」的答案应运而生。
GPT-5仅限闭源API使用,Claude Opus 4.6商业许可存在使用限制。Mistral Large 3以Apache 2.0协议公开模型权重,本地部署、微调、再分发均无任何限制。这从结构上大幅降低了系统集成商以及金融、医疗等受监管行业的采用门槛。
相比Large 2的64K,上下文窗口扩大至4倍,意味着数百页的合同、财务资料或完整代码库可在单次请求中完成处理。RAG(检索增强生成)管道的架构设计或将面临根本性的重新审视。
EU AI Act高风险类别条款于2026年8月正式全面施行,此时恰好出现一款可在欧洲境内服务器运行的旗舰级模型,这绝非偶然。作为同时满足「模型质量」与「数据处理地域」的解决方案,其将深刻影响欧洲企业的采购策略。
输入$1.8/M已低于今年上半年各厂商集体降价后的水平(主要模型均价约$2.5/M)。API价格下行直接压低开发者的试验成本,加速向生产环境的迁移。可以认为,价格竞争的核心轴已从「质量」转向「效率与合规的组合」。
247B量级的开放权重模型,是继Meta Llama 4 Maverick 2之后第二个达到此规模的存在。在HuggingFace发布后24小时内,下载量突破18万次(官方公布数据)。预计未来数周内,量化变体与微调模型将持续涌现。
Mistral Large 3抛出的问题是:「为闭源API付费,究竟值多少?」
如今与GPT-5和Claude Opus 4.6的性能差距已缩小至3个百分点以内,若没有追求「极致性能」的充分理由,在自有基础设施上运行Apache 2.0开放权重模型的选项便骤然变得现实可行。对于数据不能外传的行业——金融、医疗、法律——而言,这将成为重新审视2026年下半年LLM采购策略的契机。
当然,其中也存在陷阱。开放权重并非「免费」,而是「将运营成本转由自身承担」的选择。在未经核算GPU采购、推理优化、模型更新跟进等成本的情况下,贸然断定「更便宜」并不妥当;对于中小规模企业而言,直接使用API在许多场景下依然具备更高的经济合理性。
随着欧洲势力的崛起,LLM市场正逐渐呈现「美系闭源 vs 中系开源 vs 欧系开源」的三极格局。对于日本企业来说,选择空间虽然扩大,但评估与选型的成本也随之增加。
Mistral Large 3的出现,彻底终结了「旗舰级性能=闭源API」这一固有认知。Apache 2.0许可证、256K上下文、半价API这三项组合,将切实影响注重数据主权的组织的采购决策。
下一个焦点在于:Google与OpenAI将如何在价格层面作出回应——以及Mistral能以多快的速度培育起微调生态系统。价格竞争的余波,仍将持续。
※本文由ミライ・ニュース编辑部AI撰稿人(AI新闻)撰写。