Mistral AI「Mistral Large 3」공식 공개——유럽산 LLM이 추론 최전선에 도달, GPT-5 클래스를 절반 가격 API로 해방
機械翻訳 / Machine-translated
機械翻訳 / Machine-translated
Mistral AI가 2026년 9월 3일, 플래그십 모델 「Mistral Large 3」을 공식 공개했다. 코딩·수학·다단계 추론의 주요 벤치마크에서 GPT-5 대비 97% 전후의 점수를 기록하면서, 입력 단가는 $1.8/M 토큰으로 주요 경쟁사의 절반 이하다. 유럽발 모델이 「성능을 타협하는 선택지」에서 「비용 효율로 선택하는 최전선」으로 위상을 바꿔놓았다.
Mistral AI는 한국 시간 2026년 9월 4일 새벽, 공식 블로그 및 Hugging Face를 통해 파라미터 수 247B의 Mistral Large 3을 공개했다. 동시에 API를 la Plateforme 및 파트너 클라우드(AWS Bedrock, Azure AI)에서 제공하기 시작했다.
주요 스펙은 다음과 같다.
「Large 3은 비용 최적화의 산물이 아니라, 유럽 독자의 분산 학습 인프라를 2년에 걸쳐 재설계한 성과다」——Mistral 공동 창업자의 트윗에서(원문 프랑스어, 편집부 번역)
Mistral은 2023년 창업 이래 일관되게 「컴팩트 고성능」 노선을 걸어왔다. Mistral 7B(2023년 9월), Mixtral 8x7B(2023년 12월), Mistral Large 2(2024년 7월)를 잇달아 공개하며, 매번 「크기 대비 성능」의 효율 곡선을 갱신해온 이력이 있다.
2025년 말에 조달한 총액 26억 달러의 자금을 투입해 프랑스 국내에 독자적인 GPU 클러스터를 구축했다. 미국 클라우드에 대한 의존도를 낮추면서 추론 최적화를 진행해왔다. EU AI Act 대응 비용이 늘어나는 가운데, 유럽 테크 기업들에게 「자국 내에서 완결되는 LLM 스택」에 대한 수요는 절실하며, 그 수요가 Mistral의 성장을 뒷받침한 구도가 있다.
또한 DeepSeek R3(비용 대비 1/8)와 Meta Llama 4 Maverick 2(오픈 웨이트 추론 최고 수준)의 등장으로, 2026년 전반기에 API 비용 경쟁은 극한까지 격화됐다. Mistral Large 3은 그러한 맥락에서 「품질을 떨어뜨리지 않고 저렴하게 제공한다」는 해답으로 등장했다.
GPT-5는 클로즈드 API 전용이고, Claude Opus 4.6은 상업용 라이선스에 이용 제한이 있다. Mistral Large 3은 Apache 2.0 하에 가중치를 공개하고 있어, 온프레미스 배포·파인튜닝·재배포 모두 무제한이다. 시스템 인테그레이터 및 금융·의료 등 규제 산업에서의 도입 장벽이 구조적으로 낮다.
Large 2의 64K와 비교해 4배로 확대된 컨텍스트는, 수백 페이지의 계약서·재무 자료·코드베이스 전체를 1개의 요청으로 처리할 수 있음을 의미한다. RAG(검색 증강 생성) 파이프라인의 아키텍처 설계가 근본적으로 재검토를 요구받게 될 것으로 보인다.
EU AI Act의 고위험 카테고리 시행이 2026년 8월에 본격화된 타이밍에 맞춰, 유럽 내 서버에서 운용할 수 있는 플래그십 모델이 갖춰진 것은 우연이 아니다. 「모델의 품질」과 「데이터의 처리 지역」을 양립시키는 선택지로서, 유럽 기업의 조달 방침에 영향을 미칠 것이다.
입력 $1.8/M은 올해 전반기에 일제히 단행된 가격 인하 수준(주요 모델 평균 $2.5/M 전후)을 더욱 밑도는 수준이다. API 가격 하락은 개발자의 실험 비용을 직접 낮추고, 프로덕션으로의 전환을 가속화한다. 가격 경쟁의 중심축이 「품질」에서 「효율과 컴플라이언스의 조합」으로 이동했다고 봐도 좋을 것이다.
247B급 오픈 웨이트 모델은 Meta Llama 4 Maverick 2에 이어 두 번째다. HuggingFace에 공개된 지 24시간 만에 다운로드 건수가 18만 건을 돌파했다(회사 발표). 양자화 바리안트·파인튜닝 모델이 앞으로 수주 안에 잇달아 파생될 전망이다.
Mistral Large 3이 던진 질문은 「클로즈드 API에 얼마나 지불할 가치가 있는가」이다.
GPT-5나 Claude Opus 4.6과의 성능 차이가 3포인트 미만으로 좁혀진 지금, 「최고 성능」을 추구할 이유가 없다면, Apache 2.0의 오픈 웨이트 모델을 자사 인프라에서 운용하는 선택지는 단번에 현실성을 띠게 된다. 특히 데이터를 외부에 내보낼 수 없는 업종——금융, 의료, 법무——에게는 2026년 하반기의 LLM 조달 전략을 재검토하는 계기가 될 것이다.
한편으로 함정도 있다. 오픈 웨이트는 「무료」가 아니라 「운용 비용을 자사가 부담하는」 선택이다. GPU 조달·추론 최적화·모델 업데이트 추종 비용을 산출하지 않고 「저렴하다」고 판단하는 것은 성급하며, 중소 규모의 기업에게는 API가 여전히 경제적 합리성이 높은 경우도 많다.
유럽 세력의 부상으로 LLM 시장은 「미국계 클로즈드 vs 중국계 오픈 vs 유럽계 오픈」의 삼극 구조로 향하고 있다. 일본 기업에게는 선택지의 폭이 넓어지는 한편, 평가·선정 비용도 증가하는 국면이다.
Mistral Large 3의 등장으로, 「플래그십급 성능 = 클로즈드 API」라는 구도는 완전히 과거의 것이 되었다. Apache 2.0 라이선스, 256K 컨텍스트, 절반 가격 API라는 세 가지 조합은, 특히 데이터 주권을 중시하는 조직의 조달 판단을 움직일 것이다.
다음 초점은 Google과 OpenAI가 가격 면에서 어떻게 대응하느냐——그리고 Mistral이 파인튜닝 에코시스템을 얼마나 빠르게 육성할 수 있느냐이다. 가격 경쟁의 여파는 아직 계속된다.
※본 기사는 미래 뉴스 편집부의 AI 라이터(AI 뉴스)가 작성했습니다.