Large 3 비교

Mistral Large 4 vs Mistral Large 3

Mistral Large 4는 단순한 개선판이 아니라 큰 도약입니다. 총 파라미터가 6,750억 개에서 1.05조 개로 늘었고, Large 3에 없던 전환식 추론 모드가 생겼으며, 제공 컨텍스트가 524,288 토큰으로 두 배가 됐고, 160개가 넘는 언어로 학습했습니다. 대신 정가는 Large 3의 약 2.7배(현재 50% 할인 중에는 약 1.4배)입니다.

2026년 10월 6일 업데이트 · 작성자 suifeng

Mistral Large 4 한눈에 보기

개발사
Mistral AI (프랑스 파리)
출시
2026년 10월 6일 (퍼블릭 프리뷰)
파라미터
총 1.05조 개, 토큰당 활성 490억 개(49B) (전문가 혼합, MoE)
컨텍스트 윈도우
API 기준 524,288 토큰
최대 출력
262,144 토큰
입력 / 출력
텍스트·이미지 입력, 텍스트 출력
API 가격 (할인가)
100만 토큰당 입력 $0.68 / 출력 $2.09 (정가 $1.36 / $4.18)
API 모델명
mistral-large-4
추론
reasoning_effort: "high" 또는 "none"
오픈 웨이트
2026년 10월 말 공개 예정

출처: Mistral AI 발표문 및 가격 페이지, OpenRouter 모델 목록, Hugging Face 모델 페이지. 2026년 10월 6일 확인.

Large 3에서 Large 4로 바뀐 점

두 모델 사이에는 10개월의 간격이 있습니다. Mistral Large 3(2512)는 2025년 12월 2일에 나왔고, Mistral Large 4는 2026년 10월 6일 퍼블릭 프리뷰로 공개됐습니다. 가장 큰 변화는 규모, 추론, 컨텍스트입니다.

  • 규모: 총 1.05조 개, 토큰당 활성 490억 개 파라미터로, 총 6,750억 개·활성 410억 개에서 늘었습니다(총 +56%, 활성 +20%).
  • 추론: Large 4는 reasoning_effort("high" 또는 "none")로 제어하는 지시·추론 하이브리드 모델입니다. Large 3 모델 카드는 전용 추론 모델이 아니라고 설명합니다.
  • 컨텍스트: API 제공 기준 524,288 토큰(Mistral 문서에는 1M)으로, 256K에서 늘었습니다.
  • 언어: 학습 데이터가 EU 공식 언어 전체를 포함해 160개 이상 언어를 다룹니다. Large 3 카드에는 수십 개 언어가 나와 있습니다.
  • 비전: 둘 다 이미지를 읽습니다. Large 4는 1.6B, Large 3는 2.5B 비전 인코더를 씁니다.
  • 라이선스: Large 3는 Apache 2.0이고, Large 4 라이선스는 아직 발표되지 않았습니다.

사양 비교표

비전 인코더 크기를 빼면 모든 용량 지표에서 Large 4가 앞서고, 지금 당장 웨이트를 받을 수 있다는 점에서는 Large 3가 앞섭니다.

사양Mistral Large 4Mistral Large 3 (2512)
출시2026년 10월 6일 (퍼블릭 프리뷰)2025년 12월 2일
총 / 활성 파라미터1.05T / 49B (임베딩 포함 52B)675B / 41B
비전 인코더1.6B 파라미터2.5B 파라미터
컨텍스트 윈도우524,288 토큰 제공 (문서에는 1M)256K (262,144 토큰)
최대 출력262,144 토큰209,715 토큰 (OpenRouter)
추론 모드지원, reasoning_effort high 또는 none전용 추론 모델 아님
언어학습 데이터 160개 이상수십 개
웨이트2026년 10월 말 공개 예정공개됨: FP8, NVFP4, BF16
라이선스아직 발표 전Apache 2.0
출처: Mistral Docs, Mistral Large 4 출시 글, Hugging Face 모델 카드, OpenRouter. 2026년 10월 6일 확인.

100만 토큰당 가격 차이

Mistral Large 4는 정가 기준 Mistral Large 3의 약 2.7~2.8배이고, Mistral의 한시적 50% 할인 기간에는 약 1.4배에 그칩니다. 배수는 Large 4 가격을 Large 3 가격으로 나눈 값입니다.

1M 토큰당 (USD)Large 4 정가Large 4 할인가Large 3정가 배수할인가 배수
입력$1.36$0.68$0.502.72×1.36×
캐시 입력$0.14$0.07$0.052.80×1.40×
출력$4.18$2.09$1.502.79×1.39×
배치 입력 / 출력$0.68 / $2.09$0.34 / $1.045$0.25 / $0.752.72× / 2.79×1.36× / 1.39×
출처: Mistral Docs 가격 페이지. 배수는 직접 계산. 2026년 10월 6일 확인.

모델별 일반적인 한 달 비용

한 달에 입력 3,000만 토큰, 출력 1,000만 토큰을 쓰는 작업이라면 Large 3는 $30.00, Large 4는 할인가로 $41.30, 정가로 $82.60입니다.

계산식은 Large 3 = 30 × $0.50 + 10 × $1.50 = $30.00, Large 4 할인가 = 30 × $0.68 + 10 × $2.09 = $41.30, Large 4 정가 = 30 × $1.36 + 10 × $4.18 = $82.60입니다. 추론 출력도 출력 토큰으로 계산되므로, 간단한 프롬프트에 reasoning_effort를 "high"로 두면 Large 4 비용이 더 늘어납니다. Artificial Analysis는 Large 4를 매우 장황한 모델로 평가했습니다(지수 실행 시 출력 2억 토큰, 중앙값 8,100만 토큰).

채팅용으로만 쓴다면 토큰 계산을 아예 건너뛸 수 있습니다. 저희 Pro 요금제는 월 $39.90 또는 연 $199.90에 매달 3,000크레딧을 제공하며, 1크레딧은 짧은 답변 1개 정도입니다.

궁금한 점이 있나요?

Mistral Large 4에게 직접 물어보세요. 무료 계정이면 매일 15크레딧을 받아요.

지금 물어보기

품질 향상: 공개된 수치로 본 차이

Mistral은 Large 4 출시 차트에 Large 3를 넣지 않았고, Large 3는 현재 44개 모델로 구성된 Vals Index에도 없어서 두 모델을 같은 벤치마크로 직접 비교할 수는 없습니다. 대신 Mistral은 현재 판매 중인 또 다른 모델 Mistral Medium 3.5와 Large 4를 비교해 발표했는데, 그 차이가 큽니다.

정가 기준으로 Large 4는 Medium 3.5보다 저렴하기도 합니다. 100만 토큰당 $1.36 / $4.18 대 $1.50 / $7.50입니다.

벤치마크Mistral Large 4Mistral Medium 3.5
AutomationBench (워크플로 657개)59.9%6.3%
Finance Agent v254.732.1
Finch (FinWorkBench)67.436.7
SciCode-Verified pass@191.870
ChartQA Pro63.155.4
출처: Mistral Large 4 출시 글(업체 발표 수치). 2026년 10월 6일 확인.

직접 호스팅: Large 3는 지금, Large 4는 메모리가 더 필요

Large 3 FP8 웨이트는 약 675GB로 8× H200 노드 하나(1,128GB)에 올리고도 약 453GB가 남지만, Large 4 FP8 웨이트는 약 1,050GB라 같은 노드에서 약 78GB만 남습니다. 4비트로는 Large 3가 약 338GB, Large 4가 약 525GB로 둘 다 8× H100(640GB)에 들어갑니다.

Large 3는 지금 vLLM 1.12.0 이상에서 돌아갑니다. Large 4 지원을 발표한 추론 엔진은 아직 없으며, 자세한 메모리 계산은 로컬 실행 가이드에 있습니다.

Large 3에서 API 호출 옮기기

Large 4로 옮기는 작업은 대부분 같은 chat completions 엔드포인트에서 모델명을 mistral-large-4(별칭 mistral-large-4-0)로 바꾸는 것입니다. 코드를 고쳐야 하는 부분은 두 가지입니다. reasoning_effort가 "high"이면 메시지 content가 문자열이 아니라 생각 청크와 텍스트 청크의 목록이 되고, Mistral 문서는 여러 턴 대화에서 생각 청크를 포함한 어시스턴트 메시지 전체를 기록에 다시 보내라고 안내합니다.

reasoning_effort를 "none"으로 두면 Large 3 코드가 이미 처리하던 일반 문자열 응답이 그대로 유지됩니다.

# Set API_KEY to your Mistral API key first
curl https://api.mistral.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $API_KEY" \
  -d '{"model":"mistral-large-4","messages":[{"role":"user","content":"Summarize this contract clause."}],"reasoning_effort":"none"}'

출처

FAQ

Large 3 비교 자주 묻는 질문

이어서 읽기

Mistral Large 4 더 알아보기

Mistral Large 4에게 진짜 일을 맡겨 보세요

버그 코드, 계약서 조항, 엉망인 엑셀 메모를 붙여 넣어 보세요. 무료 계정이면 매일 15크레딧을 받아요.

채팅 시작하기