vs Small 4

Mistral Large 4 vs Mistral Small 4

Zelfde 8 prompts, zelfde instellingen, beide modellen via de Mistral API op 9 oktober 2026. Large 4 deed het beter op 6 van de 8 taken en stond gelijk op 2; Small 4 was klaar in 29,8 seconden voor de hele set tegen 55,1 voor Large 4, en kostte 6 keer minder. Hieronder staat elke taak, wie het beter deed en waarom.

Bijgewerkt op 2026-10-09 · Door suifeng

Populaire prompts

Chat openen

Opent de chat op volledig scherm. Je chats worden in je account bewaard.

Mistral Large 4 in het kort

Ontwikkelaar
Mistral AI (Parijs, Frankrijk)
Uitgebracht
6 oktober 2026 (public preview)
Parameters
1,05 biljoen in totaal, 49 miljard actief per token (Mixture of Experts)
Contextvenster
524.288 tokens via de API
Maximale output
262.144 tokens
Invoer / uitvoer
Tekst en afbeeldingen erin, tekst eruit
API-prijs (actie)
$ 0,68 input / $ 2,09 output per 1M tokens (normaal $ 1,36 / $ 4,18)
Modelnaam in de API
mistral-large-4
Redeneren
reasoning_effort: "high" of "none"
Open gewichten
Gepland voor eind oktober 2026

Bronnen: aankondiging en prijspagina van Mistral AI, modelpagina op OpenRouter, modelpagina op Hugging Face. Gecontroleerd op 6 okt. 2026.

Waarom we dit hebben gedaan

Onze gratis chat geeft elk nieuw account zijn eerste 3 antwoorden op Mistral Large 4 en schakelt daarna over op Mistral Small 4; Pro en creditpakketten blijven op Large 4. We wilden weten, met echte taken in plaats van benchmark-tabellen, wanneer het grotere model zijn prijs waard is: tegen lijstprijs kost Large 4 $1,36 per miljoen input tokens en $4,18 per miljoen output tokens, Small 4 $0,15 en $0,60, ongeveer negen keer meer op input en zeven keer meer op output.

Methode: acht prompts die op echt werk lijken (geen raadsels), elk één keer gestuurd naar mistral-large-4 en mistral-small-2603 via de chat completions API met reasoning_effort ingesteld op none, temperatuur 0,2 en een limiet van 1.500 output tokens. Tijd is wall-clock vanaf één machine in Azië, dus jouw absolute getallen zullen verschillen; de verhouding tussen de twee modellen is het punt. Eén run per prompt, dus behandel kleine verschillen als ruis.

De scorebord

Large 4 wint waar volledigheid en het opvolgen van instructies ertoe doen; Small 4 evenaart het op goed gedefinieerde conversies en is twee tot drie keer sneller.

TaakMistral Large 4Mistral Small 4Beter antwoordWaarom
Contractclausule risico's13,3 s (eerste token 1,4 s), 607 tokens3,7 s (eerste token 0,6 s), 469 tokensLarge 4Vijf risico's, elk gekoppeld aan de exacte woorden; Small 4 vond er drie en citeerde hele zinnen
Vergelijking twee kwartalen6,8 s (eerste token 0,8 s), 373 tokens3,1 s (eerste token 0,6 s), 375 tokensGelijkBeide kregen bruto winst ($2,56M / $2,30M) en operationele winst ($0,46M / $0,60M) goed; Large 4 stelde scherpere vragen
Python code review10,5 s (eerste token 0,8 s), 1042 tokens4,6 s (eerste token 0,6 s), 785 tokensLarge 4Beide vonden de injectie, de off-by-one en de gelekte connectie; Large 4 loste ze op met context managers en benoemde kolommen
Prijzen van een pagina van 2.800 tokens3,2 s (eerste token 1,0 s), 234 tokens3,8 s (eerste token 0,7 s), 488 tokensLarge 4Large 4 noemde de vier modellen die de prompt vroeg; Small 4 noemde Large 4 prijscategorieën. Beide rekenden de workload goed uit
Rommelige tekst naar JSON3,0 s (eerste token 1,0 s), 195 tokens1,9 s (eerste token 0,6 s), 201 tokensGelijkIdentieke getallen tot op de cent; Small 4 was sneller
Vertaling met een idioom5,4 s (eerste token 1,9 s), 255 tokens3,3 s (eerste token 0,7 s), 279 tokensLarge 4Large 4 vertaalde het idioom in alle vier de talen; Small 4 liet “heads up” in het Engels in de Japanse versie
Planningspuzzel10,9 s (eerste token 0,9 s), 830 tokens8,7 s (eerste token 0,6 s), 1500 tokens , afgekaptLarge 4Large 4 vond de enige geldige volgorde A-D-B-C-E met een gevalsanalyse; Small 4 raakte halverwege de 1.500-token limiet
Marketingtekst herschrijven2,0 s (eerste token 1,2 s), 24 tokens0,8 s (eerste token 0,6 s), 38 tokensLarge 4Large 4: 22 woorden, geen hype; Small 4 gebruikte “Boost” en “innovate daily”
Onze eigen run, 9 oktober 2026, Mistral API, reasoning_effort none, temperatuur 0,2, max 1.500 output tokens, één run per prompt.

Waar Large 4 duidelijk beter was

Het patroon in de zes overwinningen: Large 4 doet wat de prompt letterlijk vraagt en gaat door tot de klus af is; Small 4 beantwoordt de algemene vorm van de vraag.

  • Contractclausule: gevraagd om elk risico met de exacte woorden die het creëert, Large 4 noemde vijf risico's (inclusief het gecombineerde effect van de drie beëindigingszinnen) en citeerde het precieze fragment voor elk, en schreef vervolgens een volledige vervangende clausule met een opzegtermijn van 30 dagen en pro-rata betaling. Small 4 noemde drie risico's, citeerde hele zinnen, en liet “[X days]” in zijn herschrijving staan.
  • Code review: beide vingen de SQL-injectie, de lus die de eerste rij overslaat en de niet-gesloten connectie. De fix van Large 4 gebruikte context managers, sqlite3.Row met benoemde kolommen en “is not None” zodat een lege statusstring nog steeds filtert; Small 4 hield positionele indexen aan en sloot de connectie met een “if conn in locals()” check.
  • Extractie van een lange pagina: de prompt plakte onze 2.800-token API-prijzenpagina en vroeg om elk Mistral-model met prijzen per miljoen. Large 4 gaf de vier modellen terug (Large 4, Large 3, Medium 3.5, Small 4). Small 4 gaf tien rijen met Large 4 prijscategorieën (batch, prioriteit, regionaal) en geen ander model. Beide rekenden daarna 50M input en 5M output tokens correct uit: $88,90 lijst, $44,45 in de aanbieding.
  • Vertaling met een idioom: Large 4 vertaalde “heads up” en “swamped” idiomatisch in het Frans, Duits, Spaans en Japans. Small 4 was prima in de drie Europese talen maar liet “heads up” in het Engels binnen de Japanse zin en voegde daar een noot over toe.
  • Planningspuzzel: vijf presentaties, vijf beperkingen. Large 4 werkte de vier plaatsingen van het A-D blok door en vond de enige geldige volgorde, A-D-B-C-E, in 830 tokens. Small 4 legde de beperkingen uitgebreid uit en raakte de 1.500-token limiet aan voordat het zijn tweede geval afmaakte.
  • Copy herschrijven onder beperkingen (60 woorden, geen hypewoorden): Large 4 gaf 22 platte woorden terug. Small 4 gaf 30 woorden terug die openden met “Boost team productivity” en eindigden met “innovate daily”.

Waar Small 4 net zo goed was

Twee taken waren gelijk, en op beide was Small 4 sneller. De factuur-naar-JSON conversie kwam identiek terug van beide modellen tot op de cent (subtotaal 2.580, btw 490,20, totaal 3.070,20), in 1,9 seconden van Small 4 tegen 3,0 van Large 4. De vergelijking van twee kwartalen kreeg dezelfde bruto winst en operationele winst van beide; de drie CFO-vragen van Large 4 waren specifieker (vragend of de margedaling mixverschuiving of prijsdruk is), die van Small 4 waren adequaat.

Snelheid: Small 4 begon te antwoorden na 0,6 tot 0,7 seconden op elke taak; Large 4 deed 0,8 tot 1,9 seconden tot de eerste token en ongeveer twee tot drie keer langer om af te ronden. Voor korte, goed gedefinieerde klussen is de wachttijd het enige wat je opgeeft.

Heb je hier een vraag over?

Vraag het Mistral Large 4 zelf. Gratis account, elke dag 15 credits.

Nu vragen

Wat elk antwoord kostte

Token-aantallen zijn de eigen gebruikscijfers van de API; dollars zijn tegen Mistral's lijstprijzen (Large 4 had een tijdelijke 50% korting toen we dit deden, wat zijn kolom halveert). Op onze site kost elk antwoord in deze test één credit op beide modellen, omdat één credit tot ongeveer $0,0067 aan modelkosten dekt tegen het tarief van het gratis abonnement; het prijsverschil komt pas naar voren bij lange antwoorden en lange documenten.

TaakLarge 4 tokens in / uitLarge 4 kostenSmall 4 tokens in / uitSmall 4 kostenVerhouding
Contractclausule risico's84 / 607$0.002797 / 469$0.00039x
Vergelijking twee kwartalen97 / 373$0.0017119 / 375$0.00027x
Python code review136 / 1042$0.0045149 / 785$0.00059x
Prijzen van een pagina van 2.800 tokens2823 / 234$0.00483149 / 488$0.00086x
Rommelige tekst naar JSON122 / 195$0.0010150 / 201$0.00017x
Vertaling met een idioom69 / 255$0.001281 / 279$0.00026x
Planningspuzzel71 / 830$0.003683 / 1500$0.00094x
Marketingtekst herschrijven78 / 24$0.000294 / 38$0.00006x
Alle 8 taken3480 / 3560$0.01963922 / 4135$0.00316x
Gebruik gerapporteerd door de Mistral API op 9 oktober 2026; prijzen van Mistral's prijspagina dezelfde dag (Large 4 $1,36 / $4,18, Small 4 $0,15 / $0,60 per miljoen tokens, lijst).

Welke te gebruiken

Gebruik Small 4 wanneer het outputformaat vaststaat en de input kort is: tekst converteren naar JSON of een tabel, velden extraheren die je expliciet noemt, snelle rekenwerk op getallen die je levert, korte vertalingen tussen grote Europese talen. Gebruik Large 4 wanneer je op het antwoord zult handelen zonder het te controleren: juridische of contractreview, code die je gaat deployen, alles dat vraagt om “elk” item in een lang document, beperkingspuzzels, Japans of andere talen waar idioom ertoe doet, en schrijven onder strikte regels.

Op onze chat draait het gratis abonnement je eerste 3 antwoorden op Large 4 zodat je het verschil kunt zien op je eigen taak, en schakelt daarna over op Small 4; een creditpakket of Pro houdt elk antwoord op Large 4. De prijspagina noemt beide.

Hoe je dit kunt reproduceren

Beide modellen worden op dezelfde manier aangeroepen; alleen de modelnaam verandert. Dit is het verzoek dat we gebruikten, min de API-sleutel.

# MISTRAL_KEY holds your Mistral Studio API key (set it in your shell)
curl https://api.mistral.ai/v1/chat/completions \
  -H "Authorization: Bearer $MISTRAL_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "mistral-large-4",
    "messages": [{"role": "user", "content": "I am a freelance designer. List every risk in this clause for me, quoting the exact words that create each risk, and rewrite the clause so it is fair to both sides: ..."}],
    "reasoning_effort": "none",
    "temperature": 0.2,
    "max_tokens": 1500
  }'
# then the same call with "model": "mistral-small-2603"

FAQ

Vragen over vs Small 4

Lees verder

Meer over Mistral Large 4

Stel Mistral Large 4 een echte vraag

Plak een bug, een contractclausule of een rommelige notitie uit een spreadsheet. Met een gratis account krijg je elke dag 15 credits.

Begin met chatten