AI & AutomationNieuwsAI-generated

Mistral brengt openweightmodel Large 4 uit: biljoen parameters, gewichten eind oktober

Mistral AI heeft Mistral Large 4 uitgebracht, intern en volgens het bedrijf zelf "zeer officieel" le Chonk genoemd. Het model is vanaf nu als publieke preview te gebruiken via Mistral Studio en de API; de gewichten volgen eind deze maand. Daarmee wordt het het grootste openweightmodel dat in Europa is gebouwd.

Een biljoen parameters, 49 miljard actief

Volgens de aankondiging van Mistral heeft Large 4 een biljoen parameters en is het natively multimodaal. Het gebruikt een mixture-of-experts-architectuur waarbij per token ongeveer 49 miljard parameters actief zijn. Dat is de gebruikelijke truc om de rekenkosten per vraag laag te houden: je draagt het volledige model in het geheugen, maar je rekent maar met een fractie ervan.

Het model is volgens Mistral van de grond af getraind op 3.800 Nvidia Grace Blackwell-GPU's in de eigen datacenters van het bedrijf in Europa. The Register rekent dat om naar ongeveer 52 NVL72-racks. De preview draait op diezelfde infrastructuur. Een opvallend detail uit de aankondiging: een aanzienlijk deel van de trainingsdata was meertalig, verspreid over meer dan 160 talen, waaronder alle officiële talen van de Europese Unie.

Sterk in security, niet in de absolute top

Mistral claimt dat Large 4 kan meekomen met de sterkste open-sourcemodellen wereldwijd en dat het elk openweightmodel uit de VS of Europa ruim achter zich laat. Op wat het bedrijf "kritieke bedrijfstaken" noemt — cybersecurity, finance en recht — zou het state of the art zijn onder open modellen. Bij visual grounding stelt Mistral zelfs frontier closed models voorbij te streven.

Onafhankelijke metingen zijn nuchterder. The Register citeert benchmarkbureau Artificial Analysis, dat de preview van Large 4 op zijn intelligence-ranglijst plaatst tussen DeepSeek V4.1 Flash en de instapmodellen GPT6 Luna van OpenAI. De vlaggenschepen van OpenAI en Anthropic liggen dus een stuk hoger. Wel verslaat Large 4 volgens datzelfde bureau Inkling van Thinking Machines Lab, het sterkste Amerikaanse openweightmodel, met een ruime marge.

Expliciet geen weigeringen bij securitywerk

Mistral maakt een punt van de securityprestaties, en koppelt dat direct aan open gewichten. "Provider-level refusals can block legitimate vulnerability research and incident response, and where losing access to a capability mid-incident can itself become a critical security risk", schrijft het bedrijf. Dat is een onmiskenbare steek naar de Amerikaanse closed models, die aanvalsgerelateerde verzoeken regelmatig afwijzen — ook als een securityteam zijn eigen systemen wil red-teamen.

Tot de release van de gewichten laat Mistral het model red-teamen door securitybedrijven, geselecteerde partners en overheidsinstanties. Die krijgen een versie met minder moderatie en ruimere cybercapaciteiten.

Wat er nog komt

De gewichten komen eind oktober op Hugging Face en andere modelrepositories. Mistral noemt Large 4 het eerste model uit een reeks die mogelijk is gemaakt door de Series D-ronde van 3 miljard euro van vorige maand, en verwacht dat de prestaties nog merkbaar verbeteren met verdere reinforcement learning. Hardware-eisen voor zelf hosten heeft het bedrijf niet gegeven.