Begriff
Mistral Large 3
Mistral Large 3 (Dezember 2025) ist Mistrals offenes MoE-Flaggschiff — 675 Mrd. Parameter, 256K-Tokens-Kontext, nativ multimodal, Apache 2.0.
Mistral Large 3 — ausführlicher erklärt
Mistral Large 3 wurde am 2. Dezember 2025 veröffentlicht und ist das aktuelle Flaggschiff von Mistral AI. Die Architektur ist ein Mixture-of-Experts mit 675 Milliarden Gesamt- und 41 Milliarden aktiven Parametern pro Token. Ein nativ integrierter Vision-Encoder (~2,5 Mrd. Parameter) macht das Modell von Anfang an multimodal — kein nachträglich angeflanschtes Vision-Modul. Damit ist Large 3 das größte offen verfügbare MoE-Modell eines großen Labs.
Spezifikationen
- Kontextfenster: 256K Tokens — am oberen Ende offener Modelle, relevant für RAG, Code-Repos und lange Dokumente.
- Lizenz: Apache 2.0 — kommerzielle Nutzung erlaubt.
- Mehrsprachigkeit: Englisch, Französisch, Spanisch, Deutsch, Italienisch, Portugiesisch, Niederländisch, Chinesisch, Japanisch, Koreanisch, Arabisch.
- Benchmarks: 73,1 % auf MMLU-Pro, 93,6 % auf MATH-500.
Einordnung
Large 3 zielt auf Anwender, die offene Gewichte mit Top-Tier-Qualität kombinieren wollen — Konkurrenz im offenen Segment: DeepSeek V4, Llama 4 Maverick, Qwen 3.5. Im März 2026 ergänzte Mistral die Forge-Plattform für Enterprise-Pre- und Post-Training auf eigenen Datensätzen.
Entdecke mehr
GPT-6 Astra fand Fragen, die mein erster Security-Review übersehen hatte
Ich habe GPT-6 Astra und Fable 5.1 unabhängig RLS, API-Autorisierung und Mandantentrennung prüfen lassen. Der Cross-Review machte den Unterschied.
GlossarCodestral
Codestral ist Mistral AIs auf Code spezialisiertes Modell (erstmals Mai 2024) — ein 22-Mrd.-Parameter-Modell für Code-Vervollständigung und -Generierung, ursprünglich als offene Gewichte veröffentlicht.
LexikonKI-Modelle vergleichen — wer baut was und wofür wählen
Die wichtigsten Modellfamilien 2026 im Überblick. Wer baut Claude, GPT, Gemini, Llama, Mistral, DeepSeek, Qwen — und welches Modell wofür wählen.