Begriff
Mistral 7B
Mistral 7B (September 2023) ist das erste Open-Weight-Modell von Mistral AI — ein 7,3B-Parameter-Modell unter Apache 2.0, das damals das groessere Llama 2 13B in Benchmarks uebertraf.
Mistral 7B — ausfuehrlicher erklaert
Mistral 7B war das Debuet-Modell des franzoesischen Labors Mistral AI, veroeffentlicht im September 2023. Mit rund 7,3 Milliarden Parametern gehoert es zur Klasse der kleinen, effizienten Modelle — und wurde bekannt, weil es zum Erscheinungszeitpunkt das deutlich groessere Llama 2 13B auf allen getesteten Benchmarks uebertraf und Llama 1 34B in vielen Bereichen schlug. Das Modell steht unter der permissiven Apache-2.0-Lizenz und ist damit vollstaendig frei nutzbar, herunterladbar und kommerziell einsetzbar.
Der Grund fuer die Effizienz liegt in zwei architektonischen Kniffen: Grouped-Query Attention (GQA) beschleunigt die Inferenz, und Sliding Window Attention (SWA) erlaubt es, laengere Sequenzen zu kostenguenstigeren Bedingungen zu verarbeiten. In Benchmarks erreichte Mistral 7B etwa 60,1 auf MMLU (Wissen, 5-shot) gegenueber 55,6 bei Llama 2 13B sowie 30,5 auf HumanEval (Code) gegenueber 18,3 — besonders bei Code und Reasoning war der Abstand deutlich. Diese Kombination aus kleiner Groesse und starker Leistung machte Mistral 7B zu einem der einflussreichsten offenen Modelle seiner Zeit.
Beispiel / Praxisbezug
Der praktische Reiz von Mistral 7B liegt darin, dass es klein genug ist, um auf bescheidener Hardware zu laufen — etwa auf einer einzelnen Consumer-GPU oder, quantisiert, sogar auf leistungsstaerkeren Laptops. Ein typischer Einsatz: Ein Entwickler laedt das Modell ueber Ollama oder llama.cpp herunter und betreibt lokal einen Chat- oder Extraktions-Dienst, ohne Daten an eine Cloud-API zu geben. Wegen der Apache-2.0-Lizenz diente Mistral 7B ausserdem als beliebte Basis fuer unzaehlige Fine-Tunes, darunter deutschsprachige Varianten und domaenenspezifische Ableger.
Abgrenzung
Mistral 7B ist ein klassisches dichtes (dense) Modell, kein Mixture-of-Experts wie das spaeter veroeffentlichte Mixtral. Innerhalb von Mistral AIs Portfolio steht es am unteren, effizienten Ende und wurde ueber die Jahre von groesseren und neueren Modellen (etwa Mistral Small, Mistral Large) sowie neueren Kleinmodell-Generationen abgeloest. Von den proprietaeren API-Modellen (GPT, Claude, Gemini) unterscheidet es sich durch die offenen Gewichte und die freie Lizenz. Als 7B-Modell ist es heute in absoluten Faehigkeiten weit hinter aktuellen Frontier-Modellen, bleibt aber ein Referenzpunkt fuer den Sprung, den effiziente kleine Modelle 2023 machten.
Entdecke mehr
GPT-6 Astra fand Fragen, die mein erster Security-Review übersehen hatte
Ich habe GPT-6 Astra und Fable 5.1 unabhängig RLS, API-Autorisierung und Mandantentrennung prüfen lassen. Der Cross-Review machte den Unterschied.
GlossarCodestral
Codestral ist Mistral AIs auf Code spezialisiertes Modell (erstmals Mai 2024) — ein 22-Mrd.-Parameter-Modell für Code-Vervollständigung und -Generierung, ursprünglich als offene Gewichte veröffentlicht.
LexikonKI-Modelle vergleichen — wer baut was und wofür wählen
Die wichtigsten Modellfamilien 2026 im Überblick. Wer baut Claude, GPT, Gemini, Llama, Mistral, DeepSeek, Qwen — und welches Modell wofür wählen.