Zurück zum Glossar

Begriff

Qwen 2.5

Im September 2024 veröffentlichte offene Modellfamilie von Alibaba. Umfasst Basisgrößen von 0,5B bis 72B Parametern plus Coder- und Math-Varianten; 128K-Kontext, mehrsprachig. Kleinere Größen unter Apache 2.0, das 72B-Modell unter eigener Qwen-Lizenz.

Qwen 2.5 — ausführlicher erklärt

Qwen 2.5 ist eine offene Modellfamilie des chinesischen Konzerns Alibaba, veröffentlicht im September 2024. Sie gilt als wichtiger Schritt für offene (open-weight) Sprachmodelle, weil sie in einer breiten Größenpalette und mit permissiver Lizenzierung erschien. Die Gewichte lassen sich herunterladen, lokal ausführen und feinabstimmen.

Die Familie umfasst sieben Basisgrößen: 0,5B, 1,5B, 3B, 7B, 14B, 32B und 72B Parameter. Ergänzend gibt es spezialisierte Varianten Qwen2.5-Coder (auf Programmcode trainiert) und Qwen2.5-Math sowie quantisierte Ausgaben (GGUF, AWQ, GPTQ). Alle Modelle bieten ein Kontextfenster von 128.000 Token bei bis zu 8.000 Token Ausgabelänge und wurden auf rund 18 Billionen Token vortrainiert. Qwen ist zudem stark mehrsprachig ausgelegt.

Bei der Lizenzierung sind die Größen unter 72B unter Apache 2.0 ohne Nutzungsobergrenze freigegeben, während das 72B-Modell unter der eigenen Qwen-Lizenz steht (Auflagen ab sehr hoher Nutzerzahl).

Beispiel / Praxisbezug

Die Größenvielfalt macht Qwen 2.5 flexibel: Kleine Modelle (0,5B–3B) laufen auf schwacher Hardware oder On-Device, große (32B, 72B) liefern mehr Qualität für anspruchsvolle Aufgaben. Die Coder-Variante eignet sich für Code-Generierung und -Analyse, die Math-Variante für rechenlastige Aufgaben.

Für Teams mit Datenschutz- oder Kostenanforderungen ist die Apache-2.0-Lizenz der kleineren Modelle attraktiv: selbst hosten, frei einsetzen, ohne API-Kosten pro Anfrage.

Abgrenzung zu ähnlichen Begriffen

Qwen ist Alibabas Modellfamilie und steht neben anderen offenen Familien wie Metas Llama oder Mistral. Qwen 2.5 ist eine ältere Generation; spätere Versionen (Qwen 3 und darüber hinaus) folgten mit Mixture-of-Experts-Architekturen. Die Zusätze „Coder” und „Math” bezeichnen aufgabenspezialisierte Ableger derselben Generation, nicht eigenständige Modellfamilien.

Alle Beiträge im Überblick:Qwen