Begriff
Llama 3.3
Llama 3.3 (Dezember 2024) ist Metas offenes 70B-Instruct-Modell — es erreicht 405B-Klasse-Qualitaet bei 70B-Kosten, mit 128K-Kontext und offenen Gewichten.
Llama 3.3 — ausführlicher erklärt
Meta veröffentlichte Llama 3.3 70B Instruct am 6. Dezember 2024 als letztes Modell seines Llama-Release-Zyklus 2024. Es ist ein rein textbasiertes, instruction-getuntes Transformer-Modell mit 70,6 Mrd. Parametern, das Grouped-Query-Attention (GQA) für skalierbarere Inferenz nutzt. Das Kontextfenster umfasst 128K Token, der Wissensstand reicht bis Dezember 2023, und das Training erfolgte auf über 15 Bio. Token öffentlich verfügbarer Daten. Unterstützt werden acht Sprachen, darunter Deutsch, Englisch, Französisch und Spanisch.
Beispiel / Praxisbezug
Der Kern-Vorteil von Llama 3.3: Es zielt auf Ergebnisse der 405B-Klasse bei den Bereitstellungskosten eines 70B-Modells. Laut Meta erzeugt Llama 3.3 70B Antworten nahezu fünfmal kosteneffizienter als das größere Llama 3.1 405B — mit Infrastrukturkosten von etwa 10 Cent pro 1 Mio. Input-Token und 40 Cent pro 1 Mio. Output-Token. Als Modell mit offenen Gewichten ist es frei herunterladbar (Hugging Face) und über Plattformen wie Amazon Bedrock verfügbar; damit eignet es sich für kostensensible Deployments und Self-Hosting.
Abgrenzung
Llama 3.3 ist ein reines Text-Modell und damit enger gefasst als multimodale Modelle. Innerhalb der Llama-Reihe ist es die effizienzoptimierte 70B-Variante, die die Qualität der deutlich größeren 3.1-405B-Generation annähert, ohne deren Rechenlast. Anders als proprietäre Modelle von OpenAI oder Anthropic steht Llama unter Metas offener Community-Lizenz.
Entdecke mehr
GPT-6 Astra fand Fragen, die mein erster Security-Review übersehen hatte
Ich habe GPT-6 Astra und Fable 5.1 unabhängig RLS, API-Autorisierung und Mandantentrennung prüfen lassen. Der Cross-Review machte den Unterschied.
GlossarCode Llama
Code Llama ist Metas auf Programmierung spezialisierte Llama-2-Variante vom August 2023 — offen gewichtet, in mehreren Größen und mit Basis-, Python- und Instruct-Ausprägungen.
LexikonKI-Modelle vergleichen — wer baut was und wofür wählen
Die wichtigsten Modellfamilien 2026 im Überblick. Wer baut Claude, GPT, Gemini, Llama, Mistral, DeepSeek, Qwen — und welches Modell wofür wählen.