Open-Weight
Modelle mit offen verfügbaren Gewichten — frei herunterladbar, selbst hostbar und feinabstimmbar, mit voller Kontrolle über Daten und Betrieb (Lizenzen variieren). Anbieterübergreifende Eigenschaft, z. B. FLUX.2, Llama und DeepSeek.
- Chatterbox Speech & Voice Open-Weight
Chatterbox ist ein quelloffenes Text-to-Speech-Modell von Resemble AI unter MIT-Lizenz. In Blindtests bevorzugten Hoerer es mehrheitlich gegenueber ElevenLabs; es bietet Emotionssteuerung, Voice-Cloning und niedrige Latenz.
- Fish Audio S2 Speech & Voice Open-Weight
Fish Audio S2 ist ein quelloffenes Text-to-Speech-Modell aus der Fish-Speech-Familie. Mit Inline-Tags steuert es Emotion und Betonung auf Wortebene, unterstuetzt ueber 80 Sprachen und liefert sehr niedrige Latenz.
- FLUX.2 Bild & Video Open-Weight
FLUX.2 ist die Text-zu-Bild-Modellfamilie von Black Forest Labs. Sie umfasst die proprietaeren Varianten Pro und Flex sowie das offene 32-Mrd.-Parameter-Modell Dev und die kompakte Klein-Reihe, die Bilderzeugung und Bildbearbeitung in einem Modell vereinen.
- Foundation-Sec-8B Security-Modelle Open-Weight
Foundation-Sec-8B ist Cisco Foundation AIs offenes, auf Cyber-Security spezialisiertes Sprachmodell (2025). Es erweitert Llama-3.1-8B durch fortgesetztes Pretraining auf rund 5 Mrd. Security-Tokens und steht unter Apache-2.0-Lizenz frei zur Verfügung.
- Hunyuan3D 2.0 3D-Modelle Open-Weight
Hunyuan3D 2.0 ist Tencents offenes generatives 3D-Modell (Januar 2025). Es erzeugt in zwei Stufen hochauflösende 3D-Assets mit Texturen aus Text oder Bild und unterstützt Text-, Bild-, Skizzen- und Porträt-zu-3D. Die Gewichte sind auf Hugging Face frei verfügbar.
- Kokoro Speech & Voice Open-Weight
Kokoro ist ein offenes Text-to-Speech-Modell (v1.0, Januar 2025) mit nur 82 Mio. Parametern. Es erzeugt natürlich klingende Sprache in 8 Sprachen mit 54 Stimmen, läuft mit rund 1 GB VRAM und steht unter Apache-2.0-Lizenz.
- Microsoft TRELLIS.2 3D-Modelle Open-Weight
Microsoft TRELLIS.2 ist das staerkste offene Bild-zu-3D-Modell (4 Mrd. Parameter, MIT-Lizenz). Es erzeugt in Sekunden hochaufloesende Assets mit nativen PBR-Materialien und unterstuetzt Gaussian Splatting; Gewichte sind auf Hugging Face frei verfuegbar.
- NVIDIA Canary Speech & Voice Open-Weight
Canary ist NVIDIAs offene ASR- und Speech-Translation-Modellfamilie (CC-BY-4.0), die auf dem Open-ASR-Leaderboard bei englischer Genauigkeit vor OpenAI Whisper liegt und 25 europaeische Sprachen abdeckt.
- SauerkrautLM Open-Weight
SauerkrautLM ist eine deutschsprachige LLM-Familie des deutschen Startups VAGOsolutions — Feintunings auf Basis von Llama, Qwen, Mistral und anderen offenen Architekturen.