KI-Rückblick August 2026: Preis-Kehrtwende, Open-Weight-Welle und ein scharfer EU AI Act
KI-Rückblick August 2026: Sonnet-5-Preisstopp, Qwen3.8-Max, die Open-Weight-Welle, Google AI Mode auf Gemini Flash und der EU AI Act — eingeordnet.
in KI-Modelle
Modelle mit offen verfügbaren Gewichten — frei herunterladbar, selbst hostbar und feinabstimmbar, mit voller Kontrolle über Daten und Betrieb (Lizenzen variieren). Anbieterübergreifende Eigenschaft, z. B. FLUX.2, Llama und DeepSeek.
KI-Rückblick August 2026: Sonnet-5-Preisstopp, Qwen3.8-Max, die Open-Weight-Welle, Google AI Mode auf Gemini Flash und der EU AI Act — eingeordnet.
Juli 2026 im KI-Markt: Sonnet 5 und Opus 5 bei Anthropic, GPT-5.6 nach US-Review, Kimi K3 als Open Weight und neue GEO-Controls in der Search Console.
FLUX.2 ist die Text-zu-Bild-Modellfamilie von Black Forest Labs. Sie umfasst die proprietaeren Varianten Pro und Flex sowie das offene 32-Mrd.-Parameter-Modell Dev und die kompakte Klein-Reihe, die Bilderzeugung und Bildbearbeitung in einem Modell vereinen.
Microsoft TRELLIS.2 ist das staerkste offene Bild-zu-3D-Modell (4 Mrd. Parameter, MIT-Lizenz). Es erzeugt in Sekunden hochaufloesende Assets mit nativen PBR-Materialien und unterstuetzt Gaussian Splatting; Gewichte sind auf Hugging Face frei verfuegbar.
Chatterbox ist ein quelloffenes Text-to-Speech-Modell von Resemble AI unter MIT-Lizenz. In Blindtests bevorzugten Hoerer es mehrheitlich gegenueber ElevenLabs; es bietet Emotionssteuerung, Voice-Cloning und niedrige Latenz.
Fish Audio S2 ist ein quelloffenes Text-to-Speech-Modell aus der Fish-Speech-Familie. Mit Inline-Tags steuert es Emotion und Betonung auf Wortebene, unterstuetzt ueber 80 Sprachen und liefert sehr niedrige Latenz.
Foundation-Sec-8B ist Cisco Foundation AIs offenes, auf Cyber-Security spezialisiertes Sprachmodell (2025). Es erweitert Llama-3.1-8B durch fortgesetztes Pretraining auf rund 5 Mrd. Security-Tokens und steht unter Apache-2.0-Lizenz frei zur Verfügung.
Hunyuan3D 2.0 ist Tencents offenes generatives 3D-Modell (Januar 2025). Es erzeugt in zwei Stufen hochauflösende 3D-Assets mit Texturen aus Text oder Bild und unterstützt Text-, Bild-, Skizzen- und Porträt-zu-3D. Die Gewichte sind auf Hugging Face frei verfügbar.
Kokoro ist ein offenes Text-to-Speech-Modell (v1.0, Januar 2025) mit nur 82 Mio. Parametern. Es erzeugt natürlich klingende Sprache in 8 Sprachen mit 54 Stimmen, läuft mit rund 1 GB VRAM und steht unter Apache-2.0-Lizenz.
Canary ist NVIDIAs offene ASR- und Speech-Translation-Modellfamilie (CC-BY-4.0), die auf dem Open-ASR-Leaderboard bei englischer Genauigkeit vor OpenAI Whisper liegt und 25 europaeische Sprachen abdeckt.
SauerkrautLM ist eine deutschsprachige LLM-Familie des deutschen Startups VAGOsolutions — Feintunings auf Basis von Llama, Qwen, Mistral und anderen offenen Architekturen.
FLUX.2 von Black Forest Labs (Freiburg): Open-Weight-Bildmodell, Varianten von 4B bis 32B, Lizenzen, Hardware-Bedarf und Einordnung im Markt.
US-Exportkontrolle zwingt Anthropic, Fable 5 und Mythos 5 weltweit zu sperren. In der EU bleibt das Modell unauswählbar — eine Wiederherstellung ist offen.
Moonshot AI hat Kimi K3 gelauncht — ein Open-Weight-Modell mit 2,8 Bio. Parametern laut Hersteller. Open Weights ab 27. Juli. Was das für den Markt heißt.
Juli bis August 2026 brachte eine Welle offener Modelle: GLM-5.3, DeepSeek V4-Pro, Qwen3.8. Was die permissiven Lizenzen für Self-Hosting bedeuten.