Release: Claude Sonnet 5.5 – alle Infos zu Preis, Benchmarks und Einordnung
Anthropic hat Claude Sonnet 5.5 veröffentlicht: 2 / 10 $ pro Mio. Token, Opus-nahe Benchmarks, aber nur bei max-Effort. AA-Index 56 schlägt Astra.
Konkrete KI-Modelle und Modellfamilien im Überblick — wer sie entwickelt, wie sie sich in Reasoning, Coding, Multimodalität und Preis unterscheiden und wofür die einzelnen Linien im Alltag am besten taugen. Gegliedert nach Anbieter-Familien (GPT, Claude, Gemini …) und übergreifenden Einsatzzwecken wie Security, Bild & Video oder Open-Weight.
Anthropic hat Claude Sonnet 5.5 veröffentlicht: 2 / 10 $ pro Mio. Token, Opus-nahe Benchmarks, aber nur bei max-Effort. AA-Index 56 schlägt Astra.
OpenAI hat GPT-6.1 Sol veröffentlicht: 2 / 10 $ pro Mio. Token, fast Astra-Niveau bei Coding, aber im Gesamtindex hinter Anthropics Modellen.
Anthropic hat Claude Opus 5.5 veröffentlicht: 4 / 20 $ pro Mio. Token, rund 40 % günstiger als Opus 5 und in Coding-Benchmarks vor Fable 5.1.
Anthropic hat den 50%-Boost beendet. Seit 14. September, 9 Uhr MESZ, gelten dauerhaft +25% zur alten Basis – netto rund 17% weniger als zuvor.
Zhipu AI veröffentlicht GLM-5.3 — ein Open-Weights-MoE mit Fokus auf Coding und Cybersecurity, das agentische Benchmarks unter den offenen Modellen anführt.
xAI veröffentlicht Grok 4.6 — 500k-Token-Kontext, Bild-Input und gestaffelter Preis ab 2/6 USD, ausgelegt auf langlaufende agentische Arbeit.
Meta veröffentlicht Muse Spark 1.3 — Nachfolger von 1.2 mit agentischem Coding und Thought Compression. Was neu ist, was es kostet und für wen es zählt.
DeepSeek veröffentlicht V4.1-Flash: in eigenen Coding-Tests vorn, bei Langläufer-Agentik weit hinten — zum Bruchteil des Preises der Konkurrenz.
Anthropic markiert alle Modelle ab dem 2. August 2026 mit Wasserzeichen. Fable 5.1 macht den Anfang. Was das kann, wo es versagt, wer prüfen darf.
Am 5. September stand das Wochenkontingent mitten im Arbeiten wieder bei 5%. Plus 50% Bonus bis zum 13.9. Was du mit der geschenkten Kapazität machst.
OpenAI hat GPT-6 Astra veröffentlicht — erstes Modell auf der Preparedness-Stufe Critical. Unabhängig getestet hat es bisher praktisch niemand.
Google veröffentlicht am 2. September 2026 Gemini 3.8 Flash — getunt für Agenten und Long-Horizon-Coding, gleicher Preis, der ab Januar 2027 steigt.
Anthropic hat Claude Fable 5.1 und Mythos 5.1 veröffentlicht. Basispreis bleibt, aber Cache-Reads sind 75% günstiger und der Verbrauch sinkt.
Juli bis August 2026 brachte eine Welle offener Modelle: GLM-5.3, DeepSeek V4-Pro, Qwen3.8. Was die permissiven Lizenzen für Self-Hosting bedeuten.
Der für 1. September geplante 50-Prozent-Aufschlag auf Claude Sonnet 5 entfällt. Anthropic macht den Einführungspreis von 2/10 Dollar dauerhaft.
Daybreak Blue gibt geprüften Verteidigern seit August 2026 Zugriff auf Sol mit weniger Cyber-Refusals. Es ist kein neues KI-Modell.
Alibaba hat Qwen3.8-Max am 2. August 2026 final veröffentlicht: 2,4-Bio.-Parameter-MoE, 1M-Token-Kontext, Bild- und Video-Input per Closed API.
Anthropic hat Opus 5 veröffentlicht — gleicher Token-Preis wie 4.8, laut Anbieter Fable-nahe Leistung bei rund halben Kosten pro Aufgabe.
Moonshot AI hat Kimi K3 gelauncht — ein Open-Weight-Modell mit 2,8 Bio. Parametern laut Hersteller. Open Weights ab 27. Juli. Was das für den Markt heißt.
OpenAI hat GPT-5.6 (Sol/Terra/Luna) freigegeben — aber erst nach einer Vorab-Prüfung durch die US-Regierung. Was das für Frontier-Modelle bedeutet.
Anthropic veröffentlicht Claude Sonnet 5 am 1. Juli 2026 — laut Hersteller Near-Opus-Leistung zum Einführungspreis von 2/10 Dollar je Mio. Token.
Google Gemini läuft ab sofort als Agent in boostN — arbeite mit deinem Google-Abo über unsere Execution-Pipeline. Mistral folgt in Kürze.
Per Exportkontroll-Anordnung musste Anthropic am 12.6.2026 seine Top-Modelle Fable 5 und Mythos 5 für alle Nutzer abrupt sperren. Anthropic widerspricht offen.
Anthropic legt Zahlen offen: Claude schreibt >80 % des Produktionscodes. Zugleich plädiert die Firma für die Option, die Frontier-Entwicklung zu pausieren.
Marktüberblick Mitte 2026: Nano Banana 2, FLUX.2 und Midjourney V8 im Vergleich — welches Bild-Tool für Content- und Ad-Creatives wofür taugt.
Sora-Web/App seit 26.04.2026 aus, API endet 24.09.2026. Kling, Runway und Vidu gewinnen Nutzer. Was das für Video-Workflows heißt.
Anthropic veröffentlicht Opus 4.8 — gleicher Preis, günstigerer Fast Mode, Alignment nahe Mythos-Niveau. Was das Punkt-Release für Agenturen bedeutet.
DeepSeek macht den 75-%-Rabatt auf V4-Pro dauerhaft: 0,435 $ Input, 0,87 $ Output je Mio. Token. Was der Preisdruck für die Modellwahl bedeutet.
Auf der Build 2026 stellt Microsoft sieben eigene MAI-Modelle vor. MAI-Code-1-Flash läuft direkt in GitHub Copilot — billiger als GPT-5.5.
MiniMax M3 startet als Open-Weight-Modell mit Sparse Attention, 1-Mio-Kontext und Coding-Benchmarks auf Frontier-Niveau — zu einem Bruchteil der Kosten.
Alibabas Qwen 3.7 Max: 1 Mio. Kontext, 35 h autonom, 1.158 Tool-Calls. Was das agentische Flaggschiff kann und warum Anbieter-Benchmarks Vorsicht verlangen.
Anthropic hat eine 65-Mrd.-Runde bei 965 Mrd. Bewertung geschlossen, vertraulich IPO eingereicht und finanziert 36 Mrd. an Google-TPUs über Schulden.
Bis zu 75 Mrd. Euro für 5 GW KI-Kapazität, Phase 1 mit 45 Mrd. Euro und 3,1 GW bis 2031. Europas KI-Infrastruktur verschiebt sich nach Hauts-de-France.
Anthropic, OpenAI und Cursor kippen Flat-Rates zugunsten verbrauchsbasierter Abrechnung. Was sich konkret geändert hat und was bei dir ankommt.
Laut FT verhandelt Anthropic über eine 50-Mrd.-Dollar-Runde bei rund 900 Mrd. bis 1 Bio. Bewertung. Was die Zahlen aussagen und was nicht.
Das Freiburger Startup veröffentlicht FLUX.2 [klein] unter Apache 2.0 — sub-sekunden-Inferenz auf 13 GB VRAM und Druck auf große Foundation-Anbieter.
Cohere und Aleph Alpha verschmelzen zur 20-Milliarden-Dollar-Gruppe. Schwarz-Gruppe steckt 600 Millionen rein. Was das für sovereign AI in Europa heißt.
Seit 22. April 2026 GA: Google bündelt Vertex AI, Agent Builder und Memory Bank zur Gemini Enterprise Agent Platform — eine Plattform für alles.
Ahrefs zeigt: nur noch 38 % der in AI Overviews zitierten URLs ranken auch in den Top 10. Das alte SEO-Spielfeld verschiebt sich messbar.
675 Mrd. Parameter, 41 Mrd. aktiv, Apache 2.0. Mistral Large 3 ist das erste echte europäische Frontier-Modell mit komplett offenen Gewichten.
OpenAI hat die Runde Ende März bei 852 Mrd. abgeschlossen. Wer eingestiegen ist, was Amazon, Nvidia und SoftBank zahlen, was das bedeutet.
OpenAI bündelt Agent Builder, ChatKit und Evals. Visueller Workflow ersetzt Boilerplate-Code — und ChatKit/Evals sind seit DevDay 2025 GA.
Seit 7. Mai 2026: GPT-5.5-Cyber für vetted Cybersecurity-Teams. Weniger Refusals bei Vulnerability-Analyse, Reverse Engineering, Detection Engineering.
300 MW, 220.000 GPUs, doppelte Claude-Code-Limits. Was der SpaceX-Deal vom 6. Mai 2026 für zahlende Nutzer praktisch bedeutet.
Anthropic kündigt auf der Devcon Multi-Agent-Fleets, Outcomes-basierte Steuerung und ein Self-Improvement-Verfahren für Managed Agents an.
Zehn Templates für Wall-Street-Workflows, Claude in Excel/PowerPoint/Word/Outlook, 600 Mio. Firmen-Credit-Profile direkt in Claude.
Seit 5. Mai 2026 ist GPT-5.5 Instant das neue Default-Modell in ChatGPT. -52,5 % Halluzinationen bei Recht, Medizin, Finanzen — und weniger Emojis.
Ab 50.000 $ Monatsverbrauch greifen automatisch gestaffelte Rabatte. Was sich für Heavy-User ändert und wann der Wechsel auf den höheren Tier sich rechnet.
Mistral bringt Medium 3.5 mit 77,6 % SWE-Bench und Remote-Agenten in Vibe und Le Chat. Lokale Sessions wandern auf Wunsch in die Cloud.
Opus 4.6 ist aus dem Picker raus, Fast Mode läuft nur noch über Extra Usage. Was sich geändert hat und warum es kaum jemand mitbekommen hat.
Drei unabhängige Änderungen ließen Claude Code von März bis April schlechter arbeiten. Anthropic legt Ursachen und Konsequenzen offen.
OpenAI hat am 23. April 2026 GPT-5.5 und GPT-5.5 Pro freigeschaltet. Pro kostet $30/$180 pro MTok — sechsfacher Standard-Preis. Was das bedeutet.
Meta hat mit Muse Spark das erste Modell seiner Superintelligence Labs vorgestellt — proprietär statt offen. Unabhängig geprüft ist bisher wenig.
Mistral finanziert ein dediziertes KI-Rechenzentrum bei Paris. Ziel: 200 MW europäische Compute-Kapazität bis Ende 2027 für sovereign AI.