Zum Hauptinhalt springen

Neue KI-Modelle Juli 2026: Fable 5, GPT-5.6 Sol, Gemini 3.1 Pro und Grok 4.5 im Vergleich

Fable 5, GPT-5.6 Sol/Terra/Luna, Gemini 3.1 Pro und Grok 4.5: was in neun Tagen kam. Preise, Benchmarks und welches DACH-KMU welches Modell braucht.

7 min readTill OberhummerTill Oberhummer
Neue KI-Modelle Juli 2026: Fable 5, GPT-5.6 Sol, Gemini 3.1 Pro und Grok 4.5 im Vergleich

Update August 2026: Seit diesem Artikel sind Sonnet 5, Opus 5, GPT-5.6 und Kimi K3 erschienen. Die aktuelle Ausgabe mit allen neuen Modellen im Vergleich: Neue KI-Modelle August 2026.

Das Wichtigste in Kürze

Zwischen 1. und 9. Juli 2026 gab es drei relevante Modellereignisse: Claude Fable 5 (Redeployment nach Exportkontrollen, ursprünglich am 9. Juni 2026 vorgestellt), Grok 4.5 und GPT-5.6 (Sol/Terra/Luna) — dazu bleibt Gemini 3.1 Pro von Februar 2026 als Vergleichsbasis relevant. Kein Modell gewinnt auf ganzer Linie. Für die meisten DACH-KMU bleibt der Preis pro Aufgabe der Hebel, nicht der Top-Platz in einer Benchmark-Tabelle.

Key Takeaways (5)
  • Fable 5 ist das teuerste und laut Anthropic fähigste Modell — für lange, autonome Agenten-Läufe, nicht für Alltags-Prompting.
  • GPT-5.6 kommt in drei Preisstufen (Sol/Terra/Luna) — Luna ist günstiger als fast jedes Vorgänger-Modell.
  • Grok 4.5 unterbietet Opus 4.8 und GPT-5.5 preislich um über 60 % bei starken Coding-Benchmarks — aber ohne EU-Verfügbarkeit zum Start.
  • Gemini 3.1 Pro bleibt relevant: in diesem Vergleich am breitesten dokumentiert bei nativer Video-/Audio-Verarbeitung und 1-Mio-Token-Kontext.
  • Kein Modellwechsel-Zwang: Bestehende Multi-Modell-Setups (siehe TCO-Guide) bleiben gültig — die neuen Modelle sind zusätzliche Optionen, kein Pflicht-Upgrade.

Innerhalb weniger Tage erschienen GPT-5.6 und Grok 4.5; zugleich wurde Claude Fable 5 wieder weltweit verfügbar. Wer gerade erst ein Modell ausgewählt hat, muss deshalb nicht von vorn beginnen. Entscheidend ist nicht, welches Modell neu ist, sondern ob ein anderes Modell eure konkrete Aufgabe zuverlässiger oder günstiger löst.

Was zwischen 1. und 9. Juli 2026 passiert ist

Claude Fable 5 (ursprünglich vorgestellt 9. Juni 2026, global redeployt 1. Juli 2026): Anthropics bislang fähigstes Modell kehrte zurück, nachdem US-Exportkontrollen es am 12. Juni kurzzeitig blockiert hatten. Fable 5 ist als Mythos-Klasse-Modell speziell für lange, autonome Agenten-Läufe gebaut — Anthropic nennt Einsätze über mehrere Tage, mit Planung über mehrere Etappen und Selbstüberprüfung.

Grok 4.5 (8. Juli 2026): xAIs erstes Modell, das explizit für Coding und agentische Aufgaben trainiert wurde — auf Basis eines 1,5-Billionen-Parameter-Fundaments (V9) und echten Cursor-Session-Daten. Elon Musk bezeichnet es als "Opus-class". Preislich über 60 % günstiger als Opus 4.8 oder GPT-5.5, bei einem Intelligence-Index-Rang über allen Gemini-Modellen. EU-Verfügbarkeit war zum Start noch nicht gegeben, für Mitte Juli angekündigt.

GPT-5.6 (9. Juli 2026): OpenAI ergänzt sein Modellangebot um drei neue Leistungsstufen — Sol (Flagship), Terra (Value) und Luna (kosteneffizient) — parallel zum weiterhin verfügbaren GPT-5.5. Alle drei mit 1,05 Mio Token Kontext. Sol setzt mit 7,8 % auf ARC-AGI-3 einen neuen Bestwert und ist das erste Modell, das ein komplettes ARC-AGI-3-Spiel löst.

Gemini 3.1 Pro (bereits seit 19. Februar 2026 verfügbar, aber weiter aktuell): In diesem Vergleich bietet Googles Frontier-Modell besonders breit dokumentierte native Video- und Audioeingaben sowie ein durchgängiges 1-Mio-Token-Kontextfenster.

Die vier Modelle im Überblick

Claude Fable 5 — für besonders anspruchsvolle, fehlerkritische Aufgaben

Preis: $10,00 / $50,00 pro Million Tokens (Input/Output) — das teuerste Modell in diesem Vergleich. Anthropic selbst sagt, die Fähigkeiten übertreffen jedes bisher veröffentlichte Claude-Modell: 95,0 % auf SWE-Bench Verified. Bei SWE-Bench Pro und Terminal-Bench nennt Anthropic ebenfalls Bestwerte — die genaue Methodik (Scaffolding, Reasoning-Level) variiert je nach Auswertung und ist teils umstritten; für belastbare Vergleichszahlen lohnt der Blick in Anthropics System Card statt in einzelne Prozentwerte.

Optimal für: mehrtägige autonome Codebasis-Migrationen, geschäftskritische Multi-Step-Workflows, Aufgaben, bei denen Fehlerkosten die API-Kosten um ein Vielfaches übersteigen — dieselbe Logik wie im TCO-Guide beschrieben.

GPT-5.6 Sol / Terra / Luna — drei Preisstufen statt einem Modell

Die Preisspanne reicht von Sol ($5,00/$30,00 pro Million Tokens) bis Luna ($1,00/$6,00) — die volle Preistabelle aller drei Stufen steht weiter unten. Beim Coding Agent Index von Artificial Analysis liegt Sol dennoch hinter Fable 5.

Optimal für: Teams, die bisher mit einem GPT-Flagship-Modell für alles gearbeitet haben — Luna deckt jetzt einen Großteil der High-Volume-Fälle zum Bruchteil des bisherigen Preises ab, Sol bleibt für die anspruchsvollen Fälle reserviert.

Gemini 3.1 Pro — Multimodalität und langer Kontext

Bei $2,00/$12,00 pro Million Tokens unter 200.000 Token Kontext (darüber $4,00/$18,00) kommt bei Gemini 3.1 Pro Google-Search-Grounding für faktengeprüfte Outputs dazu.

Das macht es stark bei Videoarchiv-Analyse, sehr langen Dokumenten oder Codebasen in einem Kontext und Recherche-Aufgaben mit aktuellem Web-Bezug — Details und Preisstaffeln im TCO-Guide.

Grok 4.5 — günstiges Coding- und Agenten-Modell

Preis: $2,00/$6,00 pro Million Tokens — über 60 % günstiger als Opus 4.8 oder GPT-5.5, bei laut Artificial Analysis Intelligence Index Rang 4 (über allen Gemini-Modellen).

Einschränkung für DACH: EU-Verfügbarkeit war zum Start (8. Juli) noch nicht gegeben, laut xAI für Mitte Juli 2026 angekündigt. Wer in der EU/DACH datenschutzkonform arbeiten muss, sollte vor dem produktiven Einsatz die aktuelle Verfügbarkeit und den Verarbeitungsstandort direkt bei xAI prüfen. Update 12. August 2026: Die EU-Freigabe ist inzwischen erfolgt — Grok 4.5 ist seit 17. Juli 2026 auch in der EU verfügbar.

Preise im direkten Vergleich

ModellInput/Output pro Mio. TokensPositionierung
Claude Fable 5$10,00 / $50,00anspruchsvolle, fehlerkritische Aufgaben, lange Agenten-Läufe
GPT-5.6 Sol$5,00 / $30,00Flagship-Reasoning
Claude Opus 4.8$5,00 / $25,00Premium-Standard für fehlerkritische Aufgaben (unverändert seit 4.7)
GPT-5.6 Terra$2,50 / $15,00Value-Tier
Gemini 3.1 Pro$2,00 / $12,00 (unter 200k Kontext)Multimodal, langer Kontext
Grok 4.5$2,00 / $6,00Coding/Agenten, günstig (EU-Start Mitte Juli)
GPT-5.6 Luna$1,00 / $6,00High-Volume, kosteneffizient

Preise Stand 11. Juli 2026, ändern sich kurzfristig — aktuelle Preise immer direkt beim Anbieter prüfen (openai.com/api/pricing, anthropic.com/pricing, ai.google.dev/gemini-api/docs/pricing, x.ai/api).

Benchmarks: Wer liegt vorn?

Keine seriöse Antwort lautet "Modell X gewinnt". Jedes der vier Modelle führt in mindestens einer Kategorie: Fable 5 bei SWE-Bench Pro und Terminal-Bench, GPT-5.6 Sol bei ARC-AGI, Grok 4.5 im Artificial-Analysis-Intelligence-Index unter den Coding-Modellen, Gemini 3.1 Pro bei nativer Multimodalität. Alle Zahlen sind selbstberichtet oder von Drittanbieter-Leaderboards — nicht unabhängig auf identischen internen Workloads geprüft.

Für ein KMU ist die Benchmark-Rangliste selten die relevante Entscheidungsgrundlage. Relevanter: Welches Modell löst eure spezifische Aufgabe zuverlässig genug, und was kostet ein Fehler im Vergleich zu den API-Kosten? Der TCO-Guide rechnet das exemplarisch durch.

Was das für DACH-KMU bedeutet

Kein Modellwechsel-Zwang. Wer heute ein funktionierendes Setup hat — etwa Sonnet für Alltagsaufgaben, Opus für kritische Entscheidungen —, muss nicht migrieren, nur weil neue Modelle erschienen sind. Entscheidend bleibt, ob das aktuelle Setup die Aufgabe zuverlässig genug löst, zu vertretbaren Kosten.

Drei Situationen, in denen ein Blick auf die neuen Modelle sich lohnt: Erstens, ihr plant gerade neu — dann gehört Luna oder Grok 4.5 (sobald EU-verfügbar) in die Preis-Leistungs-Prüfung. Zweitens, ihr habt ein Hochrisiko-Prozess mit hohen Fehlerkosten — dann ist Fable 5 einen TCO-Vergleich gegen Opus 4.8 wert, trotz höherem Listenpreis. Drittens, ihr arbeitet mit langen Dokumenten, Video oder Audio — dann bietet Gemini 3.1 Pro in diesem Vergleich die am breitesten dokumentierte native Video-/Audio-Unterstützung.

Für die meisten anderen Fälle gilt weiterhin die Grundidee aus dem TCO-Guide: Aufgaben je nach Anspruch an unterschiedliche Modelle verteilen — günstiges Modell für das Volumen, teures Modell nur für die Entscheidungspunkte mit echtem wirtschaftlichen Nutzen.

Häufige Fragen

Muss ich jetzt mein KI-Setup umstellen?

Nein. Neue Modelle sind zusätzliche Optionen, kein Pflicht-Upgrade. Ein funktionierendes, wirtschaftliches Setup bleibt gültig — prüft neue Modelle gezielt dort, wo euer aktuelles Setup an Kosten- oder Qualitätsgrenzen stößt.

Welches der vier Modelle ist für ein KMU am günstigsten?

Für reines Preis-pro-Token: GPT-5.6 Luna ($1,00/$6,00) oder Grok 4.5 ($2,00/$6,00, sobald EU-verfügbar). Der günstigste Preis pro Token ist aber nicht automatisch die günstigste Lösung — die TCO-Rechnung (inklusive Fehlerkosten) entscheidet, wie im TCO-Guide gezeigt.

Ist Grok 4.5 für DACH-Unternehmen nutzbar?

Ja, seit 17. Juli 2026 — zum Start am 8. Juli 2026 war es das noch nicht, die EU-Freigabe kam wie von xAI angekündigt Mitte des Monats. Bei personenbezogenen Daten (DSGVO) lohnt trotzdem der Blick auf den aktuellen Verarbeitungsstandort direkt bei xAI.

Was ist der Unterschied zwischen Fable 5 und den Opus-Modellen?

Fable 5 ist Anthropics Mythos-Klasse — eine Stufe über den nummerierten Claude-Modellen (Opus/Sonnet), mit Fokus auf lange, autonome Agenten-Einsätze über mehrere Tage statt Einzelaufgaben. Entsprechend höher der Preis ($10/$50 vs. $5/$25 bei Opus 4.8) — für die meisten Alltagsaufgaben bleibt Opus 4.8 oder Sonnet 5 die wirtschaftlichere Wahl.

Stand: 11. Juli 2026 — Preise und Verfügbarkeit ändern sich kurzfristig, aktuelle Angaben immer beim Anbieter prüfen.

Kostenloser Check

KI-Readiness-Check

Wie bereit ist dein Betrieb für KI-Automatisierung? 10 Fragen, persönliche Auswertung mit PDF — und du weißt, wo du stehst.

Readiness prüfen (3 Min) →

Cut the Prompt — Newsletter

Schließe dich 1.200 DACH-Geschäftsführer:innen an, die unseren KI-Newsletter lesen.

Jede Woche: 3 anonymisierte Beobachtungen aus echten KMU-Projekten, 1 Tool-Update aus unserem KI-Stack und 1 Idee zum Selber-Bauen. 5 Minuten Lesezeit. Kein Hype, kein Sales-Pitch.

Mit Eintragung Datenschutzerklärung akzeptiert. Abmeldung jederzeit per Link in jeder E-Mail.

1.200 lesen uns bereits auf LinkedIn — jetzt auch per E-Mail in deiner Inbox.

Erstgespräch

Willst du das für deinen Betrieb umsetzen?

In einem 30-Minuten-Gespräch analysieren wir deinen größten Zeitfresser und zeigen dir, was in deinem Betrieb sofort automatisiert werden kann.

Kostenloses Erstgespräch anfragen →

Antwort innerhalb von 48 Stunden — persönlich von Till.

Passend dazu

Weitere Artikel