Claude Fable 5 → 5.1 01.09.2026GPT-6 Astra Rollout 03./04.09.2026Gemini 3.6 Flash → 3.8 02.09.2026Qwen3.7 Max → 3.8 03.08.2026Sora 2 / Videos API 24.09.2026OpenAI Deprecation-Welle I 23.10.2026OpenAI Deprecation-Welle II 11.12.2026Mistral Small 3.1 30.11.2025
Claude Fable 5 → 5.1 (01.09.2026): Fable 5.1 (GA 01.09.2026) löst Fable 5 ab: unveränderte $10/$50 pro Mtok, Adaptive Thinking, Knowledge-Cutoff Juni 2026, Cache-Reads $0.25/M. Matrix und Vergleich führen nur noch 5.1.
GPT-6 Astra Rollout (03./04.09.2026): Neues OpenAI-Flagship: limited Rollout 03.09., Paid-Tiers ab 04.09.2026. Erstes OpenAI-Modell mit Preparedness-Rating „Critical“ (Cyber) — gestufter Zugriff via Daybreak-Programm; „Fast Mode“ kostet 2×.
Gemini 3.6 Flash → 3.8 (02.09.2026): Gemini 3.8 Flash (GA 02.09.2026) löst 3.6 Flash zum selben Intro-Preis ab ($0.75/$3.75 bis 31.12.2026). 3.7 Flash bleibt als Previous-Generation ohne Shutdown-Datum gelistet.
Qwen3.7 Max → 3.8 (03.08.2026): Qwen3.8 Max (GA 03.08.2026, 2.4T MoE / 95B aktiv, $2.00/$6.00 international) löst Qwen3.7 Max ab; Open Weights für 3.8-Max und 3.8-27B angekündigt.
Sora 2 / Videos API (24.09.2026): OpenAI stellt die Videos API (Sora 2 / sora-2-pro) ein. Die Modelle waren nie Teil der aufrufbaren Registry und sind es auch im Vergleich nicht mehr.
OpenAI Deprecation-Welle I (23.10.2026): Ende fuer gpt-4(-turbo), gpt-3.5-turbo, o1, o3-mini, o4-mini und gpt-image-1. Migration auf die GPT-5.6-Familie bzw. gpt-image-2.
OpenAI Deprecation-Welle II (11.12.2026): Ende fuer gpt-5, gpt-5-mini, gpt-5-nano, gpt-5-pro sowie o3/o3-pro — vollstaendiger Uebergang auf die GPT-5.6-Familie.
Mistral Small 3.1 (30.11.2025): Retired. Nachfolger Mistral Small 4 (Apache-2.0) ist in der Matrix als EU-Self-Hosting-Standard gefuehrt.
$10/$50 pro Mtok; „Fast Mode“ kostet 2×. Erstes OpenAI-Modell mit Preparedness-Rating „Critical“ (Cyber) — Zugriff läuft gestuft über das Daybreak-Programm. Kontext nicht offiziell bestätigt: 1M-Klasse (MRCR v2 512K–1M). US-Provider — nicht für No-US-Anforderungen.
$10/50 Mtok
Frontier API API (gestaffelter Rollout seit 03./04.09.2026) OpenAI DPA
Update 7d Rollout 03./04.09.2026
proprietär EU-Fit: mittel
Härteste Reasoning- und Coding-Aufgaben, lange autonome Agenten-Läufe (Terminal-Bench 4.0: 57,9%) Tokens: 1M-Klasse (MRCR v2 512K–1M) · Fast Mode 2× Preis
Promo $4/$20 pro Mtok bis 21.11.2026 (Listenpreis $5/$30); SOTA Coding Agent Index (80) + Agents' Last Exam (53,6); 1M Kontext, Programmatic Tool Calling. Nach GPT-6-Astra-Rollout die ausgereifte OpenAI-Alternative. US-Provider — nicht für No-US-Anforderungen.
Promo $0.75/$3.75 pro Mtok bis 31.12.2026, danach $1.50/$7.50 — datierter Hinweis, Preis verdoppelt sich zum 01.01.2027. Löst 3.6 Flash ab (3.7 Flash bleibt als Previous-Generation gelistet). 1M Kontext, bis 64k Output. EU via Vertex.
Mistral Medium 3.5Mistral AIEU-souveräne Frontier-Wahl
Jetzt im Vergleich aufrufbar: EU-resident (api.mistral.ai), €1.38/€6.90 Mtok, Reasoning+Vision, außerhalb US CLOUD Act. Apache-2.0-Schwester Mistral Large 3 für EU-Self-Hosting.
$1.5/7.5 Mtok · 256K Kontext
Frontier API EU API (EU-resident) oder Private Deployment Mistral DPA
Update 7d Neu im Vergleich (14.06.2026)
premier; Large 3 Apache-2.0 EU-Fit: hoch
Souveräne Business-Assistenten, Multi-Agent-Reasoning mit Tool-Use, RAG, europäische Deployments Tokens: Input/Output im 256k Kontext (EU-resident)
Claude Opus 5AnthropicAnalyse, Coding, Balanced Frontier
$5/$25 pro Mtok — halber Fable-Preis bei nahezu gleicher Alltagsleistung. Anthropic 1P-API global-only; EU-Route via Bedrock/Vertex mit Aufschlag. US-Provider.
$5/25 Mtok · 200K Kontext
Frontier API API; EU nur via Bedrock/Vertex (+10%) Anthropic DPA
Jetzt im Vergleich aufrufbar: $0.66/$1.98 Off-Peak ($1.32/$3.96 Peak, seit 16.08.2026), Cache-Hit ~€0.003 (>99%), 1M Kontext, MIT-Open-Weight. CN-gehostet → DSGVO nur via EU-Self-Hosting der Gewichte.
$0.66/1.98 Mtok · 1000K Kontext
Frontier API API oder dediziert, China-Risiko
Update 7d Neu im Vergleich (14.06.2026)
MIT EU-Fit: niedrig
General Use, Coding-Benchmarks, nicht sensible Experimente Tokens: 1M Input · bis 384k Output · Cache-Hit ~€0.003 HF: 174K Downloads · 2948 Likes
$2/$6 pro Mtok (<200K Prompt; darüber $4/$12), 500K Kontext. Kein EU-Endpoint, kein etabliertes DPA-Angebot — bei Datenschutzprofilen restriktiv ausblenden.
$2/6 Mtok · 500K Kontext
Frontier API API, kein EU-Endpoint
Update 7d Release 2026-08-12
proprietär EU-Fit: niedrig
Agenten- und Reasoning-Aufgaben ohne vertrauliche Daten, X-Echtzeitkontext Tokens: 500K Input · Output je Route
Löst Qwen3.7 Max ab: 2.4T MoE (95B aktiv), 1M Kontext, nativ multimodal; international $2.00/$6.00 pro Mtok. Erste Max-Klasse mit angekündigten Open Weights. Nicht als souveräne Standardroute führen.
Reifes Ökosystem, Lizenz nicht Apache. Meta hat die Llama-Frontier-Linie eingestellt — Muse Spark 1.3 (02.09.2026, $1.25/$4.25 Mtok, 1M Kontext) ist Metas aktueller Paid-API-Pfad; Muse Glimmer (10.08.2026, 30B, Apache-2.0) ist ein Open-Weight-Release, aber kein Llama-Nachfolger; ein Llama 5 existiert nicht.
Open / Offline Self-host, EU GPU
Geprüft HF geprüft
Llama 3.3 EU-Fit: hoch
RAG, interne Copilots, lange Business-Workflows Tokens: Input/Output je Self-host-Serving HF: 11.0M Downloads · 2740 Likes
119B/6B MoE mit Vision, Function Calling und zuschaltbarem Reasoning; läuft auf 2× H200 (FP8). Aktueller Standard für lokale EU-Deployments mit niedrigem TCO.
Apertus 1.5 70BSwiss AI Initiative (ETH/EPFL/CSCS)Vollständig offene EU-Referenz
Bewusst Mid-Tier bei Benchmarks — als Souveränitäts-/Compliance-Referenz führen, nicht als Frontier. 8B + 70B, dazu „Apertus Mini“ (16 destillierte Modelle). Meistgeladenes offenes Europamodell.
· 262K Kontext
Open / Offline Self-host oder EU-Plattformen (Swisscom, Infomaniak, PHOENIQS, Public AI)
Soofi S (Base)SOOFI-Konsortium (KI Bundesverband, BMWE/IPCEI-CIS)Deutsches Souveränitäts-Basismodell
Unaligned Base-Modell — nicht für Produktion: kein öffentliches API, kein Pricing, Lizenz noch nicht final. Hybrid Mamba-2/Transformer MoE (31.6B gesamt / 3.2B aktiv), bis 1M Kontext, ~27T Tokens, trainiert auf der Telekom Industrial AI Cloud München. Gemeldeter GPQA-Contamination-Vorfall; Instruct-Variante für ~September 2026 angekündigt.
· 1000K Kontext
Open / Offline HF-Gewichte (seit 10.07.2026); kein öffentliches API
Watchlist Preview/Research — Instruct ~Sept 2026
noch nicht final (~1% Genios-lizenzierte Daten) EU-Fit: hoch
Forschung und Evaluation deutsch-europäischer Souveränitäts-Stacks (beste voll-offenen DE+EN-Aggregate: 79,1/70,1) Tokens: bis 1M Kontext · MoE 31.6B gesamt / 3.2B aktiv HF: — Downloads · — Likes