| AWS ESC US-Parent | L2 | US CLOUD Act | Amazon Nova Pro · Amazon Nova Lite Bedrock-Katalog in eusc-de-east-1 enthält ausschließlich Amazons First-Party-Modelle (Nova Lite / Nova Pro). Anthropic Claude, Meta Llama, Mistral und Cohere fehlen weiterhin (Stand Juli 2026). GPU-Instanzen und CloudFront ebenfalls noch nicht GA. | BSI C5, ISO 27001, ISO 27017, ISO 27018, ISO 27701, ISO 22301, SOC 2 | Regulierte Konzerne mit AWS-Stack und Amazon-Nova-Workloads |
|---|
| MS Sovereign US-Parent | L2 Hybrid 1-2 abhängig von Deployment (Public / Local / Partner Cloud) | US CLOUD Act | GPT-5.6 (GA) · Claude Sonnet 5 (GA) · GPT Image 2 (GA seit 21.04.2026) · Gemma 4 · Foundry Local (NVIDIA) GPT-5.6 GA seit 9. Juli 2026 mit EU Data Zone Standard (Sweden / Poland Central). Seit 5. März 2026 gilt für OpenAI-Modelle mit EU-Data-Residency ein Aufschlag von +10 %; Medienberichte vom September 2026 sprechen von einer Erhöhung auf +20 % (EU Data Zone) bzw. +30 % (Sovereign-Deployments) seit 01.09.2026 — offizielle Foundry-Preisseite im Projekt prüfen. Claude seit Anfang Juli 2026 GA in Foundry — jetzt auch Azure-gehostet (v2, Default), alternativ Anthropic-gehostet (v1); die Azure-gehostete Variante (Opus 4.8 / Sonnet 5) unterstützt Data Zone Standard bisher nur US, EU Data Zone weiter ausstehend. Foundry Local GA seit 24. Februar 2026 für disconnected / Sovereign-Private auf eigener NVIDIA-Hardware. | ISO 27001, ISO 27018, SOC 2, BSI C5 (Sov. Public Cloud), SecNumCloud (Bleu, FR) | Microsoft-Stack, hybrid/disconnected Workloads, Public Sector via Partner-Clouds |
|---|
| OVHcloud FR | L3 | EU only (FR) | Mistral Large 123B (sovereign) · Llama 4 · DeepSeek · Open-Weight on Bare Metal AI Endpoints mit 40+ managed Modellen (Standard / Fast / Batch APIs); Mistral-Large-123B als deploybare sovereign Reference-Architektur. Bare-Metal-Hosting eigener Modelle möglich. | ISO 27001, ISO 27017/18, SecNumCloud 3.2 (Bare Metal, Hosted Private Cloud, SNC Cloud Platform seit 01.09.2026), HDS | Bare-Metal-GPU, Reversibilität, kein Vendor-Lock-in |
|---|
| Scaleway FR | L3 | EU only (FR) | Mistral · Llama · DeepSeek (MaaS) Model-as-a-Service mit OpenAI-kompatibler API; tiefe Partnerschaft mit Mistral AI und Hugging Face. | ISO 27001, HDS, SecNumCloud (in progress), ACN-1 (IT, in progress) | Open-Weight-first, Mistral-Nähe, Startups & Public Sector |
|---|
| T-Systems IAC DE | L3 | EU only (DE) | Soofi S (30B MoE, veröffentlicht Juli 2026) · Perplexity Inference · Custom / Industrial Offiziell live seit 4. Februar 2026 im Tucherpark München (DC-Partner Polarise). Erste Großkunden: Agile Robots, PhysicsX, Perplexity (deutsche Inferenz), Siemens, EY; Noxtua ist am 25.03.2026 in Telekoms AI Factory eingezogen. Soofi S (30B MoE, 3.2B aktiv, DE/EN, ~27T Tokens, offene Gewichte) wurde im Juli 2026 auf der Industrial AI Cloud trainiert und veröffentlicht (Leibniz Universität Hannover, 130 dedizierte NVIDIA DGX B200 Systeme, >1000 GPUs); das ~100B-Modell bleibt das nächste Ziel. BMWK-Förderung ~€20 Mio. bis Juli 2026. | BSI C5, NIS2-konform, Germany Stack, VS-NfD-Pfad (T-Systems Sovereign Cloud) | Industrielle KI, deutsche Inferenz, KRITIS, Forschung |
|---|
| STACKIT DE | L3 | EU only (DE) | Aleph Alpha Luminous · Cohere Command R/+ (post-merger) · STACKIT AI Model Serving (serverless) Serverless, OpenAI-kompatible Modell-Inferenz mit Token-Abrechnung (ab €0,15/1M Input-Tokens, Premium €1,50/€1,75) aus Region eu01 (Deutschland) — ohne Speicherung oder Training mit Kundendaten. Modell-Stand August 2026: GPT-OSS 120B/20B, Qwen3-VL 235B, Qwen3.6 27B, Llama 3.3 70B, Gemma 4 31B, Embeddings (E5-Mistral, Qwen3-VL-Embedding). 30-Tage-Testzugang nach manueller Prüfung. Cohere/Aleph-Alpha-Fusion angekündigt 24. April 2026 (~$20 Mrd. Bewertung, 90/10 Aktionärs-Split, Dual-HQ Toronto + DE, Brand bleibt Cohere). Closing H2 2026 pendent auf Regulator-Approval (CA/DE/EU). Schwarz $600 M Lead-Strukturierung in Cohere Serie E. STACKIT-Incremental-NVIDIA/AMD-Kapazität bis 2030 für Cohere-Training und -Inferenz reserviert. | BSI C5 (höchste Stufe), VS-NfD-Empfehlung BSI, ISO 27001, TISAX | Public Sector, BSI-VS-NfD-nahe Workloads, Defense-nah |
|---|
| IONOS DE | L3 | EU only (DE) | NVIDIA DGX H200 (8× H200, self-host) · Noxtua (Legal-AI, gehostet) · AI Model Hub (Open-Weight) Kein eigenes Frontier-Modell — IONOS liefert die souveräne Inferenz-Schicht: dedizierte NVIDIA H200 Cloud-GPU VMs + DGX H200 Systeme (8× H200, 1,128 GB HBM3e) in DE-Rechenzentren. Der AI Model Hub (Doku zuletzt 04.09.2026) führt aktuell u. a. Mistral Small 24B, Mistral Nemo und Teuken-7B; Code Llama ist retired. Noxtua trainiert seit 2025 das erste DE-souveräne Legal-LLM auf dieser Infrastruktur (12.08.2026: 'Europe License'). Januar 2026: strategische BSI-Kooperation für souveräne Cloud-Sicherheit. Teil des EU-Testbeds Virt8ra. | BSI C5 (Type 1), ISO 27001 (BSI IT-Grundschutz), BSI IT-Grundschutz | Souveräne H200-Inferenz, deutsches Legal-/Health-/Public-Sector |
|---|
| Mistral Compute FR | L3 | EU only (FR) | Mistral Medium 3.5 · Mistral Large 3 (Apache-2.0) · Voxtral · Codestral Erste Deployment-Welle operativ seit Q2 2026: 13 800 NVIDIA GB300 GPUs im 44-MW-Rechenzentrum Bruyères-le-Châtel (betrieben von Eclairion, FR). Kommerzialisiert in drei Tiers — Premium, Inference und Sovereign (~€2.90/h pro GB300). Voller Ausbau bis 2028; bedient primär den eigenen Modell-Stack. Koyeb-Übernahme (Februar 2026) für die Deployment-Schicht. Seit August 2026 'European Compute Units' (ECU) als mehrjähriges Prepayment-Instrument; Roadmap 200 MW europäische Compute bis Ende 2027. | | EU-souveräne Frontier-Inferenz direkt vom Modell-Anbieter |
|---|
| Nebius NL (Nasdaq-US) | L2 EU-HQ und EU-Regionen, aber Nasdaq-gelistete Mutter — Jurisdiktion hybrid | Hybrid | 40+ Open-Weight-Modelle (MaaS) · Serverless + dedizierte Endpoints · Eigene AI-Factories (FI) Token Factory: serverless und dedizierte Inferenz für 40+ Open-Weight-Modelle (Llama, Qwen, DeepSeek, Mistral) aus EU-Regionen (Finnland, Frankreich). 31.03.2026: 310-MW-AI-Factory in Lappeenranta (FI) angekündigt — einer der größten EU-Compute-Ausbauten des Jahres. | ISO 27001, SOC 2 (Anbieterangaben) | Skalierbare Open-Weight-Inferenz aus EU-Regionen ohne Hyperscaler-Bindung |
|---|
| Hetzner DE | L1 Dediziertes GPU-Hosting — Kunde kontrolliert den kompletten Modell-Stack | EU only (DE) | Beliebige Open-Weight-Modelle (BYO) · Dedizierte GPU-Root-Server Dedizierte Root-Server mit voller Stack-Kontrolle: GEX44 (RTX 4000 SFF Ada, 20 GB) ab ~€219/Monat, GEX131 (RTX PRO 6000 Blackwell, 96 GB GDDR7) ~€889/Monat. Rechenzentren Nürnberg und Falkenstein (GEX131 auch Helsinki). Maximal eine GPU pro Server; keine H100/H200. Hetzner-Tutorials referenzieren explizit Self-Hosting von Llama und DeepSeek — beliebige Open Weights sind klar unterstützt. | ISO/IEC 27001 | Preiswertes dediziertes Self-Hosting kleiner und mittlerer Open-Weight-Modelle |
|---|
| OTC DE | L1 Self-Serve-IaaS-Schwester der Industrial AI Cloud — ohne 128-GPU-Mindestabnahme | EU only (DE) | NVIDIA H100 GPU-Flavors (IaaS) · AI Foundation Services / LLMHub (serverless) · Beliebige Open-Weight-Modelle (BYO) Zwei Self-Hosting-/Serverless-Pfade: H100-GPU-Flavors seit Dezember 2024 buchbar (klassische IaaS, kundenkontrollierter Stack — klar getrennt von der projektgetriebenen Industrial AI Cloud, kein 128-GPU-Einstieg). Zusätzlich T-Systems AI Foundation Services ('LLMHub'): token-abgerechnete, OpenAI-kompatible Modell-API mit 40+ Modellen (u. a. Llama, Mistral, Qwen, Gemma); Open-Weight-Modelle laufen auf Open Telekom Cloud in Deutschland — Achtung: proprietäre Modelle (GPT/Claude) werden über US-Hyperscaler geroutet. Kostenloser Test-API-Key self-service. | BSI C5, ISO 27001, NIS2-konform | BSI-C5-attestiertes H100-Self-Hosting aus deutscher Hand, ohne Großprojekt-Schwelle |
|---|
| plusserver DE | L1 GPU as a Service auf pluscloud — Angebotsgeschäft, keine öffentliche Preisliste | EU only (DE) | GPU as a Service (pluscloud VMware) · BYO Open-Weight-Modelle NVIDIA-Datacenter-GPUs als monatlich buchbare GPU-Profile auf der pluscloud (VMware-basiert). Konkrete GPU-Modelle und Preise nicht öffentlich — Angebot auf Anfrage. | BSI C5, ISO 27001 | C5-attestiertes GPU-Hosting für behördennahe und regulierte Workloads |
|---|
| Infercom LU (Betrieb DE) | L1 Produktions-Infrastruktur in München; juristischer Sitz Luxemburg (EU) | EU only (DE) | DeepSeek · Qwen · Llama · MiniMax (serverless, token-billed) Serverless-Inferenz (OpenAI-kompatibel, Pay-as-you-go in EUR) auf eigener SambaNova-SN40L-Dataflow-Hardware in München — laut Anbieter 'no CLOUD Act exposure'. SambaNova ist US-Chipzulieferer (nur Hardware; Infercom besitzt und betreibt die Systeme selbst). | ISO 27001 | Serverless-Token-Inferenz offener Modelle aus München, ohne GPU-Management |
|---|