EU AI Digital Sovereignty LLM Comparator EU AI Hosting · DE
EU-AI-HOSTING

Souveräne KI-Anbieter für Europa

Kompakte Entscheidungsmatrix für DSGVO-pflichtige Workloads. Dreizehn Anbieter, sechs harte KPIs — ohne Marketing-Filter. Stand: 7. September 2026.

Stand 7. September 2026 · Eigene Recherche · Q3 2026

EU AI Act seit 02.08.2026 voll in Kraft: Art.-50-Transparenzpflichten und GPAI-Enforcement durch das AI Office gelten jetzt — Anbieter-Transparenznachweise bei der Auswahl aktiv einfordern.

Layer 3Jurisdiktionssouveränität6 AnbieterLayer 2Operative Souveränität3 AnbieterLayer 1Datenresidenz4 Anbieter

Layer anklicken, um die Anbieter nach Souveränitätsstufe zu filtern. Layer 3 ist die höchste Stufe (Jurisdiktionssouveränität).

Vergleichsmatrix · 6 KPIs

Tabelle ist breiter als der Bildschirm — seitlich scrollen →

AnbieterLayerJurisdiktionFrontier-ModelleZertifikateBest-For
AWS ESC US-ParentL2 US CLOUD ActAmazon Nova Pro · Amazon Nova Lite Bedrock-Katalog in eusc-de-east-1 enthält ausschließlich Amazons First-Party-Modelle (Nova Lite / Nova Pro). Anthropic Claude, Meta Llama, Mistral und Cohere fehlen weiterhin (Stand Juli 2026). GPU-Instanzen und CloudFront ebenfalls noch nicht GA.BSI C5, ISO 27001, ISO 27017, ISO 27018, ISO 27701, ISO 22301, SOC 2Regulierte Konzerne mit AWS-Stack und Amazon-Nova-Workloads
MS Sovereign US-ParentL2 Hybrid 1-2 abhängig von Deployment (Public / Local / Partner Cloud)US CLOUD ActGPT-5.6 (GA) · Claude Sonnet 5 (GA) · GPT Image 2 (GA seit 21.04.2026) · Gemma 4 · Foundry Local (NVIDIA) GPT-5.6 GA seit 9. Juli 2026 mit EU Data Zone Standard (Sweden / Poland Central). Seit 5. März 2026 gilt für OpenAI-Modelle mit EU-Data-Residency ein Aufschlag von +10 %; Medienberichte vom September 2026 sprechen von einer Erhöhung auf +20 % (EU Data Zone) bzw. +30 % (Sovereign-Deployments) seit 01.09.2026 — offizielle Foundry-Preisseite im Projekt prüfen. Claude seit Anfang Juli 2026 GA in Foundry — jetzt auch Azure-gehostet (v2, Default), alternativ Anthropic-gehostet (v1); die Azure-gehostete Variante (Opus 4.8 / Sonnet 5) unterstützt Data Zone Standard bisher nur US, EU Data Zone weiter ausstehend. Foundry Local GA seit 24. Februar 2026 für disconnected / Sovereign-Private auf eigener NVIDIA-Hardware.ISO 27001, ISO 27018, SOC 2, BSI C5 (Sov. Public Cloud), SecNumCloud (Bleu, FR)Microsoft-Stack, hybrid/disconnected Workloads, Public Sector via Partner-Clouds
OVHcloud FRL3 EU only (FR)Mistral Large 123B (sovereign) · Llama 4 · DeepSeek · Open-Weight on Bare Metal AI Endpoints mit 40+ managed Modellen (Standard / Fast / Batch APIs); Mistral-Large-123B als deploybare sovereign Reference-Architektur. Bare-Metal-Hosting eigener Modelle möglich.ISO 27001, ISO 27017/18, SecNumCloud 3.2 (Bare Metal, Hosted Private Cloud, SNC Cloud Platform seit 01.09.2026), HDSBare-Metal-GPU, Reversibilität, kein Vendor-Lock-in
Scaleway FRL3 EU only (FR)Mistral · Llama · DeepSeek (MaaS) Model-as-a-Service mit OpenAI-kompatibler API; tiefe Partnerschaft mit Mistral AI und Hugging Face.ISO 27001, HDS, SecNumCloud (in progress), ACN-1 (IT, in progress)Open-Weight-first, Mistral-Nähe, Startups & Public Sector
T-Systems IAC DEL3 EU only (DE)Soofi S (30B MoE, veröffentlicht Juli 2026) · Perplexity Inference · Custom / Industrial Offiziell live seit 4. Februar 2026 im Tucherpark München (DC-Partner Polarise). Erste Großkunden: Agile Robots, PhysicsX, Perplexity (deutsche Inferenz), Siemens, EY; Noxtua ist am 25.03.2026 in Telekoms AI Factory eingezogen. Soofi S (30B MoE, 3.2B aktiv, DE/EN, ~27T Tokens, offene Gewichte) wurde im Juli 2026 auf der Industrial AI Cloud trainiert und veröffentlicht (Leibniz Universität Hannover, 130 dedizierte NVIDIA DGX B200 Systeme, >1000 GPUs); das ~100B-Modell bleibt das nächste Ziel. BMWK-Förderung ~€20 Mio. bis Juli 2026.BSI C5, NIS2-konform, Germany Stack, VS-NfD-Pfad (T-Systems Sovereign Cloud)Industrielle KI, deutsche Inferenz, KRITIS, Forschung
STACKIT DEL3 EU only (DE)Aleph Alpha Luminous · Cohere Command R/+ (post-merger) · STACKIT AI Model Serving (serverless) Serverless, OpenAI-kompatible Modell-Inferenz mit Token-Abrechnung (ab €0,15/1M Input-Tokens, Premium €1,50/€1,75) aus Region eu01 (Deutschland) — ohne Speicherung oder Training mit Kundendaten. Modell-Stand August 2026: GPT-OSS 120B/20B, Qwen3-VL 235B, Qwen3.6 27B, Llama 3.3 70B, Gemma 4 31B, Embeddings (E5-Mistral, Qwen3-VL-Embedding). 30-Tage-Testzugang nach manueller Prüfung. Cohere/Aleph-Alpha-Fusion angekündigt 24. April 2026 (~$20 Mrd. Bewertung, 90/10 Aktionärs-Split, Dual-HQ Toronto + DE, Brand bleibt Cohere). Closing H2 2026 pendent auf Regulator-Approval (CA/DE/EU). Schwarz $600 M Lead-Strukturierung in Cohere Serie E. STACKIT-Incremental-NVIDIA/AMD-Kapazität bis 2030 für Cohere-Training und -Inferenz reserviert.BSI C5 (höchste Stufe), VS-NfD-Empfehlung BSI, ISO 27001, TISAXPublic Sector, BSI-VS-NfD-nahe Workloads, Defense-nah
IONOS DEL3 EU only (DE)NVIDIA DGX H200 (8× H200, self-host) · Noxtua (Legal-AI, gehostet) · AI Model Hub (Open-Weight) Kein eigenes Frontier-Modell — IONOS liefert die souveräne Inferenz-Schicht: dedizierte NVIDIA H200 Cloud-GPU VMs + DGX H200 Systeme (8× H200, 1,128 GB HBM3e) in DE-Rechenzentren. Der AI Model Hub (Doku zuletzt 04.09.2026) führt aktuell u. a. Mistral Small 24B, Mistral Nemo und Teuken-7B; Code Llama ist retired. Noxtua trainiert seit 2025 das erste DE-souveräne Legal-LLM auf dieser Infrastruktur (12.08.2026: 'Europe License'). Januar 2026: strategische BSI-Kooperation für souveräne Cloud-Sicherheit. Teil des EU-Testbeds Virt8ra.BSI C5 (Type 1), ISO 27001 (BSI IT-Grundschutz), BSI IT-GrundschutzSouveräne H200-Inferenz, deutsches Legal-/Health-/Public-Sector
Mistral Compute FRL3 EU only (FR)Mistral Medium 3.5 · Mistral Large 3 (Apache-2.0) · Voxtral · Codestral Erste Deployment-Welle operativ seit Q2 2026: 13 800 NVIDIA GB300 GPUs im 44-MW-Rechenzentrum Bruyères-le-Châtel (betrieben von Eclairion, FR). Kommerzialisiert in drei Tiers — Premium, Inference und Sovereign (~€2.90/h pro GB300). Voller Ausbau bis 2028; bedient primär den eigenen Modell-Stack. Koyeb-Übernahme (Februar 2026) für die Deployment-Schicht. Seit August 2026 'European Compute Units' (ECU) als mehrjähriges Prepayment-Instrument; Roadmap 200 MW europäische Compute bis Ende 2027.EU-souveräne Frontier-Inferenz direkt vom Modell-Anbieter
Nebius NL (Nasdaq-US)L2 EU-HQ und EU-Regionen, aber Nasdaq-gelistete Mutter — Jurisdiktion hybridHybrid40+ Open-Weight-Modelle (MaaS) · Serverless + dedizierte Endpoints · Eigene AI-Factories (FI) Token Factory: serverless und dedizierte Inferenz für 40+ Open-Weight-Modelle (Llama, Qwen, DeepSeek, Mistral) aus EU-Regionen (Finnland, Frankreich). 31.03.2026: 310-MW-AI-Factory in Lappeenranta (FI) angekündigt — einer der größten EU-Compute-Ausbauten des Jahres.ISO 27001, SOC 2 (Anbieterangaben)Skalierbare Open-Weight-Inferenz aus EU-Regionen ohne Hyperscaler-Bindung
Hetzner DEL1 Dediziertes GPU-Hosting — Kunde kontrolliert den kompletten Modell-StackEU only (DE)Beliebige Open-Weight-Modelle (BYO) · Dedizierte GPU-Root-Server Dedizierte Root-Server mit voller Stack-Kontrolle: GEX44 (RTX 4000 SFF Ada, 20 GB) ab ~€219/Monat, GEX131 (RTX PRO 6000 Blackwell, 96 GB GDDR7) ~€889/Monat. Rechenzentren Nürnberg und Falkenstein (GEX131 auch Helsinki). Maximal eine GPU pro Server; keine H100/H200. Hetzner-Tutorials referenzieren explizit Self-Hosting von Llama und DeepSeek — beliebige Open Weights sind klar unterstützt.ISO/IEC 27001Preiswertes dediziertes Self-Hosting kleiner und mittlerer Open-Weight-Modelle
OTC DEL1 Self-Serve-IaaS-Schwester der Industrial AI Cloud — ohne 128-GPU-MindestabnahmeEU only (DE)NVIDIA H100 GPU-Flavors (IaaS) · AI Foundation Services / LLMHub (serverless) · Beliebige Open-Weight-Modelle (BYO) Zwei Self-Hosting-/Serverless-Pfade: H100-GPU-Flavors seit Dezember 2024 buchbar (klassische IaaS, kundenkontrollierter Stack — klar getrennt von der projektgetriebenen Industrial AI Cloud, kein 128-GPU-Einstieg). Zusätzlich T-Systems AI Foundation Services ('LLMHub'): token-abgerechnete, OpenAI-kompatible Modell-API mit 40+ Modellen (u. a. Llama, Mistral, Qwen, Gemma); Open-Weight-Modelle laufen auf Open Telekom Cloud in Deutschland — Achtung: proprietäre Modelle (GPT/Claude) werden über US-Hyperscaler geroutet. Kostenloser Test-API-Key self-service.BSI C5, ISO 27001, NIS2-konformBSI-C5-attestiertes H100-Self-Hosting aus deutscher Hand, ohne Großprojekt-Schwelle
plusserver DEL1 GPU as a Service auf pluscloud — Angebotsgeschäft, keine öffentliche PreislisteEU only (DE)GPU as a Service (pluscloud VMware) · BYO Open-Weight-Modelle NVIDIA-Datacenter-GPUs als monatlich buchbare GPU-Profile auf der pluscloud (VMware-basiert). Konkrete GPU-Modelle und Preise nicht öffentlich — Angebot auf Anfrage.BSI C5, ISO 27001C5-attestiertes GPU-Hosting für behördennahe und regulierte Workloads
Infercom LU (Betrieb DE)L1 Produktions-Infrastruktur in München; juristischer Sitz Luxemburg (EU)EU only (DE)DeepSeek · Qwen · Llama · MiniMax (serverless, token-billed) Serverless-Inferenz (OpenAI-kompatibel, Pay-as-you-go in EUR) auf eigener SambaNova-SN40L-Dataflow-Hardware in München — laut Anbieter 'no CLOUD Act exposure'. SambaNova ist US-Chipzulieferer (nur Hardware; Infercom besitzt und betreibt die Systeme selbst).ISO 27001Serverless-Token-Inferenz offener Modelle aus München, ohne GPU-Management

Anbieter im Detail

AWS European Sovereign Cloud

US CLOUD Act · US-Parent

L2

Eigene AWS-Partition (aws-eusc), seit 15. Januar 2026 GA in Brandenburg (zwei AZs). Betrieben durch die AWS European Sovereign Cloud GmbH unter deutschem Recht; Geschäftsführer Stéphane Israël und Stefan Hoechbauer sind EU-Bürger. ~90 Services beim Start (vs. 240+ in eu-central-1). Trotz operativer Trennung bleibt der US-Mutterkonzern dem CLOUD Act unterworfen.

  • Erste Hyperscaler-Option mit BSI-C5-Attestierung ab GA
  • Nitro-System + Partitionsgrenze: weder US- noch EU-Admin sieht Kunden-Memory
  • Operativer Betrieb durch EU-Personal, eigene Konzernstruktur in Deutschland
  • US-Mutter weiterhin CLOUD-Act-pflichtig — formaljuristisch keine Layer-3-Souveränität
  • ~15 % Pricing-Premium und nur 2 AZs — BSI-Geo-Redundanz (200 km) noch nicht erfüllt
  • GPU-Instanzen, CloudFront und Drittanbieter-Modelle (Claude, Llama, Mistral, Cohere) Juli 2026 weiterhin nicht verfügbar
Initial: Eigener Account in der amazonaws.eu-Partition, getrenntes IAM, eigene Container-Registry — kein Cross-Partition-VPC-Peering.
Datenstandorte: DE Brandenburg (eusc-de-east-1), BE / NL / PT (Local Zones geplant)
Anbieter öffnen

Microsoft Sovereign Cloud (Foundry)

US CLOUD Act · US-Parent

L2

Drei-stufiges Sovereign-Continuum: Sovereign Public Cloud (EU Data Boundary), Sovereign Private Cloud (Azure Local + Foundry Local seit 24. Februar 2026 für vollständig disconnected NVIDIA-Inferenz) und National Partner Clouds (Bleu, Delos). Foundry orchestriert GPT-5.6, Claude Sonnet 5, GPT Image 2 und Gemma 4. Tier-5/Tier-6-Quota Default für GPT-5.6 — kleinere Tiers müssen Quota beantragen.

  • Nahtlose Integration mit M365 und Microsoft Entra ID
  • Foundry Local GA (24.02.2026): vollständig disconnected LLM-Inferenz auf kundeneigener NVIDIA-Hardware
  • Partner-Clouds Bleu (FR, SecNumCloud) und Delos (DE, BSI-Niveau) für höchste Anforderungen
  • US-Mutter weiterhin CLOUD-Act-pflichtig auf der Public-Cloud-Schiene
  • Claude in Foundry GA, aber Azure-gehostete Variante nur mit US Data Zone — EU Data Zone weiter ohne Datum
  • Komplexität durch drei parallele Sovereignty-Tiers (Public / Local / Partner) + Tier-5/6-Quota-Hürde für GPT-5.6
Initial: Sovereign Landing Zone (SLZ) mit Bicep/Terraform-Policies; bei Partner-Clouds eigener Vertrag mit Bleu/Delos.
Datenstandorte: EU Data Boundary (Public · SE / FR / WE / PL Central), Azure Local (Sov. Private), Bleu (FR · Orange/Capgemini), Delos (DE · SAP)
Anbieter öffnen

OVHcloud

EU only (FR) · FR

L3

Französischer Anbieter ohne US-Mutter, fokussiert auf Reversibilität und Open-Source-Stack. Bare-Metal-GPU-Server (L4/L40S GA, H100/H200 Public Cloud) und Early Access auf Blackwell B200 HGX bei OVHcloud Labs. Am 1. September 2026 hat ANSSI der SNC Cloud Platform die SecNumCloud-3.2-Qualifizierung erteilt — das dritte qualifizierte OVHcloud-Produkt und die erste echte Public Cloud mit SecNumCloud; Rollout nach IT/DE/PL angekündigt. AI-Services laut Roadmap Ende 2026. April 2026: OVHcloud wurde mit DEEP und Clever Cloud von der EU-Kommission für das Sovereign-Cloud-Framework ausgewählt.

  • Komplette Immunität gegen den US CLOUD Act — Layer 3
  • Root-Zugriff auf Bare-Metal-GPU, kein Hypervisor-Layer
  • SecNumCloud 3.2 auch für die SNC Public Cloud (seit 01.09.2026) — gestützt durch FR-Gesetz 2024-449 für staatliche Sensitivdaten
  • Kleinerer Katalog höherwertiger Managed-AI-Services als Hyperscaler
  • Mehr Eigenleistung im Infrastruktur-Management nötig
  • Blackwell B200 nur in Early Access; Beta-zu-GA-Migration der SNC Cloud Platform kann Daten-Reload erfordern
Initial: Identifikation der GPU-Klasse (H200 für LLM-Training, L40S für Inferenz); EU-Region wählen; Bare-Metal-Plan reservieren.
Datenstandorte: FR (Roubaix, Strasbourg, Gravelines), DE Frankfurt, PL, GB, kein US-Mutter
Anbieter öffnen

Scaleway (iliad Group)

EU only (FR) · FR

L3

Größter europäisch-eigener Public-Cloud-Anbieter, 100 % iliad-Group-eigen. Vier aktive Cloud-Regionen (FR/PL/NL/IT) plus deutsche Availability Zone live; Schweden in Vorbereitung. iliad hat €3 Mrd. in Cloud + AI committed, ~5 000 Top-GPUs für Mistral, H, Photoroom deployed; Europas erste Blackwell-Ultra-B300-Instanzen (288 GB HBM) seit Dezember 2025 verfügbar. Model-as-a-Service mit Mistral, Llama und DeepSeek über OpenAI-kompatible API. April 2026: Der Health Data Hub migriert von Microsoft Azure zu Scaleway (Cutover bis Ende 2026) — französischer Public-Sector-Großgewinn. Mai 2026: Beitritt zum AION-Konsortium für die französische EU-AI-Gigafactory-Bewerbung.

  • Layer 3 — vollständig außerhalb US-Jurisdiktion, Teil von Digital-Euro-Konsortium
  • Schnellster Zugriff auf neue Open-Weight-Modelle (Mistral, Hugging Face)
  • Health Data Hub wechselt 2026 von Azure zu Scaleway — HDS-Referenz im Public Sector
  • Regionaler Footprint kleiner als Hyperscaler (DE als AZ, noch keine volle Region)
  • Fokus auf Open-Weight statt proprietärer Frontier-Modelle
  • Italienische ACN-1- und französische SecNumCloud-Zertifizierung noch in Bearbeitung
Initial: Scaleway-Account, EU-Region wählen (FR/PL/NL/IT); Generative API oder MaaS direkt konsumieren.
Datenstandorte: FR Paris, PL Warschau, NL Amsterdam, IT Mailand (seit 19. März 2026), DE AZ (live), SE (geplant)
Anbieter öffnen

T-Systems Industrial AI Cloud (München)

EU only (DE) · DE

L3

~10 000 NVIDIA Blackwell GPUs (DGX B200 + RTX PRO 6000), 0,5 EFLOPS Rechenleistung, 20 PB Storage. Betrieben von Deutsche Telekom / T-Systems auf deutschem Boden, vollständig erneuerbar (Eisbach-Wasserkühlung, Abwärme für Tucherpark). Teil von Made 4 Germany und Germany Stack mit SAP.

  • Größter sovereign AI-Cluster Europas; +50 % deutsche GPU-Kapazität
  • Souveräne Inferenz-Schicht für deutsche Großkunden (z. B. Perplexity DE)
  • Erneuerbar betrieben, Abwärme-Nutzung für lokale Stadtversorgung
  • Hohe Mindestabnahme (Buchung typisch ab 128 GPUs)
  • Fokus auf Großprojekte und Pilot-Workloads, weniger auf SaaS-light
  • Modellangebot derzeit projektgetrieben, kein breiter MaaS-Katalog
Initial: T-Systems Vertrag, Mindestabnahme ab 128 GPUs, Anbindung ans T-Cloud-Netzwerk für Latenz.
Datenstandorte: DE München (Tucherpark), T-Cloud Netzwerk DE
Anbieter öffnen

STACKIT (Schwarz Digits)

EU only (DE) · DE

L3

Sovereign-Cloud-Plattform der Schwarz-Gruppe (Schwarz Digits) — heute vier aktive DC-Campus in DE + AT mit ~120 MW Kapazität. Im Bau: Lübbenau (Brandenburg), €11 Mrd. Single-Investment, 200 MW Phase 1 spät 2027, ausgelegt für bis 100 000 GPUs; am 27.08.2026 committed die Schwarz Group weitere €5,6 Mrd. für ein Rechenzentrum in Mecklenburg-Vorpommern. April 2026: einer von vier Gewinnern des EU-Kommissions-Sovereign-Cloud-Rahmenvertrags (€180 Mio., 6 Jahre). Mai 2026: Sovereign-Cloud-Partnerschaft mit BT. BSI-Empfehlung für VS-NfD-nahe Behördenkommunikation. Hostet die im April 2026 angekündigte Cohere/Aleph-Alpha-Fusion.

  • BSI C5 höchste Stufe; einziger Anbieter mit BSI-Empfehlung für VS-NfD-nahe Behördenkommunikation
  • Vollständig EU-eigene Konzernstruktur — Schwarz-Gruppe (Lidl/Kaufland)
  • 575 000-MA-Eigenbedarf als Anker; €11 Mrd. Lübbenau-Investment unterzeichnet
  • Modell-Katalog (heute) eng auf Aleph Alpha Luminous und Cohere fokussiert
  • Cohere/Aleph-Alpha-Merger noch unter regulatorischem Vorbehalt (Closing H2 2026)
  • Lübbenau-Kapazität (200 MW, 100k GPUs) erst Phase 1 spät 2027 verfügbar
Initial: Schwarz-Digits-Vertrag, STACKIT-Account, EU-IdP-Anbindung; VS-NfD-Pfad für Behörden separat.
Datenstandorte: DE Neckarsulm / Ellhofen (3 Campus), AT Ostermiething, DE Lübbenau (im Bau, Phase 1 spät 2027)
Anbieter öffnen

IONOS Cloud

EU only (DE) · DE

L3

Deutscher Cloud-Anbieter (IONOS Group SE, Mehrheit United Internet AG) ohne ausländischen Mutterkonzern. Erster deutscher Cloud-Provider mit BSI C5 Type 1 + ISO 27001 nach BSI IT-Grundschutz (seit November 2023). H200-GPU-VMs und DGX-H200-Systeme GA in ISO-zertifizierten DE-Rechenzentren; transparente Stunden-Preise, keine Mindestlaufzeit. Hostet u. a. Noxtua, Europas erstes souveränes Legal-AI.

  • Layer 3 — vollständig außerhalb US-Jurisdiktion, deutscher Eigentümer
  • BSI C5 + ISO 27001 (BSI IT-Grundschutz) — erster DE-Cloud mit beiden
  • Dedizierte NVIDIA H200 GPU-VMs + DGX H200 GA in DE, by-the-minute Billing
  • Kein eigener Frontier-LLM-Katalog — IaaS-/PaaS-Fokus, Modelle bringt der Kunde
  • Kleinerer Managed-AI-Service-Katalog als Hyperscaler
  • C5:2026-Migration (Pflicht ab 1. Juni 2027) noch ausstehend
Initial: IONOS-Cloud-Account, DE-Region wählen, H200 GPU-VM oder DGX-H200-Plan reservieren; eigene Modell-Artefakte mitbringen.
Datenstandorte: DE Frankfurt, DE Berlin, DE Karlsruhe, EU (32 RZ weltweit)
Anbieter öffnen

Mistral Compute

EU only (FR) · FR

L3

Mistral AIs eigene Compute-Sparte: französische Jurisdiktion ohne US-Mutterkonzern, erste Phase mit 13 800 NVIDIA GB300 (44 MW) in Bruyères-le-Châtel seit Q2 2026 operativ. Finanziert über eine $830-Mio.-Fremdfinanzierung (≈ €722 Mio., Kredit sieben Banken, 30.03.2026). Drei kommerzielle Tiers (Premium / Inference / Sovereign) rund um den eigenen Modell-Stack (Medium 3.5, Large 3, Voxtral, Codestral). Weitere Marktentwicklung: Cohere hat Aleph Alpha übernommen (April 2026) — Mistral ist damit faktisch der einzige EU-General-Provider in kommerziellem Maßstab; OpenEuroLLM ist weiterhin nicht released.

  • Layer 3 — französische Jurisdiktion, Modell + Compute aus einer EU-Hand
  • 13 800 GB300 GPUs in FR operativ (seit Q2 2026); Sovereign-Tier explizit für regulierte Kunden
  • Open-Weight-Modelle (Large 3, Apache-2.0) zusätzlich self-hostbar
  • Voller Kapazitätsausbau erst bis 2028; aktuell primär eigener Modell-Stack
  • Zertifizierungen (ISO 27001, SecNumCloud) öffentlich noch nicht belegt
  • Ökosystem jung — Deployment-Tooling (Koyeb) noch in Integration
Initial: Mistral-Account bzw. Enterprise-Vertrag; Sovereign-Tier über Mistral Sales; Open-Weight-Modelle alternativ auf eigener EU-Hardware.
Datenstandorte: FR Bruyères-le-Châtel (Essonne), FR Les Ulis (10 MW Inferenz-DC, ab Q3 2026)
Anbieter öffnen

Nebius Token Factory

Hybrid · NL (Nasdaq-US)

L2

Amsterdamer AI-Infrastruktur-Anbieter (Nasdaq-gelistet, operativ EU-geprägt) mit eigener GPU-Flotte und der 2026 lancierten Token Factory: produktionsreife Open-Weight-Inferenz (serverless wie dediziert) aus finnischen und französischen Regionen. Jurisdiktisch hybrid: EU-Standorte und EU-Rechtspersonen, aber US-Börsennotiz der Mutter — für strikte Layer-3-Pflichten nur bedingt geeignet.

  • 40+ Open-Weight-Modelle produktionsreif aus EU-Regionen, OpenAI-kompatible API
  • Eigene AI-Factories (310 MW Lappeenranta ab 31.03.2026 committed) statt angemieteter Cloud
  • Kein Vendor-Lock-in: Open-Weight-Modelle jederzeit self-hostbar
  • Nasdaq-gelistete Mutter — CLOUD-Act-Risiko juristisch nicht vollständig ausgeschlossen
  • Kein SecNumCloud/BSI-C5-Nachweis öffentlich belegt (Stand September 2026)
  • Kein proprietäres Frontier-Modell — reines Inferenz-Angebot
Initial: Nebius-Account, EU-Region wählen (FI/FR), Token-Factory-Endpoint oder dedizierte GPU-Kapazität buchen.
Datenstandorte: FI Lappeenranta, FR Paris, NL Amsterdam, US (Konzern)
Anbieter öffnen

Hetzner GPU (GEX)

EU only (DE) · DE

L1

Deutscher Hoster ohne ausländische Mutter: dedizierte GPU-Root-Server der GEX-Reihe mit vollem Root-Zugriff — der Kunde betreibt Modell, Framework (vLLM, SGLang, Ollama) und Daten komplett selbst. Da Hetzner EU-eigen ist und die Gewichte einmalig auf den Server geladen werden, entsteht keine Drittland-Verarbeitungskette: Der Layer-1-CLOUD-Act-Vorbehalt entfällt hier faktisch.

  • Deutscher Anbieter, EU-Recht — kein Drittlandtransfer im KI-Workload
  • Voller Root-Zugriff: beliebige Open Weights (Qwen3, Gemma 4, GLM-5.3-Flash, Mistral)
  • Einstieg ab ~€219/Monat, monatlich kündbar
  • Maximal eine GPU pro Server — keine Multi-GPU-Setups für große Modelle
  • Keine Datacenter-GPUs (H100/H200) im Angebot
  • Keine BSI-C5-Attestierung öffentlich belegt (Stand September 2026)
Initial: GEX-Server im Hetzner-Robot bestellen, eigenes Inference-Setup (vLLM/SGLang/Ollama), Modell-Gewichte lizenzkonform selbst beziehen.
Datenstandorte: DE Nürnberg, DE Falkenstein, FI Helsinki
Anbieter öffnen

Open Telekom Cloud (T-Systems)

EU only (DE) · DE

L1

T-Systems' souveräne Public Cloud aus deutschen Rechenzentren — der Self-Serve-Pfad neben der Industrial AI Cloud. H100-GPUs als buchbare Flavors, voller Kunden-Zugriff auf den Stack, BSI-C5-attestiert. Deutsches Eigentum: Kein US CLOUD Act in der Verarbeitungskette.

  • BSI C5 attestiert — geeignet für KRITIS-nahe und regulierte Workloads
  • H100-Self-Hosting ohne Mindestabnahme, deutsche Regionen
  • Telekom-Eigentum: EU-Jurisdiktion durchgehend
  • Self-Serve bedeutet eigener Betrieb (Kubernetes, vLLM, Monitoring)
  • GPU-Generation H100 — Blackwell nur über die Industrial-AI-Cloud-Schiene
  • Katalog und Quota-Prozesse komplexer als bei Developer-Hostern
Initial: OTC-Tenant anlegen, GPU-Flavor-Quota beantragen, eigenen Inference-Stack betreiben.
Datenstandorte: DE Magdeburg/Biere, NL Amsterdam, CH
Anbieter öffnen

plusserver (pluscloud)

EU only (DE) · DE

L1

Deutscher Cloud-Anbieter in deutscher Eigentümerstruktur mit eigenen Rechenzentren. GPU as a Service auf der pluscloud: dedizierte NVIDIA-Profile, monatlich buchbar, BSI-C5-attestiert. Für Organisationen, die Self-Hosting mit C5-Nachweis brauchen, aber kein Telekom- oder Hyperscaler-Projekt wollen.

  • BSI C5 + deutsche Eigentümer — regulatorisch sauber für Public Sector
  • Monatlich buchbare GPU-Profile statt Projekt-Mindestabnahme
  • Eigene RZs in Deutschland, kein Drittlandbezug
  • GPU-Modelle und Preise nur auf Anfrage — kein Self-Serve-Katalog
  • Kleinerer GPU-Bestand als Hyperscaler oder Nebius
  • Kein SecNumCloud-Äquivalent für FR-Einsätze
Initial: Angebot bei plusserver anfragen, GPU-Profil auf pluscloud buchen, eigenen Modell-Stack deployen.
Datenstandorte: DE (eigene RZs, u. a. Köln)
Anbieter öffnen

Infercom (The Inference Company)

EU only (DE) · LU (Betrieb DE)

L1

Europäischer Sovereign-Inference-Anbieter: eigene SambaNova-Dataflow-Cluster in München, betrieben von einer EU-Rechtsperson (Sitz Luxemburg). OpenAI-kompatible API mit Pay-as-you-go-Token-Abrechnung in EUR — offene Modelle (DeepSeek, Qwen, Llama, MiniMax) ohne GPU-Reservierung oder Server-Management. Laut Anbieter keine CLOUD-Act-Exposition; der US-Bezug beschränkt sich auf den Chipzulieferer.

  • Serverless ohne GPU-Management: Token-Abrechnung in EUR, OpenAI-kompatible API
  • Eigene Hardware in München, EU-Rechtsperson — Betrieb komplett in EU-Hand
  • Dataflow-Hardware (SambaNova SN40L) mit hoher Inferenz-Rate für offene Modelle
  • Juristischer Sitz Luxemburg — deutscher Betrieb, aber keine DE-Rechtsperson
  • Chipzulieferer SambaNova ist US-Unternehmen (Lieferketten-, nicht Datenrisiko)
  • Junges Angebot — kein BSI C5 / SecNumCloud belegt (Stand September 2026)
Initial: API-Key bei Infercom registrieren, OpenAI-kompatiblen Endpoint einbinden, Modell wählen.
Datenstandorte: DE München
Anbieter öffnen

Self-Hosting: Welche Modelle dürfen auf eigener EU-Hardware laufen?

Wer ein Open-Weight-Modell auf gemieteter EU-GPU-Infrastruktur selbst betreibt, tritt unter dem EU AI Act regelmäßig als Betreiber (Deployer, Art. 26) auf — die aufwendigen GPAI-Pflichten verbleiben beim Modellentwickler. Vorsicht gilt, sobald das System unter eigenem Namen Dritten angeboten oder in Zweck und Verhalten substanziell verändert wird (Art. 25): Dann können vollumfängliche Provider-Pflichten entstehen. Datenschutzrechtlich ist die Konstellation besonders stark: Bei einem EU-eigenen Hoster und vollständig kundenkontrolliertem Modell-Stack entfällt jeder Drittlandtransfer. Für KRITIS-nahe Workloads bleiben C5-Attestierung des Hosters und ein dokumentierter AV-Vertrag die entscheidenden Auswahlkriterien.

Qwen3 (0.6B–235B, Coder-Next) Self-hostbar

Lizenz: Apache 2.0

Uneingeschränkt kommerziell nutzbar. Achtung: Qwen3.x-Max ist API-only — keine Gewichte.

Gemma 4 (E2B–31B) Self-hostbar

Lizenz: Apache 2.0

Seit April 2026 Apache 2.0. Ältere Gemma-1–3n bleiben unter den custom Gemma Terms (Prohibited Use Policy).

GLM-5.2 / GLM-5.3-Flash Self-hostbar

Lizenz: MIT

Frei self-hostbar, auch kommerziell.

GLM-5.3 (753B) Mit Auflagen

Lizenz: Custom (Z.ai)

Self-Hosting erlaubt; Hosting-Anbieter ab $10 Mrd. Jahresumsatz brauchen ein Z.ai Security Review — betrifft praktisch keine deutsche Firma.

Mistral Large 3 / Apertus 1.5 Self-hostbar

Lizenz: Apache 2.0

EU-freundlichste Optionen: offene Gewichte, bei Apertus zusätzlich offene Trainingsdaten.

Gemini (3.x) Nicht hostbar

Lizenz: Proprietär

Nicht hostbar — keine Gewichte, nur Google API/Vertex. Für Self-Hosting ist Gemma die offene Google-Linie.

Editorial basiert auf eigener Recherche (Q3 2026, Stand 7. September 2026). Anbieterangaben und Verfügbarkeiten können sich kurzfristig ändern. Quellen: AWS, Microsoft, OVHcloud, Scaleway, Deutsche Telekom, Schwarz Digits, Nebius, BusinessWire.