EU-souveräne KI-Inferenz

EU-souveräne KI-Inferenz. Jede Abhängigkeit benannt.

Schnelle Open-Weight-Modelle auf Hardware, die uns gehört, in München. Wir zeigen Ihnen, wo Ihre Daten laufen, wer was betreibt und welches Recht gilt - auch das, was noch nicht europäisch ist.

  • Inferenz in München
  • Luxemburger Unternehmen, keine US-Muttergesellschaft
  • Nach ISO 27001 zertifiziert
  • Bis zu 10x schneller als GPUs

Die kurze Antwort

Drei Fragen, zuerst beantwortet

Wo werden meine Daten verarbeitet?

Bei EU-souveränen Modellen in unserem Rechenzentrum in München. Prompts und Ausgaben werden nie auf eine Festplatte geschrieben.

Wer kann darauf zugreifen?

Infercom ist ein Luxemburger Unternehmen, kontrolliert in Europa. Unser US-Betriebspartner SambaNova hat Fernzugriff, um die Plattform zu betreiben. Der AVV nennt ihn.

Kann ich wieder wechseln?

Ja. Open-Weight-Modelle und eine OpenAI-kompatible API: Sie können dasselbe Modell woanders oder selbst betreiben.

Alle Dokumente im Trust Center

Compliance und Souveränität

Viele Anbieter sind DSGVO-konform. Weniger sind souverän.

Was Souveränität schützt

  • KontrolleSie entscheiden, was mit Ihren Daten und Workloads passiert, nicht jemand, den Sie weder sehen noch überstimmen können.
  • TransparenzSie wissen, wohin Ihre Daten gehen und wer sie berühren kann. Was Sie nicht sehen, können Sie nicht kontrollieren.
  • KontinuitätSie arbeiten weiter, wenn sich ein Lieferant, ein Modell oder ein Gesetz ändert, weil Sie ersetzen können, was wegfällt.

Keine US-Muttergesellschaft

Der CLOUD Act erreicht Unternehmen unter US-Recht. Infercom ist ein Luxemburger Unternehmen, kontrolliert in Europa, ohne US-Muttergesellschaft. Unser Betriebspartner SambaNova ist ein US-Unternehmen. Seinen Fernzugriff legt unser AVV offen.

AI Act

Wir unterstützen Ihre Arbeit am AI Act: welches Modell läuft, wo es läuft und zu welchen Bedingungen, dokumentiert im AVV und auf den Modellseiten.

Sechs Dimensionen

Wo wir stehen, Dimension für Dimension

Souveränität ist kein Siegel. Sie besteht aus sechs Fragen, jede mit ihrer eigenen Antwort. Hier sind unsere, einschließlich dessen, was noch nicht europäisch ist.

Daten

Was Sie bekommen
EU-souveräne Modelle laufen in unserem Rechenzentrum in München. Prompts und Ausgaben werden nie auf eine Festplatte geschrieben.
Noch nicht europäisch
Modelle aus dem Globalen Katalog laufen außerhalb der EU und sind entsprechend gekennzeichnet.
Was wir dagegen tun
Sie wählen pro Modell. Der AVV regelt die Bedingungen.

Betrieb

Was Sie bekommen
Unsere eigenen Racks, unser Vertrag mit Ihnen, nach ISO 27001 zertifiziert.
Noch nicht europäisch
SambaNova, ein US-Unternehmen, betreibt den Software-Stack mit Fernzugriff.
Was wir dagegen tun
Im AVV offengelegt. Mit On-Premises liegt der Betrieb in Ihrer Hand.

Hardware

Was Sie bekommen
Unsere eigene Hardware, keine gemietete Cloud-Kapazität.
Noch nicht europäisch
Die Chips kommen von SambaNova (USA). Jeder KI-Chip, der in Europa eingesetzt wird, ist außerhalb der EU entwickelt.
Was wir dagegen tun
Wir wählen die Hardware je nach Workload. Die API bleibt gleich, wenn sich die Hardware ändert.

Modelle

Was Sie bekommen
Open-Weight-Modelle, die Sie prüfen, mitnehmen oder selbst betreiben können.
Noch nicht europäisch
Die meisten führenden Open-Weight-Modelle kommen aus China und den USA.
Was wir dagegen tun
Sie wählen das Modell und seine Herkunft. Nichts bindet Sie.

Recht

Was Sie bekommen
Ein Luxemburger Unternehmen, kontrolliert in Europa, ohne US-Muttergesellschaft.
Was wir dagegen tun
Die vollständige Kontrollkette legen wir auf Anfrage offen.

Wirtschaft

Was Sie bekommen
Ihre Ausgaben gehen an ein europäisches Unternehmen.

Modelle

Welche Modelle wo laufen

Sie wählen den Standort pro Request, über die Modell-ID. EU-souveräne Modelle laufen in unserem Rechenzentrum in München. Modelle aus dem Globalen Katalog werden außerhalb der EU verarbeitet, in einer Region, die wir nicht kontrollieren.

Welche Modelle wo laufen
ModellTypWo es läuft
MiniMax M2.7 UltraspeedTextMünchen (EU-souverän)
Gemma 4 31BText + visionMünchen (EU-souverän)
gpt-oss-120bTextMünchen (EU-souverän)
Whisper Large v3Speech-to-textMünchen (EU-souverän)
E5-Mistral 7BEmbeddingsMünchen (EU-souverän)
Llama 3.3 70BTextAußerhalb der EU (Globaler Katalog)
DeepSeek V3.1TextAußerhalb der EU (Globaler Katalog)
DeepSeek V3.2TextAußerhalb der EU (Globaler Katalog)

Performance

Souveränität, ohne auf Geschwindigkeit zu verzichten

Chips, entwickelt für KI, halten die Arbeitsdaten des Modells direkt bei der Rechenlogik. Deshalb kommen Antworten bis zu 10x schneller als bei Inferenz auf GPUs. SambaNova gibt eine bis zu 5x bessere Energieeffizienz als bei einer GPU an.

428Output-Token/s · MiniMax M2.7 Ultraspeed
713Output-Token/s · gpt-oss-120b

Gemessen auf unserer Produktions-API: 10K Input- und 1K Output-Token, ein Request nach dem anderen, Juli 2026.

Wer darauf baut

Europäische Router und Plattformen, die sich für uns entschieden haben

Router, Plattformen und Lösungsanbieter in ganz Europa verarbeiten die Requests ihrer Kunden auf Infercom.

Router und Gateways

  • Cortecs
  • EUrouter
  • Kontinent
  • LLMrouter.eu
  • Melious
  • Noirdoc
  • Opper

Plattformen

  • Coform AI
  • Midio
  • Skymod

Lösungen

  • ABACUS
  • BasePeak
  • Beyond-Bot
  • co-mind.ai
  • DeepMask
  • Heidelbot
  • Neur-X
  • Profound Vision

Alle Partner

Ihr Weg

Drei Wege, Infercom zu nutzen

Dieselbe API und dieselben Modelle, drei Stufen der Kontrolle. Die richtige Wahl hängt davon ab, wie viel vom Stack Sie selbst besitzen wollen.

Drei Wege, Infercom zu nutzen
Inference APIDedicated CapacityOn-Premises
KontrolleAPI nutzenReservierte HardwareDen Stack besitzen
StandortUnser Rechenzentrum in MünchenUnser Rechenzentrum in MünchenIhr Rechenzentrum
BetriebInfercom betreibtInfercom betreibtIhr Team betreibt
MandantenGeteilt (Multi-Tenant)Single-Tenant-RackVollständig isoliert
AbrechnungPro TokenMonatlichHardware und Support
Eigene Fine-Tuned-Modelle-JaJa
Air-Gap möglich--Ja
Individuelle SLAs-Ja-
Zeit bis zum ersten AufrufMinutenEtwa 2 WochenEtwa 90 Tage

Inference API

Teams, die sofort starten und pro Token zahlen wollen.

Jetzt starten

Dedicated Capacity

Produktive Workloads, die garantierte Kapazität, eigene Fine-Tuned-Modelle und individuelle SLAs brauchen.

Über Dedicated sprechen

On-Premises

Regulierte Umgebungen oder Air-Gap-Umgebungen, die die Hardware selbst besitzen und betreiben müssen.

Über On-Premises sprechen

FAQ

Die schwierigen Fragen

Ihre Chips sind amerikanisch. Wie ist das souverän?

Jeder KI-Chip, der in Europa eingesetzt wird, ist außerhalb der EU entwickelt. Über die Kontrolle entscheidet, wem die Hardware gehört, wer sie betreibt und welches Recht für den Betreiber gilt. Die Racks gehören uns, und wir wählen die Hardware je nach Workload.

Sie betreiben chinesische Modelle. Wie ist das souverän?

Open-Weight-Modelle auf unserer Hardware in München zu betreiben heißt nicht, chinesische Software oder Infrastruktur zu betreiben. Nichts geht an den Hersteller des Modells. Sie wählen das Modell und können jederzeit wechseln.

Wem gehört Infercom, und wer kontrolliert es?

Infercom SCS ist eine Luxemburger Kommanditgesellschaft, geführt und kontrolliert in Europa, ohne US-Muttergesellschaft. Investoren halten wirtschaftliche Anteile ohne Geschäftsführungsrechte. Die vollständige Kontrollkette legen wir auf Anfrage offen.

Was, wenn die USA den Export von KI-Chips stoppen?

Mit Open-Weight-Modellen bleiben Sie beweglich: Sie können dasselbe Modell woanders oder selbst betreiben. Wir planen mit mehr als einem Hardware-Lieferanten.

Geht irgendetwas in die USA?

Bei EU-souveränen Modellen werden Requests in München verarbeitet, und nichts wird auf einer Festplatte gespeichert. SambaNova, unser US-Betriebspartner, hat Fernzugriff, um die Plattform zu betreiben. Der AVV legt das offen. Modelle aus dem Globalen Katalog laufen außerhalb der EU und sind gekennzeichnet.

Reicht DSGVO-Konformität nicht aus?

Die DSGVO regelt die Verarbeitung personenbezogener Daten. Sie verhindert nicht, dass ein ausländisches Gesetz einen Anbieter erreicht, der dem Recht dieses Landes unterliegt. Das entscheidet sich daran, wer den Anbieter kontrolliert, nicht daran, wo die Server stehen.

Sprechen Sie mit Menschen, die Ihr Deployment kennen

Ein europäisches Team, das Sie direkt erreichen, ohne Ticket-Warteschlange.