In der EU gehostetNeu

MiniMax M2.7 API in Europa

Frontier-Reasoning mit 229B Parametern und 428 Token pro Sekunde. Vollständig EU-souverän.

Ausgabe-Durchsatz, p50, 10K Input / 1K Output, einzelner Request. Zuletzt gemessen: Juli 2026. Alle Benchmarks und die Methodik ansehen

Das neueste Frontier-Modell von MiniMax mit 229B Parametern läuft auf der vollständig EU-souveränen Infrastruktur von Infercom in Deutschland. Es sind keine US-Hyperscaler beteiligt, und Ihre Daten sind nicht dem US CLOUD Act ausgesetzt. Dazu kommen native Multi-Agent-Unterstützung und 30% mehr Coding-Leistung als bei der Vorgängergeneration.

Jetzt starten

Neu in M2.7

M2.7 prüft seine Antworten selbst, bevor es sie ausgibt, und liefert so schon im ersten Anlauf bessere Ergebnisse. Außerdem beherrscht es die Orchestrierung mehrerer Agenten als Kernfähigkeit.

Eingebaute Selbstkritik

Neu in M2.7: Das Modell prüft und verbessert seine Ausgabe automatisch, bevor es antwortet. Bei komplexen Coding- und Reasoning-Aufgaben stimmt das Ergebnis damit öfter schon beim ersten Versuch.

Native Agent Teams

Neu in M2.7: Die Zusammenarbeit mehrerer Agenten ist eine Kernfähigkeit des Modells und nicht nur eine Frage des Promptings. Stabile Rollengrenzen, gegenseitiges Hinterfragen der Agenten und klar unterscheidbares Verhalten der Rollen sind eingebaut.

Verbessert: Software Engineering

56,22% auf SWE-Pro (gleichauf mit GPT-5.3-Codex), 55,6% auf VIBE-Pro für die Umsetzung kompletter Projekte und 57,0% auf Terminal Bench 2 für das Verständnis komplexer Systeme.

Verbessert: professionelle Skills

97% Skill-Compliance über mehr als 40 komplexe professionelle Skills. Bessere Bearbeitung von Excel, PowerPoint und Word, auch über mehrere Überarbeitungsrunden.

EU-souverän München, Deutschland

Gemessen auf der EU-Infrastruktur von Infercom

Ausgabe-Durchsatz

428tok/s

Time to First Token

690ms

Kontextfenster

192K Token

Serverseitig p50, 10K Input / 1K Output, einzelner Request

Bis zu 444 tok/s bei kürzeren Prompts. Zuletzt gemessen: Juli 2026.

Alle Benchmarks und die Methodik ansehen

30%

Mehr Coding-Leistung als die Vorgängergeneration

Warum wir es Ultraspeed nennen

Benchmark-Ergebnisse auf Frontier-Niveau

M2.7 erzielt Spitzenwerte in Coding-, Engineering- und ML-Benchmarks. Auf SWE-Pro liegt es gleichauf mit GPT-5.3-Codex oder darüber.

56.22%

SWE-Pro

Gleichauf mit GPT-5.3-Codex

76.5%

SWE Multilingual

Software Engineering in der Praxis

55.6%

VIBE-Pro

Nahe am Niveau von Opus 4.6

57.0%

Terminal Bench 2

Tiefes Systemverständnis

66.6%

MLE Bench Lite

Medaillenrate (9 Gold, 5 Silber)

52.7%

Multi SWE Bench

Komplexe Codebasen

Gebaut für agentische Workflows

M2.7 ist stark bei langen Agenten-Aufgaben, die eigenständige Entscheidungen, den Einsatz von Tools und mehrstufiges Reasoning in komplexen Fachgebieten verlangen.

  • Finanz-Workflows

    Recherche von Anfang bis Ende, Excel-Modelle, Berichte

  • SRE & DevOps

    Log-Analyse, Incident Response, Debugging in der Produktion

  • Dokumentenverarbeitung

    Word, Excel und PowerPoint mit mehreren Überarbeitungsrunden

  • ML-Wettbewerbe

    66,6% Medaillenrate auf MLE Bench Lite (9 Gold, 5 Silber)

Agentic Coding

56,22% auf SWE-Pro

Gleichauf mit GPT-5.3-Codex im anspruchsvollsten Benchmark für Software Engineering. Funktioniert mit Aider, OpenCode, Cline, Cursor, Continue, Goose, Windsurf und Claude Code.

Agentic Coding einrichten

Multi-Agent-Teams

Native Agenten-Orchestrierung

Die Zusammenarbeit mehrerer Agenten ist direkt im Modell verankert. Die Identität bleibt über Rollen hinweg stabil, die emotionale Intelligenz ist verbessert, und das kausale Reasoning trägt auch Entscheidungen in der Produktion.

Preise

Betreiben Sie ein Frontier-Modell mit 229B Parametern, transparent nach Nutzung abgerechnet.

ModellInput (pro 1M)Output (pro 1M)Kontext
MiniMax M2.7 Ultraspeed€0,60€2,40192K

Preise in EUR zzgl. MwSt. EU-souveräner Betrieb, vollständig DSGVO-konform.

Warum EU-Hosting zählt

Wenn Sie MiniMax über Infercom nutzen, bleiben Ihre Requests unter EU-Jurisdiktion:

  • Ihre Daten werden ausschließlich in Deutschland verarbeitet und verlassen nie die EU-Jurisdiktion
  • Nicht dem US CLOUD Act ausgesetzt, kein amerikanischer Hyperscaler beteiligt
  • Vollständig DSGVO-konform, mit Auftragsverarbeitungsvertrag nach EU-Recht
  • Nach ISO 27001 zertifizierte Infrastruktur im Besitz und Betrieb von Infercom
  • Keine dauerhafte Speicherung, und wir trainieren nie mit Ihren Daten
  • ISO 27001 zertifiziert
  • DSGVO-konform
  • Rechenzentrum in Deutschland
  • Eigene Hardware von Infercom

In wenigen Minuten loslegen

OpenAI-kompatible API: Sie ersetzen nur den Endpoint, Ihr bestehender Code bleibt, wie er ist. Verwenden Sie in Ihren API-Aufrufen den Modellnamen MiniMax M2.7 Ultraspeed.

Sie zahlen nur für die Token, die Sie nutzen.

quickstart.py
from openai import OpenAI

client = OpenAI(
    api_key="your-infercom-key",
    base_url="https://api.infercom.ai/v1"
)

response = client.chat.completions.create(
    model="MiniMax-M2.7",
    messages=[{"role": "user", "content": "Your prompt here"}],
    max_tokens=4096
)

print(response.choices[0].message.content)

MiniMax M2.7: häufige Fragen

Wie schnell ist MiniMax M2.7 bei Infercom?

428 Token pro Sekunde Ausgabe-Durchsatz und 690ms Time to First Token, beides serverseitig als p50 gemessen, bei 10K Input und 1K Output auf unserer Produktions-API in München. Mit kürzeren Prompts sind bis zu 444 tok/s möglich. Für ein Frontier-Reasoning-Modell mit 229B Parametern ist das bis zu 10x schneller als GPU-basierte Alternativen. Jeden Wert können Sie mit unserem Open-Source-Benchmark-Tool nachmessen.

Alle Benchmarks ansehen

Wie groß ist das Kontextfenster von MiniMax M2.7?

192K Token (196.608), die sich Ihr Prompt und die Antwort des Modells teilen. Das reicht für lange Agenten-Läufe, Codeänderungen über viele Dateien und Dokumentensammlungen, die man sonst auf mehrere Requests verteilen müsste.

Was ein Kontextfenster ist

Ist MiniMax M2.7 ein Open-Weight-Modell?

Ja. MiniMax veröffentlicht die Gewichte von M2.7 offen auf Hugging Face. Sie können das Modell über unsere API sofort in Produktion nehmen. Und weil die Gewichte offen sind, sind Sie nie an einen einzelnen Anbieter gebunden.

Was ein Open-Weight-Modell ist

Kann ich MiniMax M2.7 in der EU betreiben?

Ja. Infercom betreibt M2.7 auf eigener Hardware in einem Tier-III+-Rechenzentrum in München. Requests werden innerhalb der EU-Jurisdiktion verarbeitet und sind nicht dem US CLOUD Act ausgesetzt. Die Infrastruktur ist nach ISO 27001 zertifiziert, und ein Auftragsverarbeitungsvertrag nach EU-Recht ist auf Anfrage erhältlich. Wir trainieren nicht mit Ihren Daten.

So funktioniert EU-Souveränität bei uns

Was kostet MiniMax M2.7?

Sie zahlen pro Token, ohne Mindestumsatz und ohne monatliche Bindung: €0,60 pro Million Input-Token und €2,40 pro Million Output-Token (zzgl. MwSt.). Abgerechnet wird nur, was Sie nutzen. Verbrauch und Kosten sehen Sie live im Cloud-Portal.

Alle Preise ansehen

Bereit, die Zukunft der KI in Europa zu gestalten?

Schließen Sie sich Unternehmen an, die souveräne KI mit erstklassiger Performance einsetzen