MiniMax M2.7 API in Europa
Frontier-Reasoning mit 229B Parametern und 428 Token pro Sekunde. Vollständig EU-souverän.
Ausgabe-Durchsatz, p50, 10K Input / 1K Output, einzelner Request. Zuletzt gemessen: Juli 2026. Alle Benchmarks und die Methodik ansehen
Das neueste Frontier-Modell von MiniMax mit 229B Parametern läuft auf der vollständig EU-souveränen Infrastruktur von Infercom in Deutschland. Es sind keine US-Hyperscaler beteiligt, und Ihre Daten sind nicht dem US CLOUD Act ausgesetzt. Dazu kommen native Multi-Agent-Unterstützung und 30% mehr Coding-Leistung als bei der Vorgängergeneration.
Jetzt startenNeu in M2.7
M2.7 prüft seine Antworten selbst, bevor es sie ausgibt, und liefert so schon im ersten Anlauf bessere Ergebnisse. Außerdem beherrscht es die Orchestrierung mehrerer Agenten als Kernfähigkeit.
Eingebaute Selbstkritik
Neu in M2.7: Das Modell prüft und verbessert seine Ausgabe automatisch, bevor es antwortet. Bei komplexen Coding- und Reasoning-Aufgaben stimmt das Ergebnis damit öfter schon beim ersten Versuch.
Native Agent Teams
Neu in M2.7: Die Zusammenarbeit mehrerer Agenten ist eine Kernfähigkeit des Modells und nicht nur eine Frage des Promptings. Stabile Rollengrenzen, gegenseitiges Hinterfragen der Agenten und klar unterscheidbares Verhalten der Rollen sind eingebaut.
Verbessert: Software Engineering
56,22% auf SWE-Pro (gleichauf mit GPT-5.3-Codex), 55,6% auf VIBE-Pro für die Umsetzung kompletter Projekte und 57,0% auf Terminal Bench 2 für das Verständnis komplexer Systeme.
Verbessert: professionelle Skills
97% Skill-Compliance über mehr als 40 komplexe professionelle Skills. Bessere Bearbeitung von Excel, PowerPoint und Word, auch über mehrere Überarbeitungsrunden.
Gemessen auf der EU-Infrastruktur von Infercom
Ausgabe-Durchsatz
Time to First Token
Kontextfenster
192K Token
Serverseitig p50, 10K Input / 1K Output, einzelner Request
Bis zu 444 tok/s bei kürzeren Prompts. Zuletzt gemessen: Juli 2026.
Alle gemessenen Benchmarks ansehen Offizielle Ankündigung lesen
Benchmark-Ergebnisse auf Frontier-Niveau
M2.7 erzielt Spitzenwerte in Coding-, Engineering- und ML-Benchmarks. Auf SWE-Pro liegt es gleichauf mit GPT-5.3-Codex oder darüber.
56.22%
SWE-Pro
Gleichauf mit GPT-5.3-Codex
76.5%
SWE Multilingual
Software Engineering in der Praxis
55.6%
VIBE-Pro
Nahe am Niveau von Opus 4.6
57.0%
Terminal Bench 2
Tiefes Systemverständnis
66.6%
MLE Bench Lite
Medaillenrate (9 Gold, 5 Silber)
52.7%
Multi SWE Bench
Komplexe Codebasen
Gebaut für agentische Workflows
M2.7 ist stark bei langen Agenten-Aufgaben, die eigenständige Entscheidungen, den Einsatz von Tools und mehrstufiges Reasoning in komplexen Fachgebieten verlangen.
-
Finanz-Workflows
Recherche von Anfang bis Ende, Excel-Modelle, Berichte
-
SRE & DevOps
Log-Analyse, Incident Response, Debugging in der Produktion
-
Dokumentenverarbeitung
Word, Excel und PowerPoint mit mehreren Überarbeitungsrunden
-
ML-Wettbewerbe
66,6% Medaillenrate auf MLE Bench Lite (9 Gold, 5 Silber)
Agentic Coding
56,22% auf SWE-Pro
Gleichauf mit GPT-5.3-Codex im anspruchsvollsten Benchmark für Software Engineering. Funktioniert mit Aider, OpenCode, Cline, Cursor, Continue, Goose, Windsurf und Claude Code.
Multi-Agent-Teams
Native Agenten-Orchestrierung
Die Zusammenarbeit mehrerer Agenten ist direkt im Modell verankert. Die Identität bleibt über Rollen hinweg stabil, die emotionale Intelligenz ist verbessert, und das kausale Reasoning trägt auch Entscheidungen in der Produktion.
Preise
Betreiben Sie ein Frontier-Modell mit 229B Parametern, transparent nach Nutzung abgerechnet.
| Modell | Input (pro 1M) | Output (pro 1M) | Kontext |
|---|---|---|---|
| MiniMax M2.7 Ultraspeed | €0,60 | €2,40 | 192K |
Preise in EUR zzgl. MwSt. EU-souveräner Betrieb, vollständig DSGVO-konform.
Warum EU-Hosting zählt
Wenn Sie MiniMax über Infercom nutzen, bleiben Ihre Requests unter EU-Jurisdiktion:
- Ihre Daten werden ausschließlich in Deutschland verarbeitet und verlassen nie die EU-Jurisdiktion
- Nicht dem US CLOUD Act ausgesetzt, kein amerikanischer Hyperscaler beteiligt
- Vollständig DSGVO-konform, mit Auftragsverarbeitungsvertrag nach EU-Recht
- Nach ISO 27001 zertifizierte Infrastruktur im Besitz und Betrieb von Infercom
- Keine dauerhafte Speicherung, und wir trainieren nie mit Ihren Daten
- ISO 27001 zertifiziert
- DSGVO-konform
- Rechenzentrum in Deutschland
- Eigene Hardware von Infercom
In wenigen Minuten loslegen
OpenAI-kompatible API: Sie ersetzen nur den Endpoint, Ihr bestehender Code bleibt, wie er ist. Verwenden Sie in Ihren API-Aufrufen den Modellnamen MiniMax M2.7 Ultraspeed.
Sie zahlen nur für die Token, die Sie nutzen.
from openai import OpenAI
client = OpenAI(
api_key="your-infercom-key",
base_url="https://api.infercom.ai/v1"
)
response = client.chat.completions.create(
model="MiniMax-M2.7",
messages=[{"role": "user", "content": "Your prompt here"}],
max_tokens=4096
)
print(response.choices[0].message.content)MiniMax M2.7: häufige Fragen
Wie schnell ist MiniMax M2.7 bei Infercom?
428 Token pro Sekunde Ausgabe-Durchsatz und 690ms Time to First Token, beides serverseitig als p50 gemessen, bei 10K Input und 1K Output auf unserer Produktions-API in München. Mit kürzeren Prompts sind bis zu 444 tok/s möglich. Für ein Frontier-Reasoning-Modell mit 229B Parametern ist das bis zu 10x schneller als GPU-basierte Alternativen. Jeden Wert können Sie mit unserem Open-Source-Benchmark-Tool nachmessen.
Wie groß ist das Kontextfenster von MiniMax M2.7?
192K Token (196.608), die sich Ihr Prompt und die Antwort des Modells teilen. Das reicht für lange Agenten-Läufe, Codeänderungen über viele Dateien und Dokumentensammlungen, die man sonst auf mehrere Requests verteilen müsste.
Ist MiniMax M2.7 ein Open-Weight-Modell?
Ja. MiniMax veröffentlicht die Gewichte von M2.7 offen auf Hugging Face. Sie können das Modell über unsere API sofort in Produktion nehmen. Und weil die Gewichte offen sind, sind Sie nie an einen einzelnen Anbieter gebunden.
Kann ich MiniMax M2.7 in der EU betreiben?
Ja. Infercom betreibt M2.7 auf eigener Hardware in einem Tier-III+-Rechenzentrum in München. Requests werden innerhalb der EU-Jurisdiktion verarbeitet und sind nicht dem US CLOUD Act ausgesetzt. Die Infrastruktur ist nach ISO 27001 zertifiziert, und ein Auftragsverarbeitungsvertrag nach EU-Recht ist auf Anfrage erhältlich. Wir trainieren nicht mit Ihren Daten.
Was kostet MiniMax M2.7?
Sie zahlen pro Token, ohne Mindestumsatz und ohne monatliche Bindung: €0,60 pro Million Input-Token und €2,40 pro Million Output-Token (zzgl. MwSt.). Abgerechnet wird nur, was Sie nutzen. Verbrauch und Kosten sehen Sie live im Cloud-Portal.
Mehr erfahren
- Anleitung zur API-Einrichtung Base URL, Modell-IDs und Codebeispiele
- Performance-Benchmarks So schnell läuft MiniMax M2.7 Ultraspeed auf unserer EU-Infrastruktur
- Anleitung für Agentic Coding Aider, OpenCode und Cursor mit MiniMax einrichten
- gpt-oss-120b Wenn reiner Durchsatz wichtiger ist als Frontier-Reasoning
- EU-souveräne KI Wo Ihre Daten liegen und wer darauf zugreifen kann
- Preise Transparente Preise pro Token