OpenAI-kompatibel

MiniMax API

MiniMax-Modelle über einen OpenAI-kompatiblen Endpoint. Drop-in-Ersatz: Sie ändern nur die Base-URL.

Base URL
https://api.infercom.ai/v1

MiniMax-Modelle sind auf Infercom vollständig OpenAI-kompatibel. Nutzen Sie die Base-URL api.infercom.ai/v1 mit Ihrem bestehenden OpenAI SDK, ohne weitere Änderungen am Code. MiniMax-M2.7 Ultraspeed läuft mit über 400 Token pro Sekunde, gehostet in München und vollständig DSGVO-konform.

Verfügbare Modelle

Alle MiniMax-Modelle auf Infercom. Verwenden Sie die Modell-ID in Ihren API-Requests.

ModellModell-IDParameterKontextGeschwindigkeitIdeal für
MiniMax-M2.7 UltraspeedMiniMax-M2.7229B MoE192K Token428 tok/sSelbstkritik, Multi-Agent, Agentic Coding

Ausgabe-Durchsatz, p50, 10K Input / 1K Output, einzelner Request. Zuletzt gemessen: Juli 2026.

Modell-IDs unterscheiden Groß- und Kleinschreibung. Verwenden Sie sie genau wie angegeben.

Schnellstart

Funktioniert mit jedem OpenAI-kompatiblen SDK. Sie müssen nur auf unseren Endpoint zeigen.

Die Integration hat drei Schritte. Erstens registrieren Sie sich auf cloud.infercom.ai und erhalten Ihren API-Key. Zweitens ändern Sie die Base-URL von api.openai.com auf api.infercom.ai/v1. Drittens setzen Sie das Modell auf MiniMax-M2.7. Ihr bestehender Code, Ihre Prompts und Ihre Tools funktionieren unverändert.

Python
from openai import OpenAI

client = OpenAI(
    base_url="https://api.infercom.ai/v1",
    api_key="your-api-key"
)

response = client.chat.completions.create(
    model="MiniMax-M2.7",
    messages=[{"role": "user", "content": "Hello"}],
    stream=True
)

for chunk in response:
    print(chunk.choices[0].delta.content, end="")
JavaScript
import OpenAI from 'openai';

const client = new OpenAI({
  baseURL: 'https://api.infercom.ai/v1',
  apiKey: 'your-api-key',
});

const response = await client.chat.completions.create({
  model: 'MiniMax-M2.7',
  messages: [{ role: 'user', content: 'Hello' }],
});

console.log(response.choices[0].message.content);
curl
curl https://api.infercom.ai/v1/chat/completions \
  -H "Authorization: Bearer your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "MiniMax-M2.7",
    "messages": [{"role": "user", "content": "Hello"}],
    "stream": true
  }'
LangChain
from langchain_openai import ChatOpenAI

llm = ChatOpenAI(
    base_url="https://api.infercom.ai/v1",
    api_key="your-api-key",
    model="MiniMax-M2.7"
)

response = llm.invoke("Explain quantum computing")
print(response.content)

Unterstützte Endpoints

  • POST /v1/chat/completions

    OpenAI Chat Completions (mit Streaming)

  • POST /v1/messages

    Anthropic Messages API

  • POST /v1/responses

    OpenAI Responses API

  • GET /v1/models

    Verfügbare Modelle auflisten

Warum MiniMax auf Infercom

In der EU gehostet

Rechenzentrum in München, vollständig DSGVO-konform und nicht dem US CLOUD Act ausgesetzt.

Bis zu 10x schneller

Die Dataflow-Architektur von SambaNova liefert Inferenz in Weltrekord-Geschwindigkeit.

Keine dauerhafte Speicherung

Ihre Prompts und Ausgaben werden nie dauerhaft gespeichert oder für Training verwendet.

Drop-in-kompatibel

Funktioniert mit dem OpenAI SDK, dem Anthropic SDK, LangChain, LlamaIndex und jedem OpenAI-kompatiblen Tool.

Häufig gestellte Fragen

Ist die MiniMax API mit OpenAI kompatibel?

Ja, MiniMax-Modelle sind auf Infercom vollständig OpenAI-kompatibel. Nutzen Sie die Base-URL api.infercom.ai/v1 mit Ihrem bestehenden OpenAI SDK, mit LangChain, LlamaIndex oder jedem OpenAI-kompatiblen Tool. Außer der Base-URL müssen Sie nichts am Code ändern.

Wie lautet die Base-URL der MiniMax API?

Die Base-URL ist https://api.infercom.ai/v1. Setzen Sie sie im OpenAI SDK als base_url oder in JavaScript als baseURL. Unterstützte Endpoints: /chat/completions (OpenAI), /messages (Anthropic), /responses (OpenAI Responses API) und /models.

Kann ich LangChain mit MiniMax nutzen?

Ja, verwenden Sie ChatOpenAI aus langchain_openai mit base_url='https://api.infercom.ai/v1' und model='MiniMax-M2.7'. LlamaIndex, CrewAI und andere Frameworks mit OpenAI-Unterstützung funktionieren ebenfalls.

Was ist MiniMax M2.7 Ultraspeed?

MiniMax M2.7 Ultraspeed ist ein MoE-Modell mit 229B Parametern (10B aktiv), eingebauter Selbstkritik, nativer Multi-Agent-Unterstützung und einem Kontextfenster von 192K. Es läuft mit über 400 Token pro Sekunde auf der EU-Infrastruktur von Infercom und ist unser Flaggschiff für Agentic Coding und mehrstufiges Reasoning.

Ist die MiniMax API DSGVO-konform?

Ja, MiniMax-Modelle laufen auf Infercom auf Infrastruktur in München. Sie sind vollständig DSGVO-konform und arbeiten ohne dauerhafte Speicherung: Prompts und Ausgaben werden nie dauerhaft gespeichert oder für Training verwendet. Die Verarbeitung ist nicht dem US CLOUD Act ausgesetzt.

MiniMax noch heute nutzen

Ihr API-Key in 30 Sekunden. Sie zahlen nur die Token, die Sie nutzen.