Compatibilità API

API compatibile OpenAI. Zero modifiche al codice.

Passa da OpenAI o Anthropic in pochi minuti. Stessi SDK, stesso codice e un'inferenza fino a 10x più veloce su infrastruttura sovrana UE.

Il passaggio in 5 minuti

Cambi una riga di codice, tutto il resto resta com'è.

01

Registrati e ottieni la chiave API

Crea il tuo account su cloud.infercom.ai.

02

Cambia la base URL

Punta il tuo SDK OpenAI o Anthropic esistente su api.infercom.ai

03

Scegli il modello

Usa MiniMax M2.7 Ultraspeed (modello di punta), gpt-oss-120b (il più veloce) o un altro modello del nostro catalogo.

OpenAI SDK
from openai import OpenAI

client = OpenAI(
    base_url="https://api.infercom.ai/v1",
    api_key="your-api-key"
)

response = client.chat.completions.create(
    model="MiniMax-M2.7",
    messages=[{"role": "user", "content": "Hello"}],
    stream=True
)

for chunk in response:
    print(chunk.choices[0].delta.content, end="")
Responses API
from openai import OpenAI

client = OpenAI(
    base_url="https://api.infercom.ai/v1",
    api_key="your-api-key"
)

# Responses API - built for agentic workflows
response = client.responses.create(
    model="MiniMax-M2.7",
    input="Hello",
    reasoning={"effort": "high"}
)

print(response.output_text)
Anthropic SDK
from anthropic import Anthropic

client = Anthropic(
    base_url="https://api.infercom.ai",
    api_key="your-api-key"
)

response = client.messages.create(
    model="MiniMax-M2.7",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Hello"}]
)

print(response.content[0].text)
curl
curl https://api.infercom.ai/v1/chat/completions \
  -H "Authorization: Bearer your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "MiniMax-M2.7",
    "messages": [{"role": "user", "content": "Hello"}],
    "stream": true
  }'

Scegli il tuo SDK

Piena compatibilità con le librerie client di OpenAI e Anthropic

OpenAI SDK

Compatibile con l'SDK OpenAI

Sostituto drop-in di OpenAI. Funziona con il tuo codice, i tuoi strumenti e i tuoi framework.

  • Chat Completions e Responses API
  • Funziona con LangChain, LlamaIndex, CrewAI
  • Python, JavaScript, TypeScript, REST
  • Streaming, function calling, modalità JSON

Vedi la documentazione sulla compatibilità OpenAI

Anthropic SDK

Anthropic Messages API

Usa direttamente l'SDK Anthropic. Stesso formato della Messages API, ospitato nell'UE.

  • Endpoint standard /v1/messages
  • Funziona con il codice Anthropic esistente
  • Tool use con MiniMax e gpt-oss-120b
  • Stessa autenticazione

Vision, extended thinking e prompt caching non sono attualmente supportati.

Vedi la documentazione sulla compatibilità Anthropic

Guide per i singoli modelli

Istruzioni di configurazione dettagliate per modelli specifici

MiniMax APIModelli M2.7 tramite l'SDK OpenAI

Altri esempi

Funziona con i tuoi linguaggi e framework preferiti

JavaScript / TypeScript
import OpenAI from 'openai';

const client = new OpenAI({
  baseURL: 'https://api.infercom.ai/v1',
  apiKey: 'your-api-key',
});

const response = await client.chat.completions.create({
  model: 'MiniMax-M2.7',
  messages: [{ role: 'user', content: 'Hello' }],
});

console.log(response.choices[0].message.content);
LangChain
from langchain_openai import ChatOpenAI

llm = ChatOpenAI(
    base_url="https://api.infercom.ai/v1",
    api_key="your-api-key",
    model="MiniMax-M2.7"
)

response = llm.invoke("Explain quantum computing")
print(response.content)

Vedi la guida rapida completa

Più veloce delle alternative

L'architettura dataflow di SambaNova offre un'inferenza fino a 10x più veloce rispetto ai provider basati su GPU.

428tok/s · MiniMax M2.7
713tok/s · gpt-oss-120b
Fino a 10xpiù veloce dell'inferenza su GPU

Throughput di output, p50, 10K input / 1K output, singola richiesta. Ultima misurazione: luglio 2026.

Vedi i benchmark delle prestazioni

Endpoint supportati

  • /v1/chat/completions

    Chat completions con streaming

  • /v1/responses

    Responses API per workflow agentici - tool, ragionamento, streaming

  • /v1/messages

    Formato Anthropic Messages API

  • /v1/models

    Elenca i modelli disponibili e i metadati

  • /v1/embeddings

    Embedding di testo (modelli selezionati)

Riferimento API completo

Sovranità UE inclusa

API compatibile OpenAI, giurisdizione europea.

  • I modelli sovrani UE vengono eseguiti in Germania (Equinix MU4)
  • Nessuna esposizione al US CLOUD Act
  • Conforme al GDPR, certificazione ISO 27001
  • Nessuna archiviazione persistente di prompt e output

Scopri la sovranità UE

ISO 27001Certificato
GDPRConforme
AI ActPronta
Tier III+Datacenter

Vuoi costruire il futuro dell'AI in Europa?

Unisciti alle organizzazioni che usano l'AI sovrana con prestazioni di altissimo livello