Ospitato nell'UENovità

MiniMax M2.7 API in Europa

Ragionamento di livello frontier con 229B parametri e 428 token al secondo. Pienamente sovrano UE.

Throughput di output, p50, 10K input / 1K output, singola richiesta. Ultima misurazione: luglio 2026. Vedi tutti i benchmark e la metodologia

L'ultimo modello frontier di MiniMax, con 229B parametri, gira sull'infrastruttura di Infercom in Germania, pienamente sovrana UE. Nessun hyperscaler statunitense è coinvolto e i tuoi dati non sono esposti al CLOUD Act USA. In più offre supporto nativo multi-agente e prestazioni di coding migliori del 30% rispetto alla generazione precedente.

Inizia ora

Novità di M2.7

M2.7 rivede le proprie risposte prima di inviarle, e così ottiene risultati migliori già al primo tentativo. Inoltre gestisce l'orchestrazione di più agenti come capacità di base.

Autocritica integrata

Novità di M2.7: il modello rivede e migliora automaticamente il proprio output prima di rispondere. Nei compiti complessi di coding e ragionamento, il risultato è corretto più spesso già al primo tentativo.

Native Agent Teams

Novità di M2.7: la collaborazione tra più agenti è una capacità di base del modello, non solo una questione di prompting. Confini di ruolo stabili, agenti che si mettono in discussione a vicenda e comportamenti ben distinti per ogni ruolo sono integrati.

Migliorato: software engineering

56,22% su SWE-Pro (alla pari con GPT-5.3-Codex), 55,6% su VIBE-Pro per la consegna di progetti completi e 57,0% su Terminal Bench 2 per la comprensione di sistemi complessi.

Migliorato: competenze professionali

97% di skill compliance su oltre 40 skill professionali complesse. Modifica migliorata di file Excel, PowerPoint e Word, anche su più cicli di revisione.

Sovrano UE Monaco, Germania

Misurato sull'infrastruttura UE di Infercom

Throughput di output

428tok/s

Time to First Token

690ms

Context window

192K token

Lato server p50, 10K input / 1K output, singola richiesta

Fino a 444 tok/s con prompt più brevi. Ultima misurazione: luglio 2026.

Vedi tutti i benchmark e la metodologia

30%

Prestazioni di coding migliori rispetto alla generazione precedente

Perché lo chiamiamo Ultraspeed

Risultati nei benchmark di livello frontier

M2.7 ottiene punteggi di vertice nei benchmark di coding, engineering e ML. Su SWE-Pro è alla pari con GPT-5.3-Codex o lo supera.

56.22%

SWE-Pro

Alla pari con GPT-5.3-Codex

76.5%

SWE Multilingual

Ingegneria del software nella pratica

55.6%

VIBE-Pro

Vicino al livello di Opus 4.6

57.0%

Terminal Bench 2

Comprensione profonda dei sistemi

66.6%

MLE Bench Lite

Tasso di medaglie (9 ori, 5 argenti)

52.7%

Multi SWE Bench

Codebase complesse

Pensato per i workflow agentici

M2.7 eccelle nei compiti agentici di lunga durata che richiedono decisioni autonome, uso di strumenti e ragionamento in più passaggi in ambiti professionali complessi.

  • Workflow finanziari

    Ricerca dall'inizio alla fine, modelli Excel, report

  • SRE & DevOps

    Analisi dei log, incident response, debug in produzione

  • Elaborazione di documenti

    Word, Excel e PowerPoint con più cicli di modifica

  • Competizioni di ML

    66,6% di medaglie su MLE Bench Lite (9 ori, 5 argenti)

Agentic coding

56,22% su SWE-Pro

Alla pari con GPT-5.3-Codex nel benchmark di software engineering più impegnativo. Funziona con Aider, OpenCode, Cline, Cursor, Continue, Goose, Windsurf e Claude Code.

Configura l'agentic coding

Team multi-agente

Orchestrazione nativa degli agenti

La collaborazione tra più agenti è integrata direttamente nel modello. L'identità resta stabile tra i ruoli, l'intelligenza emotiva è migliorata e il ragionamento causale regge anche le decisioni in produzione.

Prezzi

Esegui un modello frontier da 229B parametri con prezzi trasparenti basati sul consumo.

ModelloInput (per 1M)Output (per 1M)Contesto
MiniMax M2.7 Ultraspeed€0,60€2,40192K

Prezzi in EUR IVA esclusa. Gestione sovrana UE, pienamente conforme al GDPR.

Perché conta l'hosting nell'UE

Se usi MiniMax tramite Infercom, le tue richieste restano sotto la giurisdizione UE:

  • I tuoi dati vengono elaborati esclusivamente in Germania e non lasciano mai la giurisdizione UE
  • Nessuna esposizione al CLOUD Act USA e nessun hyperscaler statunitense coinvolto
  • Piena conformità al GDPR, con un DPA basato sul diritto UE
  • Infrastruttura certificata ISO 27001, di proprietà di Infercom e gestita da Infercom
  • Nessuna archiviazione persistente: non addestriamo mai modelli sui tuoi dati
  • Certificata ISO 27001
  • Conforme al GDPR
  • Datacenter in Germania
  • Hardware di proprietà di Infercom

Inizia in pochi minuti

API compatibile con OpenAI: cambi solo l'endpoint e il tuo codice resta com'è. Nelle chiamate API usa il nome del modello MiniMax M2.7 Ultraspeed.

Paghi solo i token che usi.

quickstart.py
from openai import OpenAI

client = OpenAI(
    api_key="your-infercom-key",
    base_url="https://api.infercom.ai/v1"
)

response = client.chat.completions.create(
    model="MiniMax-M2.7",
    messages=[{"role": "user", "content": "Your prompt here"}],
    max_tokens=4096
)

print(response.choices[0].message.content)

MiniMax M2.7: domande frequenti

Quanto è veloce MiniMax M2.7 su Infercom?

428 token al secondo di throughput di output e 690ms di time to first token (il tempo al primo token), entrambi misurati lato server come p50 con 10K token di input e 1K di output sulla nostra API di produzione a Monaco. Con prompt più brevi arriva fino a 444 tok/s. Per un modello di ragionamento frontier da 229B parametri significa fino a 10x più velocità rispetto alle alternative basate su GPU. Puoi rimisurare ogni valore con il nostro strumento di benchmark open source.

Vedi tutti i benchmark

Quanto è grande il context window di MiniMax M2.7?

192K token (196.608), condivisi tra il tuo prompt e la risposta del modello. Bastano per lunghe esecuzioni agentiche, modifiche al codice su molti file e raccolte di documenti che altrimenti andrebbero suddivise su più richieste.

Cos'è un context window

MiniMax M2.7 è un modello open-weight?

Sì. MiniMax pubblica apertamente i pesi di M2.7 su Hugging Face. Puoi mettere subito il modello in produzione tramite la nostra API. E poiché i pesi sono aperti, non dipendi mai da un unico provider.

Cos'è un modello open-weight

Posso usare MiniMax M2.7 nell'UE?

Sì. Infercom esegue M2.7 su hardware di proprietà in un datacenter Tier III+ a Monaco. Le richieste vengono elaborate all'interno della giurisdizione UE, senza esposizione al CLOUD Act USA. L'infrastruttura è certificata ISO 27001 e un DPA basato sul diritto UE è disponibile su richiesta. Non addestriamo modelli sui tuoi dati.

Come funziona la sovranità UE da noi

Quanto costa MiniMax M2.7?

Paghi per token, senza minimi e senza vincoli mensili: €0,60 per milione di token di input e €2,40 per milione di token di output (IVA esclusa). Ti viene fatturato solo ciò che usi, e consumi e spesa sono visibili in tempo reale nel portale cloud.

Vedi tutti i prezzi

Vuoi costruire il futuro dell'AI in Europa?

Unisciti alle organizzazioni che usano l'AI sovrana con prestazioni di altissimo livello