Inference API

Enkel, transparent prissætning

Pay-as-you-go-priser for Inference API. Intet minimumsforbrug og ingen binding: Du betaler kun for de tokens, du bruger.

  • Priser direkte i EUR
  • Intet minimum, ingen binding
  • EU-suveræn som standard

Priser for Inference API

Priser per token for vores delte, EU-suveræne inferensplatform. Har du brug for reserveret kapacitet eller din egen hardware? De to løsninger prissætter vi individuelt per projekt.

Du er her

Inference API

Delt infrastruktur, betaling per token. Du kommer i gang på få minutter og skalerer i takt med dit behov, uden minimumsforbrug og uden binding.

  • EU-suveræn som standard
  • Pay-as-you-go
  • OpenAI-kompatibel API

Fra

€0,20 / 1M tokens, ekskl. moms

Se alle priser

Sammenlign alle tre side om side

Sådan fungerer API-priserne

Inference API afregnes per token. Et token svarer til cirka 4 tegn på engelsk, men det varierer med model og sprog. Du betaler kun for det, du bruger, uden minimumsforbrug og uden binding.

Hvad er et token?

Tokens er de grundenheder, en LLM behandler. På engelsk svarer 1 token til cirka 4 tegn eller ¾ af et ord, og 1.000 ord er omkring 1.300 tokens. Andre sprog, også dansk, bruger ofte flere tokens til den samme tekst.

Input vs. output

Du betaler separat for input (din prompt) og output (modellens svar). Output koster mere, fordi modellen læser din prompt i én parallel omgang. Hvert output-token kræver derimod sin egen fulde omgang gennem modellen, ét token ad gangen.

Vælg en model

Hver model har sine styrker, og der findes ikke ét "bedste" valg. Med EU-suveræne modeller (🇪🇺) bliver dine data garanteret under europæisk jurisdiktion.

EU

EU-suveræne modeller

Fuld GDPR-overholdelse, ikke omfattet af US CLOUD Act

EU-suveræne modeller
ModelModalitetInput/1MOutput/1MKontekst
MiniMax M2.7 UltraspeedText€0,60€2,40192K
Gemma 4 31BText + vision€0,20€0,35128K
gpt-oss-120bText€0,22€0,59128K
Whisper Large v3Speech-to-text€0,10--
E5-Mistral 7BEmbeddings€0,13-4K

Priser i EUR, ekskl. moms. EU-hostede modeller giver fuld datasuverænitet. Speech-to-text og embeddings afregnes kun efter input-tokens, fordi de returnerer transskriptioner eller vektorer og ikke genereret tekst.

Global

Globalt modelkatalog

Flere modeller via global infrastruktur

Globalt modelkatalog
ModelModalitetInput/1MOutput/1MKontekst
Llama 3.3 70BText€0,60€1,20128K
DeepSeek V3.1Text€3,00€4,50128K
DeepSeek V3.2Text€3,00€4,5032K

Priser i EUR, ekskl. moms. Forespørgsler behandles på global infrastruktur uden for EU.

Beregn dine månedlige omkostninger

Start med et typisk workload, og tilpas derefter tallene til dit eget.

Anslåede månedlige omkostninger (ekskl. moms)

€324,00

Per forespørgsel
€0,00108
Per dag
€10,80
Pris (input / output per 1M)
€0,60 / €2,40

EU-suveræn - data bliver i EU

Kun et skøn. Beregningen går ud fra cirka 30 dages jævnt forbrug. Det faktiske antal tokens afhænger af sprog, indhold og modellens tokenizer (på engelsk giver cirka 750 ord omkring 1.000 tokens). Speech-to-text og embeddings er ikke med her, fordi de kun afregnes efter input-tokens. Priserne står i tabellen ovenfor. Du kan altid se dit præcise forbrug på cloud.infercom.ai/plans/usage.

Adgangsniveauer

Vælg, hvordan du vil starte. Du kan opgradere når som helst, efterhånden som du vokser.

Start her

Developer

Pay-as-you-go

Opret en konto og en API-nøgle, og betal kun for de tokens, du bruger. Intet minimumsforbrug, ingen binding.

Se rate limits

 

Enterprise

Listepris med mængderabatter

De samme priser per token som udgangspunkt, plus rabat for aftalt volumen, individuelle SLA'er, prioriteret support og højere rate limits.

Kontakt salg

Ofte stillede spørgsmål

Hvordan fungerer afregningen?

Inference API er pay-as-you-go. Du tilføjer et betalingskort som betalingsmetode, og dit forbrug trækkes per token efter de offentliggjorte listepriser. Du betaler altså kun for det, du bruger, uden minimumsforbrug og uden månedlig binding. Med priserne ovenfor er det nemt at regne omkostningerne ud på forhånd.

Kan jeg se mit tokenforbrug og mine aktuelle udgifter?

Ja, i realtid. Dit aktuelle tokenforbrug finder du på cloud.infercom.ai/plans/usage, og din afregning og dine fakturaer på cloud.infercom.ai/plans/billing. Så ved du altid præcis, hvad du har brugt, og hvad det koster.

Hvilke rate limits gælder?

Rate limits afhænger af plan og model. Developer-niveauet har standardgrænser, som er beskrevet i vores dokumentation om rate limits. Enterprise-planer giver individuelle rate limits, der passer til dit workload. Rate limits styrer, hvor ofte du kan sende forespørgsler. De påvirker ikke inferenshastigheden for den enkelte forespørgsel.

Hvilke betalingsmetoder accepterer I?

Til vores inferenstjeneste accepterer vi de gængse betalingskort via Stripe. Kunder med Enterprise, Dedicated Capacity eller On-Premises kan også betale via faktura.

Hvad omfatter EU-suverænitet?

Med EU-suveræne modeller foregår al databehandling som standard i vores europæiske datacentre. Dine data forlader kun EU-jurisdiktionen, hvis du udtrykkeligt vælger modeller fra det globale katalog. Fuld GDPR-overholdelse og parathed til AI Act er inkluderet.

Tilbyder I mængderabatter?

Ja, både Enterprise-aftaler og aftaler om Dedicated Capacity har individuelle priser, der bygger på dit aftalte forbrug. Tal med vores salgsteam om dine behov.

Klar til at bygge fremtidens AI i Europa?

Slut dig til virksomheder, der bruger suveræn AI med performance i topklasse