Enkel, transparent prissætning
Pay-as-you-go priser for Inference API. Ingen minimum, ingen binding - betal kun for de tokens, du bruger.
Inference API-prissætning
Betaling per token for vores delte, EU-suveræne inferens-platform. Har du brug for reserveret kapacitet eller din egen hardware? Disse to prissættes per engagement.
Inference API
Delt infrastruktur, betaling per token. Kom i gang på minutter, skaler i takt med væksten - ingen minimum, ingen binding.
Sådan fungerer API-prissætning
Inference API prissættes per token. Et token er cirka 4 tegn på engelsk (dette varierer efter model og sprog). Du betaler for det, du bruger - ingen minimum, ingen binding.
Hvad er et token?
Tokens er de grundlæggende enheder, som LLM'er behandler. På engelsk er 1 token ≈ 4 tegn eller ¾ af et ord. 1.000 ord ≈ 1.300 tokens. Andre sprog kan bruge flere tokens per tegn.
Input vs Output
Du betaler separat for input (din prompt) og output (modellens svar). Output koster mere end input, fordi din prompt læses i ét enkelt parallelt gennemløb, mens hvert output-token kræver sit eget fulde gennemløb af modellen - ét token ad gangen.
Valg af model
Hver model er bedst til forskellige opgaver - der er ikke ét enkelt "bedste" valg. EU-suveræne modeller (🇪🇺) garanterer, at dine data forbliver i europæisk jurisdiktion.
EU-suveræne modeller
Fuld GDPR-overholdelse, ingen eksponering for US CLOUD Act
| Model | Modalitet | Input/1M | Output/1M | Kontekst |
|---|---|---|---|---|
| MiniMax M2.7 Ultraspeed | Text | €0.60 | €2.40 | 192K |
| Gemma 4 31B | Text + vision | €0.20 | €0.35 | 128K |
| gpt-oss-120b | Text | €0.22 | €0.59 | 128K |
| Whisper Large v3 | Speech-to-text | €0.10 | — | — |
| E5-Mistral 7B | Embeddings | €0.13 | — | 4K |
Priser i EUR, ekskl. moms. EU-hostede modeller inkluderer fuld datasuverænitet. Speech-to-text og embeddings afregnes kun på input-tokens (de returnerer transskriptioner eller vektorer, ikke genereret tekst).
Globalt modelkatalog
Yderligere modeller via global infrastruktur
| Model | Modalitet | Input/1M | Output/1M | Kontekst |
|---|---|---|---|---|
| Llama 3.3 70B | Text | €0.60 | €1.20 | 128K |
| DeepSeek V3.1 | Text | €3.00 | €4.50 | 128K |
| DeepSeek V3.2 | Text | €3.00 | €4.50 | 32K |
Priser i EUR, ekskl. moms. Forespørgsler behandles på global infrastruktur uden for EU.
Estimér dine månedlige omkostninger
Start fra en typisk arbejdsbelastning, og justér derefter tallene, så de passer til din.
≈ 300,000 / måned
≈ 600 ord
≈ 188 ord
Estimerede månedlige omkostninger
€324.00
Kun et estimat. Antager ~30 dages jævn brug. Faktiske token-antal varierer efter sprog, indhold og modellens tokenizer (~750 ord ≈ 1.000 tokens på engelsk). Speech-to-text og embeddings vises ikke her - de afregnes kun på input-tokens; se pristabellen ovenfor. Tjek det præcise forbrug når som helst på cloud.infercom.ai/plans/usage.
Adgangsniveauer
Vælg hvordan du vil starte - opgrader når som helst i takt med væksten.
Pay as you go
Tilmeld dig, opret en API-nøgle, og betal kun for de tokens, du bruger. Ingen minimum, ingen binding.
Se rate limits →Listepris, med mængderabatter
De samme priser per token som dit udgangspunkt, med rabatter for forpligtet volumen, individuelle SLA'er, prioriteret support og højere rate limits.
Kontakt salg →