Prezzi semplici e trasparenti
Tariffe pay-as-you-go per la Inference API. Nessun minimo, nessun impegno - paghi solo per i token che utilizzi.
Prezzi della Inference API
Tariffe pay-per-token per la nostra piattaforma di inferenza condivisa e sovrana UE. Ti serve capacità riservata o hardware proprio? Queste due opzioni hanno un prezzo definito per progetto.
Inference API
Infrastruttura condivisa, pay-per-token. Inizia in pochi minuti e scala man mano che cresci - nessun minimo, nessun impegno.
Come funziona il prezzo dell'API
La Inference API ha un prezzo per token. Un token corrisponde a circa 4 caratteri in inglese (varia in base al modello e alla lingua). Paghi per ciò che utilizzi - nessun minimo, nessun impegno.
Cos'è un token?
I token sono le unità di base elaborate dagli LLM. In inglese, 1 token ≈ 4 caratteri o ¾ di una parola. 1.000 parole ≈ 1.300 token. Altre lingue possono utilizzare più token per carattere.
Input vs Output
Paghi separatamente per input (il tuo prompt) e output (la risposta del modello). L'output costa più dell'input perché il tuo prompt viene letto in un unico passaggio parallelo, mentre ogni token di output richiede un proprio passaggio completo attraverso il modello - un token alla volta.
Scegliere un modello
Ogni modello eccelle in compiti diversi - non esiste un'unica scelta "migliore". I modelli sovrani UE (🇪🇺) garantiscono che i tuoi dati restino nella giurisdizione europea.
Modelli sovrani UE
Piena conformità GDPR, nessuna esposizione allo US CLOUD Act
| Modello | Modalità | Input/1M | Output/1M | Contesto |
|---|---|---|---|---|
| MiniMax M2.7 Ultraspeed | Text | €0.60 | €2.40 | 192K |
| Gemma 4 31B | Text + vision | €0.20 | €0.35 | 128K |
| gpt-oss-120b | Text | €0.22 | €0.59 | 128K |
| Whisper Large v3 | Speech-to-text | €0.10 | — | — |
| E5-Mistral 7B | Embeddings | €0.13 | — | 4K |
Prezzi in EUR, IVA esclusa. I modelli ospitati nell'UE includono piena sovranità dei dati. Speech-to-text ed embedding vengono fatturati solo sui token di input (restituiscono trascrizioni o vettori, non testo generato).
Catalogo modelli globale
Modelli aggiuntivi tramite infrastruttura globale
| Modello | Modalità | Input/1M | Output/1M | Contesto |
|---|---|---|---|---|
| Llama 3.3 70B | Text | €0.60 | €1.20 | 128K |
| DeepSeek V3.1 | Text | €3.00 | €4.50 | 128K |
| DeepSeek V3.2 | Text | €3.00 | €4.50 | 32K |
Prezzi in EUR, IVA esclusa. Richieste elaborate su infrastruttura globale al di fuori dell'UE.
Stima il tuo costo mensile
Parti da un carico di lavoro tipico, poi regola i numeri in base al tuo.
≈ 300,000 / mese
≈ 600 parole
≈ 188 parole
Costo mensile stimato
€324.00
Solo una stima. Presuppone circa 30 giorni di utilizzo costante. Il conteggio effettivo dei token varia in base a lingua, contenuto e tokenizer del modello (~750 parole ≈ 1.000 token in inglese). Speech-to-text ed embedding non sono mostrati qui - vengono fatturati solo sui token di input; vedi la tabella delle tariffe sopra. Controlla l'utilizzo esatto in qualsiasi momento su cloud.infercom.ai/plans/usage.
Livelli di accesso
Scegli come vuoi iniziare - fai l'upgrade in qualsiasi momento man mano che cresci.
Pay-as-you-go
Registrati, crea una API key e paga solo per i token che utilizzi. Nessun minimo, nessun impegno.
Vedi i rate limit →Prezzo di listino, con sconti sui volumi
Le stesse tariffe per token come base, con sconti su volumi concordati, SLA personalizzati, supporto prioritario e rate limit più elevati.
Contatta il team commerciale →