Inference API

Prezzi semplici e trasparenti

Tariffe pay-as-you-go per la Inference API. Nessun minimo, nessun impegno - paghi solo per i token che utilizzi.

💶Prezzi nativi in EURNessun minimo, nessun impegno🇪🇺Sovranità UE di default

Prezzi della Inference API

Tariffe pay-per-token per la nostra piattaforma di inferenza condivisa e sovrana UE. Ti serve capacità riservata o hardware proprio? Queste due opzioni hanno un prezzo definito per progetto.

Sei qui

Inference API

Infrastruttura condivisa, pay-per-token. Inizia in pochi minuti e scala man mano che cresci - nessun minimo, nessun impegno.

Sovranità UE di default Pay-as-you-go API compatibile con OpenAI

A partire da

€0.20 / 1M token

Vedi tutte le tariffe

Come funziona il prezzo dell'API

La Inference API ha un prezzo per token. Un token corrisponde a circa 4 caratteri in inglese (varia in base al modello e alla lingua). Paghi per ciò che utilizzi - nessun minimo, nessun impegno.

Cos'è un token?

I token sono le unità di base elaborate dagli LLM. In inglese, 1 token ≈ 4 caratteri o ¾ di una parola. 1.000 parole ≈ 1.300 token. Altre lingue possono utilizzare più token per carattere.

Input vs Output

Paghi separatamente per input (il tuo prompt) e output (la risposta del modello). L'output costa più dell'input perché il tuo prompt viene letto in un unico passaggio parallelo, mentre ogni token di output richiede un proprio passaggio completo attraverso il modello - un token alla volta.

Scegliere un modello

Ogni modello eccelle in compiti diversi - non esiste un'unica scelta "migliore". I modelli sovrani UE (🇪🇺) garantiscono che i tuoi dati restino nella giurisdizione europea.

🇪🇺

Modelli sovrani UE

Piena conformità GDPR, nessuna esposizione allo US CLOUD Act

ModelloModalitàInput/1MOutput/1MContesto
MiniMax M2.7 UltraspeedText0.60€2.40192K
Gemma 4 31BText + vision0.20€0.35128K
gpt-oss-120bText0.22€0.59128K
Whisper Large v3Speech-to-text0.10
E5-Mistral 7BEmbeddings0.134K

Prezzi in EUR, IVA esclusa. I modelli ospitati nell'UE includono piena sovranità dei dati. Speech-to-text ed embedding vengono fatturati solo sui token di input (restituiscono trascrizioni o vettori, non testo generato).

🌐

Catalogo modelli globale

Modelli aggiuntivi tramite infrastruttura globale

ModelloModalitàInput/1MOutput/1MContesto
Llama 3.3 70BText0.601.20128K
DeepSeek V3.1Text3.004.50128K
DeepSeek V3.2Text3.004.5032K

Prezzi in EUR, IVA esclusa. Richieste elaborate su infrastruttura globale al di fuori dell'UE.

Stima il tuo costo mensile

Parti da un carico di lavoro tipico, poi regola i numeri in base al tuo.

300,000 / mese

600 parole

188 parole

Costo mensile stimato

324.00

Per richiesta0.00108
Al giorno10.80
Tariffa (in / out per 1M)0.6 / €2.4
Sovrano UE - i dati restano nell'UE

Solo una stima. Presuppone circa 30 giorni di utilizzo costante. Il conteggio effettivo dei token varia in base a lingua, contenuto e tokenizer del modello (~750 parole ≈ 1.000 token in inglese). Speech-to-text ed embedding non sono mostrati qui - vengono fatturati solo sui token di input; vedi la tabella delle tariffe sopra. Controlla l'utilizzo esatto in qualsiasi momento su cloud.infercom.ai/plans/usage.

Livelli di accesso

Scegli come vuoi iniziare - fai l'upgrade in qualsiasi momento man mano che cresci.

DeveloperInizia qui

Pay-as-you-go

Registrati, crea una API key e paga solo per i token che utilizzi. Nessun minimo, nessun impegno.

Vedi i rate limit →
Enterprise

Prezzo di listino, con sconti sui volumi

Le stesse tariffe per token come base, con sconti su volumi concordati, SLA personalizzati, supporto prioritario e rate limit più elevati.

Contatta il team commerciale →

Domande frequenti

Pronto a Costruire il Futuro dell'AI in Europa?

Unisciti alle organizzazioni lungimiranti che implementano AI sovrana con prestazioni di livello mondiale