Inference API

Einfache, transparente Preise

Pay-as-you-go-Tarife für die Inference API. Keine Mindestabnahme, keine Verpflichtung - Sie zahlen nur für die Token, die Sie nutzen.

💶Preise nativ in EURKeine Mindestabnahme, keine Verpflichtung🇪🇺EU-souverän standardmäßig

Preise der Inference API

Pay-per-Token-Tarife für unsere geteilte, EU-souveräne Inferenz-Plattform. Benötigen Sie reservierte Kapazität oder eigene Hardware? Diese beiden werden pro Engagement bepreist.

Sie sind hier

Inference API

Geteilte Infrastruktur, Pay-per-Token. Starten Sie in Minuten und skalieren Sie mit Ihrem Wachstum - keine Mindestabnahme, keine Verpflichtung.

EU-souverän standardmäßig Pay-as-you-go OpenAI-kompatible API

Ab

€0.20 / 1M Token

Alle Tarife ansehen

So funktioniert die API-Preisgestaltung

Die Inference API wird pro Token abgerechnet. Ein Token entspricht im Englischen etwa 4 Zeichen (dies variiert je nach Modell und Sprache). Sie zahlen für das, was Sie nutzen - keine Mindestabnahme, keine Verpflichtungen.

Was ist ein Token?

Token sind die Grundeinheiten, die LLMs verarbeiten. Im Englischen entspricht 1 Token ≈ 4 Zeichen oder ¾ eines Wortes. 1.000 Wörter ≈ 1.300 Token. Andere Sprachen benötigen unter Umständen mehr Token pro Zeichen.

Input vs. Output

Sie zahlen separat für Input (Ihren Prompt) und Output (die Antwort des Modells). Output kostet mehr als Input, weil Ihr Prompt in einem einzigen parallelen Durchlauf gelesen wird, während jeder Output-Token einen eigenen vollständigen Durchlauf durch das Modell benötigt - ein Token nach dem anderen.

Ein Modell wählen

Jedes Modell glänzt bei unterschiedlichen Aufgaben - es gibt keine einzelne "beste" Wahl. EU-souveräne Modelle (🇪🇺) garantieren, dass Ihre Daten in europäischer Jurisdiktion bleiben.

🇪🇺

EU-souveräne Modelle

Vollständige DSGVO-Konformität, kein US-CLOUD-Act-Risiko

ModellModalitätInput/1MOutput/1MKontext
MiniMax M2.7 UltraspeedText0.60€2.40192K
Gemma 4 31BText + vision0.20€0.35128K
gpt-oss-120bText0.22€0.59128K
Whisper Large v3Speech-to-text0.10
E5-Mistral 7BEmbeddings0.134K

Preise in EUR, zzgl. MwSt. EU-gehostete Modelle beinhalten vollständige Datensouveränität. Speech-to-text und Embeddings werden nur auf Input-Token abgerechnet (sie liefern Transkripte oder Vektoren, keinen generierten Text).

🌐

Globaler Modellkatalog

Zusätzliche Modelle über globale Infrastruktur

ModellModalitätInput/1MOutput/1MKontext
Llama 3.3 70BText0.601.20128K
DeepSeek V3.1Text3.004.50128K
DeepSeek V3.2Text3.004.5032K

Preise in EUR, zzgl. MwSt. Anfragen werden auf globaler Infrastruktur außerhalb der EU verarbeitet.

Schätzen Sie Ihre monatlichen Kosten

Starten Sie mit einem typischen Workload und passen Sie die Zahlen dann an Ihren an.

300,000 / Monat

600 Wörter

188 Wörter

Geschätzte monatliche Kosten

324.00

Pro Anfrage0.00108
Pro Tag10.80
Tarif (in / out pro 1M)0.6 / €2.4
EU-souverän - Daten bleiben in der EU

Nur eine Schätzung. Geht von ca. 30 Tagen gleichmäßiger Nutzung aus. Die tatsächliche Token-Anzahl variiert je nach Sprache, Inhalt und Modell-Tokenizer (~750 Wörter ≈ 1.000 Token im Englischen). Speech-to-text und Embeddings werden hier nicht angezeigt - sie werden nur auf Input-Token abgerechnet; siehe die Tariftabelle oben. Prüfen Sie Ihre exakte Nutzung jederzeit unter cloud.infercom.ai/plans/usage.

Zugangsstufen

Wählen Sie, wie Sie starten möchten - jederzeit upgraden, wenn Sie wachsen.

DeveloperHier starten

Pay-as-you-go

Registrieren Sie sich, erstellen Sie einen API-Key und zahlen Sie nur für die Token, die Sie nutzen. Keine Mindestabnahme, keine Verpflichtung.

Rate Limits ansehen →
Enterprise

Listenpreis, mit Mengenrabatten

Dieselben Per-Token-Tarife als Basis, mit Rabatten für zugesagte Volumen, individuellen SLAs, Priority-Support und höheren Rate Limits.

Vertrieb kontaktieren →

Häufig gestellte Fragen

Bereit, die Zukunft der AI in Europa zu gestalten?

Schließen Sie sich zukunftsorientierten Unternehmen an, die Souveräne KI mit Weltklasse-Performance einsetzen