API-Kompatibilität
OpenAI-kompatible API. Keine Code-Änderungen.
Wechseln Sie in wenigen Minuten von OpenAI oder Anthropic. Dieselben SDKs, derselbe Code und bis zu 10x schnellere Inferenz auf EU-souveräner Infrastruktur.
Wechsel in 5 Minuten
Sie ändern eine Zeile Code, alles andere bleibt.
01
Registrieren und API-Key erhalten
Legen Sie Ihr Konto auf cloud.infercom.ai an.
02
Base-URL ändern
Richten Sie Ihr bestehendes OpenAI- oder Anthropic-SDK auf api.infercom.ai aus
03
Modell wählen
Nutzen Sie gpt-oss-120b (unser schnellstes Modell), Gemma 4 31B (Text und Bilder) oder ein anderes Modell aus unserem Katalog.
from openai import OpenAI
client = OpenAI(
base_url="https://api.infercom.ai/v1",
api_key="your-api-key"
)
response = client.chat.completions.create(
model="gpt-oss-120b",
messages=[{"role": "user", "content": "Hello"}],
stream=True
)
for chunk in response:
print(chunk.choices[0].delta.content, end="")from openai import OpenAI
client = OpenAI(
base_url="https://api.infercom.ai/v1",
api_key="your-api-key"
)
# Responses API - built for agentic workflows
response = client.responses.create(
model="gpt-oss-120b",
input="Hello",
reasoning={"effort": "high"}
)
print(response.output_text)from anthropic import Anthropic
client = Anthropic(
base_url="https://api.infercom.ai",
api_key="your-api-key"
)
response = client.messages.create(
model="gpt-oss-120b",
max_tokens=1024,
messages=[{"role": "user", "content": "Hello"}]
)
print(response.content[0].text)curl https://api.infercom.ai/v1/chat/completions \
-H "Authorization: Bearer your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-oss-120b",
"messages": [{"role": "user", "content": "Hello"}],
"stream": true
}'Wählen Sie Ihr SDK
Volle Kompatibilität mit den Client-Bibliotheken von OpenAI und Anthropic
OpenAI SDK
Kompatibel mit dem OpenAI SDK
Drop-in-Ersatz für OpenAI. Funktioniert mit Ihrem bestehenden Code, Ihren Tools und Frameworks.
- Chat Completions und Responses API
- Funktioniert mit LangChain, LlamaIndex, CrewAI
- Python, JavaScript, TypeScript, REST
- Streaming, Function Calling, JSON-Modus
Anthropic SDK
Anthropic Messages API
Nutzen Sie das Anthropic SDK direkt. Dasselbe Format der Messages API, in der EU gehostet.
- Standard-Endpoint /v1/messages
- Funktioniert mit bestehendem Anthropic-Code
- Tool Use mit gpt-oss-120b
- Dieselbe Authentifizierung
Vision, Extended Thinking und Prompt Caching werden derzeit nicht unterstützt.
Weitere Beispiele
Funktioniert mit Ihren bevorzugten Sprachen und Frameworks
import OpenAI from 'openai';
const client = new OpenAI({
baseURL: 'https://api.infercom.ai/v1',
apiKey: 'your-api-key',
});
const response = await client.chat.completions.create({
model: 'gpt-oss-120b',
messages: [{ role: 'user', content: 'Hello' }],
});
console.log(response.choices[0].message.content);from langchain_openai import ChatOpenAI
llm = ChatOpenAI(
base_url="https://api.infercom.ai/v1",
api_key="your-api-key",
model="gpt-oss-120b"
)
response = llm.invoke("Explain quantum computing")
print(response.content)Schneller als die Alternativen
Die Dataflow-Architektur von SambaNova liefert bis zu 10x schnellere Inferenz als GPU-basierte Anbieter.
Ausgabe-Durchsatz, p50, 10K Input / 1K Output, einzelner Request. Zuletzt gemessen: Juli 2026.
Unterstützte Endpoints
-
/v1/chat/completionsChat Completions mit Streaming
-
/v1/responsesResponses API für agentische Workflows - Tools, Reasoning, Streaming
-
/v1/messagesFormat der Anthropic Messages API
-
/v1/modelsVerfügbare Modelle und Metadaten auflisten
-
/v1/embeddingsText-Embeddings (ausgewählte Modelle)
EU-Souveränität inklusive
OpenAI-kompatible API, europäische Jurisdiktion.
- EU-souveräne Modelle laufen in einem zertifizierten Rechenzentrum in München
- Kein Risiko durch den US CLOUD Act
- DSGVO-konform, nach ISO 27001 zertifiziert
- Keine dauerhafte Speicherung von Prompts und Ausgaben
Dokumentation
Alles, was Sie für die Integration brauchen