MiniMax API
MiniMax-Modelle über einen OpenAI-kompatiblen Endpoint. Drop-in-Ersatz: Sie ändern nur die Base-URL.
https://api.infercom.ai/v1MiniMax-Modelle sind auf Infercom vollständig OpenAI-kompatibel. Nutzen Sie die Base-URL api.infercom.ai/v1 mit Ihrem bestehenden OpenAI SDK, ohne weitere Änderungen am Code. MiniMax-M2.7 Ultraspeed läuft mit über 400 Token pro Sekunde, gehostet in München und vollständig DSGVO-konform.
Verfügbare Modelle
Alle MiniMax-Modelle auf Infercom. Verwenden Sie die Modell-ID in Ihren API-Requests.
| Modell | Modell-ID | Parameter | Kontext | Geschwindigkeit | Ideal für | |
|---|---|---|---|---|---|---|
| MiniMax-M2.7 Ultraspeed | MiniMax-M2.7 | 229B MoE | 192K Token | 400+ tok/s | Selbstkritik, Multi-Agent, Agentic Coding | Details ansehen → |
Modell-IDs unterscheiden Groß- und Kleinschreibung. Verwenden Sie sie genau wie angegeben.
Schnellstart
Funktioniert mit jedem OpenAI-kompatiblen SDK. Sie müssen nur auf unseren Endpoint zeigen.
Die Integration hat drei Schritte. Erstens registrieren Sie sich auf cloud.infercom.ai und erhalten Ihren API-Key. Zweitens ändern Sie die Base-URL von api.openai.com auf api.infercom.ai/v1. Drittens setzen Sie das Modell auf MiniMax-M2.7. Ihr bestehender Code, Ihre Prompts und Ihre Tools funktionieren unverändert.
from openai import OpenAI
client = OpenAI(
base_url="https://api.infercom.ai/v1",
api_key="your-api-key"
)
response = client.chat.completions.create(
model="MiniMax-M2.7",
messages=[{"role": "user", "content": "Hello"}],
stream=True
)
for chunk in response:
print(chunk.choices[0].delta.content, end="")Unterstützte Endpoints
POST /v1/chat/completionsOpenAI Chat Completions (mit Streaming)
POST /v1/messagesAnthropic Messages API
POST /v1/responsesOpenAI Responses API
GET /v1/modelsVerfügbare Modelle auflisten
Warum MiniMax auf Infercom
In der EU gehostet
Rechenzentrum in München, vollständig DSGVO-konform und nicht dem US CLOUD Act ausgesetzt.
Bis zu 10x schneller
Die Dataflow-Architektur von SambaNova liefert Inferenz in Weltrekord-Geschwindigkeit.
Zero Data Retention
Ihre Prompts und Ausgaben werden nie gespeichert oder für Training verwendet.
Drop-in-kompatibel
Funktioniert mit dem OpenAI SDK, dem Anthropic SDK, LangChain, LlamaIndex und jedem OpenAI-kompatiblen Tool.
Häufig gestellte Fragen
Ist die MiniMax API mit OpenAI kompatibel?
Ja, MiniMax-Modelle sind auf Infercom vollständig OpenAI-kompatibel. Nutzen Sie die Base-URL api.infercom.ai/v1 mit Ihrem bestehenden OpenAI SDK, mit LangChain, LlamaIndex oder jedem OpenAI-kompatiblen Tool. Außer der Base-URL müssen Sie nichts am Code ändern.
Wie lautet die Base-URL der MiniMax API?
Die Base-URL ist https://api.infercom.ai/v1. Setzen Sie sie im OpenAI SDK als base_url oder in JavaScript als baseURL. Unterstützte Endpoints: /chat/completions (OpenAI), /messages (Anthropic), /responses (OpenAI Responses API) und /models.
Kann ich LangChain mit MiniMax nutzen?
Ja, verwenden Sie ChatOpenAI aus langchain_openai mit base_url='https://api.infercom.ai/v1' und model='MiniMax-M2.7'. LlamaIndex, CrewAI und andere Frameworks mit OpenAI-Unterstützung funktionieren ebenfalls.
Was ist MiniMax M2.7 Ultraspeed?
MiniMax M2.7 Ultraspeed ist ein MoE-Modell mit 229B Parametern (10B aktiv), eingebauter Selbstkritik, nativer Multi-Agent-Unterstützung und einem Kontextfenster von 192K. Es läuft mit über 400 Token pro Sekunde auf der EU-Infrastruktur von Infercom und ist unser Flaggschiff für Agentic Coding und mehrstufiges Reasoning.
Ist die MiniMax API DSGVO-konform?
Ja, MiniMax-Modelle laufen auf Infercom auf Infrastruktur in München. Sie sind vollständig DSGVO-konform und arbeiten mit Zero Data Retention: Prompts und Ausgaben werden nie gespeichert oder für Training verwendet. Die Verarbeitung ist nicht dem US CLOUD Act ausgesetzt.
MiniMax noch heute nutzen
Ihr API-Key in 30 Sekunden. Sie zahlen nur die Token, die Sie nutzen.