MiniMax M2.7 API in Europa
229B Frontier-Reasoning mit 428 Tokens pro Sekunde. Vollständig EU-souverän.
Das neueste 229B-Parameter-Frontier-Modell von MiniMax, betrieben auf Infercoms vollständig EU-souveräner Infrastruktur in Deutschland. Keine US-Hyperscaler. Keine CLOUD-Act-Exponierung. Native Multi-Agent-Unterstützung, 30% bessere Coding-Leistung gegenüber der Vorgängergeneration.
Neu in M2.7
M2.7 bietet eingebaute Selbstkritik für bessere Erstergebnisse sowie native Multi-Agent-Orchestrierung als Kernfähigkeit.
Eingebaute Selbstkritik
Neu in M2.7: Das Modell überprüft und verfeinert seine Ausgaben automatisch vor der Antwort. Bessere Erstergebnisse bei komplexen Coding- und Reasoning-Aufgaben.
Native Agent-Teams
Neu in M2.7: Multi-Agent-Kollaboration als Kernfähigkeit des Modells - nicht nur Prompting. Stabile Rollengrenzen, adversariales Reasoning und Verhaltensdifferenzierung eingebaut.
Verbessert: Software Engineering
56,22% auf SWE-Pro (entspricht GPT-5.3-Codex), 55,6% auf VIBE-Pro für vollständige Projektlieferung, 57,0% auf Terminal Bench 2 für komplexes Systemverständnis.
Verbessert: Professionelle Skills
97% Skill-Compliance über 40+ komplexe professionelle Skills. Verbessertes Excel-, PowerPoint- und Word-Editing mit mehrstufiger Revision.
Gemessen auf Infercom EU-Infrastruktur
Output-Throughput
428tok/s
Time to First Token
690ms
Kontextfenster
192Ktokens
Serverseitiger p50, 10K Input / 1K Output, Einzelanfrage
Bis zu 444 tok/s bei kürzeren Prompts. Zuletzt gemessen: July 2026.
Alle Benchmarks und die Methodik ansehenVertiefung in unserem Glossar
Frontier Benchmark-Performance
M2.7 erreicht Top-Scores über Coding-, Engineering- und ML-Benchmarks hinweg - entspricht oder übertrifft GPT-5.3-Codex auf SWE-Pro.
SWE-Pro
56.22%
Matches GPT-5.3-Codex
SWE Multilingual
76.5%
Real-world engineering
VIBE-Pro
55.6%
Near Opus 4.6 level
Terminal Bench 2
57.0%
Deep system understanding
MLE Bench Lite
66.6%
Medal rate (9 gold, 5 silver)
Multi SWE Bench
52.7%
Complex codebases
Gebaut für agentische Workflows
M2.7 glänzt bei langfristigen Agent-Aufgaben, die autonome Entscheidungsfindung, Tool-Nutzung und mehrstufiges Reasoning über komplexe professionelle Domänen erfordern.
Finanz-Workflows
End-to-End-Recherche, Excel-Modellierung, Berichtserstellung
SRE & DevOps
Log-Analyse, Incident Response, Production Debugging
Dokumentenverarbeitung
Word, Excel, PowerPoint mit mehrstufiger Bearbeitung
ML-Wettbewerbe
66,6% Medaillenrate auf MLE Bench Lite (9 Gold, 5 Silber)
Agentisches Coding
56,22% auf SWE-Pro
Entspricht GPT-5.3-Codex auf dem anspruchsvollsten Software-Engineering-Benchmark. Funktioniert mit Aider, OpenCode, Cline, Cursor, Continue, Goose, Windsurf und Claude Code.
Agentisches Coding einrichtenMulti-Agent-Teams
Native Agent-Orchestrierung
Internalisierte Multi-Agent-Kollaboration als native Fähigkeit. Stabile Identität über Rollen hinweg, verbesserte emotionale Intelligenz und robustes kausales Reasoning für Produktionsentscheidungen.
Frontier-Performance, Bruchteil der Kosten
Ein 229B-Parameter Frontier-Modell zu Open-Source-Preisen betreiben.
| Modell | Input (pro 1M) | Output (pro 1M) | Relative Kosten |
|---|---|---|---|
| Claude Opus 4.6 | $15.00 | $75.00 | ~30x mehr |
| Claude Sonnet 4.6 | $3.00 | $15.00 | ~6x mehr |
| MiniMax M2.7 Ultraspeed | €0.60 | €2.40 | Basis |
Preise Stand Mai 2026.
Warum EU-Hosting wichtig ist
MiniMax über Infercom zu betreiben bedeutet vollständige EU-Souveränität - die schnellste Inferenz in Europa ohne ausländische Jurisdiktion:
- Ihre Daten werden ausschließlich in Deutschland verarbeitet - verlassen nie die EU-Jurisdiktion
- Keine US CLOUD Act-Exposition - keine amerikanische Hyperscaler-Beteiligung
- Vollständige DSGVO-Konformität mit EU-basiertem Datenverarbeitungsvertrag
- ISO 27001 zertifizierte Infrastruktur, im Besitz und Betrieb von Infercom
- Keine Datenspeicherung - wir trainieren nie mit Ihren Daten
In Minuten loslegen
from openai import OpenAI
client = OpenAI(
api_key="your-infercom-key",
base_url="https://api.infercom.ai/v1"
)
response = client.chat.completions.create(
model="MiniMax-M2.7",
messages=[{"role": "user", "content": "Your prompt here"}],
max_tokens=4096
)
print(response.choices[0].message.content)OpenAI-kompatible API. Drop-in-Ersatz für Ihren bestehenden Code. Verwenden Sie den Modellnamen MiniMax M2.7 Ultraspeed in Ihren API-Aufrufen.
Zahlen Sie nur für die genutzten Tokens.
MiniMax M2.7: Häufige Fragen
428 Tokens pro Sekunde Output-Throughput und 690 ms Time to First Token, beides serverseitige p50-Werte bei 10K Input / 1K Output auf unserer Produktions-API in München. Bei kürzeren Prompts sind Spitzen bis zu 444 tok/s möglich. Für ein 229B-Frontier-Reasoning-Modell ist das bis zu 10x schneller als GPU-basierte Alternativen, und jede Zahl lässt sich mit unserem Open-Source-Benchmark-Tool reproduzieren.
Alle Benchmarks ansehen192K Tokens (196.608), aufgeteilt zwischen Ihrem Prompt und der Antwort des Modells. Das ist für lange agentische Läufe, Codeänderungen über mehrere Dateien und Dokumentensammlungen ausgelegt, die sonst über mehrere Anfragen aufgeteilt werden müssten.
Was ein Kontextfenster istJa. MiniMax veröffentlicht die M2.7-Gewichte offen auf Hugging Face. Sie können das Modell über unsere API direkt in Produktion nehmen, und weil die Gewichte offen sind, binden Sie sich an keinen einzelnen Anbieter.
Was Open-Weight konkret bedeutetJa. Infercom betreibt M2.7 auf eigener Hardware in einem Tier-III+-Rechenzentrum in München. Anfragen werden innerhalb der EU-Jurisdiktion verarbeitet, ohne Exponierung gegenüber dem US CLOUD Act. Die Infrastruktur ist ISO 27001 zertifiziert, ein EU-Auftragsverarbeitungsvertrag ist auf Anfrage verfügbar. Wir trainieren nicht mit Ihren Daten.
So funktioniert EU-Souveränität hierAbrechnung pro Token, ohne Mindestumsatz und ohne monatliche Bindung: 0,60 EUR pro Million Input-Tokens und 2,40 EUR pro Million Output-Tokens. Sie zahlen nur für die tatsächliche Nutzung, Verbrauch und Kosten sehen Sie live im Cloud-Portal.
Vollständige Preise ansehenMehr erfahren
API-Einrichtungsanleitung
Base URL, Modell-IDs und Code-Beispiele
Performance-Benchmarks
Sehen Sie, wie MiniMax M2.7 Ultraspeed auf unserer EU-Infrastruktur performt
Agentisches Coding Guide
Aider, OpenCode, Cursor mit MiniMax einrichten
gpt-oss-120b
Wenn reiner Throughput wichtiger ist als Frontier-Reasoning
EU-souveräne KI
Wo Ihre Daten liegen und wer darauf zugreifen kann
Preise
Transparente Token-basierte Preise
