MiniMax M2.7 API i Europa
229B frontier-reasoning ved 428 tokens per sekund. Fuldt EU-suverænt.
Den nyeste 229B-parameter frontier-model fra MiniMax, der kører på Infercoms fuldt EU-suveræne infrastruktur i Tyskland. Ingen amerikanske hyperscalere. Ingen CLOUD Act-eksponering. Native multi-agent-understøttelse, 30% bedre kodning end forrige generation.
Nyt i M2.7
M2.7 tilføjer indbygget selvkritik for bedre første-forsøg resultater, plus native multi-agent orkestrering som kernefunktion.
Indbygget selvkritik
Nyt i M2.7: Modellen gennemgår og forfiner automatisk sine output før svar. Bedre første-forsøg resultater på komplekse coding- og reasoning-opgaver.
Native Agent Teams
Nyt i M2.7: Multi-agent samarbejde som kernefunktion - ikke bare prompting. Stabile rollegrænser, adversarial reasoning og adfærdsdifferentiering indbygget.
Forbedret: Software Engineering
56,22% på SWE-Pro (matcher GPT-5.3-Codex), 55,6% på VIBE-Pro for fuld projektlevering, 57,0% på Terminal Bench 2 for kompleks systemforståelse.
Forbedret: Professionelle Skills
97% skill compliance på tværs af 40+ komplekse professionelle skills. Forbedret Excel, PowerPoint og Word redigering med multi-runde revision.
Målt på Infercoms EU-infrastruktur
Output-throughput
428tok/s
Time to First Token
690ms
Kontekstvindue
192Ktokens
Serverside-p50, 10K input / 1K output, enkelt forespørgsel
Op til 444 tok/s på kortere prompts. Sidst målt: July 2026.
Se alle benchmarks og metoden bagUddybning i vores ordliste
Frontier Benchmark Performance
M2.7 opnår top-tier scores på tværs af coding, engineering og ML benchmarks - matcher eller overgår GPT-5.3-Codex på SWE-Pro.
SWE-Pro
56.22%
Matches GPT-5.3-Codex
SWE Multilingual
76.5%
Real-world engineering
VIBE-Pro
55.6%
Near Opus 4.6 level
Terminal Bench 2
57.0%
Deep system understanding
MLE Bench Lite
66.6%
Medal rate (9 gold, 5 silver)
Multi SWE Bench
52.7%
Complex codebases
Bygget til agentiske workflows
M2.7 udmærker sig ved langsigtede agent-opgaver der kræver autonom beslutningstagning, tool-brug og multi-step reasoning på tværs af komplekse professionelle domæner.
Finansielle Workflows
End-to-end research, Excel-modellering, rapportgenerering
SRE & DevOps
Log-analyse, incident response, produktion debugging
Dokumentbehandling
Word, Excel, PowerPoint med multi-runde redigering
ML Konkurrencer
66,6% medaljerate på MLE Bench Lite (9 guld, 5 sølv)
Agentisk Coding
56,22% på SWE-Pro
Matcher GPT-5.3-Codex på det mest krævende software engineering benchmark. Virker med Aider, OpenCode, Cline, Cursor, Continue, Goose, Windsurf og Claude Code.
Opsæt agentisk codingMulti-Agent Teams
Native Agent Orkestrering
Internaliseret multi-agent samarbejde som native evne. Stabil identitet på tværs af roller, forbedret emotionel intelligens og robust kausal reasoning for produktionsbeslutninger.
Frontier Performance, Brøkdel af Prisen
Kør en 229B parameter frontier model til open-source priser.
| Model | Input (per 1M) | Output (per 1M) | Relativ Pris |
|---|---|---|---|
| Claude Opus 4.6 | $15.00 | $75.00 | ~30x mere |
| Claude Sonnet 4.6 | $3.00 | $15.00 | ~6x mere |
| MiniMax M2.7 Ultraspeed | €0.60 | €2.40 | Basis |
Priser pr. maj 2026.
Hvorfor EU-hosting er vigtigt
At køre MiniMax gennem Infercom betyder fuld EU-suverænitet - den hurtigste inferens i Europa uden udenlandsk jurisdiktion:
- Dine data behandles udelukkende i Tyskland - forlader aldrig EU-jurisdiktion
- Ingen US CLOUD Act eksponering - ingen amerikansk hyperscaler involvering
- Fuld GDPR compliance med EU-baseret databehandlingsaftale
- ISO 27001 certificeret infrastruktur ejet og drevet af Infercom
- Ingen datalagring - vi træner aldrig på dine data
Kom i gang på minutter
from openai import OpenAI
client = OpenAI(
api_key="your-infercom-key",
base_url="https://api.infercom.ai/v1"
)
response = client.chat.completions.create(
model="MiniMax-M2.7",
messages=[{"role": "user", "content": "Your prompt here"}],
max_tokens=4096
)
print(response.choices[0].message.content)OpenAI-kompatibel API. Drop-in erstatning for din eksisterende kode. Brug modelnavnet MiniMax M2.7 Ultraspeed i dine API-kald.
Betal kun for de tokens, du bruger.
MiniMax M2.7: ofte stillede spørgsmål
428 tokens per sekund i output-throughput og 690 ms Time to First Token, begge serverside-p50 målt ved 10K input / 1K output på vores produktions-API i München. På kortere prompts topper den op til 444 tok/s. For en 229B frontier-reasoning-model er det op til 10x hurtigere end GPU-baserede alternativer, og hvert tal kan reproduceres med vores open source-benchmarkværktøj.
Se alle benchmarks192K tokens (196.608), delt mellem din prompt og modellens svar. Det er lavet til lange agentiske kørsler, kodeændringer på tværs af flere filer og dokumentsamlinger, der ellers skulle deles op over flere forespørgsler.
Hvad et kontekstvindue erJa. MiniMax udgiver M2.7-vægtene åbent på Hugging Face. Du kan sætte modellen i produktion gennem vores API med det samme, og fordi vægtene er åbne, er du aldrig låst til én udbyder.
Hvad open-weight faktisk betyderJa. Infercom leverer M2.7 fra hardware, vi selv ejer, i et Tier III+ datacenter i München i Tyskland. Forespørgsler behandles inden for EU-jurisdiktion uden eksponering mod den amerikanske CLOUD Act, infrastrukturen er ISO 27001-certificeret, og en EU-databehandleraftale er tilgængelig på forespørgsel. Vi træner ikke på dine data.
Sådan fungerer EU-suverænitet herBetaling per token uden minimum og uden månedlig binding: 0,60 EUR per million input-tokens og 2,40 EUR per million output-tokens. Du betaler kun for det, du bruger, og forbrug og omkostninger kan følges live i cloud-portalen.
Se de fulde priserLær mere
API opsætningsguide
Base URL, model-ID'er og kodeeksempler
Performance Benchmarks
Se hvordan MiniMax M2.7 Ultraspeed performer på vores EU-infrastruktur
Agentisk Coding Guide
Opsæt Aider, OpenCode, Cursor med MiniMax
gpt-oss-120b
Når rå throughput betyder mere end frontier-reasoning
EU-suveræn AI
Hvor dine data ligger, og hvem der kan nå dem
Priser
Transparent per-token prissætning
