Alle Modelle

MiniMax M3: Modell von MiniMax

Offizielles MiniMax-M3-Routing für Coding-Agenten, 1M Kontext und native multimodale Verarbeitung.

1M tokens · Text / Vision / Code · Prompt cache

Okou führt MiniMax M3 nicht mehr aus. Diese Seite bleibt als Referenz für Spezifikationen, Preise und Benchmarks erhalten. Für dieselbe Art von Arbeit nutze GPT 5.6 Luna.

GPT 5.6 Luna ansehen

Was ist MiniMax M3?

1. Juni 2026 · Offizielles MiniMax-M3-Textmodell neben der beibehaltenen M2-Serie.

MiniMax M3 ist das neue offizielle MiniMax-Textmodell für Coding- und Agent-Workloads. MiniMax beschreibt es als Kombination aus Frontier-Coding-Fähigkeit, 1M-Token-Kontextfenster und nativem multimodalem Verständnis.

Die bestehenden M2-Einträge bleiben verfügbar, während M3 für neue Auswahlen der Default des MiniMax-Providers ist.

Das zeichnet MiniMax M3 aus

Architektur- und Funktionsmerkmale im Überblick.

M3 nutzt MiniMax Sparse Attention für Ultra-Langkontext. Die offizielle API unterstützt bis zu 1M Token mit 512K garantierter Mindestgröße, automatische Prompt-Cache-Unterstützung und natives multimodales Verständnis.

Technische Daten auf einen Blick

FamilieMiniMax M3
ModalitätenText, Vision, Code
SprachenMehrsprachig
Kontextfenster1M Token (512K garantiertes Minimum)
Prompt cachingUnterstützt mit automatischen Cache-Reads

MiniMax M3 Benchmarks

PostTrainBench LiveAnbieterangabe
Rang #3
BrowseCompAnbieterangabe
83.5

MiniMax M3 Preise

Listenpreis des Anbieters, pro 1 Mio. Tokens.

Input$0.60
Output$2.40
Cache Read$0.12
Cache WriteNicht abgerechnet

Wie sich MiniMax M3 in der Praxis verhält

Beobachtetes Verhalten aus produktiven Agent-Durchläufen.

Coding-Agenten

Die beste MiniMax-Option für Coding-Assistenten, lange Tool-Ketten und mehrstufige Repository-Arbeit.

Langkontext

Ein 1M-Kontextfenster hält große Dokumente, Code, Logs und frühere Arbeit im Scope, ohne die Modellfamilie zu wechseln.

Multimodal

Natives Vision-Verständnis macht M3 geeigneter als M2, wenn Screenshots, Diagramme oder visuelle Artefakte Teil des Workflows sind.

Beste Agent-Aufgaben für MiniMax M3

Der Coding-Agent, der bei MiniMax bleiben muss

Repository-Edits, Debugging und agentische Coding-Flows, bei denen dein Deployment bereits MiniMax-Keys nutzt, aber ein stärkeres Coding-Modell als M2.1 braucht.

Der Review-Lauf mit Langkontext

Große Pull Requests, Logs, Notebooks oder Designdokumente, die in einem Modellkontext bleiben sollen, während der Agent denkt und editiert.

MiniMax M3 vs andere Modelle

MiniMax M3 vs Claude Sonnet 4.6

Sonnet 4.6 bleibt die Basislinie für Zuverlässigkeit bei komplexer englischer Tool-Nutzung. M3 ist deutlich günstiger und attraktiv für MiniMax-native Coding-Agenten, sollte aber für kritische Workflows validiert werden.

Fazit: Solltest du MiniMax M3 nutzen?

Nutze MiniMax M3, wenn du das offizielle MiniMax-Coding-Modell mit Langkontext und Vision-Support willst. Behalte M2.1, wenn Kosten und Kompatibilität wichtiger sind.

Verfügbarkeit von MiniMax M3 auf Okou

MiniMax M3 wurde aus dem Okou-Angebot entfernt und lässt sich daher weder im Chat noch in einem Workflow auswählen; auch mit eigenem API-Schlüssel ist das Modell nicht verfügbar. GPT 5.6 Luna deckt dieselbe kostensparende Stufe ab.