Tous les modèles

MiniMax M3 : le modèle de MiniMax

Routage officiel MiniMax M3 pour les agents de codage, contexte 1M et compréhension multimodale native.

1M tokens · Text / Vision / Code · Prompt cache

Okou n'exécute plus MiniMax M3. Cette page est conservée comme référence pour ses caractéristiques, ses tarifs et ses benchmarks. Pour le même type de travail, utilisez GPT 5.6 Luna.

Voir GPT 5.6 Luna

Qu'est-ce que MiniMax M3 ?

1er juin 2026 · Modèle texte officiel MiniMax M3 aux côtés de la série M2 conservée.

MiniMax M3 est le nouveau modèle texte officiel de MiniMax pour les charges de codage et agentiques. MiniMax le décrit comme combinant des capacités de codage de pointe, une fenêtre de contexte de 1 million de tokens et une compréhension multimodale native.

Les entrées M2 existantes restent disponibles, tandis que M3 devient le modèle MiniMax par défaut pour les nouvelles sélections.

Ce qui distingue MiniMax M3

Principales caractéristiques d'architecture et de capacités.

M3 utilise MiniMax Sparse Attention pour un contexte ultra-long. L'API officielle prend en charge jusqu'à 1 million de tokens avec un minimum garanti de 512K, une prise en charge automatique du cache de prompt et une compréhension multimodale native.

Spécifications en un coup d'œil

FamilleMiniMax M3
ModalitésTexte, vision, code
LanguesMultilingue
Fenêtre de contexte1M tokens (minimum garanti de 512K)
Cache de promptPris en charge avec lectures de cache automatiques

Benchmarks de MiniMax M3

PostTrainBench Liveannoncé par l'éditeur
Rang n°3
BrowseCompannoncé par l'éditeur
83,5

Tarification de MiniMax M3

Prix catalogue fournisseur, par million de tokens.

Entrée$0.60
Sortie$2.40
Lecture cache$0.12
Écriture cacheNon facturé

Comment MiniMax M3 se comporte en pratique

Comportement observé lors d'exécutions d'agents en production.

Agents de codage

La meilleure option MiniMax pour les assistants de codage, les longues chaînes d'outils et le travail multi-étapes sur dépôt.

Contexte long

Une fenêtre de contexte de 1M permet aux agents de garder en portée de grands documents, du code, des journaux et le travail antérieur sans changer de famille de modèles.

Multimodal

La compréhension native de la vision rend M3 plus adapté que M2 lorsque captures d'écran, schémas ou artefacts visuels font partie du workflow.

Meilleures tâches d'agent pour MiniMax M3

L'agent de codage qui doit rester sur MiniMax

Édition de dépôt, débogage et flux de codage agentique où votre déploiement utilise déjà des clés MiniMax mais a besoin d'un modèle de codage plus fort que M2.1.

La revue en contexte long

Grandes pull requests, journaux, notebooks ou documents de conception qui doivent rester dans un seul contexte de modèle pendant que l'agent raisonne et édite.

MiniMax M3 vs autres modèles

MiniMax M3 vs Claude Sonnet 4.6

Sonnet 4.6 reste la référence en fiabilité sur l'utilisation d'outils complexe en anglais. M3 est bien moins cher et attractif pour les agents de codage natifs MiniMax, mais doit être validé sur les workflows critiques.

En résumé : devriez-vous utiliser MiniMax M3 ?

Utilisez MiniMax M3 lorsque vous voulez le modèle de codage officiel de MiniMax avec contexte long et prise en charge de la vision. Conservez M2.1 lorsque le coût et la compatibilité priment.

Disponibilité de MiniMax M3 sur Okou

MiniMax M3 a été retiré de l'offre Okou : il ne peut plus être sélectionné dans le chat ni dans un workflow, et il n'est pas disponible avec votre propre clé API. GPT 5.6 Luna couvre le même palier économique.