Todos los modelos

MiniMax M3: modelo de MiniMax

Enrutamiento oficial de MiniMax M3 para agentes de código, contexto de 1M y comprensión multimodal nativa.

1M tokens · Text / Vision / Code · Prompt cache

Okou ya no ejecuta MiniMax M3. Esta página se mantiene como referencia de sus especificaciones, precios y benchmarks. Para el mismo tipo de trabajo, usa GPT 5.6 Luna.

Ver GPT 5.6 Luna

¿Qué es MiniMax M3?

1 de junio de 2026 · Modelo de texto oficial MiniMax M3 junto a la serie M2 conservada.

MiniMax M3 es el nuevo modelo de texto oficial de MiniMax para cargas de código y agentes. MiniMax lo describe como una combinación de capacidad frontier de código, una ventana de contexto de 1M tokens y comprensión multimodal nativa.

Las entradas M2 existentes siguen disponibles, mientras M3 es el valor predeterminado del proveedor MiniMax para nuevas selecciones.

Qué destaca de MiniMax M3

Características principales de arquitectura y capacidades.

M3 usa MiniMax Sparse Attention para contexto ultralargo. La API oficial soporta hasta 1M tokens con un mínimo garantizado de 512K, soporte automático de caché de prompts y comprensión multimodal nativa.

Especificaciones rápidas

FamiliaMiniMax M3
ModalidadesTexto, visión, código
IdiomasMultilingüe
Ventana de contexto1M tokens (mínimo garantizado de 512K)
Caché de promptsSoportado con lecturas automáticas de caché

Benchmarks de MiniMax M3

PostTrainBench Livereportado por el proveedor
Puesto #3
BrowseCompreportado por el proveedor
83.5

Precios de MiniMax M3

Precio de lista del proveedor, por 1M de tokens.

Input$0.60
Output$2.40
Lectura de caché$0.12
Escritura de cachéNo facturado

Cómo se comporta MiniMax M3 en la práctica

Comportamiento observado en ejecuciones de agentes en producción.

Agentes de código

La mejor opción de MiniMax para asistentes de código, cadenas largas de herramientas y trabajo de repositorio en varios pasos.

Contexto largo

Una ventana de contexto de 1M permite mantener documentos grandes, código, logs y trabajo previo dentro del alcance sin cambiar de familia de modelos.

Multimodal

La comprensión visual nativa hace que M3 encaje mejor que M2 cuando el flujo incluye capturas de pantalla, diagramas o artefactos visuales.

Mejores tareas para MiniMax M3

El agente de código que debe quedarse en MiniMax

Ediciones de repositorio, debugging y flujos agénticos de código donde tu despliegue ya usa claves MiniMax pero necesita un modelo de código más fuerte que M2.1.

La revisión de contexto largo

Pull requests grandes, logs, notebooks o documentos de diseño que deberían mantenerse en un solo contexto de modelo mientras el agente razona y edita.

MiniMax M3 vs otros modelos

MiniMax M3 vs Claude Sonnet 4.6

Sonnet 4.6 sigue siendo la base de fiabilidad para uso complejo de herramientas en inglés. M3 es mucho más barato y atractivo para agentes de código nativos de MiniMax, pero debe validarse en flujos críticos.

Conclusión: ¿deberías usar MiniMax M3?

Usa MiniMax M3 cuando quieres el modelo oficial de código de MiniMax con contexto largo y soporte visual. Conserva M2.1 cuando importan más el costo y la compatibilidad.

Disponibilidad de MiniMax M3 en Okou

MiniMax M3 se ha retirado del catálogo de Okou, por lo que ya no puede seleccionarse en el chat ni en un workflow, y tampoco está disponible con tu propia clave de API. GPT 5.6 Luna cubre el mismo nivel de ahorro de costes.