Todos os modelos

MiniMax M3: o modelo da MiniMax

Roteamento oficial do MiniMax M3 para agentes de codificação, contexto de 1M e compreensão multimodal nativa.

1M tokens · Text / Vision / Code · Prompt cache

A Okou não executa mais o MiniMax M3. Esta página é mantida como referência de especificações, preços e benchmarks. Para o mesmo tipo de trabalho, use o GPT 5.6 Luna.

Ver GPT 5.6 Luna

O que é o MiniMax M3?

1º de junho de 2026 · Modelo de texto oficial MiniMax M3 ao lado da série M2 mantida.

O MiniMax M3 é o novo modelo de texto oficial da MiniMax para cargas de trabalho de codificação e agênticas. A MiniMax o descreve como a combinação de capacidade de codificação de fronteira, uma janela de contexto de 1M de tokens e compreensão multimodal nativa.

As entradas existentes do M2 permanecem disponíveis, enquanto o M3 é o padrão do provedor MiniMax para novas seleções.

O que se destaca no MiniMax M3

Principais recursos de arquitetura e capacidade.

O M3 usa MiniMax Sparse Attention para contexto ultralongo. A API oficial oferece suporte a até 1M de tokens com um mínimo garantido de 512K, suporte automático a cache de prompt e compreensão multimodal nativa.

Especificações em resumo

FamíliaMiniMax M3
ModalidadesTexto, visão, código
IdiomasMultilíngue
Janela de contexto1M tokens (mínimo garantido de 512K)
Cache de promptCompatível com leituras de cache automáticas

Benchmarks do MiniMax M3

PostTrainBench Livereportado pelo fornecedor
Posição #3
BrowseCompreportado pelo fornecedor
83.5

Preços do MiniMax M3

Preço de tabela do provedor, por 1M de tokens.

Entrada$0.60
Saída$2.40
Leitura de cache$0.12
Escrita de cacheNão cobrado

Como o MiniMax M3 se comporta na prática

Comportamento observado em execuções de agentes em produção.

Agentes de codificação

A melhor opção da MiniMax para assistentes de codificação, longas cadeias de ferramentas e trabalho de repositório de várias etapas.

Contexto longo

Uma janela de contexto de 1M permite que os agentes mantenham grandes documentos, código, logs e trabalho anterior em escopo sem trocar de família de modelos.

Multimodal

A compreensão de visão nativa torna o M3 um encaixe melhor que o M2 quando screenshots, diagramas ou artefatos visuais fazem parte do fluxo de trabalho.

Melhores tarefas de agente para o MiniMax M3

O agente de codificação que precisa permanecer na MiniMax

Edições de repositório, depuração e fluxos de codificação agêntica em que sua implantação já usa chaves da MiniMax, mas precisa de um modelo de codificação mais forte que o M2.1.

A execução de revisão de contexto longo

Grandes pull requests, logs, notebooks ou documentos de design que devem permanecer em um único contexto de modelo enquanto o agente raciocina e edita.

MiniMax M3 vs outros modelos

MiniMax M3 vs Claude Sonnet 4.6

O Sonnet 4.6 permanece a base de confiabilidade para uso complexo de ferramentas em inglês. O M3 é muito mais barato e atraente para agentes de codificação nativos da MiniMax, mas deve ser validado em fluxos de trabalho críticos.

Conclusão: você deveria usar o MiniMax M3?

Use o MiniMax M3 quando quiser o modelo oficial de codificação da MiniMax com contexto longo e suporte a visão. Mantenha o M2.1 quando custo e compatibilidade importarem mais.

Disponibilidade do MiniMax M3 na Okou

O MiniMax M3 foi removido do catálogo da Okou, portanto não pode mais ser selecionado no chat nem em um workflow, e não está disponível com sua própria chave de API. O GPT 5.6 Luna cobre o mesmo nível de economia.