Tutti i modelli

MiniMax M3: il modello di MiniMax

Routing MiniMax M3 ufficiale per agenti di programmazione, contesto da 1M e comprensione multimodale nativa.

1M tokens · Text / Vision / Code · Prompt cache

Okou non esegue più MiniMax M3. Questa pagina resta come riferimento per specifiche, prezzi e benchmark. Per lo stesso tipo di lavoro, usa GPT 5.6 Luna.

Vedi GPT 5.6 Luna

Cos'è MiniMax M3?

1 giugno 2026 · Modello testuale MiniMax M3 ufficiale, accanto alla serie M2 mantenuta.

MiniMax M3 è il nuovo modello testuale MiniMax ufficiale per carichi di lavoro di programmazione e agentici. MiniMax lo descrive come la combinazione di capacità di programmazione di frontiera, una finestra di contesto da 1M di token e comprensione multimodale nativa.

Le voci M2 esistenti restano disponibili, mentre M3 è il predefinito del provider MiniMax per le nuove selezioni.

Cosa rende notevole MiniMax M3

Caratteristiche principali di architettura e capacità.

M3 utilizza la MiniMax Sparse Attention per un contesto ultra-lungo. L'API ufficiale supporta fino a 1M di token con un minimo garantito di 512K, supporto automatico della prompt cache e comprensione multimodale nativa.

Specifiche in breve

FamigliaMiniMax M3
ModalitàTesto, visione, codice
LingueMultilingue
Finestra di contesto1M token (minimo garantito 512K)
Prompt cachingSupportato con letture automatiche dalla cache

Benchmark di MiniMax M3

PostTrainBench Liveriportato dal vendor
Posizione #3
BrowseCompriportato dal vendor
83,5

Prezzi di MiniMax M3

Prezzo di listino del provider, per 1M di token.

Input$0.60
Output$2.40
Lettura cache$0.12
Scrittura cacheNon fatturato

Come si comporta MiniMax M3 nella pratica

Comportamento osservato dalle esecuzioni di agenti in produzione.

Agenti di programmazione

La migliore opzione MiniMax per assistenti di programmazione, lunghe catene di strumenti e lavoro multi-step sui repository.

Contesto lungo

Una finestra di contesto da 1M permette agli agenti di tenere in ambito grandi documenti, codice, log e lavoro precedente senza cambiare famiglia di modelli.

Multimodale

La comprensione visiva nativa rende M3 più adatto di M2 quando screenshot, diagrammi o artefatti visivi fanno parte del flusso di lavoro.

I migliori task per agenti con MiniMax M3

L'agente di programmazione che deve restare su MiniMax

Modifiche ai repository, debugging e flussi di programmazione agentica in cui il tuo deployment usa già chiavi MiniMax ma necessita di un modello di programmazione più forte di M2.1.

L'esecuzione di revisione a contesto lungo

Grandi pull request, log, notebook o documenti di progettazione che dovrebbero restare in un unico contesto del modello mentre l'agente ragiona e modifica.

MiniMax M3 vs altri modelli

MiniMax M3 vs Claude Sonnet 4.6

Sonnet 4.6 resta la baseline per l'affidabilità sull'uso complesso degli strumenti in inglese. M3 è molto più economico e interessante per gli agenti di programmazione nativi MiniMax, ma andrebbe validato sui flussi di lavoro critici.

In sintesi: dovresti usare MiniMax M3?

Usa MiniMax M3 quando vuoi il modello di programmazione MiniMax ufficiale con contesto lungo e supporto visivo. Mantieni M2.1 quando costo e compatibilità contano di più.

Disponibilità di MiniMax M3 su Okou

MiniMax M3 è stato rimosso dalla lineup di Okou, quindi non può più essere selezionato in chat né in un workflow, e non è disponibile con la tua chiave API. GPT 5.6 Luna copre lo stesso livello di risparmio.