Kimi K3: el modelo frontera de 2,8T de Moonshot
El modelo Mixture-of-Experts de 2,8 billones de parámetros de Moonshot, con ventana de contexto de 1M de tokens, entrada nativa de imagen y vídeo, y pesos abiertos.
1M tokens · Text / Vision / Video / Code · Prompt cache
Okou no ejecuta Kimi K3. Esta página es una referencia de sus especificaciones, precios y benchmarks. Para el mismo tipo de trabajo en Okou, hoy usa Claude Fable 5.
Ver Claude Fable 5Kimi K3 es el modelo frontera de Moonshot AI, lanzado el 16 de julio de 2026: una red Mixture-of-Experts dispersa con 2,8 billones de parámetros totales, 16 de 896 expertos activos por token, ventana de contexto de 1.048.576 tokens y entrada nativa de imagen y vídeo. Artificial Analysis le da 57,1 en el Intelligence Index v4.1: cuarto entre las configuraciones probadas, por detrás de Claude Fable 5 (59,9) y GPT 5.6 Sol (58,9), y por delante de Claude Opus 4.8.
El precio de lista es de $3.00 por millón de tokens de entrada, $0.30 con acierto de caché y $15.00 por millón de tokens de salida, plano en toda la ventana y sin recargo por contexto largo. Los pesos abiertos se publicaron en Hugging Face el 27 de julio de 2026 bajo la Kimi K3 License de la propia Moonshot. Okou no ejecuta Kimi K3. El modelo más cercano del catálogo de Okou es Claude Fable 5, que iguala la ventana de 1M de tokens y encabeza ese mismo Intelligence Index.
¿Qué es Kimi K3?
16 de julio de 2026 · La línea frontera de Moonshot. Sucesor de la serie Kimi K2, incluido K2.7 Code.
Kimi K3 es el modelo frontera de Moonshot AI, presentado el 16 de julio de 2026 y servido a través de la app de Kimi y de la API de Kimi como kimi-k3. Es un modelo Mixture-of-Experts disperso: 2,8 billones de parámetros totales con 16 de 896 expertos activos por token, y eso es lo que mantiene el coste de inferencia cerca del de un modelo denso de gama media pese al tamaño.
El salto respecto a la línea K2 es mayor en el trabajo de agente de larga duración. En la suite de lanzamiento de Moonshot, K3 encabeza a todos los modelos probados en Program Bench, SWE Marathon, BrowseComp, SpreadsheetBench 2 y Automation Bench, mientras queda por detrás de Claude Fable 5 en FrontierSWE y de GPT 5.6 Sol en DeepSWE. En el Elo GDPval-AA v2 de Artificial Analysis, que puntúa trabajo de conocimiento económicamente valioso, alcanza 1668, frente a los 1190 de Kimi K2.6 y por encima de los 1600 de Claude Opus 4.8.
Qué destaca de Kimi K3
Características principales de arquitectura y capacidades.
K3 combina la pila MoE con dos mecanismos de eficiencia que Moonshot llama Kimi Delta Attention y Attention Residuals, a los que atribuye una decodificación hasta 6,3 veces más rápida, y sirve su ventana de 1.048.576 tokens a un precio único, sin tramos de contexto. La salida llega a 131.072 tokens por defecto y puede configurarse más alta dentro de la misma ventana. La entrada admite texto, imágenes y vídeo; la salida es texto. La API en platform.kimi.ai es compatible con OpenAI, y los pesos —unos 594 GB en MXFP4— están publicados para autoalojamiento.
Especificaciones rápidas
Benchmarks de Kimi K3
Las puntuaciones de código, agentes y visión son las cifras de lanzamiento de Moonshot, con todos los modelos al máximo esfuerzo de razonamiento; el Intelligence Index y el Elo GDPval son mediciones independientes de Artificial Analysis. Una tabla del proveedor es un techo, no una garantía, y hay evaluadores independientes que reportan una tasa de alucinación bastante superior a la que publica Moonshot.
Precios de Kimi K3
Precio de lista del proveedor, por 1M de tokens.
Cómo se comporta Kimi K3 en la práctica
Comportamiento reportado por el proveedor en su material de lanzamiento y por evaluaciones independientes.
Ejecuciones de agente largas
Los benchmarks que K3 gana con claridad —SWE Marathon, Automation Bench, BrowseComp— miden mantener el rumbo durante cientos de pasos, no acertar a la primera. Encaja con cómo Moonshot presenta el modelo: primero motor de agentes.
Precio plano en 1M de tokens
La ventana completa de 1.048.576 tokens se factura a una sola tarifa, sin recargo a partir de cierto umbral. La ventana de 1M de GPT-5.5, en cambio, cobra distinto la entrada por encima de 272K tokens, y eso es lo que encarece las ejecuciones muy largas en un solo contexto.
Coste por tarea
Artificial Analysis midió $0.94 por tarea en su índice: aproximadamente la mitad de los $1.80 de Claude Opus 4.8 y en línea con los $1.04 de GPT 5.6 Sol. Moonshot cita tasas de acierto de caché por encima del 90% en cargas de código, lo que acerca el coste efectivo de entrada a la tarifa de $0.30.
Mejores tareas para Kimi K3
Leer un repositorio entero en un solo contexto
Una ventana de 1M de tokens a precio plano cabe una base de código completa, un trimestre de tickets de soporte o un conjunto documental largo en una sola petición, sin trocear y sin recargo esperando al final de la ventana.
Agentes de navegación e investigación
BrowseComp 91,2 es la puntuación más alta de la tabla de lanzamiento de Moonshot, por delante de GPT 5.6 Sol y Claude Fable 5. La investigación web de varios saltos —encontrar la fuente, seguir la cita, cuadrar las cifras— es donde más se nota el entrenamiento agéntico de K3.
Entrada de capturas y vídeo
K3 acepta imágenes y vídeo de forma nativa, así que los agentes de QA que leen capturas y las tuberías que procesan clips grabados no necesitan un modelo de visión aparte delante del modelo de razonamiento.
Cuándo evitar Kimi K3
Evita K3 cuando el trabajo exija un perfil de seguridad auditado por el proveedor o soporte empresarial contractual en EE. UU. o la UE; cuando los prompts sean tan cortos que la tarifa de caché de $0.30 nunca se aplique y baste un modelo de bajo coste; y cuando el objetivo sea autoalojar: 594 GB de pesos MXFP4 piden 64 aceleradores o más para producción. Las pruebas independientes también han medido tasas de alucinación bastante por encima de la cifra publicada por Moonshot, así que las salidas con muchos datos siguen necesitando verificación. Y en Okou, sencillamente, K3 no es una opción.
Kimi K3 vs otros modelos
Kimi K3 vs Claude Fable 5
Fable 5 gana en el Intelligence Index (59,9 frente a 57,1) y en FrontierSWE (86,6 frente a 81,2); K3 se lleva Terminal-Bench 2.1, BrowseComp y SWE Marathon. Ambos tienen ventana de 1M de tokens. Lo que suele decidir es precio y disponibilidad: Fable 5 cuesta $10/$50 por millón de tokens y se ejecuta en Okou; K3 cuesta $3/$15 y no.
Kimi K3 vs GPT 5.6 Sol
Sol saca 58,9 en el Intelligence Index frente a 57,1 de K3, y gana DeepSWE (73,0 frente a 67,5) y Terminal-Bench por medio punto. K3 responde con 1M de ventana frente a los 400K de Sol y un tercio del precio de entrada. El coste medido por tarea queda cerca: $0.94 para K3, $1.04 para Sol.
Kimi K3 vs Claude Opus 4.8
K3 va por delante de Opus 4.8 en la mayoría de suites agénticas y en el Elo GDPval-AA (1668 frente a 1600), a $3/$15 contra $5/$25. Opus 4.8 conserva la ventaja en fiabilidad del enrutado de herramientas en producción y está disponible en Okou, donde K3 no lo está.
Kimi K3 vs Kimi K2.7 Code
K3 es el sucesor: 1M de tokens de contexto frente a 256K, entrada de vídeo nativa y un techo mucho más alto en benchmarks agénticos, a un precio unas tres veces mayor ($3/$15 frente a $1.14/$4.80). Ninguno se ejecuta hoy en Okou: K2.7 Code fue retirado y K3 nunca se añadió.
Conclusión: ¿deberías usar Kimi K3?
El modelo de pesos abiertos más potente publicado hasta ahora, y el primero que compite con la frontera cerrada en trabajo de agente a un tercio del precio de Fable 5. Okou no lo ejecuta, así que lee esta página como referencia: para las mismas cargas agénticas de 1M de tokens en Okou, Claude Fable 5 es lo más parecido.
Preguntas frecuentes
¿Puedo usar Kimi K3 en Okou?
Hoy no. Kimi K3 no forma parte del catálogo de modelos de Okou: no se puede elegir en el chat ni en un workflow, y tampoco se puede añadir con tu propia clave de API. Claude Fable 5 es el modelo más cercano que Okou sí ejecuta: la misma ventana de contexto de 1M de tokens y la mejor puntuación en ese mismo Intelligence Index.
¿Cuándo se lanzó Kimi K3?
Moonshot AI lanzó Kimi K3 el 16 de julio de 2026 en la app de Kimi y en la API de Kimi, y publicó los pesos abiertos en Hugging Face el 27 de julio de 2026.
¿Cuál es la ventana de contexto de Kimi K3?
1.048.576 tokens, contando entrada y salida juntas, con precio plano en toda la ventana. La salida es de 131.072 tokens por defecto y puede configurarse más alta dentro del contexto restante.
¿Cuánto cuesta Kimi K3?
$3.00 por millón de tokens de entrada sin acierto de caché, $0.30 por millón con acierto y $15.00 por millón de tokens de salida, sin recargo por contexto largo. En la app de Kimi, los planes de pago empiezan en $19 al mes con ventana de 256K, y la ventana completa de 1M se desbloquea a partir de $39 al mes.
¿Kimi K3 es de código abierto?
Los pesos son abiertos bajo la Kimi K3 License de la propia Moonshot, que se lee como una MIT con dos condiciones comerciales: un negocio de model-as-a-service necesita un acuerdo aparte con Moonshot cuando sus ingresos superan los $20M en cualquier periodo de 12 meses, y todo producto con más de 100 millones de usuarios activos mensuales o $20M de ingresos mensuales debe mostrar "Kimi K3" en su interfaz.
Alternativas
Disponibilidad de Kimi K3 en Okou
Kimi K3 no forma parte del catálogo de modelos de Okou, así que no se puede elegir ni en el chat ni en un workflow, y tampoco se puede añadir con tu propia clave de API. Claude Fable 5 es el modelo más cercano que Okou ejecuta hoy.