Kimi K3 es lo que ocurre cuando la expresión «ejecútalo tú mismo» se lleva hasta la escala de un centro de datos. Sus pesos se pueden descargar, el modelo puede permanecer dentro del perímetro de una organización y su inteligencia se encuentra cerca de la frontera. Sin embargo, el checkpoint oficial comprimido ocupa aproximadamente 1,4 terabytes. La privacidad es posible; la sencillez, no.
Artificial Analysis sitúa ahora a Kimi K3 en torno a 60 en su Intelligence Index actual, empatado con el GLM-5.3 insignia dentro del grupo líder de pesos abiertos. El texto anterior del sitio hablaba de una puntuación cercana a 80 y de un quinto puesto en una escala previa. Esa fotografía ha caducado. La puntuación nueva no significa que su inteligencia haya empeorado; lo que cambió fue la regla de medir.
La historia que cuenta Moonshot para tareas concretas sigue siendo impresionante. La empresa comunica 88.3 en Terminal-Bench 2.1, 67.5 en DeepSWE y 81.2 en FrontierSWE. La comprensión nativa de imágenes y vídeo, junto con un contexto de un millón de tokens, convierte a K3 en algo más que un motor de texto. Un sistema privado puede examinar material visual, repositorios grandes e historiales extensos sin enviarlos a un proveedor externo de modelos.
Entonces llega la factura de la física. Su arquitectura mixture-of-experts activa aproximadamente 104 mil millones de parámetros por token, pero el sistema debe almacenar y enrutar de todos modos el conjunto completo de 2,8 billones de parámetros. Las instalaciones experimentales parten de numerosos aceleradores con mucha memoria; una producción seria puede necesitar decenas. Que solo algunos especialistas trabajen en cada caso no permite que el hospital derribe los demás consultorios.
La escalera competitiva también ha cambiado. GLM-5.3-Flash ofrece un checkpoint oficial FP8 de 306 GiB, derechos MIT y una capacidad independiente ligeramente inferior. Qwen3.8-Flash-Next baja hacia los 75 GB con una cuantización agresiva y solo seis mil millones de parámetros activos, aunque su licencia es más restrictiva. Qwen3.8-27B cabe en unos 18 GB a cuatro bits. Ninguno iguala todos los puntos fuertes de Kimi, pero todos son mucho más fáciles de poseer.
Por eso Kimi K3 sigue siendo un hito sin seguir siendo una recomendación práctica entre los dos primeros puestos. Elígelo cuando tu organización ya opere la infraestructura necesaria y su perfil multimodal gane en una evaluación comparable. Para todos los demás, la revolución de los pesos abiertos ofrece ahora puertas más pequeñas para entrar en el mismo edificio.