Kimi K3 ya es real y ya se puede usar. Moonshot AI lo lanzó el 16 de julio de 2026 en Kimi.com, Kimi Work, Kimi Code y API. Lo que llegará el 27 de julio son los pesos completos para descarga, no el primer acceso al modelo.
Su primera gran señal de interés es muy concreta: Kimi K3 ocupa el primer puesto de WebDev Arena en desarrollo frontend, por delante de Claude Fable 5 y GPT-5.6 Sol en esa clasificación. Eso encaja con las pruebas prácticas que muchos usuarios están haciendo con páginas, interfaces y animaciones, pero no demuestra que gane en razonamiento, escritura, agentes o programación de backend.
Respuesta rápida
- Úsalo ya si trabajas en frontend, diseño web, repositorios largos o tareas visuales.
- No sustituyas automáticamente a Claude o GPT-5.6 si tu trabajo depende de fiabilidad general, herramientas concretas o un agente ya integrado.
- Espera al 27 de julio si lo que quieres son los pesos completos y la documentación técnica final.
- No prepares un PC doméstico para ejecutarlo entero: 2,8 billones de parámetros siguen requiriendo infraestructura de servidor aunque el modelo active pocos expertos por token.
Qué es Kimi K3
Kimi K3 es un modelo Mixture of Experts de 2,8 billones de parámetros con visión nativa y una ventana de contexto de un millón de tokens. Moonshot lo presenta como el primer modelo abierto en la escala de tres billones y utiliza dos piezas arquitectónicas propias: Kimi Delta Attention y Attention Residuals.
La arquitectura enruta cada token a 16 de 896 expertos. Esto reduce el cálculo efectivo frente a activar todo el modelo, pero no significa que el archivo descargable pese como un modelo de 16 expertos pequeños. Inferencia y almacenamiento son problemas distintos.
| Dato | Kimi K3 |
|---|---|
| Lanzamiento en servicios | 16 de julio de 2026 |
| Parámetros totales | 2,8 billones |
| Expertos activados | 16 de 896 por token |
| Contexto máximo anunciado | 1 millón de tokens |
| Modalidad | Texto y visión nativa |
| Acceso actual | Kimi.com, Kimi Work, Kimi Code y API |
| Pesos completos | Anunciados para el 27 de julio de 2026 |
| Modelo de API | kimi-k3 |
Por qué es número 1 en WebDev Arena
WebDev Arena no es un examen de preguntas con una respuesta cerrada. Dos modelos reciben el mismo encargo para construir una aplicación web; los usuarios interactúan con ambos resultados y votan cuál prefieren. El ranking utiliza esas comparaciones para estimar la fortaleza de cada modelo.
Por eso el primer puesto de Kimi K3 es relevante para interfaces, landing pages, dashboards, juegos web y clones visuales. Mide algo que un benchmark de funciones aisladas no captura bien: si el resultado parece útil, completo y convincente para una persona.
También tiene límites:
- una interfaz bonita puede ocultar errores funcionales;
- el ranking cambia con nuevos votos y modelos;
- el prompt inicial favorece la generación en un solo intento;
- no equivale a mantener un repositorio durante semanas;
- una posición global no garantiza que gane en tu tipo de web.
La conclusión correcta es: Kimi K3 es ahora una opción de primer nivel para frontend, no que haya ganado todas las categorías de IA.
Kimi K3 frente a Claude Fable 5 y GPT-5.6 Sol
| Prioridad | Opción que probaría primero | Motivo |
|---|---|---|
| Frontend visual en un solo prompt | Kimi K3 | Lidera WebDev Arena en la foto del lanzamiento |
| Trabajo general y agente integrado | Claude Fable 5 o GPT-5.6 Sol | Moonshot reconoce que siguen por delante en rendimiento general |
| Contexto masivo con imágenes | Kimi K3 | Visión nativa y hasta 1 M de contexto |
| Flujo Claude Code ya establecido | Claude Fable 5 | Cambiar de modelo también implica cambiar herramientas y hábitos |
| Codex y ecosistema OpenAI | GPT-5.6 Sol | Integración propia y comportamiento ajustado al producto |
| Pesos para investigar o desplegar | Kimi K3 desde el 27 de julio | Apertura anunciada, pero con requisitos enormes |
La comparación debe hacerse con el mismo repositorio, instrucciones, herramientas y tiempo. Moonshot advierte además que sus propias cifras usan distintos harnesses según el modelo, y que Fable 5 sufrió fallback en una parte de una evaluación. No mezcles una tabla del fabricante con una prueba neutral.
Precio de la API de Kimi K3
Moonshot publica estos precios por millón de tokens:
- Entrada con caché: 0,30 dólares.
- Entrada sin caché: 3 dólares.
- Salida: 15 dólares.
La diferencia entre entrada con y sin caché es enorme. En tareas de programación, conviene conservar instrucciones y contexto estable para reutilizar la caché. Las notas de Kimi Code también avisan de que cambiar de modelo invalida el contexto almacenado; empezar una sesión nueva después del cambio evita consumo innecesario.
El coste real depende sobre todo de la salida razonada. Un millón de tokens de contexto disponible no significa que debas rellenarlo en cada petición.
Disponibilidad y pausa de suscripciones
La demanda del lanzamiento ha llevado a Moonshot a priorizar clientes existentes y pausar temporalmente nuevas suscripciones. El acceso gratuito, la velocidad y la creación de nuevos planes pueden fluctuar mientras se amplía capacidad.
Esto no contradice que el modelo esté publicado: Kimi K3 está disponible, pero no toda persona puede contratar inmediatamente cualquier plan. Si ya tienes acceso, puedes utilizarlo; si no, prueba la web y comprueba el estado actual antes de basar un proyecto en una cuota concreta.
¿Se podrá instalar en local?
“Pesos abiertos” no equivale a “modelo doméstico”. Incluso cuantizado, un modelo de 2,8 billones de parámetros necesita una cantidad extraordinaria de almacenamiento, RAM/VRAM y ancho de banda. Activar 16 expertos reduce el cálculo de cada token, pero el sistema debe conservar o distribuir los expertos.
Para un usuario normal hay tres rutas realistas:
- Kimi.com, para probar el asistente sin configurar nada.
- Kimi Code, para trabajar con repositorios y terminal.
- API, para integrar el modelo y controlar costes.
Los pesos completos serán relevantes para empresas, proveedores de inferencia y comunidades que preparen cuantizaciones o despliegues distribuidos. No recomendamos comprar hardware hasta que existan tamaños, formatos y pruebas independientes.
Veredicto Tecno-V
Kimi K3 merece atención porque combina una escala inédita, visión, contexto largo y una demostración convincente en frontend. Para diseñar una web o generar una primera interfaz, ya es una alternativa real a Claude Fable 5 y GPT-5.6 Sol.
No lo presentaríamos como ganador universal. Su mejor titular es más preciso: Kimi K3 lidera WebDev Arena y entra en la primera división de los modelos de código, mientras Fable 5 y GPT-5.6 Sol mantienen ventajas generales según la propia evaluación de Moonshot.
Consulta nuestras alternativas a Claude, la guía de modelos Claude y límites de Claude Code y el centro de inteligencia artificial útil. Revisaremos esta página cuando se publiquen los pesos y el informe técnico completo el 27 de julio.
Consulta también cómo elaboramos nuestros análisis.
Cómo hemos preparado este análisis
Contrastamos especificaciones, fuentes enlazadas y opciones de compra para ayudarte a decidir. La recomendación final es el criterio editorial de Tecno-V.

Comentarios de la comunidad
Todavía no hay comentarios publicados por la comunidad.