La empresa china Moonshot AI presentó Kimi K3, un modelo de inteligencia artificial de 2.8 billones de parámetros que se colocó en el primer lugar de una evaluación pública de programación web, por encima de sistemas desarrollados por Anthropic y OpenAI.
El resultado ha generado atención internacional porque muestra una reducción de la distancia entre los modelos chinos y los sistemas propietarios que dominan el mercado estadounidense, especialmente en tareas de desarrollo de interfaces, programación prolongada y ejecución autónoma de proyectos.
Kimi K3 obtuvo 1,679 puntos en la clasificación general de Frontend Code Arena, frente a los 1,631 registrados por Claude Fable 5 y los 1,618 de GPT-5.6 Sol. La plataforma advierte que la puntuación del modelo chino todavía es preliminar y se basaba en 1,757 evaluaciones al momento de actualizar la tabla.
Lidera una prueba específica de programación web
Frontend Code Arena compara modelos mediante tareas de desarrollo de páginas y aplicaciones web que exigen razonamiento, uso de herramientas y ejecución de instrucciones en varias etapas.
Los usuarios revisan resultados generados por dos sistemas sin conocer inicialmente cuál produjo cada respuesta y votan por la alternativa que consideran mejor.
El primer lugar de Kimi K3 constituye un avance importante, pero no significa que sea superior a Claude o GPT en todas las áreas. Las clasificaciones pueden variar según el tipo de tarea, la configuración del modelo, el número de evaluaciones y la metodología utilizada.
En otras pruebas profesionales, científicas, financieras o de ingeniería de software, los modelos de OpenAI y Anthropic mantienen resultados superiores en distintas categorías. Por tanto, el desempeño de Kimi debe interpretarse como una señal de competitividad en programación web, no como una victoria absoluta sobre todos sus rivales.
Un modelo de 2.8 billones de parámetros
Moonshot describe Kimi K3 como su modelo insignia más potente. El sistema posee 2.8 billones de parámetros totales, comprensión visual nativa y una ventana de contexto de hasta un millón de tokens, suficiente para procesar grandes códigos, documentos extensos y flujos de trabajo con abundante información.
La cantidad total de parámetros no implica que todos sean utilizados simultáneamente. Kimi K3 emplea una arquitectura de “mezcla de expertos” que selecciona 16 de sus 896 módulos especializados para procesar cada token.
Este sistema busca reducir la cantidad de recursos activados durante cada operación, aunque ejecutar localmente un modelo de esta magnitud continuará requiriendo una infraestructura informática especializada.
Moonshot sostiene que las modificaciones arquitectónicas introducidas en K3 mejoraron aproximadamente 2.5 veces la eficiencia de escalamiento frente a la generación anterior. Esa afirmación procede de evaluaciones de la propia empresa y deberá contrastarse cuando se publique el informe técnico completo.
Diseñado para tareas prolongadas
La empresa afirma que Kimi K3 fue optimizado para proyectos de programación que pueden extenderse durante horas y requieren poca supervisión humana.
Entre sus capacidades promocionadas figuran la comprensión de grandes repositorios de código, el uso coordinado de herramientas, la creación de aplicaciones, el desarrollo de videojuegos tridimensionales y la utilización de información visual para corregir interfaces o diseños.
Moonshot también lo dirige hacia actividades de conocimiento que combinan investigación, análisis, redacción, elaboración de presentaciones y revisión de resultados.
Estas funciones forman parte de una tendencia hacia modelos que no solo responden preguntas, sino que dividen objetivos complejos en etapas y ejecutan acciones de manera más autónoma.
¿Es realmente un modelo de código abierto?
Moonshot promociona Kimi K3 como el primer modelo abierto de la categoría de tres billones de parámetros. Sin embargo, la expresión más precisa en este momento es modelo de pesos abiertos anunciado, porque sus archivos completos todavía no han sido publicados.
La compañía informó que liberará los pesos antes del 27 de julio de 2026, junto con detalles adicionales sobre la arquitectura, el entrenamiento y las evaluaciones. Hasta que se produzca esa publicación, Arena continúa identificándolo como un modelo propietario.
Los pesos son los valores numéricos aprendidos durante el entrenamiento. Cuando una empresa permite descargarlos, investigadores y compañías pueden ejecutar el modelo en sus propias infraestructuras, adaptarlo o integrarlo a otros sistemas, dependiendo de las condiciones de su licencia.
Eso no significa necesariamente que todo el software, los datos de entrenamiento y el proceso de desarrollo sean públicos. Por esa razón, “pesos abiertos” y “código abierto” no siempre son conceptos equivalentes.
Presiona también por sus precios
Arena presenta a Kimi K3 con un precio aproximado de tres dólares por cada millón de tokens de entrada y 15 dólares por cada millón de tokens de salida.
En la misma clasificación, GPT-5.6 Sol aparece con tarifas de cinco dólares de entrada y 30 dólares de salida, mientras Claude Fable 5 figura con precios de diez y 50 dólares, respectivamente. Las tarifas pueden cambiar según la longitud del contexto, el uso de caché, la región y el proveedor que comercialice el servicio.
OpenAI confirma que el precio general anunciado para GPT-5.6 Sol es de cinco dólares por millón de tokens de entrada y 30 dólares por la salida.
La combinación de rendimiento competitivo y menor costo podría resultar atractiva para empresas que procesan grandes cantidades de información o ejecutan agentes de programación continuamente.
Reacción en Estados Unidos
El avance llamó la atención de David Sacks, inversionista tecnológico y copresidente del Consejo de Asesores Presidenciales en Ciencia y Tecnología de Estados Unidos.
Sacks consideró preocupante que un modelo chino alcanzara por primera vez el primer puesto de Frontend Code Arena y utilizó el resultado para cuestionar propuestas regulatorias que, a su juicio, podrían ralentizar el desarrollo tecnológico estadounidense.
Anastasios Angelopoulos, cofundador y director ejecutivo de Arena, describió el lanzamiento como uno de los acontecimientos más importantes del año para los modelos abiertos y señaló que nuevos resultados podrían confirmar la posición competitiva de Kimi.
El lanzamiento se produce mientras Estados Unidos mantiene restricciones sobre el acceso de China a determinados procesadores avanzados. Las empresas chinas han respondido desarrollando nuevas arquitecturas, modelos más eficientes e infraestructura tecnológica propia.
Persisten interrogantes sobre seguridad y entrenamiento
El crecimiento de los modelos de pesos abiertos también plantea preocupaciones sobre seguridad, ya que una vez publicados pueden ser modificados y ejecutados sin depender de los controles establecidos por la empresa creadora.
Además, Anthropic ha acusado anteriormente a Moonshot y otras compañías chinas de utilizar técnicas de destilación para reproducir capacidades de Claude. Moonshot no ha reconocido esas acusaciones, mientras China las ha calificado como infundadas.
La destilación puede ser una técnica legítima para entrenar modelos pequeños a partir de sistemas más potentes, pero genera controversia cuando se realiza mediante el uso no autorizado de servicios propietarios.
Una competencia cada vez más cerrada
Kimi K3 no demuestra todavía que China haya desplazado de manera general a Estados Unidos en inteligencia artificial. Sí evidencia que los desarrolladores chinos pueden alcanzar o superar a los principales modelos occidentales en tareas específicas y ofrecer sus servicios a precios competitivos.
El verdadero alcance del sistema podrá evaluarse con mayor precisión después de la publicación de sus pesos, su informe técnico y pruebas independientes más amplias.
Por ahora, su primer puesto en programación web introduce un nuevo competidor en la élite de la inteligencia artificial y aumenta la presión sobre OpenAI, Anthropic y otras empresas para mejorar el desempeño, reducir precios y justificar las ventajas de mantener sus modelos cerrados.













