3 min de lectura

Kimi K3 supera a Claude en codificación frontend

El modelo de pesos abiertos Kimi K3 de Moonshot AI encabezó el benchmark de codificación frontend de Arena.AI, superando a Claude Fable 5 en cinco de seis categorías.

Imagen: TechRepublic

Moonshot AI ha lanzado Kimi K3, un modelo de pesos abiertos de 2.8 billones de parámetros orientado a la programación, el razonamiento y el trabajo de conocimiento, y su resultado principal es una victoria sobre Claude Fable 5 de Anthropic en un benchmark de codificación frontend.

La startup china afirma que Kimi K3 tiene una ventana de contexto de 1 millón de tokens y soporte nativo de visión. Moonshot lo calificó como “el primer modelo abierto de clase 3T del mundo” construido para tareas de larga duración como desarrollo de software, investigación y resolución de problemas complejos. La compañía también reconoció que Kimi K3 aún queda por detrás de los sistemas propietarios más potentes en general, aunque publicó lo que describió como resultados de vanguardia en sus evaluaciones.

Kimi K3 ya está disponible a través del chatbot de Kimi, la aplicación de escritorio, el asistente de programación y los servicios de API. Moonshot planea publicar los pesos completos del modelo el 27 de julio.

Resultados del benchmark frontend de Arena.AI

La mayor afirmación de Moonshot se centra en el Frontend Code Arena de Arena.AI, un benchmark para construir interfaces de usuario del mundo real en diseño de productos, visualización de datos y aplicaciones creativas.

Recomendado

El acuerdo de 1.500 millones de dólares de Anthropic con autores recibe la aprobación judi

Según la compañía, Kimi K3 se clasificó en primer lugar y superó a Claude Fable 5 en cinco categorías:

  • Marca y marketing
  • Diseño basado en referencias
  • Datos y analítica
  • Producto de consumo
  • Simulaciones y herramientas de creación de contenido

Sólo quedó por detrás de Claude en Juegos.

Eso importa porque la codificación frontend prueba más que la generación de código. Los modelos también deben manejar el diseño de la distribución, el diseño visual, decisiones de UX y requisitos funcionales.

Precios, disponibilidad y la propuesta de pesos abiertos

Moonshot dijo que Kimi K3 rindió de forma competitiva con Fable 5 y superó sustancialmente a varios otros modelos, incluidos GPT 5.6 Sol, GPT 5.5 y Claude Opus 4.8, en evaluaciones específicas. Artificial Analysis también situó a Kimi K3 cerca de los sistemas de primera categoría en su Índice de Inteligencia, aunque todavía por detrás de Fable 5 y GPT-5.6 Sol en conjunto.

Su precio se establece en $3 por millón de tokens de entrada y $15 por millón de tokens de salida a través de la API. TechRepublic señala que, aunque esto es más alto que algunos rivales chinos, el rendimiento del modelo aún podría convertirlo en una alternativa creíble a los sistemas estadounidenses más caros.

La importancia más amplia es el lanzamiento de pesos abiertos. A diferencia de los modelos cerrados, el enfoque de Kimi K3 ofrece a desarrolladores y empresas la opción de personalizar y desplegar el modelo por sí mismos en lugar de depender completamente de APIs alojadas. Para los equipos que evalúan IA para trabajo de software comercial, especialmente en generación de interfaces, eso puede ser tan importante como la propia victoria en el benchmark.

Ava Chen

AI Editor

Ava covers the rapidly evolving world of artificial intelligence, from foundational models and research labs to the real-world economics of intelligence. With a background in computational linguistics, she cuts through the hype to find out what actually works. She firmly believes that benchmarks are just marketing until reproduced in the wild.

vía TechRepublic

// Sigue leyendo