hotIA

3 min de lectura

Alibaba presenta Qwen3.8 como el número 2 — sin pruebas aún

Alibaba afirma que su nuevo Qwen3.8 de 2,4 billones de parámetros ocupa el segundo lugar solo tras Fable 5, pero no publicó benchmarks ni ficha del modelo.

Imagen: TNW

Alibaba ha presentado Qwen3.8, un modelo de 2,4 billones de parámetros que califica como su más potente hasta la fecha —y afirma que es «segundo solo después de Fable 5». La afirmación, hecha por el equipo Qwen de la compañía en X durante la Conferencia Mundial de Inteligencia Artificial en Shanghái, llegó sin las pruebas habituales. Según SiliconANGLE, Alibaba no publicó puntuaciones de benchmarks, ni ficha técnica del modelo, ni resultados de pruebas independientes que respalden esa clasificación.

Las acciones de Alibaba subieron hasta un 5,4% el lunes tras el anuncio.

Qwen3.8 es el primer modelo de la familia Qwen por encima de 1 billón de parámetros que es multimodal, lo que significa que puede trabajar con imágenes, vídeo, documentos y texto. Alibaba afirma que supera a su anterior buque insignia, especialmente en tareas de programación y ofimática, como desarrollo full-stack y análisis de datos. El desarrollador principal, Shuai Bai, lo describió como el primer modelo multimodal del equipo con un billón de parámetros, con una comprensión que, según dijo, iguala o supera a la de los principales sistemas propietarios.

Recomendado

Jaron Lanier dice que 'IA' es la historia equivocada

El avance está disponible ya a través de la suscripción Token Plan de Alibaba y las herramientas para desarrolladores Qoder, con un precio equivalente al 10% de la tarifa estándar durante la prueba. Alibaba afirma que los pesos completamente abiertos llegarán «pronto», pero no ha dado una fecha ni ha divulgado los términos de la licencia.

Falta de benchmarks y fecha de los pesos abiertos

Esa ausencia de pruebas marca un cambio para Alibaba. Su anterior buque insignia, Qwen3.7-Max, se lanzó en mayo con un conjunto completo de resultados publicados. Qwen3.8 se ha lanzado sin ninguno, y ningún ranking público lo ha situado todavía. En LMArena, donde Fable 5 ocupa la primera posición, el más antiguo Qwen3.7-Max aparece mucho más abajo.

La verificación externa solo será posible una vez que se publiquen los pesos. Hasta entonces, la comparación de Alibaba sigue siendo la suya.

El último impulso de modelos abiertos en China

El momento parece deliberado. El lanzamiento se produjo tres días después de que Moonshot presentara Kimi K3, un modelo abierto de 2,8 billones de parámetros que encabezó un importante ranking de programación y sacudió las acciones de los fabricantes de chips estadounidenses, según señaló The Decoder. Otros laboratorios chinos también están presionando en la frontera, entre ellos Zhipu con GLM-5.2.

También hay un ángulo comercial: al igual que Moonshot, Alibaba está incorporando el modelo primero en productos de pago y publicando los pesos más tarde, capturando la demanda de clientes antes de que llegue el acceso gratuito. Eso importa porque los modelos más grandes de Alibaba no han sido típicamente de pesos abiertos. Nathan Lambert dijo que la medida indica una nueva fase en la competencia entre los laboratorios chinos.

Si la publicación eventual coincide con las afirmaciones de Alibaba, esto llevaría a los modelos de pesos abiertos más profundamente a un territorio que normalmente dominan los mayores laboratorios estadounidenses. Por ahora, sin embargo, la compañía está pidiendo al mercado que confíe en el bombo publicitario antes de la descarga.

Ava Chen

AI Editor

Ava covers the rapidly evolving world of artificial intelligence, from foundational models and research labs to the real-world economics of intelligence. With a background in computational linguistics, she cuts through the hype to find out what actually works. She firmly believes that benchmarks are just marketing until reproduced in the wild.

vía TNW

// Sigue leyendo