3 min de lectura

Poolside apuesta por Laguna S 2.1 para IA de programación autoalojada

Poolside ha lanzado Laguna S 2.1, un modelo de 118.000 millones de parámetros con pesos abiertos para programación agente que, según la startup, puede rivalizar con sistemas mucho más grandes mientras

Imagen: TNW

Poolside ha lanzado Laguna S 2.1, un modelo de 118.000 millones de parámetros con pesos abiertos para programación agente que la startup afirma puede igualar o superar a rivales varias veces más grandes mientras se ejecuta en un único sistema de escritorio Nvidia DGX Spark.

La empresa de San Francisco dice que el modelo usa un diseño de mezcla de expertos con ocho mil millones de parámetros activos por token. Sus pesos están disponibles en Hugging Face bajo la licencia OpenMDW de la Linux Foundation.

En dos benchmarks centrados en programación, Laguna S 2.1 obtuvo resultados que la sitúan en el mismo rango que modelos abiertos más grandes:

Recomendado

Google elimina los controles de muestreo de Gemini en los nuevos modelos Flash

  • algo más del 70% en Terminal-Bench
  • casi el 60% en SWE-Bench Pro

Según Poolside, eso es suficiente para igualar o superar a modelos de DeepSeek, Nvidia y Thinking Machines con entre dos y ocho veces más parámetros activos. La compañía también dice que el modelo “aún no está en la vanguardia”, y que los sistemas cerrados de OpenAI y Anthropic siguen obteniendo puntuaciones muy superiores en esas mismas pruebas.

Alternativa occidental a los modelos chinos de pesos abiertos

Poolside presenta el lanzamiento como una respuesta directa al dominio de los laboratorios chinos en modelos de pesos abiertos, especialmente DeepSeek, la familia Qwen de Alibaba y Kimi de Moonshot. La compañía afirma que ningún laboratorio occidental había publicado un modelo de pesos abiertos en la clase de 118.000 millones de parámetros durante 11 meses antes de este lanzamiento.

Forbes informó que Poolside presentó explícitamente el modelo como una opción autoalojada para empresas y gobiernos occidentales que no quieren enviar datos a un proveedor extranjero. Eso encaja con la base de clientes a la que Poolside ya se dirige a través de su API y su entorno para agentes: gobiernos, defensa y otras organizaciones altamente reguladas.

Fundada en 2023 por el ex CTO de GitHub Jason Warner y Eiso Kant, Poolside recaudó 500 millones de dólares en una Serie B en octubre de 2024 con una valoración de 3.000 millones de dólares, con respaldo de Nvidia y eBay. Una prevista Serie C de 2.000 millones de dólares que habría valorado la compañía en 14.000 millones de dólares se vino abajo en abril de 2026 después de que CoreWeave abandonara un proyecto conjunto de centro de datos en Texas.

Entrenamiento en 4.000 GPU H200

Poolside dice que construyó Laguna S 2.1 con su plataforma interna Model Factory, que automatiza la búsqueda de arquitecturas y el aprendizaje por refuerzo a partir de la ejecución de código. El entrenamiento se completó en menos de cuatro semanas en 4.000 GPU Nvidia H200.

La compañía lanzó el modelo más pequeño Laguna XS tres semanas antes y dice que está publicando nuevos modelos con una cadencia de aproximadamente cinco semanas. Como demostración de razonamiento a largo plazo, Poolside también publicó una trayectoria que muestra al modelo resolviendo de forma independiente un problema de combinatoria que, hasta hace poco, solo los modelos de vanguardia más grandes habían abordado.

La propuesta comercial es directa: los clientes pueden pagar para ejecutar un modelo capaz de programación en su propio hardware en lugar de depender de una API cerrada. Pero los propios datos de benchmark de Poolside muestran que Laguna S 2.1 aún queda rezagado frente a los líderes de código cerrado por aproximadamente 10 a 15 puntos porcentuales en Terminal-Bench —una brecha que podría decidir si el autoalojamiento merece la pena.

Ava Chen

AI Editor

Ava covers the rapidly evolving world of artificial intelligence, from foundational models and research labs to the real-world economics of intelligence. With a background in computational linguistics, she cuts through the hype to find out what actually works. She firmly believes that benchmarks are just marketing until reproduced in the wild.

vía TNW

// Sigue leyendo