Poolside lanza Laguna S 2.1, un modelo de codificación que supera a competidores 10 veces más grandes.

Poolside lanza Laguna S 2.1, un modelo de codificación que supera a competidores 10 veces más grandes.

Poolside, un laboratorio de inteligencia artificial con sede en San Francisco, ha presentado su modelo más avanzado, el Laguna S 2.1, en un contexto donde la transparencia radical se está convirtiendo en un diferenciador clave para competir en la vanguardia de la IA. Con una arquitectura de Mixture-of-Experts (MoE) que activa solo 8 mil millones de sus 118 mil millones de parámetros, este modelo no solo revoluciona en términos de capacidad, sino que también aborda la creciente demanda de modelos abiertos de confianza.

Con un contexto de hasta 1 millón de tokens, Laguna S 2.1 ha demostrado un rendimiento notable en diversas tareas de codificación, superando a modelos considerablemente más grandes. En la prueba de Terminal-Bench 2.1, logró un impresionante 70.2%, ocupando el puesto 11 en la tabla de clasificación de la compañía. Comparativamente, modelos de hasta 1.6 billones de parámetros, como el DeepSeek-V4-Pro-Max, solo lograron un 64%. De esta manera, Poolside establece un nuevo estándar en el rendimiento de modelos de menor tamaño.

Un contexto de competencia abierta en la IA

El lanzamiento de Laguna S 2.1 se produce en medio de un debate acalorado sobre la procedencia de los modelos de IA de peso abierto. En el último año, la adopción de sistemas de peso abierto, que permiten a los desarrolladores descargar y ejecutar modelos en su propia infraestructura, ha inclinado la balanza hacia laboratorios de China, donde nombres como DeepSeek y Kimi han dominado. Jason Warner, co-CEO de Poolside, ha enfatizado la necesidad de contar con modelos abiertos confiables en Occidente, que permitan a las empresas tener control sobre la infraestructura que utilizan.

Poolside no solo busca competir; la compañía está alineando su estrategia con un entorno de alta seguridad, enfocándose en el sector gubernamental y de defensa. Este enfoque responde a una creciente preocupación sobre la dependencia de modelos chinos, donde las empresas que estandarizan en estos pueden volverse más difíciles de convertir en clientes.

Arquitectura y eficiencia de los costos

La arquitectura MoE de Laguna S 2.1 ha sido diseñada para reducir los costos de inferencia, alineando gastos con los 8 mil millones de parámetros activos en lugar de los 118 mil millones totales. Esto permite que el modelo funcione eficientemente en una sola máquina Nvidia DGX Spark, lo que resulta en una economía de tokens favorable para cargas de trabajo a gran escala. El modelo está disponible a un precio agresivo por token, significativamente más bajo que sus competidores, lo que facilita su adopción para empresas que buscan optimizar costos.

Además, la compañía ha trabajado en la integración de su modelo en plataformas como Baseten y Vercel, ofreciendo soporte amplio desde su lanzamiento. Uno de los aspectos más destacados es el enfoque conductual del modelo, que busca operar con mayor persistencia y control durante las tareas, fortaleciendo su aplicabilidad en entornos de trabajo donde no se supervisa constantemente.

Transparencia en la evaluación de IA

Un aspecto innovador del lanzamiento de Laguna S 2.1 es la decisión de Poolside de publicar todas las trayectorias de evaluación de sus pruebas finales. Esto contrarresta la crisis de credibilidad en la IA, donde muchos resultados son cuestionables. Al detallar cada paso y decisión durante las pruebas, Poolside se posiciona como un competidor serio en un campo donde la transparencia podría ser tan valiosa como la propia tecnología.

La compañía también ha admitido algunas limitaciones del modelo, como su tendencia a adaptarse demasiado a entornos específicos y ciertas complicaciones al manejar diferentes esquemas de herramienta en agentes de terceros. A pesar de esto, se sigue considerando a Laguna S 2.1 como una opción creíble en el campo de la IA de peso abierto, capaz de competir con modelos mucho más grandes y complejos que dominan actualmente el mercado.

A medida que Poolside continúa desarrollando modelos más grandes y sofisticados, queda la incertidumbre sobre su capacidad para mantener este ritmo de innovación. Sin embargo, sus planes de expansión sugieren un compromiso sólido con un futuro en el que la inteligencia pueda ser accesible y moldeable por cualquiera, lo que podría redefinir el panorama de la IA tal como lo conocemos.