Skip to content
ai agents

El agente de IA de Alibaba programa durante 10 días

Una nueva IA de pesos abiertos acaba de completar un maratón de programación de 10 días, creando una aplicación compleja desde cero. Esto no es solo otro chatbot; es un desafío directo a los gigantes de código cerrado y un vistazo a un futuro de desarrolladores autónomos.

Sol Aguirre
El agente de IA de Alibaba programa durante 10 días

Una IA acaba de programar durante 10 días seguidos

Alibaba acaba de ampliar los límites de los agentes de IA autónomos. Su nuevo buque insignia, Qwen 3.8 Max, un modelo de pesos abiertos de 2.4 billones de parámetros, demostró recientemente una hazaña sin precedentes: programó durante más de 10 días seguidos. Partiendo de una carpeta vacía, el modelo construyó de forma autónoma "O my CLI", un agente de código totalmente funcional ya disponible en GitHub, demostrando su capacidad para un desarrollo sostenido e independiente.

Esta demostración innovadora destaca la fortaleza central de Qwen 3.8 Max: la programación agéntica. Diseñada para mantener la tarea durante días, esta capacidad permite al modelo manejar proyectos de largo alcance que requieren una planificación compleja, ejecución iterativa y autocorrección continua sin intervención humana constante. Destaca en la navegación de desafíos de programación de varios días, aprovechando su ventana de contexto de 1 millón de tokens para mantener la coherencia del proyecto.

Mejorando aún más su autonomía, Qwen 3.8 Max cuenta con capacidades multimodales nativas. Su sistema de visión integrado actúa como un bucle de retroalimentación continua, permitiendo al modelo "ver" su progreso, analizar resultados y refinar su plan de forma dinámica. Esta visión permite una autocorrección y adaptación sofisticadas, cruciales para navegar la naturaleza iterativa del desarrollo de software complejo, desde el concepto inicial hasta el despliegue.

Dentro de la bestia de 2.4 billones de parámetros

Qwen 3.8 Max de Alibaba es un logro monumental en la arquitectura de modelos: un sistema de Mixture-of-Experts (MoE) disperso de 2.4 billones de parámetros. Este diseño activa inteligentemente solo unos 95 mil millones de parámetros por token durante la inferencia, logrando un equilibrio crítico entre la potencia computacional bruta y la eficiencia operativa. El modelo también cuenta con una ventana de contexto de 1 millón de tokens y capacidades multimodales, procesando imágenes, video y texto para una comprensión integral.

Este lanzamiento representa un profundo cambio estratégico para Alibaba, marcando la primera vez que liberan los pesos de su modelo más potente, el nivel "Max". Este movimiento agresivo de 'pesos abiertos' señala un desafío significativo para los gigantes de IA propietarios, remodelando fundamentalmente el panorama competitivo para los sistemas agénticos de vanguardia. Sugiere un futuro donde las capacidades de IA de primer nivel estén más ampliamente disponibles.

A pesar de su escala colosal, Alibaba ha garantizado una amplia accesibilidad. Los desarrolladores pueden acceder a Qwen 3.8 Max a través de API, con precios competitivos de $2 por millón de tokens de entrada y $6 por millón de tokens de salida. Además, para la experimentación y el desarrollo local, Alibaba lanzó una variante más pequeña y manejable de 27 mil millones de parámetros, diseñada para ejecutarse eficientemente en máquinas personales. Este enfoque dual democratiza el acceso a capacidades agénticas de IA avanzadas.

El guantelete de benchmarks frente a GPT-5 y Claude

Qwen 3.8 Max no solo programa de forma autónoma; se compara competitivamente con los principales modelos de código cerrado. En tareas agénticas, brilla, obteniendo 86.1 en OSWorld-Verified, superando a Claude Fable 5 (aprox. 85.0) y GPT-5.6 Sol (83.2). También lidera PaperBench para análisis de investigación con 93.0, por delante de GPT-5.6 Sol (90.5) y Claude Fable 5 (88.8).

En Terminal-Bench 2.1, Qwen 3.8 Max obtiene 86.6, superando tanto a Claude Opus 4.8 como a Claude Fable 5 (ambos con 84.6), aunque queda por detrás de GPT-5.6 Sol (88.8). Sin embargo, para ingeniería compleja en SWE-bench Pro, obtiene 67.7, por detrás de Claude Fable 5 (80.0) y Claude Opus 4.8 (69.2).

Este sistema de 2.4 billones de parámetros presenta un perfil potente y equilibrado, desafiando directamente el dominio que han mantenido durante mucho tiempo los modelos de código cerrado de Anthropic y OpenAI. Destaca especialmente en casos de uso agénticos y en la reproducción de investigaciones, posicionándose como un modelo versátil y robusto.

Aunque la demostración de 10 días creando 'O my CLI' resultó innovadora, operó dentro de un entorno controlado, un matiz crucial para su implementación en el mundo real. Considere su precio de API: $2 por millón de tokens de entrada y $6 por millón de tokens de salida. Este modelo de pesos abiertos puede ejecutarse durante días, ofreciendo una alternativa atractiva y consciente de los costos en el cambiante panorama de la IA.

¿Te está gustando? Recibe uno así en tu bandeja cada mañana.

un correo al día · date de baja en dos clics · sin rastreadores de terceros

¿Es este el fin del dominio del código cerrado?

El lanzamiento de Qwen 3.8 Max por parte de Alibaba cambia fundamentalmente la dinámica de poder global de la IA. Un modelo MoE de primer nivel con 2.4 billones de parámetros que surge de China, ahora con pesos abiertos, desafía directamente el dominio establecido de código cerrado de los gigantes tecnológicos occidentales. Esto intensifica la carrera mundial por construir y distribuir IA de frontera, creando un panorama competitivo más diversificado.

Es fundamental señalar que "pesos abiertos" no equivale a "código abierto" (open-source) total. Alibaba proporciona acceso a los parámetros del modelo, lo que permite una amplia experimentación y desarrollo. Sin embargo, posibles restricciones de licencia futuras aún podrían regir la implementación comercial, definiendo los verdaderos límites de su accesibilidad para aplicaciones empresariales.

Para la industria en general, esto democratiza el acceso a una IA agéntica altamente capaz. Los desarrolladores obtienen una nueva y poderosa herramienta, diseñada para la codificación autónoma de varios días, lo que podría acelerar drásticamente los ciclos de innovación. No obstante, la adopción generalizada de modelos tan potentes de diversos orígenes geopolíticos también plantea nuevas preguntas sobre el uso comercial, la gobernanza de datos y los estándares de implementación ética a nivel mundial. La frontera del desarrollo de la IA ahora se siente decididamente más abierta y más compleja.

Preguntas frecuentes

¿Qué es Qwen 3.8 Max?

Qwen 3.8 Max es un modelo de IA de pesos abiertos de 2.4 billones de parámetros de Alibaba, diseñado específicamente para tareas autónomas de larga duración, como la codificación agéntica.

¿Puedo ejecutar Qwen 3.8 Max en mi computadora portátil?

No, el modelo de 2.4T de parámetros requiere recursos computacionales significativos. Sin embargo, Alibaba también ha lanzado una variante de 27 mil millones de parámetros, Qwen 3.8-27B, diseñada para ejecutarse en máquinas personales.

¿Cómo se compara Qwen 3.8 Max con modelos como GPT o Claude?

Es altamente competitivo. Qwen 3.8 Max supera a modelos como Claude Fable 5 y GPT-5.6 Sol en puntos de referencia de uso de computadora agéntica (OSWorld-Verified), pero se queda atrás en algunas pruebas complejas de ingeniería de software (SWE-bench Pro).

¿Qué construyó Qwen 3.8 Max en su demostración de 10 días?

En su demostración más impresionante, se le dio al modelo una carpeta vacía y, durante 10 días, construyó de forma autónoma 'O my CLI', un agente de código completo y funcional que ahora está disponible en GitHub.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only