Claude perdió. He aquí el porqué.
Enfrentamos al Claude Opus de mayor puntuación contra el más económico y de pesos abiertos Qwen 3.8 en una batalla de programación en el mundo real. El modelo que ganó no fue el que predecían los benchmarks.
Tag
5 publicaciones
Enfrentamos al Claude Opus de mayor puntuación contra el más económico y de pesos abiertos Qwen 3.8 en una batalla de programación en el mundo real. El modelo que ganó no fue el que predecían los benchmarks.
Hemos estado buscando modelos que 'razonen' más profundamente, creyendo que es el único camino hacia una IA más inteligente. Pero un nuevo modelo de código abierto demuestra que esto es una trampa, logrando resultados superiores al desaprender deliberadamente este hábito derrochador.
Una nueva IA de pesos abiertos acaba de completar un maratón de programación de 10 días, creando una aplicación compleja desde cero. Esto no es solo otro chatbot; es un desafío directo a los gigantes de código cerrado y un vistazo a un futuro de desarrolladores autónomos.
Un nuevo modelo de código abierto de China no solo está alcanzando a GPT-5 y Fable, sino que los está superando en puntos de referencia clave. Pero este increíble regalo al mundo de la IA esconde una trampa geopolítica que podría remodelar toda la industria.
Una nueva IA de código abierto se ejecuta completamente en tu portátil, ofreciendo un rendimiento que rivaliza con modelos masivos en la nube como GPT-4V. Descubre cómo Qwen 2.5 VL lee imágenes, corrige código y analiza vídeo localmente, cambiando las reglas del juego para los desarrolladores de todo el mundo.