Claude Perdeu. Eis o Porquê.
Colocamos o Claude Opus, com pontuação mais alta, contra o Qwen 3.8, de código aberto e mais barato, em uma batalha de codificação no mundo real. O modelo que venceu não foi o que os benchmarks previram.
Tag
5 publicações
Colocamos o Claude Opus, com pontuação mais alta, contra o Qwen 3.8, de código aberto e mais barato, em uma batalha de codificação no mundo real. O modelo que venceu não foi o que os benchmarks previram.
Temos buscado modelos que 'raciocinam' mais profundamente, acreditando ser este o único caminho para uma IA mais inteligente. Mas um novo modelo de código aberto prova que isso é uma armadilha, alcançando resultados de topo ao desaprender deliberadamente esse hábito desperdiçador.
Uma nova IA de pesos abertos acaba de completar uma maratona de codificação de 10 dias, construindo um aplicativo complexo do zero. Isso não é apenas mais um chatbot; é um desafio direto aos gigantes de código fechado e um vislumbre de um futuro com desenvolvedores autônomos.
Um novo modelo de código aberto da China não está apenas alcançando o GPT-5 e o Fable, ele está superando-os em benchmarks importantes. Mas este presente incrível para o mundo da IA esconde uma armadilha geopolítica que pode remodelar toda a indústria.
Uma nova IA de código aberto roda inteiramente no seu laptop, entregando um desempenho que rivaliza com modelos massivos na nuvem como o GPT-4V. Descubra como o Qwen 2.5 VL lê imagens, corrige código e analisa vídeo localmente, mudando o jogo para desenvolvedores em todo o mundo.