Skip to content
comparisons

Anthropic acaba de superar al nuevo modelo de OpenAI

Acaban de lanzarse dos nuevos modelos de IA insignia, pero una brutal prueba comparativa de renderizado 3D revela una impactante brecha de capacidad. Un modelo representa un salto generacional, mientras que el otro plantea serias dudas sobre su enfoque de entrenamiento.

Vera Cole
Anthropic acaba de superar al nuevo modelo de OpenAI

Un brutal enfrentamiento en Blender

El nuevo Claude Claude Opus 5.5 de Anthropic se enfrentó recientemente al GPT-6 GPT-6 Sol de OpenAI en un duelo directo en Blender. Esta rigurosa prueba enfrentó a los modelos insignia entre sí, ejecutando prompts complejos e idénticos en un entorno 3D exigente. Al ejecutar Claude Claude Opus 5.5 en Claude Code y GPT-6 GPT-6 Sol en OpenAI OpenAI Codex, ambos operaron con un ajuste de detalle "extra alto" para llevar sus capacidades al límite.

El desafío principal exigía una recreación detallada de un coche de Fórmula 1 1 de Ferrari. Los evaluadores llevaron a los modelos más allá, requiriendo dos animaciones intrincadas: primero, el ensamblaje preciso del coche a partir de sus componentes individuales, y luego una secuencia dinámica de parada en boxes donde el vehículo entra y sale del encuadre. Esta tarea de varias etapas evaluó tanto el renderizado estático como la generación de movimiento complejo.

Fundamentalmente, ambos modelos demostraron una comprensión contextual avanzada desde el principio. Al tener acceso a la web para obtener imágenes de referencia, no solo utilizaron fotos oficiales del lanzamiento de Ferrari del sitio web de Fórmula 1 1, sino que también corrigieron de forma autónoma un error del usuario. El prompt inicial solicitaba erróneamente un coche "F2"; tanto Claude Claude Opus 5.5 como GPT-6 GPT-6 Sol interpretaron inteligentemente esto como un coche de "Fórmula 1 1", procediendo con los datos de referencia correctos. Esto demostró una impresionante comprensión previa a la tarea.

Un salto generacional frente a un desastre con fallos

El Claude Claude Opus de Anthropic entregó un renderizado en Blender verdaderamente excepcional, estableciendo un nuevo punto de referencia para el contenido 3D generado por IA. Su animación de construcción fue súper limpia, presentando una revelación con estilo de plano técnico donde los componentes individuales brillaban y se ensamblaban sin problemas. Las piezas encajaron en su lugar sin fallos ni problemas de superposición, mostrando reflejos impecables en el suelo y detalles de alta calidad en los neumáticos y el alerón trasero.

El resultado de Claude Claude Opus, aunque casi perfecto, presentó pequeñas imprecisiones. El alerón delantero parecía demasiado grande y carecía del perfil aerodinámico de un coche de Fórmula 1 1 real, y los bordes dentados de las aletas estaban invertidos. A pesar de estos pequeños defectos, el creador lo elogió como "uno de los mejores renderizados, si no el mejor, que he conseguido que haga un modelo", destacando la calidad y el pulido superiores del modelo en general.

GPT-6 GPT-6 Sol, en marcado contraste, produjo un resultado "menos limpio y pulido". Su modelo de coche sufrió de varias partes desconectadas, y el logotipo de IBM en la parte trasera estaba orientado incorrectamente, lo que indica una clara falta de conciencia espacial e integridad de diseño. El renderizado se sintió menos detallado, recordando a las capacidades de IA anteriores.

El rendimiento de la animación amplió aún más la brecha. La secuencia de parada en boxes de GPT-6 GPT-6 Sol incluyó extraños fallos de animación, como neumáticos nuevos flotando de manera poco realista junto al coche mientras entraba y salía del encuadre. Esta falta significativa de pulido, junto con las partes desconectadas, subrayó un claro salto generacional a favor de Anthropic.

El precio de la perfección

GPT-6 GPT-6 Sol cumplió en velocidad y costo. Terminó las complejas tareas de Blender en solo 48 minutos, incurriendo en un costo mínimo de $4.50. Este rendimiento posiciona a GPT-6 Sol como el campeón indiscutible para los usuarios preocupados por el presupuesto que priorizan la finalización rápida.

Por el contrario, Claude Claude Opus exigió una mayor inversión de tiempo y capital. El modelo tardó 1 hora y 7 minutos en renderizar el conjunto completo de animaciones, con un coste total de $27.86. Esto hizo que Claude Claude Opus fuera casi seis veces más caro que su competidor de OpenAI.

El precio más elevado de Claude Opus se correlaciona directamente con su volumen de salida. Generó significativamente más datos para lograr sus resultados impecables, con aproximadamente $11 de su factura total dedicados a la escritura en su caché. Para profundizar en lo último de Anthropic, consulte Introducing Claude Claude Opus 5.5 - Anthropic.

Aunque GPT-6 GPT-6 Sol ofrecía una tarifa más barata por token, su resultado final para la prueba del coche fue en gran medida inutilizable para el trabajo profesional en 3D. Los modelos renderizados tenían menos detalle, presentaban fallos y carecían de las animaciones pulidas que proporcionaba Claude Claude Opus. La calidad a menudo justifica un mayor gasto.

Para cualquiera que aborde proyectos 3D complejos donde la fidelidad visual es primordial, Claude Claude Opus representa la opción superior, aunque más cara. Ignore GPT-6 GPT-6 Sol si su flujo de trabajo exige activos listos para producción, ya que sus ahorros de costes iniciales se verán anulados por un extenso trabajo de corrección.

¿Te está gustando? Recibe uno así en tu bandeja cada mañana.

un correo al día · date de baja en dos clics · sin rastreadores de terceros

Dónde encajan ahora Astra y Fable

Ampliando la prueba del coche, GPT-6 GPT-6 Astra de OpenAI entró en escena, presentando un desafío formidable al dominio de Claude Claude Opus. Este nuevo competidor demostró capacidades que casi igualaron el punto de referencia establecido por el buque insignia de Anthropic, superando los límites del renderizado 3D impulsado por IA.

El renderizado de GPT-6 Astra obtuvo grandes elogios por su realismo, presentando un alerón delantero más preciso y una iluminación superior en comparación con Claude Claude Opus. Incluso ganó una encuesta pública por su refinada animación de parada en boxes, aunque fue el modelo más lento probado, completando las tareas en 1 hora y 49 minutos por $32.47.

GPT-6 GPT-6 Sol, aunque fue el más rápido y barato con 48 minutos por $4.50, produjo constantemente los peores resultados, lo que lo hace inadecuado para el trabajo 3D de alta fidelidad. FableAIAI 5.1 también se quedó atrás, siendo el más caro con $42.44 a pesar de un tiempo de finalización decente de 1 hora y 13 minutos.

En consecuencia, Claude Claude Opus emerge como el nuevo daily driver inequívoco para la exigente creación 3D impulsada por IA. Ofreció un paquete general superior (animaciones de construcción limpias, detalles de alta calidad y fallos mínimos) por $27.86 en 1 hora y 7 minutos, posicionándolo como la segunda solución GPT-6 más barata. Ignore Claude Claude Opus si el coste y la velocidad son sus únicas métricas GPT-6, incluso a costa de la calidad.

Preguntas frecuentes

¿Qué modelo de IA fue mejor para el renderizado 3D en Blender?

Opus 5.5 de Anthropic fue el ganador decisivo, produciendo un modelo 3D y una animación significativamente más limpios, detallados y pulidos en comparación con GPT-6 Sol.

¿Cómo se comparó GPT-6 Astra con Opus 5.5?

GPT-6 Astra fue un competidor muy fuerte y considerado un segundo puesto cercano a Opus 5.5. Aunque el autor prefirió Opus en general, una encuesta reveló que muchos favorecieron la animación de parada en boxes de Astra por su realismo.

¿Fue GPT-6 Sol más barato que Opus 5.5?

Sí, GPT-6 Sol fue significativamente más barato y rápido, costando $4.50 y tardando 48 minutos. Sin embargo, Opus 5.5, con $27.86 y 67 minutos, produjo un resultado muy superior, justificando su mayor coste para esta tarea específica.

¿Qué tarea se les asignó a los modelos de IA?

A cada modelo se le pidió que creara un modelo 3D de alta precisión de un coche Ferrari F1 en Blender utilizando referencias web, luego que animara la construcción del coche y, finalmente, que creara una animación de parada en boxes.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only

Para builders

Esta página está trabajando para la herramienta de otro.

La leen los agentes de IA. Aterrizan compradores. Responde en ocho idiomas y vía MCP. Tu herramienta puede tener una igual — publicada en 24 horas.