Skip to content
comparisons

Opus 5: El asesino de Fable ya está aquí

Anthropic acaba de lanzar su competidor para Fable 5 a mitad de precio, prometiendo un rendimiento de vanguardia. Pero nuestras pruebas prácticas revelan un detalle crítico sobre su costo real que los benchmarks no muestran.

Vera Cole
Opus 5: El asesino de Fable ya está aquí

El bombardeo de benchmarks: El dominio sobre el papel de Opus 5

Opus 5 de Anthropic ha llegado, posicionándose como el nuevo estándar de vanguardia para evaluaciones críticas de programación y trabajo de conocimiento. En Frontier-Bench, supera demostrablemente a Fable 5 por casi un 10%, un margen significativo que redefine las expectativas de rendimiento.

El rendimiento de Opus 5 en el benchmark ARC-AGI es particularmente innovador, alcanzando un impresionante 30.2%. Esto representa un salto monumental desde el 1.5% de Opus 4.8 y el máximo anterior de 7.8% de Sol, demostrando una nueva capacidad para convertir pruebas en notación algebraica para un razonamiento lógico avanzado.

Las métricas de terceros de Artificial Analysis refuerzan el dominio sobre el papel de Opus 5 en múltiples dimensiones críticas. Toma la delantera indiscutible sobre Fable 5 y GPT 5.6 Sol tanto en el Agentic Index como en el Intelligence Index.

Aunque Opus 5 asegura el segundo lugar en el Coding Index, solo 0.3 puntos detrás de GPT 5.6 Sol Extra High, sigue superando a Fable 5 por 1.5 puntos. Estos resultados integrales de los benchmarks confirman la ventaja inmediata y sustancial de Opus 5 en inteligencia de frontera.

Decodificando la promesa de 'mitad de precio'

Anthropic posiciona a Opus 5 como una alternativa a "mitad de precio" frente a Fable 5, y sus tarifas oficiales de API lo confirman. Opus 5 mantiene el mismo precio que Opus 4.8: $5 por millón de tokens de entrada y $25 por millón de tokens de salida. Esta estructura, efectivamente, lo hace aproximadamente a mitad de costo que Fable 5 por token.

Los análisis de costos basados en benchmarks a menudo refuerzan la propuesta de valor de Opus 5, mostrando que es más barato por tarea que Fable 5. Artificial Analysis encontró que Opus 5 es 72 centavos más barato para una tarea típica. CursorBench también informó que Opus 5 costó $8 para una tarea donde Fable 5 costó $17.

Sin embargo, las pruebas prácticas revelan una historia diferente para tareas complejas. Una sola tarea de programación de un juego de carreras de Fórmula 1 le costó a Opus 5 $12.99, haciéndolo más caro que Fable 5 en esa instancia. Esta anomalía se debió a que Opus 5 consumió cinco veces más tokens para el mismo resultado, desafiando la narrativa de "mitad de precio" en escenarios prácticos de alto consumo de tokens.

A pesar de la reducción relativa de costos de Opus 5, GPT 5.6 Sol sigue siendo el campeón indiscutible de relación precio-rendimiento. Los modelos de Anthropic, incluido Opus 5, todavía ocupan un nivel de precios premium. Los usuarios que prioricen la eficiencia de costos absoluta encontrarán un mejor valor fuera del ecosistema Opus.

De los benchmarks a las construcciones: Enfrentamiento en el mundo real

Más allá de los benchmarks teóricos, Opus 5 demuestra un rendimiento impresionante en el mundo real. En una tarea de generación de un juego de Fórmula 1, Opus 5 produjo mejores efectos visuales y funcionalidad en comparación con sus rivales. Su resultado, un único archivo HTML usando Three.js, presentaba coches de F1 bien modelados, manejo preciso, tiempos de vuelta funcionales y posicionamiento exacto. Los coches de Fable 5 parecían más básicos, mientras que GPT 5.6 Sol entregó una versión con errores sin pista, activos invertidos y una sección de pista rota, haciendo de Opus 5 el claro ganador en calidad de ejecución.

Opus 5 destacó aún más en un proyecto de panel financiero full-stack. Generó una aplicación moderna y completamente funcional con una UI/UX limpia y páginas dedicadas para todas las funciones solicitadas. Opus 5 empleó un stack tecnológico contemporáneo que incluye React Router y Node con SQLite para una gestión de datos robusta. Fable 5 optó por un router propio, un enfoque más antiguo, mientras que Kimi K3 utilizó una base de datos de archivos JSON menos robusta, lo que resalta el enfoque sofisticado de Opus 5 en la arquitectura de proyectos. Para obtener más detalles técnicos sobre sus capacidades, consulte Introducing Opus 5 - Anthropic.

Este modelo demuestra constantemente un gran criterio de programación y una capacidad excepcional para ejecutar proyectos complejos de múltiples archivos en un solo intento. Sus resultados no solo son funcionales, sino que también se adhieren a los estándares de desarrollo modernos, estableciendo a Opus 5 como una herramienta de desarrollo formidable y altamente capaz para uso profesional.

¿Te está gustando? Recibe uno así en tu bandeja cada mañana.

un correo al día · date de baja en dos clics · sin rastreadores de terceros

¿El nuevo estándar? Dónde encaja Opus 5 en tu stack

Opus 5 presenta una alternativa a Fable 5 convincente para el 95% de las tareas, ofreciendo inteligencia de primer nivel a un precio significativamente más favorable. Supera a Fable 5 en casi un 10% en Frontier-Bench y alcanzó un 30.2% sin precedentes en ARC-AGI, mostrando una novedosa capacidad de razonamiento algebraico. Opus 5 cuesta $5 por millón de tokens de entrada y $25 por millón de salida, aproximadamente la mitad del costo típico de finalización de tareas de Fable 5.

Fundamentalmente, Opus 5 ofrece ventajas estratégicas a través de sus políticas de datos. A diferencia de Fable 5, Opus 5 no tiene requisitos de retención de datos para el acceso general. Las políticas de datos restrictivas de Fable 5 incluso impidieron su inclusión en el benchmark ARC-AGI, lo que resalta la mayor flexibilidad y aplicabilidad más amplia de Opus 5 para flujos de trabajo sensibles o propietarios.

El panorama actual de la IA presenta ahora una jerarquía distinta para necesidades especializadas:

  • Fable 5: Mantiene su ventaja para investigaciones complejas y de largo plazo.
  • GPT 5.6 Sol: Ofrece un rendimiento consciente del presupuesto, casi a mitad de precio que Opus 5.
  • Kimi K3: Impresiona con sus capacidades de pesos abiertos, asegurando su nicho.

Opus 5, sin embargo, emerge definitivamente como el nuevo motor diario de alto rendimiento, ofreciendo inteligencia de frontera sin el costo premium ni políticas de datos restrictivas.

Preguntas frecuentes

¿Qué es Claude Opus 5?

Claude Opus 5 es el último modelo de lenguaje grande de Anthropic, diseñado para ofrecer una inteligencia cercana a su modelo de frontera, Fable 5, pero a un precio significativamente menor. Se posiciona como un modelo potente y eficiente para las tareas diarias.

¿Cómo se compara Opus 5 con Fable 5?

Sobre el papel, Opus 5 iguala o supera a Fable 5 en benchmarks clave como los índices de codificación, agentes e inteligencia. También carece de los requisitos de retención de datos de Fable. Sin embargo, es probable que Fable 5 siga siendo superior para problemas extremadamente complejos y de largo plazo.

¿Es Opus 5 realmente más barato que Fable 5?

El precio de la API para Opus 5 es aproximadamente la mitad que el de Fable 5. Si bien los benchmarks sugieren costos de tarea más bajos, algunas pruebas del mundo real muestran que puede usar significativamente más tokens, lo que potencialmente lo hace más costoso para ciertas tareas de generación complejas.

¿Qué tuvo de especial la puntuación de Opus 5 en el benchmark ARC-AGI?

Opus 5 logró una puntuación masiva del 30.2% en ARC-AGI, en comparación con el máximo anterior del 7.8%. Los investigadores notaron que demostró una nueva capacidad al convertir problemas de razonamiento abstracto en notación algebraica para resolverlos, una habilidad no vista en otros modelos.

Found this useful? Share it.

For builders

Want Stork to write one of these about your product?

Send us a URL. We use the product, form a view, and publish what we actually think — in 8 languages, labeled Sponsored, with no copy approval on your side. That last part is what makes it worth quoting.

See how it works$500 · AI tools & software only

Para builders

Esta página está trabajando para la herramienta de otro.

La leen los agentes de IA. Aterrizan compradores. Responde en ocho idiomas y vía MCP. Tu herramienta puede tener una igual — publicada en 24 horas.