Claude Opus 5 supera a Fable 5 en pruebas de rendimiento al costo de la mitad

BABA-1,64%
Key Takeaways
  • Anthropic lanzó Claude Opus 5 el 24 de julio a 5 dólares por cada millón de tokens de entrada, a la mitad del coste de Fable 5.
  • Opus 5 obtuvo un 43,3% en Frontier-Bench v0.1 frente al 33,7% de Fable 5 y el 34,4% de GPT-5.6 Sol.
  • Opus 5 se convirtió en el valor predeterminado en Claude Max, sustituyendo a Fable 5 tras sus interrupciones operativas.

Anthropic lanzó Claude Opus 5 el 24 de julio, con un precio de 5 USD por cada millón de tokens de entrada—la mitad del costo de su modelo anterior, Claude Fable 5—mientras superaba a Fable 5 en la mayoría de los principales benchmarks. Opus 5 obtuvo un 43,3% en Frontier-Bench v0.1, una evaluación de codificación con agentes, frente al 33,7% de Fable 5 y el 34,4% de GPT-5.6 Sol de OpenAI; en ARC-AGI-3, un benchmark novedoso de resolución de problemas, logró un 30,2% frente al 7,8% de GPT-5.6 Sol. El nuevo modelo se convirtió en la opción predeterminada en Claude Max y en la opción más sólida en Claude Pro, reemplazando de forma efectiva a Fable 5 como la alternativa por defecto para la mayoría de los suscriptores tras las disrupciones operativas de Fable 5 a principios de este verano.

La gama de Anthropic consta de cuatro niveles: Haiku es rápido y barato, Sonnet es de gama media, Opus es el caballo de batalla y la clase Mythos—introducida esta primavera—incluye Claude Fable 5 para el público y Claude Mythos 5 para investigadores de ciberseguridad verificados y operadores de infraestructuras críticas a través de Project Glasswing.

Claude Opus 5 supera a Fable 5 en los principales benchmarks

En Frontier-Bench v0.1, que prueba si los agentes de codificación de IA pueden completar tareas reales de ingeniería de software de extremo a extremo, Opus 5 alcanzó un 43,3%. Fable 5 se quedó en 33,7% y GPT-5.6 Sol de OpenAI obtuvo 34,4%.

La mayor diferencia apareció en ARC-AGI-3, una prueba de resolución de problemas basada en acertijos novedosos que un modelo no podría haber memorizado a partir de los datos de entrenamiento. Opus 5 logró un 30,2%; GPT-5.6 Sol obtuvo un 7,8%; Fable 5 no fue evaluado en absoluto.

En GDPval-AA v2, un benchmark de trabajo del conocimiento puntuado mediante valoraciones Elo usadas para medir el rendimiento relativo en tareas profesionales reales, Opus 5 llegó a 1.861 frente a 1.747 de Fable 5 y 1.736 de GPT-5.6 Sol.

Fable 5 superó a Opus 5 por un margen pequeño solo en evaluaciones relacionadas con legal y salud, según los benchmarks publicados por Anthropic.

Anthropic fija el precio de Opus 5 en 5 USD por cada millón de tokens de entrada

Opus 5 está disponible por API a 5 USD por cada millón de tokens de entrada y 25 USD por cada millón de tokens de salida. Hay un modo Fast que funciona a unas 2,5 veces la velocidad por defecto disponible al doble del precio base—10 USD por cada millón de tokens de entrada y 50 USD por cada millón de tokens de salida.

La fijación de precios coincide con Opus 4.8 y es exactamente la mitad del costo de Fable 5, que Anthropic había posicionado como el producto de frontera diario para usuarios que pagan.

Fable 5 fue retirado a nivel global tras una orden de control de exportaciones

Fable 5 se lanzó el 9 de junio, fue retirado globalmente tres días después tras que el gobierno de EE. UU. emitiera una orden de control de exportaciones de emergencia citando una vulnerabilidad de jailbreak, y volvió el 30 de junio. Al regresar, pasó de inmediato a un modelo solo de créditos, ya no incluido en los planes estándar.

Opus 5 ahora ocupa el hueco que Fable 5 no pudo mantener como buque insignia para suscriptores.

Plataformas de terceros validan las mejoras de rendimiento de Opus 5

Lovable, una plataforma de desarrollo con millones de usuarios, ejecutó Opus 5 en sus evaluaciones internas. “No es solo que sea mejor en nuestras tareas de codificación con agentes más difíciles, con un 22% más sobre Opus 4.7; es más estable, con mucha menos variación de una ejecución a otra”, dijo Fabian Hedin en una declaración compartida por Anthropic.

Zapier probó Opus 5 en AutomationBench, una evaluación que puntúa si un modelo puede llevar un flujo de trabajo empresarial completo desde el inicio hasta el final sin ayuda humana. El modelo “tomó un libro de trabajo sin procesar de salud de la cuenta y ejecutó una secuencia completa de prevención de churn de extremo a extremo: marcando cuentas en riesgo, alertando al responsable adecuado y resumiendo para operaciones de retención. Los modelos anteriores no superaron la prueba; Opus 5 alcanzó el 100%”.

Ultima Genomics, una empresa de secuenciación de ADN, dijo que el modelo “se comporta más como un científico cuidadoso que como cualquier modelo que hayamos ejecutado. Llega a las pruebas estadísticas correctas para descartar variables de confusión, contrasta sus propios resultados con métodos independientes y se mantiene en el camino durante análisis largos de múltiples pasos”.

El lanzamiento llegó una semana después de que Moonshot AI, una startup con sede en Pekín respaldada por Alibaba, presentara Kimi K3: un modelo de pesos abiertos de 2,8 billones de parámetros que Moonshot describió como el sistema abierto de IA más grande del mundo. Los benchmarks independientes ubicaron de forma consistente a Kimi K3 en tercer lugar en general, por detrás de Fable 5 y GPT-5.6 Sol, superando a esos dos en áreas específicas.

Preguntas frecuentes

¿En qué benchmarks superó Claude Opus 5 a Fable 5?

Claude Opus 5 obtuvo 43,3% en Frontier-Bench v0.1 frente al 33,7% de Fable 5, 30,2% en ARC-AGI-3 (Fable 5 no fue evaluado) y 1.861 en GDPval-AA v2 frente a 1.747 de Fable 5. Fable 5 superó a Opus 5 por un margen pequeño solo en evaluaciones relacionadas con legal y salud.

¿Cuánto cuesta Claude Opus 5 en comparación con Fable 5?

Claude Opus 5 cuesta 5 USD por cada millón de tokens de entrada y 25 USD por cada millón de tokens de salida mediante API—exactamente la mitad del costo implícito de Fable 5. Hay un modo Fast disponible a 10 USD por cada millón de tokens de entrada y 50 USD por cada millón de tokens de salida.

¿Por qué se retiró Claude Fable 5 de la disponibilidad global?

Fable 5 se lanzó el 9 de junio y fue retirado globalmente tres días después, tras que el gobierno de EE. UU. emitiera una orden de control de exportaciones de emergencia citando una vulnerabilidad de jailbreak. Regresó el 30 de junio como un modelo solo de créditos, ya no incluido en los planes estándar.

Aviso legal: La información en esta página puede provenir de fuentes de terceros y es solo para referencia. No representa las opiniones ni puntos de vista de Gate y no constituye asesoramiento financiero, de inversión ni legal. El comercio de activos virtuales implica un alto riesgo. No te bases únicamente en la información presentada en esta página para tomar decisiones. Para más detalles, consulta el Aviso legal.
Comentar
0/400
Sin comentarios