Claude Opus 5 supera a Fable 5 en la mayoría de los benchmarks—al mitad de precio

By: rootdata|2026/07/24 18:28:43

Claude Opus 5 se lanza hoy. Es más barato para las empresas operar que el modelo líder de Anthropic, Claude Fable 5, que la compañía había posicionado como el producto de vanguardia para usuarios de pago. Además, Opus 5 también lo supera en benchmarks significativos.

Para entender dónde encaja Opus 5: la línea de productos de Anthropic tiene cuatro niveles. Haiku es rápido y barato. Sonnet es de gama media. Opus es el caballo de batalla. Por encima de eso está la clase Mythos—un nivel que Anthropic introdujo esta primavera—que incluye Claude Fable 5 para el público y Claude Mythos 5, una versión con menos restricciones reservada a través del Proyecto Glasswing para investigadores de ciberseguridad verificados y operadores de infraestructura crítica.

Fable 5 ha tenido un recorrido difícil como el buque insignia para suscriptores. Se lanzó el 9 de junio, fue retirado globalmente tres días después tras una orden de control de exportación de emergencia emitida por el gobierno de EE. UU. citando una vulnerabilidad de jailbreak, y volvió el 30 de junio—solo para cambiar inmediatamente a un modelo solo de créditos, ya no incluido en los planes estándar. Opus 5 ahora ocupa el lugar que Fable 5 no pudo mantener.

Lovable, una plataforma de desarrolladores con millones de usuarios, ejecutó Opus 5 en sus evaluaciones internas y notó que las mejoras van más allá de las puntuaciones brutas: "No solo es mejor en nuestras tareas de codificación más difíciles, un 22% más que Opus 4.7, es más estable, con mucha menos variación de ejecución a ejecución," dijo Fabian Hedin en una declaración compartida por Anthropic.

Los benchmarks

Puede sonar extraño, pero Opus supera a Fable en casi todo lo que importará al usuario cotidiano sin estar etiquetado como de clase Mythos como Fable.

En Frontier-Bench v0.1—un benchmark que prueba si los agentes de codificación de IA pueden completar tareas de ingeniería de software reales de extremo a extremo, puntuadas como un porcentaje de tareas aprobadas—Opus 5 alcanzó el 43.3%. Fable 5 llegó al 33.7%. GPT-5.6 Sol de OpenAI, el principal rival comercial de Anthropic, obtuvo un 34.4%.

El margen más amplio está en ARC-AGI-3, una prueba de resolución de problemas genuina construida alrededor de rompecabezas novedosos que un modelo no podría haber memorizado de los datos de entrenamiento, puntuadas como un porcentaje de rompecabezas resueltos. Opus 5 alcanzó el 30.2%; GPT-5.6 Sol obtuvo un 7.8%; y Fable 5 no fue probado en absoluto. En GDPval-AA v2—un benchmark de trabajo de conocimiento puntuado a través de calificaciones Elo, el sistema de clasificación estilo ajedrez utilizado para medir el rendimiento relativo en tareas profesionales reales—Opus 5 alcanzó 1,861 frente a los 1,747 de Fable 5 y los 1,736 de GPT-5.6 Sol.

Zapier probó Opus 5 en AutomationBench, una evaluación que puntúa si un modelo puede llevar a cabo un flujo de trabajo empresarial completo de principio a fin sin ayuda humana. Su veredicto: el modelo "tomó un libro de trabajo de salud de cuentas crudo y ejecutó una secuencia completa de prevención de cancelaciones de principio a fin: señalando cuentas en riesgo, alertando al propietario correcto y resumiendo para operaciones de retención. Modelos anteriores no pasaron; Opus 5 alcanzó el 100%."

Anthropic también está promocionando Opus 5 como una mejora para la investigación. Ultima Genomics, una empresa de secuenciación de ADN, dijo que el modelo "se comporta más como un científico cuidadoso que cualquier modelo que hayamos ejecutado. Busca las pruebas estadísticas correctas para descartar confusores, verifica sus propios resultados mediante métodos independientes y se mantiene en el camino a través de análisis largos y de múltiples pasos."

Dicho esto, estas dos áreas—legal y salud—son las únicas en las que Fable 5 sobresale por un pequeño margen.

El lanzamiento llega una semana después de que Moonshot AI, una startup con sede en Beijing respaldada por Alibaba, presentó Kimi K3—un modelo de 2.8 billones de parámetros (lo que significa que cualquiera puede descargar el código subyacente para ejecutarlo de forma independiente) que Moonshot describe como el sistema de IA abierto más grande del mundo. Los benchmarks independientes colocan consistentemente a Kimi K3 en tercer lugar en general, detrás de Fable 5 y GPT-5.6 Sol, superando a esos dos en áreas específicas.

Opus 5 está disponible ahora a través de API a $5 por millón de tokens de entrada y $25 por millón de salida. (Los tokens son la unidad básica de información que un modelo de IA puede procesar tanto en entrada como en salida). También está disponible un modo Rápido que funciona a aproximadamente 2.5 veces la velocidad predeterminada, al doble del precio base—$10 por millón de tokens de entrada y $50 por millón de salida.

Este lanzamiento puede poner fin a la ansiedad por la falta de disponibilidad pública de Fable 5. Opus también está disponible a través de suscripción para todos.

Descargo de responsabilidad: Este contenido se proporciona únicamente con fines generales de desarrollo de marca e informativos y no constituye asesoramiento financiero, de inversión, legal ni fiscal. Cualquier evento, recompensa, evento en línea o información relacionada que se mencione en el presente documento no debe considerarse como una recomendación, solicitud o invitación para comprar, vender, tradear o negociar de cualquier otra forma con cualquier criptoactivo o para utilizar cualquier servicio. Los criptoactivos son sumamente volátiles y pueden provocar pérdidas. Es posible que los servicios de WEEX y los eventos en línea no estén disponibles en todas las regiones, así como que estén sujetos a las leyes, regulaciones y requisitos de elegibilidad vigentes. Usted es responsable de asegurarse de que su uso de los servicios de WEEX cumpla con las leyes locales y de evaluar cuidadosamente los riesgos antes de participar en cualquier actividad relacionada con las criptomonedas.

También te puede interesar

iconiconiconiconiconicon
Atención al cliente:@weikecs
Cooperación empresarial:@weikecs
Trading cuantitativo y MM:bd@weex.com
Programa VIP:support@weex.com