Radar Claude Opus 5 no llegó: qué modelos usar hoy y cómo prepararse para el que viene
Anthropic no lanzó Opus 5 el jueves 23 de julio pese a los rumores. El catálogo real sigue con Fable 5, Opus 4.8, Sonnet 5 y Haiku 4.5. Mientras, GPT-5.6 ya corre. Guía para elegir, migrar y no pagar de más.
El jueves 23 de julio de 2026 pasó sin que Anthropic lanzara Claude Opus 5, pese a que los rumores —alimentados por un identificador de modelo visto en Cursor y señales en Vertex AI— le asignaban hasta un 88% de probabilidad en Polymarket. Lo que sí llegó fue una actualización del modo de voz que ahora corre sobre Opus y Sonnet, además de Haiku, y permite disparar acciones en apps conectadas como Gmail, Slack o Notion en once idiomas, español incluido. Pero el catálogo de modelos sigue sin un `claude-opus-5`.
El catálogo real que tienes hoy
Anthropic tiene cinco modelos disponibles, con precios claros y diferencias operativas que cualquier equipo en América Latina debería considerar antes de decidir:
- Claude Fable 5 (USD 10 / USD 50 por millón de tokens): la máxima capacidad pública, pensada para agentes largos y tareas de alto valor. Usa el nuevo tokenizer que incrementa hasta 30% los tokens del mismo texto, por lo que el costo efectivo es mayor que el de tabla.
- Claude Opus 4.8 (USD 5 / USD 25): el punto medio para programación compleja y agentes empresariales. Soporta 1M de contexto y `effort` desde `high` por defecto.
- Claude Sonnet 5 (USD 3 / USD 15, hasta el 31 de agosto a USD 2 / USD 10): el mejor equilibrio entre velocidad, capacidad y precio. Cubre entre 70% y 80% de las tareas diarias.
- Claude Haiku 4.5 (USD 1 / USD 5): el más rápido y barato para clasificación, resúmenes y procesamiento por lotes. Contexto de 200K tokens.
- Claude Mythos 5: mismas especificaciones que Fable 5 pero con disponibilidad limitada a clientes aprobados en Project Glasswing.
La lección es simple: no existe `claude-opus-5`, y el modelo más capaz del catálogo se llama Fable, no Opus. Ningún leak anticipó ese nombre.
Por qué el mercado se equivocó y qué aprendemos
Las tres señales que alimentaron el rumor —el string "Claude Honeycomb EAP" en Cursor, su aparición en el catálogo de cuotas de Vertex AI, y la cadencia de 42 a 70 días entre versiones de Opus 4.x— eran todas compatibles con un lanzamiento inminente, pero ninguna era un anuncio oficial. Polymarket tenía un contrato específico que preguntaba si el modelo aterrizaba exactamente el jueves 23, y ese cotizaba solo 29%. La diferencia entre 88% y 29% ilustra un problema metodológico: cuando cites una probabilidad de un mercado de predicción, verifica qué pregunta concreta está midiendo.
Para equipos en Argentina, Brasil o México, el riesgo no es el rumor, sino la especulación operativa. Si tu equipo dejó de migrar a un modelo confirmado esperando Opus 5, ya perdiste dos semanas de mejoras en costo y capacidad. Sonnet 5, por ejemplo, cerró buena parte de la brecha con Opus 4.8 a la mitad del precio, y GPT-5.6 de OpenAI —lanzado el 9 de julio con las variantes Sol, Terra y Luna— ya supera a Fable 5 en agentes de código según mediciones de Artificial Analysis.
Cómo elegir modelo sin esperar al próximo lanzamiento
La recomendación práctica es diseñar una escalera de enrutamiento, no apostar por un solo modelo. Para la mayoría de tareas diarias —revisión de código, documentación, automatización de procesos internos— Sonnet 5 rinde mejor en relación costo-beneficio. Si la tarea es compleja, sube a Opus 4.8. Y solo si la tarea es crítica y de alto valor, usa Fable 5. Haiku queda para lotes ligeros y alta concurrencia.
Hay dos detalles que casi nadie mira y que encarecen las cuentas. Primero, el tokenizer nuevo de Fable 5 y Sonnet 5 produce más tokens para el mismo texto: el costo real por tarea puede ser 30% superior al que sugiere la tabla de precios. Segundo, si usas `effort: max` sin control, los tokens de salida se disparan. Anthropic tiene en beta el parámetro `task_budget`, que limita el total de tokens para toda una tarea y evita sorpresas.
Qué hacer esta semana
Lo más urgente es auditar los strings de modelo en tu código. Opus 4.1 se depreca el 5 de agosto de 2026, y modelos como `claude-3-7-sonnet` ya devuelven 404 desde febrero. Si tienes `temperature`, `top_p` o `top_k` en tus llamadas, esos parámetros rompen en Opus 4.7 y posteriores: la forma correcta de controlar el comportamiento ahora es el prompt más el nivel de `effort`. Y conviene revisar el prompt caching, que funciona por coincidencia de prefijos: usarlo para system prompts y documentos largos reduce costos de forma significativa.
Mientras el ecosistema espera el próximo movimiento de Anthropic, el trabajo útil está en migrar a lo que ya existe, medir costos reales con muestras propias y no dejar decisiones operativas en manos de un rumor.