Claude Opus 5 no llegó: qué modelos usar hoy y cómo prepararse para el que viene

Anthropic no lanzó Opus 5 el jueves 23 de julio pese a los rumores. El catálogo real sigue con Fable 5, Opus 4.8, Sonnet 5 y Haiku 4.5. Mientras, GPT-5.6 ya corre. Guía para elegir, migrar y no pagar de más.

Claude Opus 5 no llegó: qué modelos usar hoy y cómo prepararse para el que viene

El jueves 23 de julio de 2026 pasó sin que Anthropic lanzara Claude Opus 5, pese a que los rumores —alimentados por un identificador de modelo visto en Cursor y señales en Vertex AI— le asignaban hasta un 88% de probabilidad en Polymarket. Lo que sí llegó fue una actualización del modo de voz que ahora corre sobre Opus y Sonnet, además de Haiku, y permite disparar acciones en apps conectadas como Gmail, Slack o Notion en once idiomas, español incluido. Pero el catálogo de modelos sigue sin un `claude-opus-5`.

El catálogo real que tienes hoy

Anthropic tiene cinco modelos disponibles, con precios claros y diferencias operativas que cualquier equipo en América Latina debería considerar antes de decidir:

Patrocinado Advertisement
  • Claude Fable 5 (USD 10 / USD 50 por millón de tokens): la máxima capacidad pública, pensada para agentes largos y tareas de alto valor. Usa el nuevo tokenizer que incrementa hasta 30% los tokens del mismo texto, por lo que el costo efectivo es mayor que el de tabla.
  • Claude Opus 4.8 (USD 5 / USD 25): el punto medio para programación compleja y agentes empresariales. Soporta 1M de contexto y `effort` desde `high` por defecto.
  • Claude Sonnet 5 (USD 3 / USD 15, hasta el 31 de agosto a USD 2 / USD 10): el mejor equilibrio entre velocidad, capacidad y precio. Cubre entre 70% y 80% de las tareas diarias.
  • Claude Haiku 4.5 (USD 1 / USD 5): el más rápido y barato para clasificación, resúmenes y procesamiento por lotes. Contexto de 200K tokens.
  • Claude Mythos 5: mismas especificaciones que Fable 5 pero con disponibilidad limitada a clientes aprobados en Project Glasswing.

La lección es simple: no existe `claude-opus-5`, y el modelo más capaz del catálogo se llama Fable, no Opus. Ningún leak anticipó ese nombre.

Por qué el mercado se equivocó y qué aprendemos

Las tres señales que alimentaron el rumor —el string "Claude Honeycomb EAP" en Cursor, su aparición en el catálogo de cuotas de Vertex AI, y la cadencia de 42 a 70 días entre versiones de Opus 4.x— eran todas compatibles con un lanzamiento inminente, pero ninguna era un anuncio oficial. Polymarket tenía un contrato específico que preguntaba si el modelo aterrizaba exactamente el jueves 23, y ese cotizaba solo 29%. La diferencia entre 88% y 29% ilustra un problema metodológico: cuando cites una probabilidad de un mercado de predicción, verifica qué pregunta concreta está midiendo.

Para equipos en Argentina, Brasil o México, el riesgo no es el rumor, sino la especulación operativa. Si tu equipo dejó de migrar a un modelo confirmado esperando Opus 5, ya perdiste dos semanas de mejoras en costo y capacidad. Sonnet 5, por ejemplo, cerró buena parte de la brecha con Opus 4.8 a la mitad del precio, y GPT-5.6 de OpenAI —lanzado el 9 de julio con las variantes Sol, Terra y Luna— ya supera a Fable 5 en agentes de código según mediciones de Artificial Analysis.

Cómo elegir modelo sin esperar al próximo lanzamiento

La recomendación práctica es diseñar una escalera de enrutamiento, no apostar por un solo modelo. Para la mayoría de tareas diarias —revisión de código, documentación, automatización de procesos internos— Sonnet 5 rinde mejor en relación costo-beneficio. Si la tarea es compleja, sube a Opus 4.8. Y solo si la tarea es crítica y de alto valor, usa Fable 5. Haiku queda para lotes ligeros y alta concurrencia.

Hay dos detalles que casi nadie mira y que encarecen las cuentas. Primero, el tokenizer nuevo de Fable 5 y Sonnet 5 produce más tokens para el mismo texto: el costo real por tarea puede ser 30% superior al que sugiere la tabla de precios. Segundo, si usas `effort: max` sin control, los tokens de salida se disparan. Anthropic tiene en beta el parámetro `task_budget`, que limita el total de tokens para toda una tarea y evita sorpresas.

Qué hacer esta semana

Lo más urgente es auditar los strings de modelo en tu código. Opus 4.1 se depreca el 5 de agosto de 2026, y modelos como `claude-3-7-sonnet` ya devuelven 404 desde febrero. Si tienes `temperature`, `top_p` o `top_k` en tus llamadas, esos parámetros rompen en Opus 4.7 y posteriores: la forma correcta de controlar el comportamiento ahora es el prompt más el nivel de `effort`. Y conviene revisar el prompt caching, que funciona por coincidencia de prefijos: usarlo para system prompts y documentos largos reduce costos de forma significativa.

Mientras el ecosistema espera el próximo movimiento de Anthropic, el trabajo útil está en migrar a lo que ya existe, medir costos reales con muestras propias y no dejar decisiones operativas en manos de un rumor.

Fuentes

  1. Presentando Claude Opus 5
  2. Claude Opus 5: el lanzamiento que no fue (y qué usar hoy)
  3. Cómo elegir los modelos Claude actuales de Anthropic: Fable, Opus ...
  4. Claude Opus 5: lanzamiento, especificaciones filtradas y benchmarks
  5. Capacidades de los modelos de lenguaje grandes en ingeniería de control: un estudio de referencia sobre GPT-4, Claude 3 Opus y Gemini 1.0 Ultra
Ariel Acosta

Escrito por

Ariel Acosta

Experto en seguridad de información

Ingeniero en sistemas y gestor de servicios de TI con más de 10 años de experiencia en diseño, implementación y administración de infraestructura de red, seguridad y procesos tecnológicos. Ha desarrollado una carrera orientada a sostener operaciones críticas, optimizar entornos corporativos y traducir necesidades técnicas en soluciones funcionales para organizaciones que dependen de plataformas estables, seguras y alineadas con el negocio, con foco en eficiencia y control.