IA hoy OpenAI rebaja un 33% la API de su modelo estrella y la curva costo-capacidad se desploma
OpenAI recorta precios de GPT-5.6 Sol hasta noviembre y promete más rebajas. El paper de arXiv confirma: el modelo barato ya iguala al flagship de hace 11 semanas a una quinta parte del costo.
OpenAI bajó ayer el precio de la API de GPT-5.6 Sol: 20% en entrada (de 5 a 4 dólares por millón de tokens) y 33% en salida (de 30 a 20 dólares). La oferta es promocional hasta el 21 de noviembre y viene con promesa de seguir recortando un 20% adicional cada trimestre ITmedia.
No es generosidad repentina. El paper "From BERT to Frontier Agents" (arXiv:2608.13675) documenta el colapso de la curva capacidad-costo: GPT-5.6 Luna, el tier económico a 1/6 dólares por millón de tokens, iguala o supera al flagship GPT-5.5 de once semanas atrás en la mayoría de benchmarks agénticos y profesionales a una quinta parte del precio arXiv. Los precios de entrada cayeron 60x desde GPT-3 (2020) a Luna (2026).
La frontera ya no es un solo modelo. El estudio muestra fragmentación por tarea: Claude Opus 5 gana en frontend coding por preferencia humana, Claude Fable 5 en coding a nivel de repositorio, GPT-5.6 Sol en trabajo agéntico de terminal, y Opus 5 cuadruplicó el récord ARC-AGI-3. Un router de dos modelos recupera el óptimo por benchmark de un oráculo de seis arXiv.
Para empresas latinoamericanas, la señal es clara: el acceso a capacidad near-frontier dejó de ser tema de presupuesto. La nueva dashboard de OpenAI permite límites duros de gasto por API key, proyecto u organización —freno de mano incluido cuando se toca el techo ITmedia. Los modelos Terra (2/12) y Luna (0,20/1,20) quedaron fuera de esta ronda; ya habían bajado 20% y 80% respectivamente el 30 de julio.
La apuesta de OpenAI es volumétrica: abaratar para que el uso explote. La apuesta del paper es arquitectónica: enrutar cada tarea al modelo especializado barato en lugar de pagar el premium del generalista. Las dos convergen en lo mismo —el costo marginal de inteligencia útil tiende a cero— y dejan una pregunta incómoda para el CTO regional: ¿sigues comprando el modelo más caro por inercia o ya armaste tu router?