OpenAI y Anthropic recortan precios en un empuje agresivo contra los modelos de IA open source
Puntos clave
- •OpenAI recortó los precios de GPT-5.6 Luna en un 80% el 30 de julio, a $0.20 por millón de tokens de entrada y $1.20 por millón de tokens de salida, mientras redujo GPT-5.6 Terra en un 20% a $2/$12.
- •Anthropic hizo permanente el 10 de agosto el precio de lanzamiento de Claude Sonnet 5 en $2 por millón de tokens de entrada y $10 por millón de tokens de salida.
- •El 22 de septiembre, OpenAI lanzó GPT-6 Sol y GPT-6 Luna a precios aproximadamente un 50% menores que los de la generación anterior, y Anthropic respondió con Claude Opus 5.5 a precios de lista de $4/$20 más mejoras de eficiencia que equivalen a alrededor de un 40% de ahorro efectivo.
- •DeepSeek V4 Flash, de China, ofrece precios de tan solo alrededor de $0.14/$0.28 por millón de tokens, y algunos modelos chinos se acercan a las capacidades de gama media de EE. UU. a un costo entre cinco y nueve veces menor.
- •Los pronunciados recortes de precios propietarios reducen la brecha de costos que justifica el autoalojamiento de modelos open source, y los anticipados expedientes de OPI de estas compañías mostrarían si los tokens con descuento se convierten en ingresos a gran escala.

La guerra de precios de IA ha entrado en una nueva fase. A lo largo de 2026, OpenAI y Anthropic han reducido sistemáticamente los precios de sus modelos de gama media, con recortes lo bastante pronunciados como para que los desarrolladores se replanteen si las alternativas open source siguen valiendo la pena frente a las complicaciones del autoalojamiento. Dado que las tarifas por token son el costo recurrente dominante para los equipos que ejecutan funciones de IA en producción, recortes de esta magnitud repercuten directamente en las decisiones de construir o comprar en toda la industria.
Las cifras detrás de la guerra de precios
El 30 de julio, OpenAI redujo los precios de GPT-5.6 Luna en un 80%, llevando los costos a $0.20 por millón de tokens de entrada y $1.20 por millón de tokens de salida. El modelo de gama alta de la compañía, GPT-5.6 Terra, también recibió un recorte del 20%, quedando en $2 por entrada y $12 por salida por millón de tokens.
Anthropic siguió el 10 de agosto, haciendo permanente el precio de lanzamiento de Claude Sonnet 5 en $2/$10 por millón de tokens.
Una segunda ola llegó el 22 de septiembre, cuando OpenAI lanzó GPT-6 Sol y GPT-6 Luna a $2/$10 y $0.10/$0.50 respectivamente, aproximadamente un 50% por debajo de los precios de la generación anterior. Anthropic respondió con Claude Opus 5.5 a un precio de lista de $4/$20, aunque las mejoras de eficiencia integradas generan alrededor de un 40% de ahorro efectivo para los usuarios.
Para quienes no conocen estas tablas: los precios de las API se miden por millón de tokens —los fragmentos de palabras y caracteres que procesan los modelos— y la entrada, el texto que recibe el modelo, suele costar menos que la salida, el texto que genera.
Por qué el open source está bajo presión
El autoalojamiento de modelos de pesos abiertos no implica tarifas por token, pero traslada los costos a hardware de GPU, tiempo de ingeniería y operaciones las 24 horas. Cada recorte de precios de lista de los modelos propietarios reduce el margen que el autoalojamiento necesita para justificar esa carga.
Las empresas están dividiendo cada vez más sus cargas de trabajo en niveles. Los modelos propietarios económicos se encargan de tareas rutinarias como resúmenes, clasificación e interacciones básicas con clientes, mientras que los modelos premium se reservan para cargas de trabajo especializadas donde las diferencias de rendimiento realmente importan.
El open source todavía conserva una participación significativa en volumen, particularmente en plataformas como OpenRouter, donde los desarrolladores combinan modelos a través de una sola integración.
El factor China
Las compañías chinas de IA han establecido puntos de referencia de precios agresivamente bajos que hacen que incluso los precios reducidos de EE. UU. parezcan car. DeepSeek V4 Flash ofrece precios de tan solo alrededor de $0.14/$0.28 por millón de tokens, socavando ampliamente a sus contrapartes estadounidenses. En volúmenes altos, brechas como estas se convierten rápidamente en facturas mensuales notablemente distintas para cargas de trabajo grandes.
La brecha de rendimiento también se está reduciendo. Algunos modelos chinos ahora se acercan a las capacidades de gama media de EE. UU. a costos entre cinco y nueve veces menores.
Cálculos de OPI y presión sobre los márgenes
Se espera ampliamente que tanto OpenAI como Anthropic persigan OPIs. Recortar precios de forma agresiva impulsa la adopción y las métricas de uso, pero también comprime los márgenes. La apuesta es que los precios más bajos generan mayor volumen, y que ese mayor volumen eventualmente compense los márgenes más delgados de cada llamada a la API.
Esa disyuntiva adquiere mayor peso antes de una salida a bolsa, donde los inversionistas suelen examinar el crecimiento y la rentabilidad en paralelo. Como empresas privadas, ninguna de las dos publica estados financieros auditados hoy, por lo que sus futuros expedientes de OPI darían a la industria su primer vistazo concreto de si los tokens con descuento se traducen en ingresos a gran escala.