- Los precios de inferencia de IA están cayendo en picado mientras los proveedores modelo luchan por liderar en costes.
- Las subidas de precio de DeepSeek muestran que la carrera hacia el fondo ya podría estar revirtiéndose.
- Una IA más barata podría impulsar un mayor uso, trasladando el valor de los modelos a chips e infraestructuras.
La próxima batalla de la industria de la IA no es quién tiene el modelo más inteligente. Se trata de quién puede realizar una tarea de forma más barata. Ese cambio se hizo evidente este mes, cuando los laboratorios estadounidenses recortaron los precios para contener a rivales chinos más baratos, solo para que el más barato de esos rivales, DeepSeek, subiera sus propios tipos.
¿Por qué el coste, no solo la capacidad, decide ahora el mercado
Los modelos chinos de peso abierto han ido tomando el control discretamente. Los informes de este año muestran que los proveedores chinos gestionan ahora más de la mitad de todo el tráfico enrutado a EE. UU. en OpenRouter, la plataforma que muchos desarrolladores utilizan para comparar y acceder a modelos, frente a aproximadamente una décima parte del año anterior.
La propuesta es sencilla: un rendimiento casi de frontera a una fracción del precio. Esa presión obligó a OpenAI a actuar.
El 30 de julio, redujo el precio de entrada para GPT-5.6 Luna en un 80%, de 1 a 0,20 dólares por millón de tokens, con el precio de salida bajando de 6 a 1,20 dólares. Los datos citados por Jefferies de Silicon Data muestran que los costes medios de inferencia empresarial cayeron de aproximadamente 2,04 dólares por millón de tokens a finales de mayo a unos 1,16-1,18 dólares en agosto, un mínimo anual.
El cambio de cara de DeepSeek
Mientras tanto, la empresa que inició la guerra de precios acaba de subir mucho sus propios precios. A partir del 16 al 17 de agosto, DeepSeek introdujo la facturación en horas punta y fuera de horas punta para sus modelos V4-Pro y V4-Flash, con aumentos que van desde el 50% hasta más del 1.100% dependiendo del modelo y la hora del día.
La producción de V4-Pro salta de $0,87 a $3,96 por millón de tokens en los picos (9:00-12:00 y de 14:00-18:00 hora de Pekín), o $1,98 fuera de hora punta. La producción de V4-Flash sube de $0,28 a $1,32 en el pico, y a $0,66 fuera de hora punta.
DeepSeek afirma que el cambio pretende distribuir la demanda de forma más equitativa en toda su infraestructura. Incluso tras la subida, sus tipos siguen por debajo de muchos rivales, pero la brecha con el modelo Luna descontado de OpenAI se ha reducido drásticamente y, en algunas comparaciones de horas punta, ha desaparecido por completo.
El ángulo de la paradoja de Jevons
La caída de precios no significa necesariamente la caída de las facturas. Cuando cada tarea se abarata mucho, se vuelve rentable ejecutar muchas más: agentes de varios pasos, flujos de trabajo automatizados y procesos que antes no merecían la pena automatizar.
Los analistas ya han señalado que las cargas de trabajo agential que encadenan decenas de llamadas, antes poco prácticas, ahora son más baratas que una sola llamada semanas antes. Esa es la clásica paradoja de Jevons: las ganancias de eficiencia pueden expandir el consumo total más rápido de lo que reducen el precio por unidad. En otras palabras, el gasto en IA empresarial podría seguir aumentando incluso cuando el coste por tarea baja.
Quién realmente pierde
Si la inferencia sigue avanzando hacia la fijación de precios de materias primas, los desarrolladores de modelos que compiten por la producción bruta se enfrentan a la mayor presión, especialmente porque OpenAI y Anthropic persiguen OPVs con valoraciones cercanas a 1 billón de dólares. Los márgenes más bajos en los tokens dificultan justificar esas valoraciones solo con las ventas del modelo.
La infraestructura parece más aislada. Más tareas, agentes y llamadas de inferencia siguen requiriendo chips, capacidad en la nube y centros de datos, independientemente de quién gane la guerra de precios.
Relacionado: Gemini 3.7 Flash podría convertir a la cripto en el campo de pruebas definitivo para agentes de IA
Disclaimer: The information presented in this article is for informational and educational purposes only. The article does not constitute financial advice or advice of any kind. Coin Edition is not responsible for any losses incurred as a result of the utilization of content, products, or services mentioned. Readers are advised to exercise caution before taking any action related to the company.