Volver al BlogInteligencia Artificial

Los precios de la IA se desplomaron este verano: cómo recalcular lo que pagas por tus automatizaciones

4 de agosto de 20267 min de lectura

Entre el 30 de junio y el 3 de agosto se movió el mapa de precios de la IA. Te muestro con números cómo auditar tus automatizaciones y qué recortar.

Si montaste una automatización con IA antes de julio y no la has vuelto a tocar, hoy pagas un precio que ya no tiene sentido. El modelo que elegiste era la opción razonable entonces; hoy hay otro que hace el mismo trabajo por una fracción. Tu factura no se ajusta sola: se ajusta el día que tú cambias la configuración.

En cinco semanas se movió buena parte del mapa. Un modelo bajó 80% de precio tres semanas después de salir, otro llegó al plan gratuito de su proveedor y un tercero entró desde China con precio agresivo. Si tienes un chatbot o un clasificador de correos sobre una API, tu costo variable cambió sin que hicieras nada.

Lo que cambió entre el 30 de junio y el 3 de agosto

La línea de tiempo, en dólares por millón de tokens de entrada y de salida:

  • 30 de junio. Anthropic lanza Claude Sonnet 5 a 2/10 y lo pone como modelo por defecto en el plan gratuito y en el Pro. En la API es claude-sonnet-5. Ojo: ese precio se anunció como introductorio.
  • 9 de julio. OpenAI publica GPT-5.6 en tres versiones: Sol (insignia) a 5/30, Terra a 2.50/15 y Luna a 1/6. El mismo día estrena ChatGPT Work, al inicio solo en planes Pro, Enterprise y Edu.
  • 24 de julio. Anthropic saca Claude Opus 5 a 5/25, el mismo precio que Opus 4.8. Contexto de un millón de tokens y hasta 128k de salida.
  • 30 de julio. OpenAI recorta Luna un 80%, de 1.00/6.00 a 0.20/1.20, y Terra un 20%, de 2.50/15 a 2.00/12. Sol se queda en 5/30.
  • 3 de agosto. Alibaba lanza Qwen3.8-Max a 2/6, tras mostrarlo en preview el 19 de julio en la conferencia mundial de IA en Shanghái.

Lo que más me llama la atención del 30 de julio es el plazo: tres semanas entre el lanzamiento y el recorte, sin una generación nueva de modelos de por medio. Las coberturas lo atribuyen a la sensibilidad al costo de los clientes empresariales; lo de la presión china es lectura de analistas, no un dato confirmado. La conclusión es la misma: el precio de lista de un modelo hoy no es un dato estable.

Haz la cuenta con tus propios números

Uso una cifra redonda para que la adaptes: 50 millones de tokens de entrada y 10 millones de salida al mes. Con Luna al precio del 9 de julio, esa carga costaba 110 dólares mensuales; con el precio del 30 de julio cuesta 22. Son 88 dólares al mes, más de mil al año, sin tocar tu lógica. Con Terra pasó de 275 a 220. Con Sonnet 5 sale en 200 y con Qwen3.8-Max en 160.

Y el número incómodo: esa misma carga con Sol, que no bajó de precio, son 550 dólares. Veinticinco veces lo que cuesta en Luna para el mismo trabajo. Con Opus 5, 500. Si tu automatización clasifica correos y quedó en el modelo insignia, esa diferencia la pagas cada mes por comodidad.

El modelo caro casi nunca gana en la tarea rutinaria

No te voy a vender que el modelo barato es igual de bueno. No lo es, y los proveedores lo dicen con números: Anthropic reporta que Opus 5 más que duplica a Opus 4.8 en Frontier-Bench v0.1, triplica al siguiente mejor modelo en ARC-AGI 3 y supera el mejor resultado de Fable 5 en OSWorld 2.0 a poco más de un tercio del costo. Son cifras del propio fabricante, y son impresionantes. Pero ninguno de esos benchmarks mide lo que corre en tu negocio: clasificar cuatrocientos correos en tres categorías no es un problema de frontera.

La forma honesta de decidirlo es medirlo tú. Toma cincuenta casos reales de tu operación, con las respuestas correctas ya conocidas, y córrelos por los dos modelos con el mismo prompt. Si el barato falla en tres y el caro en uno, la pregunta es si esos dos casos justifican pagar todo el volumen al precio alto. En mi experiencia casi nunca: aísla el subconjunto difícil con una regla y manda solo ese al modelo caro. Lo aprendí pagando el precio caro, que es haber dejado todo en el modelo grande por no hacer la prueba.

El plazo del 31 de agosto que sí tienes que anotar

Aquí va la letra chica que más gente se va a saltar. El precio de 2/10 de Sonnet 5 se anunció como introductorio hasta el 31 de agosto, con un salto previsto a 3/15 después. Al día de hoy, 7 de agosto, no hay confirmación pública de si ese aumento se aplicará, se pospondrá o se cancelará.

Con la carga del ejemplo, la diferencia entre 2/10 y 3/15 son 100 dólares al mes: de 200 a 300, un 50% más. Ponle una alerta al calendario para la última semana de agosto y confirma la tarifa antes de comprometer un presupuesto o un precio al cliente.

Qwen3.8-Max te importa aunque nunca lo uses

El modelo de Alibaba tiene 2,4 billones de parámetros totales con 95.000 millones activos, ventana de un millón de tokens y trabaja con texto, imagen, video y documentos. Alibaba afirma que solo queda por detrás de Claude Fable 5, y en OSWorld-Verified reporta 86,1. También anunció que abrirá los pesos. Mi opinión: para un negocio hispano en Estados Unidos que maneja datos de clientes, un proveedor chino trae preguntas de cumplimiento y de percepción que no valen la pena resolver hoy. Pero igual te toca: un modelo casi de frontera a 2/6 pone un piso de precio que termina reflejándose en tu factura de OpenAI o de Anthropic.

No firmes contratos anuales cerrados

Si un proveedor de IA, o una agencia que te revende IA, te ofrece hoy un contrato anual con precio fijo y descuento por compromiso, la pregunta es qué pasa si el costo por unidad de trabajo vuelve a caer 80% en octubre. Con el ritmo de las últimas cinco semanas, no es rebuscado. Hay otra señal: Sol no bajó de precio, pero pasó a ser aproximadamente 2,5 veces más rápido en la API, y OpenAI atribuye parte de esa mejora a que el propio modelo reescribió sus kernels de GPU. Todavía hay eficiencia por exprimir del lado del proveedor. Contratos mensuales o trimestrales, con cláusula de revisión.

La auditoría de treinta minutos

Si estás empezando, este es el orden que yo seguiría hoy mismo:

  1. Lista las automatizaciones vivas: chatbots, clasificadores, generadores de contenido, flujos en Zapier o Make.
  2. Anota qué modelo tiene configurado cada una. No el proveedor: el nombre del modelo. Es el campo que casi nadie revisa después de la primera semana.
  3. Calcula el costo mensual real de cada una con los precios de arriba y tu volumen del último mes.
  4. Marca las que corren en Sol u Opus 5 haciendo trabajo rutinario. Ahí está tu ahorro inmediato.
  5. Antes de migrar, corre la prueba de los cincuenta casos. Si el económico pasa, cámbialo y deja el caro para las excepciones.
  6. Pon la alerta de la última semana de agosto para revisar el precio de Sonnet 5.

Si haces solo el paso dos, ya vas ganando: la mayoría de los negocios que reviso no sabe qué modelo tiene configurado, y ese desconocimiento convierte la caída del 80% en cero ahorro.


Lo que vemos este verano no es una promoción: es un mercado ajustando su precio hacia abajo mientras la calidad sube. Buenísimo para un negocio pequeño, pero solo si tienes el hábito de revisar. Ponle fecha fija al calendario, el primer lunes de cada mes.

WH

Wilmer Hurtado

Consultor de Marketing & IA · Miami, FL

Más de 30 años de experiencia en Marketing, de los cuales 23 años en el mercado de los Estados Unidos. Ayudo a emprendedores, profesionales y empresas a crecer usando marketing digital e inteligencia artificial. Growth Hacker, Paid Media specialist y Productor Multimedia.

Próximo Taller

Taller de 6 horas de Claude Cowork

Taller en vivo de 6 horas (2 sesiones × 3h en Zoom). Aprende a usar Claude Cowork para producir contenido, reportes, contenido y automatizaciones reales. Sin saber programar.

Ver detalles del taller →