← Volver a Novedades
Ahorrar tokens y plata · Guerra de precios Anthropic-OpenAI · 29 de septiembre de 2026

Modelo de IA barato o caro: cuándo conviene cada uno

El 22 de septiembre, con menos de dos horas de diferencia, Anthropic y OpenAI bajaron los precios de sus modelos. No fue una promoción de lanzamiento ni una casualidad: fue el mismo día porque las dos empresas venían de anunciar que iban a bajar el ritmo de las mejoras, y terminaron compitiendo por precio en su lugar. Para cualquiera que paga una IA por uso —por token, la unidad mínima de texto que un modelo lee o escribe—, esa guerra de precios deja una pregunta más útil que "cuál es la mejor IA": cuál conviene para cada tarea.

Un camión blindado enorme entrega un solo sobre en un comercio de barrio mientras un repartidor en bicicleta espera atrás con varios paquetes

Qué bajó el 22 de septiembre

Anthropic lanzó Claude Opus 5.5, su modelo más potente, con precio de lanzamiento 20% más bajo que el anterior: 4 dólares por millón de tokens de entrada y 20 por millón de salida, contra 5 y 25 antes. La empresa asegura que en tareas típicas el costo total baja 40%, porque además el modelo necesita menos tokens para resolver lo mismo. OpenAI, casi a la misma hora, sumó dos modelos nuevos a su familia GPT-6: Sol, a 2 dólares de entrada y 10 de salida por millón de tokens, y Luna, a apenas 0,10 y 0,50 —la mitad de lo que costaban sus versiones anteriores—, y esta vez sin fecha de vencimiento: la empresa aclaró que son precios permanentes, no de lanzamiento.

Por qué hay un modelo para cada tarea, no uno solo

Escritorio de noche con miniaturas de una bicicleta, una camioneta y un camión, cada una junto a un paquete de su tamaño, sobre un libro contable

Ninguna de las dos empresas bajó el precio de su modelo insignia y lo dejó ahí: lo que hicieron fue ensanchar el catálogo hacia abajo. OpenAI es explícita con el motivo: Luna está pensado para tareas de alto volumen y baja complejidad —resumir un texto, extraer un dato, responder algo directo—, Sol para trabajo repetitivo pero más elaborado, como programar o revisar código, y Astra, su modelo insignia lanzado a principios de mes, para lo que necesita razonar de punta a punta. Usar el modelo insignia para todo es como mandar un camión blindado a entregar un sobre: llega, pero cuesta muchísimo más de lo que la tarea necesita. La diferencia entre el modelo más caro y el más barato de una misma familia puede ser de cientos de veces por token.

Qué mirar antes de elegir

No alcanza con mirar el precio de lanzamiento. OpenAI aprovechó el mismo anuncio para subir el descuento de caché de prompts —la función que cobra una fracción del precio normal por reutilizar instrucciones que se repiten en cada mensaje— a 90% sobre los tokens de entrada ya guardados. Para un bot que responde consultas de un negocio, la cuenta real no es "cuánto cuesta el mejor modelo", sino cuánto cuesta la combinación: qué proporción de los mensajes son simples y pueden ir a un modelo chico, cuáles necesitan uno más caro, y cuánto de eso ya está cacheado. Esa cuenta, y no el anuncio del día, es la que termina en la factura.

La consulta simple no necesita el modelo caro

Un bot de atención bien armado no manda todos los mensajes al mismo modelo: reserva el más caro para lo que realmente lo necesita y resuelve el resto con uno más chico.

Mirá cómo se arma la atención por WhatsApp de un negocio →