Los modelos baratos de IA están cambiando por completo las reglas del juego, y OpenAI junto a Anthropic empiezan a notar la presión. Durante mucho tiempo la pregunta era una sola: qué modelo resultaba más inteligente. Ahora la conversación se ha movido hacia otro terreno, el de la inteligencia por cada dólar invertido. Y ahí, los modelos más económicos de Google y Meta acaban de dar un golpe sobre la mesa que nadie esperaba tan pronto.
Hasta hace poco, los modelos baratos no tenían mucho que rascar. Eran claramente menos capaces que los grandes modelos frontera. Pero el guion ha dado un giro rápido, muy rápido. Google ya no habla de Gemini 3.8 Flash como una simple versión ligera. Lo presenta como su modelo caballo de batalla, pensado para programación, agentes y razonamiento en varios pasos. El precio es lo llamativo: cada millón de tokens de entrada y salida sale por 0,75 y 3,75 dólares, muy por debajo de la competencia. Y lo mejor viene con los números. Según Artificial Analysis, en modo high alcanza 59 puntos en su Intelligence Index, al nivel de GPT-5.6 Sol y Grok 4.6. Además vuela con 302 tokens por segundo y ronda los 0,58 dólares por tarea.
Meta responde en cuestión de horas
Apenas unas horas después del lanzamiento de Google, Meta presentó Muse Spark 1.3, un modelo con planteamiento casi idéntico. Brilla en programación, en trabajo agéntico y en tareas largas donde hay que usar herramientas paso tras paso. Artificial Analysis le concede 61 puntos en su Intelligence Index en la versión xhigh, colocándolo al nivel de GPT-5.6 max y Grok 4.6 high. La versión max, todavía con acceso limitado, sube hasta los 62 puntos.
Y otra vez el precio manda. Meta indica que Muse Spark xhigh cuesta 1,25 y 4,25 dólares por millón de tokens de entrada y salida. En el índice de inteligencia por dólar se calcula un coste de 0,55 dólares por tarea, frente a los 0,95 de GPT-5.6 max o los 1,23 de Claude Opus high. Traducido: inteligencia parecida a un precio mucho menor.
Los agentes cambian toda la ecuación
Aquí está el punto que lo explica todo. Una charla casual con un chatbot consume pocos tokens. Pero un agente de IA que trabaja sin parar para cumplir un objetivo, como programar una app, hace peticiones constantes, revisa archivos y vuelve sobre sus pasos. En ese escenario, que el modelo sea barato lo es todo.
Y ahí Muse Spark 1.3 saca ventaja: usa alrededor de un 20 por ciento menos de llamadas a herramientas y un 25 por ciento menos de tokens que su versión anterior. Google, por su parte, mantendrá hasta finales de 2026 los precios de 3.7 Flash, aunque admite que el nuevo modelo trabaja más y gasta más tokens. Eso hace que una tarea cueste cerca de un 40 por ciento más que con 3.7 Flash. Aun así, hablamos de 0,58 dólares, apenas tres centavos por encima de Muse Spark 1.3.
El ritmo es vertiginoso. Gemini 3.8 Flash llegó tres semanas después del 3.7, y es el tercer Flash en seis semanas. Meta pasó de Muse Spark 1.1 en julio, al 1.2 en agosto y al 1.3 en septiembre. Las ventajas en los benchmarks duran días. El verdadero rival de los modelos frontera es el modelo suficientemente bueno, y pagar los 10 y 50 dólares por millón de tokens de Fable 5.1 empieza a parecer mala idea cuando estas alternativas cuestan diez veces menos.
Fuente
Imagen: xataka.com
