Google lanza Gemini 3.6 Flash: agentes de IA mucho más baratos
Google acaba de abaratar el terreno donde se libra la verdadera batalla de la IA: los agentes. Gemini 3.6 Flash es el nuevo modelo de trabajo pesado que Google lanzó para recortar latencia y costo por token en las tareas que hacen los agentes de IA empresariales. Gemini 3.6 Flash llega acompañado de una versión aún más económica, Gemini 3.5 Flash-Lite, pensada para volumen alto.
Qué cambia
Gemini 3.6 Flash está orientado a programación y razonamiento multimodal, mientras que Gemini 3.5 Flash-Lite apunta a trabajo de alto volumen y baja latencia, con un precio de US$0,3 por millón de tokens de entrada y US$2,5 por millón de salida. Hay además una variante restringida, Gemini 3.5 Flash Cyber, construida para remediación de vulnerabilidades. El mensaje de Google es claro: hacer que un agente ejecute miles de pasos deje de ser un lujo de presupuesto.
Por qué importa
Los agentes que investigan, programan o atienden clientes consumen tokens en cantidades enormes porque razonan en muchos pasos. Al bajar el costo por token, Gemini 3.6 Flash permite que equipos pequeños prueben soporte, investigación y automatización sin inflar la nómina ni la factura de la nube.
Qué significa para América Latina
El costo siempre fue el gran freno de la IA en la región, y modelos como Gemini 3.6 Flash lo atacan de frente. Una pyme colombiana o un estudio de desarrollo mexicano puede montar un agente de atención al cliente en español o automatizar reportes por una fracción de lo que costaba hace un año. La letra pequeña: los «thinking tokens» que estos modelos gastan al razonar pueden disparar la cuenta si no se miden, así que conviene vigilar el consumo desde el primer día. Aun así, la tendencia juega a favor de quien tiene menos recursos, y eso, para el ecosistema latino, es una buena noticia.
Lee también:
La guerra de precios de la IA: por qué 2026 hizo la IA mucho más barata
OpenAI abarata GPT-5.6 Luna un 80%
