Google y OpenAI han presentado nuevas opciones enfocadas en llevar la inteligencia artificial a velocidades mucho mayores para programación y agentes autónomos. Gemini 3.7 Flash ya está disponible de forma general y apuesta por reducir costes, mientras GPT-5.6 Sol Ultrafast utiliza hardware de Cerebras para ejecutar el modelo más potente de OpenAI hasta 14 veces más rápido, aunque por ahora su acceso está limitado mediante invitación.
Google lanza Gemini 3.7 Flash para agentes de IA
Google ha lanzado Gemini 3.7 Flash, un nuevo modelo optimizado especialmente para programación, automatización y agentes capaces de ejecutar tareas empresariales de varios pasos.
El modelo admite una ventana de contexto de hasta 1 millón de tokens de entrada y puede generar hasta 64.000 tokens de salida.
También es multimodal y puede procesar texto, imágenes, vídeo, audio y documentos PDF, además de utilizar herramientas y controlar ordenadores para completar determinadas tareas.
Google pretende posicionarlo como un modelo eficiente para sistemas autónomos que necesitan realizar grandes cantidades de operaciones manteniendo bajo el coste computacional.
OpenAI lleva GPT-5.6 Sol hasta los 750 tokens por segundo
OpenAI, por su parte, ha presentado una versión preliminar de GPT-5.6 Sol Ultrafast.
No se trata de un modelo diferente, sino de una nueva modalidad de ejecución de GPT-5.6 Sol diseñada específicamente para maximizar la velocidad.
La infraestructura utiliza chips de Cerebras y puede alcanzar hasta 750 tokens de salida por segundo, aproximadamente 14 veces la velocidad estándar de GPT-5.6 Sol.
Esta velocidad está especialmente orientada a aplicaciones donde la latencia resulta crítica, como agentes de voz capaces de razonar y responder prácticamente en tiempo real durante una conversación.
GPT-5.6 Sol Ultrafast permanece limitado por invitación
Existe una diferencia importante entre los dos lanzamientos.
Mientras Gemini 3.7 Flash está disponible de forma general para desarrolladores, GPT-5.6 Sol Ultrafast continúa en una fase limitada mediante invitación.
OpenAI está probando inicialmente esta infraestructura con determinadas compañías y casos de uso antes de ampliar su disponibilidad.
La compañía todavía no ha publicado comparativas completas de rendimiento entre Ultrafast y modelos rivales, centrándose principalmente en la reducción de latencia que proporciona la infraestructura de Cerebras.
Gemini 3.7 Flash apuesta también por reducir el precio
Google está utilizando el coste como otro elemento competitivo.
Gemini 3.7 Flash tendrá inicialmente un precio de 0,75 dólares por millón de tokens de entrada y 3,75 dólares por millón de tokens de salida hasta finales de 2026.
Después del 31 de diciembre, las tarifas previstas aumentarán hasta 1,50 dólares para la entrada y 7,50 dólares para la salida.
La estrategia busca convertir Flash en una opción especialmente atractiva para aplicaciones que ejecutan grandes volúmenes de consultas, donde pequeñas diferencias en el coste por token pueden tener un impacto significativo.
Google asegura superar a varios modelos rivales
Según las pruebas publicadas por la propia Google, Gemini 3.7 Flash supera a diferentes modelos competidores en 11 de las 18 categorías evaluadas.
Entre los resultados destacados se encuentra una puntuación de 1.588 Elo en Code Arena para desarrollo web y un 30,4% en AutomationBench para automatización de procesos empresariales.
Sin embargo, estos resultados proceden de la metodología y las pruebas publicadas por Google, por lo que deben interpretarse como afirmaciones del propio fabricante hasta contar con evaluaciones independientes más amplias.
La nueva batalla de la IA se traslada a la velocidad
La competencia entre los grandes laboratorios de inteligencia artificial está evolucionando.
Durante los últimos años, la industria se concentró principalmente en conseguir modelos con mayor capacidad de razonamiento y mejores resultados en benchmarks. La expansión de los agentes autónomos está convirtiendo ahora la velocidad, latencia y coste de inferencia en factores igualmente importantes.
Un agente que utiliza herramientas, consulta bases de datos, escribe código y ejecuta múltiples acciones puede realizar numerosas llamadas al modelo antes de completar una única tarea. Reducir cada una de esas esperas puede transformar radicalmente la experiencia final.
Gemini 3.7 Flash ya está disponible en más de 160 países, mientras GPT-5.6 Sol Ultrafast permanece limitado por invitación. Ambos movimientos muestran hacia dónde se dirige la siguiente fase competitiva de la inteligencia artificial: modelos capaces no solo de razonar mejor, sino de hacerlo suficientemente rápido y barato como para operar continuamente mediante agentes en tiempo real.



