Google lanzó Gemini 3.7 Flash el jueves, un modelo de bajo costo para codificación y agentes que ahora está disponible de forma general.
OpenAI presentó una vista previa de GPT-5.6 Sol Ultrafast, un nivel impulsado por Cerebras que ejecuta su modelo más capaz hasta 14 veces más rápido.
La carrera de velocidad ha pasado de la inteligencia bruta a los agentes en tiempo real, pero solo el modelo de Google llega hoy a todos los desarrolladores.
Google y OpenAI impulsaron hoy el mismo mensaje: la IA ahora es lo suficientemente rápida como para resultar impresionante para quienes usan agentes de IA, y cada empresa anunció modelos ultrarrápidos.
Los dos lanzamientos están construidos de manera diferente, y solo uno está realmente en tus manos hoy.
Google lanzó Gemini 3.7 Flash, su último modelo ajustado para la codificación de software y flujos de trabajo empresariales autónomos. OpenAI abrió una vista previa limitada de GPT-5.6 Sol Ultrafast, un nuevo nivel de servicio que ejecuta su modelo más capaz a hasta 750 tokens de salida por segundo.
Hoy presentamos Gemini 3.7 Flash, nuestro modelo de trabajo más inteligente hasta ahora para codificación y agentes.
Este modelo aporta mejoras sustanciales en ingeniería de software, desarrollo web y trabajo de conocimiento complejo.
Gemini 3.7 Flash es un modelo de disponibilidad general. Acepta hasta un millón de tokens de entrada (aproximadamente 750,000 palabras) y devuelve 64,000, manejando texto, imágenes, video, audio y PDFs, y puede llamar herramientas y controlar una computadora. Google lo presenta como el cerebro barato para sistemas autónomos que planifican tareas y completan trabajos de múltiples pasos con menos ayuda humana.
El modelo no sacrifica calidad por velocidad. Es a la vez más capaz y más eficiente, siendo capaz de completar nuestra tarea de codificación de prueba en 2 minutos y 13 segundos, mientras que el último modelo Flash tardó más de 5 minutos. La brecha de calidad entre los dos también es notable.
El modo Ultrafast de OpenAI no es un modelo nuevo. Es GPT-5.6 Sol—el mismo modelo que OpenAI utilizó un equipo rojo de IA para reforzar contra ataques de inyección de prompts antes del lanzamiento—en una vía más rápida, impulsado por el fabricante de chips Cerebras. Es aproximadamente 14 veces más rápido que la velocidad estándar del propio GPT-5.6 Sol.
Vista previa del modo Ultrafast: GPT-5.6 Sol a hasta 14 veces la velocidad.
Se lanza primero en la API de OpenAI a un grupo selecto de clientes con acceso ampliado a más empresas a medida que crece la capacidad. pic.twitter.com/a5dleofiDJ
Los chips a escala de oblea de Cerebras generan hasta 750 tokens por segundo, unas 560 palabras, lo suficientemente rápido como para que un agente de voz pueda pensar durante una llamada.
Los números que importan
La propia hoja de referencia de Google sitúa a Gemini 3.7 Flash por delante de Claude Sonnet 5, GPT-5.6 Terra y otros en 11 de las 18 categorías probadas, incluida una puntuación máxima de 1.588 Elo en Code Arena para desarrollo web y un 30.4% en AutomationBench para flujos de trabajo empresariales. Todo eso se basa en la metodología de Google, así que trate el liderazgo como una afirmación de la empresa.
Como cualquier Gemini Flash, el modelo también es barato. A 75 centavos por millón de tokens de entrada y 3.75 dólares por millón de tokens de salida hasta fin de año, es la mitad de la tarifa original de Gemini 3.6 Flash. Ese precio de introducción expira el 31 de diciembre y luego se duplica a 1.50 y 7.50 dólares, lo que sigue siendo barato para un modelo de Google.
OpenAI no ha publicado puntuaciones cara a cara para Ultrafast más allá de las citas de clientes. El ingeniero de IA de Jane Street, John Crepezzi, dijo en el anuncio de OpenAI que la velocidad de Cerebras "permite diferentes formas de usar los modelos". El líder de producto de Podium, Courtland Lykins, lo llamó "invaluable en nuestra pila de voz", diciendo que la velocidad "cambia completamente la experiencia de las llamadas". El nivel es solo por invitación por ahora.
El impulso por la velocidad llega mientras los laboratorios pasan de "quién es el más inteligente" a "quién es lo suficientemente rápido para los agentes". El momento de Google es señalado. Su buque insignia Gemini 3.5 Pro todavía falta, sin fecha de lanzamiento, tres semanas después de 3.6 Flash y días después de una reorganización del liderazgo de DeepMind que movió a Demis Hassabis a un lado para el adjunto Koray Kavukcuoglu. OpenAI, mientras tanto, está alquilando la velocidad de Cerebras en lugar de esperar a su propia pila.
Gemini 3.7 Flash ya está disponible en más de 160 países; GPT-5.6 Sol Ultrafast sigue siendo solo por invitación.