Carrera por la velocidad: Google y OpenAI presentaron soluciones de IA de nueva generación

El mercado de la inteligencia artificial sigue en plena efervescencia: el 13 de agosto, dos gigantes tecnológicos lanzaron sus actualizaciones, dirigidas al mismo nicho: el procesamiento ultrarrápido de tareas para desarrolladores y agentes de IA. Google presentó Gemini 3.7 Flash, y OpenAI anunció el modo Ultrafast para su modelo insignia GPT-5.6 Sol. Esto no es solo una evolución, sino una señal clara de hacia dónde se dirige la industria: hacia la velocidad y la eficiencia, y no solo hacia la potencia bruta.
Novedades en Gemini 3.7 Flash
Google posiciona Gemini 3.7 Flash como un caballo de batalla para la programación y la automatización de procesos empresariales. Las mejoras clave se centran en la planificación en múltiples etapas, el seguimiento preciso de instrucciones y la generación de código. Sin embargo, lo más interesante es el precio: la compañía ha anunciado una reducción del coste de uso a la mitad en comparación con el precio inicial de la versión anterior. Es un movimiento agresivo, teniendo en cuenta que la línea Flash ya estaba orientada a escenarios donde la velocidad de respuesta es crítica: codificación, trabajo de agentes y tareas con múltiples llamadas secuenciales al modelo.
Recordemos que en julio se lanzó Gemini 3.6 Flash con un precio de $1,5 por 1 millón de tokens de entrada y $7,5 por 1 millón de tokens de salida. En ese momento, la compañía informó de que el nuevo modelo consume un 17% menos de tokens de salida que 3.5 Flash. Mientras tanto, el modelo insignia Gemini 3.5 Pro, que muchos esperaban, no se ha lanzado al público: los desarrolladores aún lo están probando con socios, y los plazos de lanzamiento siguen siendo inciertos.
Cómo OpenAI aceleró GPT-5.6 Sol
OpenAI respondió de manera simétrica, pero con un enfoque diferente. El modo Ultrafast para GPT-5.6 Sol, según la compañía, acelera la generación hasta 750 tokens de salida por segundo, lo que es hasta 14 veces más rápido que el modo estándar. El secreto está en el uso de la infraestructura de Cerebras, especializada en computación ultrarrápida. Sin embargo, en el lanzamiento, solo un número limitado de clientes tendrá acceso a Ultrafast a través de la API, y OpenAI promete ampliar el acceso a medida que aumente la capacidad de cómputo.
La cifra de 750 tokens por segundo no es nueva: ya se mencionó en junio durante el anuncio de GPT-5.6. En ese momento, también estaba claro que Sol se lanzaría en Cerebras, pero con la salvedad de una incorporación gradual de usuarios. Ahora, ese plan comienza a materializarse. En este contexto, cabe recordar el lanzamiento en agosto de Grok 4.6 de SpaceXAI, un modelo centrado en tareas de agentes a largo plazo y programación. La competencia se está intensificando al máximo.
Mi análisis: Ambos anuncios confirman la tendencia hacia modelos "pequeños y rápidos" que puedan operar en tiempo real. La reducción de precio de Google y la velocidad extrema de OpenAI son dos enfoques diferentes para el mismo problema: hacer que la IA sea accesible para la automatización masiva. A corto plazo, gana quien pueda ofrecer el mejor equilibrio entre precio y latencia de respuesta, especialmente en el segmento de soluciones de agentes, donde cada milisegundo adicional es dinero perdido.