La carrera de velocidad en la IA: Google y OpenAI presentan nuevas soluciones para desarrolladores

El 13 de agosto tuvo lugar un doble anuncio que marcó un nuevo rumbo en el desarrollo de la IA generativa. Google presentó el modelo Gemini 3.7 Flash, mientras que OpenAI anunció el modo Ultrafast para su GPT-5.6 Sol. Ambas compañías apuestan claramente por la velocidad y la eficiencia, algo crucial para tareas de código y agentes de IA autónomos.
Novedades en Gemini 3.7 Flash
Google posiciona Gemini 3.7 Flash como un caballo de batalla para la programación y la automatización de procesos empresariales. Los desarrolladores afirman mejoras sustanciales en la planificación multietapa, la precisión en el seguimiento de instrucciones y la calidad de la generación de código. Además, la compañía ha dado un paso radical: el coste de uso se ha reducido a la mitad en comparación con el precio inicial de la versión anterior. Esto hace que el modelo sea extremadamente atractivo para cargas de producción a gran escala.

La línea Flash se concibió originalmente como una solución para escenarios donde la velocidad de respuesta es tan importante como su calidad. Esto incluye codificación, trabajo de agentes de IA y cualquier tarea que implique múltiples consultas secuenciales al modelo. Cabe recordar que en julio se lanzó Gemini 3.6 Flash con un precio de $1,5 por millón de tokens de entrada y $7,5 por millón de tokens de salida. En ese momento, la compañía informó que el nuevo modelo consume un 17% menos de tokens de salida que su predecesora.
Sin embargo, tras estos anuncios queda en el aire la cuestión del modelo insignia Gemini 3.5 Pro. El modelo aún no se ha lanzado públicamente, y los desarrolladores solo lo están probando con socios seleccionados. Los plazos concretos de lanzamiento siguen siendo vagos, lo que genera intriga en el mercado.
Cómo OpenAI aceleró GPT-5.6 Sol
OpenAI, por su parte, presentó el modo Ultrafast para GPT-5.6 Sol. Las cifras declaradas son impresionantes: velocidad de trabajo hasta 14 veces superior a la estándar y generación de hasta 750 tokens de salida por segundo. El secreto de esta aceleración radica en el uso de la infraestructura de Cerebras, especializada en chips ultrarrápidos para IA.
En su lanzamiento, Ultrafast estará disponible a través de la API para un grupo limitado de clientes. Es un paso lógico: OpenAI necesita probar la carga y escalar la capacidad de cómputo. A medida que esta crezca, el acceso se abrirá a un público más amplio. La cifra de 750 tokens por segundo ya se mencionó en junio, cuando se anunció GPT-5.6. Entonces, los desarrolladores advirtieron que la versión acelerada en Cerebras se implementaría por fases.
En este contexto, cabe recordar también el lanzamiento de Grok 4.6 de SpaceXAI en agosto, que puso el foco en tareas de agentes a largo plazo y programación. La competencia en el segmento de modelos "rápidos" se intensifica, y eso es una excelente noticia para el mercado.
Mi análisis: Ambos anuncios confirman la tendencia clave de 2026: el cambio de enfoque de modelos "inteligentes" a modelos "rápidos y baratos". Para los desarrolladores de Web3 y los protocolos DeFi, esto significa una reducción de los costes operativos y la posibilidad de crear agentes más complejos que trabajen en tiempo real. Reducir a la mitad el precio de Gemini 3.7 Flash no es solo marketing, sino un intento directo de capturar cuota de mercado en el desarrollo empresarial, donde el precio por token suele ser un factor decisivo.