El gigante de la nube Amazon Web Services y el fabricante de chips Nvidia han firmado un nuevo acuerdo a gran escala, en virtud del cual se añadirán dos millones de unidades gráficas adicionales a la infraestructura global de AWS entre 2027 y 2028. Esto no es solo otra expansión de capacidad, sino una respuesta estratégica a la demanda explosiva de los segmentos de IA agéntica y física, que requieren arquitecturas de computación fundamentalmente diferentes.
Millones de aceleradores: del entrenamiento a la robótica
El nuevo lote de suministros complementa el plan anunciado previamente en el GTC 2026 para instalar más de 1 millón de GPU a partir de este año. Así, el parque total de aceleradores de Nvidia en AWS alcanzará una escala de varios millones. Estos recursos se utilizarán no solo para el entrenamiento clásico y la inferencia de modelos, sino también para cargas de trabajo fundamentalmente nuevas: agentes autónomos que ejecutan escenarios de múltiples pasos y sistemas robóticos que operan en entornos físicos reales.
Evolución del hardware: Blackwell, Rubin y soluciones personalizadas
En el marco de la asociación, AWS integrará en sus clústeres varias generaciones de plataformas de Nvidia, incluidas Blackwell Ultra y las futuras Rubin y Rubin Ultra. Un elemento clave es el uso del procesador NVIDIA Vera CPU, diseñado específicamente para coordinar herramientas, ejecutar código y realizar simulaciones en escenarios agénticos. Esto permite liberar a las GPU de tareas rutinarias y aumentar la eficiencia general de la computación.
Una línea separada es la integración profunda con los chips AWS Trainium. La división de Amazon, Annapurna Labs, junto con Nvidia, amplía el soporte de la tecnología NVLink Fusion, incluida la memoria de alta velocidad y las interconexiones escalables a nivel de rack. Este enfoque híbrido brinda a los clientes flexibilidad para elegir la arquitectura óptima según sus tareas específicas.
Nuevas instancias y rendimiento
AWS también ha presentado las instancias en la nube EC2 G7 basadas en GPU NVIDIA RTX PRO 4500 Blackwell Server Edition. Esta es la primera oferta de este tipo entre los principales proveedores de nube. Según mis datos, en comparación con la generación anterior G6, las nuevas instancias demuestran:
- hasta 4,6 veces mayor eficiencia en la inferencia de IA;
- hasta 2,1 veces más rendimiento gráfico.
Además, la infraestructura mantiene la compatibilidad con las soluciones de red AWS Nitro y Elastic Fabric Adapter, así como con las tecnologías NVIDIA Spectrum.
Pedido gubernamental e IA física
Un bloque separado del acuerdo se refiere a los clientes gubernamentales y de defensa de EE. UU. AWS y Nvidia crearán fábricas de IA especializadas para procesar datos clasificados con un nivel de seguridad Impact Level 6 o superior, que recibirán alrededor de 100 000 GPU. Esto es una señal de que la infraestructura de IA se está convirtiendo en un elemento crítico de la seguridad nacional.
La asociación va mucho más allá de los centros de datos. Amazon Robotics estandarizará el uso de la plataforma de Nvidia para IA física: Jetson, Omniverse e Isaac. Estas tecnologías se destinarán a la automatización de almacenes, la generación de datos sintéticos y la simulación del comportamiento de robots. Los modelos abiertos NVIDIA Nemotron seguirán disponibles a través de Amazon Bedrock y SageMaker.
Mi opinión: Este acuerdo consolida definitivamente un cambio de paradigma en la industria. La competencia se desplaza del simple aumento del número de GPU a la construcción de fábricas de computación integrales, donde aceleradores, CPU, memoria y red funcionan como un organismo único. Las empresas que puedan ofrecer este enfoque integral obtendrán una ventaja decisiva en la carrera por el dominio en la era de la IA agéntica. Inversores y desarrolladores deberían seguir de cerca cómo esta integración afectará el costo de la computación y la disponibilidad de capacidad en los próximos dos o tres años.