En un movimiento estratégico que promete redefinir el panorama de la inteligencia artificial en la nube, AWS y NVIDIA han anunciado una expansión significativa de su colaboración. Esta alianza, que se extiende a lo largo de 16 años, busca satisfacer la creciente demanda de infraestructura de IA a nivel global.
La iniciativa incluye el despliegue de 2 millones de GPUs adicionales de NVIDIA en la infraestructura global de AWS entre 2027 y 2028. Este anuncio sigue a un compromiso previo de agregar más de un millón de chips a partir de 2026, una decisión impulsada por una demanda que superó todas las expectativas.
Una expansión sin precedentes en infraestructura de IA
Las empresas también planean introducir nuevas CPUs basadas en NVIDIA Vera en la nube de Amazon para soportar aplicaciones de IA cada vez más avanzadas. Además, se implementarán mejoras en la red, incluyendo la tecnología NVLink Fusion combinada con memoria de alta banda ancha personalizada, con el objetivo de mejorar el rendimiento en grandes clústeres de computación.
Las actualizaciones en el servicio de análisis de Amazon, utilizando el software cuDF de NVIDIA, prometen velocidades de procesamiento casi 3.7 veces más rápidas que las configuraciones estándar. Estas mejoras también deberían entregar un aumento de aproximadamente 30% en el rendimiento precio en comparación con los conjuntos que dependen únicamente de chips estándar.
Innovaciones en búsqueda vectorial y robótica
Las capacidades de búsqueda vectorial en el servicio de búsqueda de Amazon también están mejorando, con la construcción de índices completándose aproximadamente 9 veces más rápido cuando se ejecuta en GPUs. Además, la división de robótica de Amazon está trabajando con NVIDIA en herramientas de simulación destinadas a acelerar el entrenamiento de robots de próxima generación para almacenes.
El plan también incluye la reserva de 100,000 chips para necesidades de computación sensibles de agencias gubernamentales y de defensa a nivel nacional. Matt Garman CEO de AWS, destacó que los clientes buscan la libertad de elegir las mejores herramientas para sus cargas de trabajo de IA y la confianza de que todo funcione sin problemas.
Demanda y proyecciones futuras
Jensen Huang fundador y CEO de NVIDIA, señaló que la demanda de computación acelerada en el almacenamiento en la nube global ha continuado superando las proyecciones realizadas solo meses atrás este año. Esta expansión sugiere que ambas empresas esperan que el gasto en inteligencia artificial siga aumentando más allá de los niveles ya elevados actuales.
Los nuevos procesadores entregados bajo este plan ampliado deberían ofrecer una inferencia notablemente más rápida y un mejor rendimiento gráfico para los clientes. Las actualizaciones de hardware recientes ya entregan hasta 4.6 veces más rápido en inferencia y 2.1 veces más fuerte en salida gráfica en comparación con la generación anterior de sistemas.
Si la demanda real se mantiene al ritmo de estos ambiciosos planes, solo se hará evidente una vez que la nueva infraestructura esté completamente operativa.



