Los esfuerzos de seguridad en IA requerirán más capacidad de cómputo

Investing.com - Contrariamente a los temores de los inversores de que el endurecimiento de los requisitos de seguridad podría frenar la demanda de hardware, los principales desarrolladores de modelos de frontera en el AI Infra Summit revelaron que la seguridad y la alineación de la IA son procesos que requieren una gran capacidad de cómputo y que se espera que impulsen un mayor gasto en infraestructura, según un informe de investigación de Citi.
Esta conclusión surgió del primer día de la conferencia celebrada en Santa Clara, donde los analistas señalaron que asegurar una enorme capacidad de cómputo, energía e instalaciones —más que la innovación en arquitectura de modelos por sí sola— se ha convertido en el principal cuello de botella para la industria.
Los centros de datos de nueva generación están siendo diseñados para albergar entre un 30% y un 40% más de GPUs, mientras que plataformas de orquestación de software como Astra y mejoras de hardware como la plataforma Vera Rubin de Nvidia buscan optimizar el rendimiento del sistema de extremo a extremo.
Nvidia destaca un aumento de demanda de 100 veces impulsado por la IA agéntica
Durante el summit, Ian Buck, vicepresidente de Hyperscale y HPC de , explicó cómo la transición de los chatbots conversacionales hacia la "IA agéntica" autónoma está multiplicando los requisitos de hardware.
Buck señaló que las cargas de trabajo agénticas son aproximadamente 100 veces más exigentes que las aplicaciones de chat de 2023, citando expansiones exponenciales en las longitudes de secuencias de entrada, el dimensionamiento de la caché KV, las interacciones de múltiples turnos y la generación de subagentes.
El reposicionamiento de Intel y la visión de 5 GW de Meta
El director ejecutivo de , Lip-Bu Tan, intervino en el summit para exponer el giro estratégico del fabricante de chips, que pasa de ser un proveedor tradicional de CPUs a convertirse en un proveedor integral de infraestructura de IA.
Tan subrayó que, a medida que la competencia se desplaza de la potencia bruta de las GPUs hacia la optimización a nivel de sistema, las CPUs seguirán siendo fundamentales para el aprendizaje por refuerzo, las capas de orquestación y los flujos de trabajo agénticos. Para agilizar la toma de decisiones, Tan simplificó la estructura de gestión de Intel, reduciendo la jerarquía de entre 10 y 12 niveles a entre 4 y 5.
En cuanto a la fabricación, Tan confirmó que el nodo de proceso 18A de Intel se encuentra en producción en volumen, con el avanzado nodo 14A próximo a su lanzamiento, respaldado por una versión PDK 0,9 prevista para octubre y una PDK 1,0 para el próximo trimestre.
Al mismo tiempo, Santosh Janardhan, responsable de infraestructura de , detalló la experiencia de la compañía en el escalado de una infraestructura de entrenamiento masiva.
A medida que Meta avanza desde su clúster "Prometheus" de más de 1 gigavatio hacia su infraestructura "Hyperion" de 5 gigavatios en los próximos años, Janardhan identificó las redes multirregión sin pérdidas como el mayor obstáculo operativo.
Para cumplir su objetivo de limitar las interrupciones en los clústeres de GPUs a tan solo dos por cada 8.000 GPUs al día, Meta desplegó una arquitectura de red propietaria de agregación de back-end (BAG).
Este artículo ha sido generado y traducido con el apoyo de AI y revisado por un editor. Para más información, consulte nuestros T&C.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.