NVIDIA presenta Groq 3 LPX, acelerador de inferencia de baja latencia para IA

NVIDIA presenta el Groq 3 LPX, un acelerador de inferencia optimizado para la plataforma Vera Rubin, que responde a las demandas de baja latencia y amplio contexto en sistemas agentes. Su diseño permite una generación de tokens rápida y predecible, mejorando la interactividad en aplicaciones de inteligencia artificial. Junto con los GPU Rubin NVL72, forman una arquitectura heterogénea que equilibra el rendimiento en carga y la sensibilidad a la latencia, potenciando la eficiencia de los centros de datos.

Ilustración de un hombre mayor con auriculares y chaqueta