Avances en IA: Investigador de MIT mejora la toma de decisiones en juegos complejos

Gabriele Farina, profesor asistente en MIT, investiga la toma de decisiones en escenarios complejos mediante la combinación de teoría de juegos, aprendizaje automático y estadísticas. Su trabajo busca comprender y optimizar las interacciones en sistemas con información imperfecta. Farina ha logrado avances significativos, como el desarrollo de algoritmos que superan a jugadores humanos en juegos estratégicos, destacando su influencia en la evolución de la inteligencia artificial.

Anthropic y Google amplían colaboración para potenciar capacidades de computación avanzadas

Anthropic ha aumentado su colaboración con Google y Broadcom, firmando un acuerdo para múltiples gigavatios de capacidad TPU de próxima generación, que estará disponible a partir de 2027. Esta expansión impulsará sus modelos Claude, respondiendo a la creciente demanda global. La alianza también refuerza su inversión en infraestructura de computación en EE. UU., con la expectativa de atender más de 1,000 clientes empresariales en crecimiento acelerado.

NVIDIA presenta Groq 3 LPX, acelerador de inferencia de baja latencia para IA

NVIDIA presenta el Groq 3 LPX, un acelerador de inferencia optimizado para la plataforma Vera Rubin, que responde a las demandas de baja latencia y amplio contexto en sistemas agentes. Su diseño permite una generación de tokens rápida y predecible, mejorando la interactividad en aplicaciones de inteligencia artificial. Junto con los GPU Rubin NVL72, forman una arquitectura heterogénea que equilibra el rendimiento en carga y la sensibilidad a la latencia, potenciando la eficiencia de los centros de datos.

Optimización de la Utilización de GPUs con NVIDIA Run:ai y NIM

La implementación de modelos de lenguaje (LLMs) enfrenta retos por la diversidad de requisitos de recursos en las cargas de inferencia. Esto puede resultar en baja utilización de GPU y altos costos. NVIDIA NIM y NVIDIA Run:ai ofrecen soluciones mediante orquestación inteligente, optimizando recursos y mejorando el rendimiento. Con técnicas como fraccionamiento de GPU y gestión dinámica de memoria, se mejora la eficiencia sin comprometer la latencia.

Ilustración de un hombre mayor con auriculares y chaqueta