NVIDIA lanza Fleet Intelligence para optimizar la gestión de flotas de GPU en tiempo real
NVIDIA presenta Fleet Intelligence, un servicio gestionado que permite la monitorización continua y optimización de flotas de GPU en tiempo real. Este sistema aborda los desafíos de la gestión de hardware heterogéneo y cargas de trabajo multitenant, proporcionando visibilidad sobre el rendimiento, la salud y el uso de energía de los GPUs. Además, incluye alertas y herramientas para asegurar la integridad y eficiencia operativa en centros de datos.
NVIDIA Model Optimizer mejora el rendimiento de modelos AI mediante cuantización post-entrenamiento
La cuantización de modelos es una técnica eficaz que reduce el uso de VRAM y mejora el rendimiento de inferencia en dispositivos como las GPUs GeForce RTX. Esta publicación detalla cómo utilizar NVIDIA Model Optimizer para cuantizar modelos como CLIP en formato FP8. Se discuten métodos y beneficios, destacando cómo esta práctica permite que los modelos de IA se ejecuten de manera más eficiente en entornos con recursos limitados.
NVIDIA GB200 NVL72 revoluciona la eficiencia en centros de datos con programación de bloques en Slurm
El nuevo sistema NVIDIA GB200 NVL72 transforma la construcción de clústeres de GPU al extender la coherencia de NVLink en un rack completo, logrando un rendimiento exascale. Esta innovación demanda un enfoque de programación diferente, donde el «localidad a escala de rack» se convierte en una restricción crítica. El plugin de programación de bloques Slurm optimiza la asignación de trabajos, mejorando el rendimiento y la eficiencia del sistema en este contexto.
Acelera la inferencia NNE en Unreal Engine con NVIDIA TensorRT para RTX
Las técnicas de redes neuronales están revolucionando los gráficos por computadora al mejorar la calidad de imagen y optimizar el rendimiento en tiempo real. Unreal Engine 5 introduce el NNE y un plugin para TensorRT que permite una inferencia más eficiente en GPUs NVIDIA RTX, demostrando mejoras significativas en comparación con otros métodos. Este avance abre nuevas posibilidades creativas para desarrolladores y artistas en la creación de contenido.
Nueva herramienta acelera la estimación del consumo energético en centros de datos de IA
Investigadores del MIT han desarrollado el método «EnergAIzer», que permite estimar en segundos el consumo energético de cargas de trabajo de inteligencia artificial en centros de datos. Este enfoque mejora la eficiencia energética al facilitar la asignación de recursos y disminuir el desperdicio de energía, permitiendo a los desarrolladores y operadores considerar el impacto energético de sus decisiones antes de implementar modelos de IA.
Agentes LLM triunfan en competencia de Kaggle con codificación asistida por IA
En marzo de 2026, tres agentes LLM generaron más de 600,000 líneas de código y realizaron 850 experimentos, logrando el primer lugar en una competencia de Kaggle. El éxito se basa en la rapidez para generar y probar ideas, optimizado por la combinación de LLM y aceleración por GPU. Este enfoque permite una experimentación más eficiente y el desarrollo de modelos predictivos de datos tabulares de alto rendimiento.
NVIDIA lanza NVbandwidth, herramienta clave para evaluar el rendimiento de memoria en GPUs
NVIDIA NVbandwidth es una herramienta fundamental para medir el rendimiento de la interconexión y la memoria de sistemas GPU. Diseñada para desarrolladores de CUDA, permite evaluar el rendimiento y la latencia de transferencias de memoria. Ofrece pruebas exhaustivas que incluyen evaluaciones unidireccionales y bidireccionales, optimizando así el movimiento de datos. Su uso es clave para diagnosticar cuellos de botella y mejorar la eficiencia en aplicaciones complejas.
Nuevo toolkit de NVIDIA potencia simulaciones atómicas en química y ciencia de materiales
NVIDIA presenta el ALCHEMI Toolkit, una herramienta innovadora diseñada para construir flujos de trabajo de simulación atomística personalizados en química y ciencia de materiales. Al integrar modelos de aprendizaje automático con componentes acelerados por GPU, ALCHEMI aborda el desafío de equilibrar precisión y velocidad, permitiendo simulaciones más eficientes y escalables. Esto transforma la forma en que los investigadores realizan descubrimientos en estos campos, optimizando la utilización de recursos computacionales.
Reduce costos de checkpoints en entrenamiento de modelos con Python y NVIDIA nvCOMP
Entrenar modelos de lenguaje implica crear puntos de control que son costosos en almacenamiento. Estos pueden llegar a ser enormes, generando altos gastos. Con solo 30 líneas de Python y la biblioteca NVIDIA nvCOMP, se puede implementar una compresión sin pérdidas que reduce significativamente los costos, ahorrando hasta $56,000 mensuales. Esta optimización es crucial para equipos de inteligencia artificial que buscan eficiencia en sus recursos.
Waypoint-1.5: Mundos interactivos mejorados para GPU de consumo
Waypoint-1.5 es una innovadora actualización del modelo de video en tiempo real de Overworld, diseñada para ofrecer mundos generativos interactivos en hardware accesible. Esta versión mejora la fidelidad visual y amplía la compatibilidad con diversas configuraciones de máquinas, permitiendo entornos en 720p y 60 FPS. Además, introduce un modelo optimizado para dispositivos más modestos y se centra en la interactividad en tiempo real, superando la simple demostración visual.