Nuevos conjuntos de datos privados mejoran el Open ASR Leaderboard
Se han agregado nuevos conjuntos de datos privados de alta calidad para mejorar el Open ASR Leaderboard, diseñado para la optimización del rendimiento en reconocimiento automático de voz. Colaborando con Appen Inc. y DataoceanAI, se busca evitar el «benchmaxxing» y asegurar medidas de rendimiento más confiables. Estos datos incluyen diversas acepciones del inglés, y la comunidad puede evaluar modelos para reflejar mejor el desempeño en situaciones del mundo real.
Los costos de evaluación en IA superan los límites económicos y afectan la investigación
Los costos de evaluación en inteligencia artificial han alcanzado niveles preocupantes y se están convirtiendo en un obstáculo significativo. Ejemplos recientes, como el Holistic Agent Leaderboard, revelan gastos de hasta $40,000 por evaluaciones, lo que limita la capacidad de grupos académicos y organizaciones independientes para realizar estudios rigurosos. A medida que el costo de las evaluaciones supera incluso el de la capacitación de modelos, la evaluación se convierte en una barrera de acceso en el campo de la IA.
Optimización de rendimiento en inferencias de IA con NVIDIA Run:ai y fracciones de GPU
NVIDIA Run:ai implementa un sistema de programación inteligente que maximiza el uso de recursos mediante la fraccionamiento dinámico de GPUs. Esto permite aumentar la capacidad de usuarios concurrentes y el rendimiento de modelos de lenguaje grandes (LLMs) sin comprometer la latencia. La colaboración con Nebius demuestra que este enfoque es eficaz para escalar cargas de trabajo de IA, ofreciendo autoscalado y mejora de costos para las empresas.
NVIDIA lanza FastGen, una biblioteca para acelerar modelos de difusión en IA
Los recientes avances en modelos de difusión han transformado la inteligencia artificial generativa, desafiando la eficiencia de muestreo. El nuevo FastGen de NVIDIA es una biblioteca de código abierto que unifica métodos de destilación, mejorando la velocidad de muestreo de modelos complejos, como la generación de video, sin sacrificar la calidad. FastGen permite a los usuarios acelerar modelos de difusión con un interfaz flexible y escalable, impulsando la innovación en diversas aplicaciones.