Mejoran modelos de lenguaje al generar comandos Bash con decodificación restringida

Un equipo de investigación de NVIDIA ha implementado la decodificación restringida por gramática para mejorar la generación de comandos Bash en modelos de lenguaje pequeños. Al aplicarla a 13 modelos, lograron aumentar la tasa de éxito promedio de tareas del 62.5% al 75.2%. Esta técnica permite que los modelos generen comandos más fiables y seguros, restringiendo las acciones posibles y mejorando la ejecución de comandos complejos.

Educación sin pantallas: el nuevo enfoque tecnológico en Madrid

La educación en Madrid se transforma hacia enfoques tecnológicos sin pantallas, propuestos ante nuevas regulaciones sobre dispositivos en el aula. La metodología «unplugged» de IGNITE Serious Play fomenta el aprendizaje práctico y colaborativo, potenciando habilidades como el pensamiento crítico y la resolución de problemas. Este modelo, cada vez más aceptado en colegios, integra además la enseñanza de tecnología en un entorno bilingüe.

CUDA Tile ahora se puede programar en BASIC

CUDA 13.1 ha presentado cuTile BASIC, una nueva forma de programación en GPUs que busca facilitar el paralelismo fino en la codificación. Este modelo permite a los desarrolladores de BASIC acceder a la aceleración de GPU y mejorar el rendimiento de aplicaciones heredadas. La iniciativa responde a la demanda de quienes han utilizado BASIC en el pasado, permitiendo revitalizar sus proyectos con modernas capacidades computacionales en hardware avanzado.

cuTile.jl trae programación basada en tiles de NVIDIA CUDA a Julia

cuTile.jl introduce la programación basada en bloques de NVIDIA CUDA en Julia, permitiendo a los desarrolladores de este lenguaje escribir kernels GPU de alto rendimiento de manera más intuitiva. Siguiendo el modelo de cuTile para Python, facilita la gestión de operaciones en bloques de datos y ofrece paridad de rendimiento en kernels intensivos. Este paquete experimental es parte de la creciente integración de Julia en el ecosistema de GPU.

Nuevo marco «EnCompass» optimiza el uso de modelos de lenguaje en agentes de IA

El marco EnCompass, desarrollado por investigadores del CSAIL del MIT, optimiza los agentes de inteligencia artificial al permitirles retroceder y realizar múltiples intentos en busca de soluciones efectivas generadas por modelos de lenguaje. Esto reduce significativamente el esfuerzo de programación, facilita la experimentación con diferentes estrategias de búsqueda y mejora la eficiencia en tareas complejas, como la traducción de código y gestión de grandes bibliotecas.

NVIDIA integra CUDA Tile como backend en OpenAI Triton para mejorar la programación en GPU

NVIDIA ha desarrollado CUDA Tile, un modelo de programación de GPU que mejora la portabilidad y el rendimiento de Tensor Cores. Esta tecnología se integra como backend en OpenAI Triton, permitiendo la programación eficiente de kernels de aprendizaje profundo. Con Triton-to-TileIR, los desarrolladores pueden compilar código directamente a CUDA Tile IR, facilitando el acceso a arquitecturas avanzadas sin reescribir su código existente.

Claude enseña a modelos abiertos a escribir kernels CUDA

El artículo explica cómo utilizar la herramienta «upskill» para mejorar modelos de inteligencia artificial en la tarea de escribir núcleos CUDA. A través de un proceso interactivo, se puede transferir conocimiento de modelos avanzados a versiones más ligeras, optimizando costos y rendimiento. Se presentan metodologías, evaluaciones, y ejemplos de implementación, destacando la capacidad de generar habilidades específicas para tareas complejas.

NVIDIA presenta distribución equitativa de recursos GPU en Kubernetes con nuevo modo de programación

NVIDIA Run:ai v2.24 presenta un nuevo modo de programación llamado fairshare basado en el tiempo, que optimiza la asignación de recursos GPU en clústeres de Kubernetes. Esta función resuelve problemas históricos de distribución justa al considerar el uso previo de recursos, permitiendo que equipos con menos consumo reciente obtengan priorización sobre cuotas excesivas. Así, se garantiza un acceso equilibrado y eficiente a los recursos en entornos compartidos.

Ilustración de un hombre mayor con auriculares y chaqueta