DeepSeek lanza V4 con capacidad de contexto de un millón de tokens para tareas agenticas

DeepSeek ha lanzado su versión V4, que cuenta con una capacidad de contexto de un millón de tokens, lo que la hace ideal para tareas de agentes. Con dos modelos diferentes, V4-Pro y V4-Flash, se enfoca en mejorar la eficiencia en el uso de memoria y en el manejo de largas secuencias. Se presentan innovaciones en la arquitectura que optimizan el rendimiento y facilitan la implementación en aplicaciones complejas.

Lanzamiento de MiniMax M2.7 con mejoras para flujos de trabajo de IA en plataformas NVIDIA

MiniMax M2.7, la última actualización del modelo MiniMax, optimiza flujos de trabajo complejos en plataformas NVIDIA para aplicaciones de inteligencia artificial. Con un diseño de mezcla de expertos, ofrece eficiencia en su uso de parámetros y es ideal para tareas complejas. Su integración con herramientas de código abierto permite a los desarrolladores ejecutar y afinar modelos con facilidad, mejorando significativamente el rendimiento en diversas aplicaciones.

NVIDIA presenta una solución eficiente para la comunicación en modelos Mixture-of-Experts

La comunicación en el entrenamiento de modelos Mixture-of-Experts (MoE) presenta desafíos significativos, como la ineficiencia del paralelismo de expertos y la sobrecarga de comunicación. Este artículo presenta Hybrid-EP, una solución optimizada que mejora la comunicación y reduce el tiempo de entrenamiento, aprovechando plataformas NVIDIA. Se destaca su capacidad para manejar eficientemente cargas dinámicas y su integración con modelos tamaño-híper, logrando mejoras notables en rendimiento con respecto a enfoques anteriores.

Ilustración de un hombre mayor con auriculares y chaqueta