NVIDIA lanza Nemotron 3 Nano Omni, un modelo unificado para el razonamiento multimodal eficiente
NVIDIA ha presentado el Nemotron 3 Nano Omni, un modelo multimodal que integra razonamiento visual, auditivo y textual en un solo sistema eficiente. Este modelo, que reemplaza las cadenas de modelos fragmentadas, reduce costos y mejora la consistencia entre modalidades. Con una arquitectura híbrida y de código abierto, permite a los desarrolladores personalizar su uso en diversas aplicaciones, destacando en tareas de inteligencia documental, video y audio.
NVIDIA lanza modelos Nemotron 3 para inteligencia artificial multimodal y segura
NVIDIA ha presentado los modelos Nemotron 3, diseñados para crear sistemas de inteligencia artificial que integran razonamiento, seguridad y capacidades multimodales. Estos modelos optimizan la interacción en tiempo real con usuarios y mejoran la eficiencia en el procesamiento de datos complejos. Entre sus innovaciones se encuentra Nemotron 3 Super, que ofrece alta precisión y bajo coste computacional, y Nemotron 3 Content Safety, que garantiza interacciones seguras.
Lanzamiento de Gemma 4: Nuevos modelos de IA multimodal y multilingüe para despliegue local
Gemma 4 presenta modelos multimodales y multilingües, optimizados para despliegues en diversas plataformas, desde centros de datos hasta dispositivos de borde. Estos modelos satisfacen la creciente demanda de implementaciones locales para el desarrollo de IA, ofreciendo mejoras en eficiencia y precisión. Con capacidades en razonamiento, codificación, y soporte de más de 140 idiomas, facilitan la creación de flujos de trabajo inteligentes en entornos regulados como salud y finanzas.
Alibaba lanza Qwen3.5, un modelo avanzado para agentes multimodales
Alibaba ha lanzado la serie Qwen3.5, un modelo abierto de aproximadamente 400 mil millones de parámetros diseñado para agentes multimodales nativos. Con avances en razonamiento y comprensión de interfaces de usuario, este modelo mejora sus predecesores. Es ideal para aplicaciones de codificación, razonamiento visual y búsquedas complejas, y se puede integrar fácilmente utilizando endpoints acelerados por GPU de NVIDIA.