Gemma 4 toma decisiones autónomas con visión en Jetson Orin Nano

Gemma 4 ofrece una demostración innovadora que permite interactuar con ella a través de voz y webcam, todo realizado en un NVIDIA Jetson Orin Nano Super. Este sistema local utiliza tecnologías de reconocimiento de voz y síntesis para responder preguntas, incluso determinando si necesita ver a través de la cámara para proporcionar respuestas contextualizadas. La implementación de esta inteligencia artificial es altamente destacable por su capacidad de procesamiento en un dispositivo compacto.

Google DeepMind lanza Gemma 4, modelos multimodales de inteligencia en Hugging Face

La familia de modelos multimodales Gemma 4 de Google DeepMind ya está disponible en Hugging Face, ofreciendo soporte para diversos agentes e infraestructuras de inferencia. Con licencia abierta y capacidad para manejar texto, audio e imagen, estos modelos destacan en calidad y adaptabilidad, siendo ideales para su uso en dispositivos. Además, han demostrado un rendimiento sobresaliente en pruebas, optimizando tareas complejas de inteligencia multimodal y fine-tuning.

Lanzamiento de Gemma 4: Nuevos modelos de IA multimodal y multilingüe para despliegue local

Gemma 4 presenta modelos multimodales y multilingües, optimizados para despliegues en diversas plataformas, desde centros de datos hasta dispositivos de borde. Estos modelos satisfacen la creciente demanda de implementaciones locales para el desarrollo de IA, ofreciendo mejoras en eficiencia y precisión. Con capacidades en razonamiento, codificación, y soporte de más de 140 idiomas, facilitan la creación de flujos de trabajo inteligentes en entornos regulados como salud y finanzas.

Ilustración de un hombre mayor con auriculares y chaqueta