La expansión de Gemmaverse llega con el lanzamiento de Gemma 4, un modelo multimodal y multilingüe diseñado para adaptarse a diversas implementaciones, desde el centro de datos NVIDIA Blackwell hasta Jetson en el borde. Estos modelos satisfacen la creciente demanda de despliegue local para el desarrollo y prototipado de IA, cumpliendo con requisitos de seguridad y eficiencia de costos.
La nueva generación mejora la eficiencia y precisión, siendo adecuada para una amplia gama de tareas comunes:
- Razonamiento: Rendimiento destacado en la resolución de problemas complejos.
- Codificación: Generación y depuración de código para flujos de trabajo de desarrolladores.
- Agentes: Soporte nativo para el uso estructurado de herramientas (llamadas a funciones).
- Capacidades de visión, video y audio: Habilita interacciones multimodales ricas para casos de uso como reconocimiento de objetos y reconocimiento automático de voz (ASR).
- Entrada multimodal intercalada: Mezcla libre de texto e imágenes en cualquier orden dentro de un solo aviso.
- Multilingüe: Soporte inmediato para más de 35 idiomas y preentrenado en más de 140.
Modelos y capacidades de Gemma 4
El conjunto incluye cuatro modelos, incluido el primer modelo MoE de Gemma, que se pueden ejecutar en una sola GPU NVIDIA H100 y soporta más de 140 idiomas. Las variantes A4B de 31B y 26B son modelos de razonamiento de alto rendimiento adecuados para entornos locales y en centros de datos. Los modelos E4B y E2B son la nueva edición de modelos diseñados para dispositivos y móviles, lanzados inicialmente con Gemma 3n.
Cada modelo está disponible en Hugging Face con puntos de control BF16, y se espera que un punto de control NVFP4 cuantizado para Gemma-4-31B esté disponible pronto para desarrolladores de NVIDIA Blackwell.
Ejecutar cargas de trabajo inteligentes en dispositivos
A medida que los flujos de trabajo de IA se integran en aplicaciones diarias, la capacidad de ejecutar estos modelos más allá de entornos de centros de datos tradicionales se vuelve crítica. La gama de sistemas de cliente y borde de NVIDIA, desde GPUs RTX y DGX Spark hasta Jetson Nano, proporciona a los desarrolladores flexibilidad para gestionar costos y latencia, mientras cumplen con requisitos de seguridad para industrias altamente reguladas como la salud y las finanzas.
Colaboramos con vLLM, Ollama y llama.cpp para ofrecer la mejor experiencia de despliegue local para cada uno de los modelos Gemma 4. Unsloth también proporciona soporte desde el primer día con modelos optimizados y cuantizados para un despliegue local eficiente a través de Unsloth Studio.


