Transformers.js v4 (preview) ya está disponible en NPM, lo que facilita su acceso. Tras casi un año de desarrollo, comenzamos en marzo de 2025, ahora puedes probarlo con un simple comando.
npm i @huggingface/transformers@next
Continuaremos publicando versiones de v4 bajo la etiqueta next en NPM hasta el lanzamiento completo, por lo que se esperan actualizaciones regulares.
Mejoras en Rendimiento y Ejecución
La adopción de un nuevo WebGPU Runtime reescrito completamente en C++ es el cambio más significativo. Hemos colaborado con el equipo de ONNX Runtime para probar exhaustivamente este runtime en aproximadamente 200 arquitecturas de modelos compatibles.
Este nuevo runtime permite el uso del mismo código de transformers.js en diversos entornos de JavaScript, incluyendo navegadores, aplicaciones de servidor y aplicaciones de escritorio. Ahora es posible ejecutar modelos acelerados por WebGPU directamente en Node, Bun y Deno.
![]()
Hemos demostrado que es posible ejecutar modelos de IA de última generación 100% localmente en el navegador. Ahora, nos enfocamos en mejorar el rendimiento, logrando que estos modelos funcionen lo más rápido posible, incluso en entornos con recursos limitados.
Estructuración del Repositorio
El desarrollo de una nueva versión mayor nos brindó la oportunidad de invertir en la base de código y abordar esfuerzos de refactorización que se habían postergado.
Espacios de PNPM
Hasta ahora, el repositorio de GitHub servía como nuestro paquete npm. Sin embargo, dado que el futuro requiere varios subpaquetes que dependen del núcleo de Transformers.js, hemos convertido el repositorio en un monorepo utilizando espacios de pnpm.
Estructura de Clases Modular
Otro esfuerzo de refactorización importante se centró en el archivo models.js. En la versión 3, todos los modelos estaban definidos en un solo archivo de más de 8,000 líneas, lo que dificultaba su mantenimiento. Para la versión 4, dividimos esto en módulos más pequeños, mejorando la legibilidad.
Nuevos Modelos y Arquitecturas
Gracias a nuestra nueva estrategia de exportación y el soporte creciente de ONNX Runtime para operadores personalizados, hemos agregado muchos nuevos modelos y arquitecturas a Transformers.js v4. Estos incluyen modelos populares como GPT-OSS, Chatterbox, y FalconH1.
Además, estos modelos son compatibles con WebGPU, permitiendo su ejecución en el navegador o en entornos de JavaScript del lado del servidor con aceleración de hardware.
Sistema de Construcción Nuevo
Hemos migrado nuestro sistema de construcción de Webpack a esbuild, reduciendo los tiempos de construcción de 2 segundos a solo 200 milisegundos. Esto hace que la iteración en el desarrollo sea significativamente más rápida.
Biblioteca Standalone Tokenizers.js
Con la versión 4, hemos extraído la lógica de tokenización en una biblioteca separada, @huggingface/tokenizers, que funciona sin problemas en navegadores y entornos del lado del servidor.
Mejoras Variadas
Hemos realizado varias mejoras en la calidad de vida a través de la biblioteca. El sistema de tipos ha sido mejorado con tipos de pipeline dinámicos que se adaptan según las entradas, proporcionando una mejor experiencia para los desarrolladores.

Además, hemos mejorado el registro para ofrecer a los usuarios más control y retroalimentación clara durante la ejecución de modelos.
Agradecimientos
Agradecemos sinceramente a todos los que contribuyeron a este lanzamiento, especialmente al equipo de ONNX Runtime por su increíble trabajo en el nuevo runtime WebGPU.


