Transformers.js v4 ya disponible en NPM para pruebas

Transformers.js v4 (preview) ya está disponible en NPM, lo que facilita su acceso. Tras casi un año de desarrollo, comenzamos en marzo de 2025, ahora puedes probarlo con un simple comando.

npm i @huggingface/transformers@next 

Continuaremos publicando versiones de v4 bajo la etiqueta next en NPM hasta el lanzamiento completo, por lo que se esperan actualizaciones regulares.

Mejoras en Rendimiento y Ejecución

La adopción de un nuevo WebGPU Runtime reescrito completamente en C++ es el cambio más significativo. Hemos colaborado con el equipo de ONNX Runtime para probar exhaustivamente este runtime en aproximadamente 200 arquitecturas de modelos compatibles.

Este nuevo runtime permite el uso del mismo código de transformers.js en diversos entornos de JavaScript, incluyendo navegadores, aplicaciones de servidor y aplicaciones de escritorio. Ahora es posible ejecutar modelos acelerados por WebGPU directamente en Node, Bun y Deno.

Overview

Hemos demostrado que es posible ejecutar modelos de IA de última generación 100% localmente en el navegador. Ahora, nos enfocamos en mejorar el rendimiento, logrando que estos modelos funcionen lo más rápido posible, incluso en entornos con recursos limitados.

Estructuración del Repositorio

El desarrollo de una nueva versión mayor nos brindó la oportunidad de invertir en la base de código y abordar esfuerzos de refactorización que se habían postergado.

Espacios de PNPM

Hasta ahora, el repositorio de GitHub servía como nuestro paquete npm. Sin embargo, dado que el futuro requiere varios subpaquetes que dependen del núcleo de Transformers.js, hemos convertido el repositorio en un monorepo utilizando espacios de pnpm.

Estructura de Clases Modular

Otro esfuerzo de refactorización importante se centró en el archivo models.js. En la versión 3, todos los modelos estaban definidos en un solo archivo de más de 8,000 líneas, lo que dificultaba su mantenimiento. Para la versión 4, dividimos esto en módulos más pequeños, mejorando la legibilidad.

Nuevos Modelos y Arquitecturas

Gracias a nuestra nueva estrategia de exportación y el soporte creciente de ONNX Runtime para operadores personalizados, hemos agregado muchos nuevos modelos y arquitecturas a Transformers.js v4. Estos incluyen modelos populares como GPT-OSS, Chatterbox, y FalconH1.

Además, estos modelos son compatibles con WebGPU, permitiendo su ejecución en el navegador o en entornos de JavaScript del lado del servidor con aceleración de hardware.

Sistema de Construcción Nuevo

Hemos migrado nuestro sistema de construcción de Webpack a esbuild, reduciendo los tiempos de construcción de 2 segundos a solo 200 milisegundos. Esto hace que la iteración en el desarrollo sea significativamente más rápida.

Biblioteca Standalone Tokenizers.js

Con la versión 4, hemos extraído la lógica de tokenización en una biblioteca separada, @huggingface/tokenizers, que funciona sin problemas en navegadores y entornos del lado del servidor.

Mejoras Variadas

Hemos realizado varias mejoras en la calidad de vida a través de la biblioteca. El sistema de tipos ha sido mejorado con tipos de pipeline dinámicos que se adaptan según las entradas, proporcionando una mejor experiencia para los desarrolladores.

Type Improvements

Además, hemos mejorado el registro para ofrecer a los usuarios más control y retroalimentación clara durante la ejecución de modelos.

Agradecimientos

Agradecemos sinceramente a todos los que contribuyeron a este lanzamiento, especialmente al equipo de ONNX Runtime por su increíble trabajo en el nuevo runtime WebGPU.

– Enlace contenido original: https://huggingface.co/blog/transformersjs-v4
Ilustración de un hombre mayor con auriculares y chaqueta