DeepInfra se ha convertido en un proveedor de inferencia en el Hugging Face Hub, ampliando sus capacidades en la plataforma.
Este nuevo integrante en el ecosistema de Hugging Face potencia la inferencia sin servidor directamente en las páginas de modelos. Los proveedores de inferencia están integrados de manera fluida en los SDK de cliente, tanto para JavaScript como para Python, facilitando el uso de diversos modelos con los proveedores preferidos.
Integración y precios
DeepInfra es una plataforma de inferencia AI sin servidor que ofrece precios competitivos por token. Con más de 100 modelos disponibles, permite a los desarrolladores integrar capacidades de IA en sus aplicaciones con un proceso de configuración sencillo.
La plataforma soporta distintos tipos de modelos, incluyendo LLMs, text-to-image, text-to-video y embeddings. Como parte de esta integración inicial, DeepInfra lanzará soporte para tareas de generación de texto y conversación en Hugging Face, permitiendo el acceso a LLMs populares como DeepSeek V4, Kimi-K2.6, y GLM-5.1. Pronto habrá soporte para tareas adicionales como text-to-image y text-to-video.
Uso de DeepInfra
Para obtener más información sobre cómo utilizar DeepInfra como proveedor de inferencia, consulta su página de documentación.
La lista completa de modelos soportados por DeepInfra está disponible aquí.
Sigue a DeepInfra en Hugging Face: https://huggingface.co/DeepInfra.
Funcionamiento
Interfaz de usuario del sitio web
- En la configuración de tu cuenta, puedes:
- Definir tus propias claves API para los proveedores que has registrado. Si no se configura una clave personalizada, tus solicitudes se dirigirán a HF.
- Ordenar proveedores según tus preferencias, lo cual se aplica a los widgets y fragmentos de código en las páginas de los modelos.

- Existen dos modos al llamar a los proveedores de inferencia:
- Clave personalizada (las llamadas van directamente al proveedor de inferencia, usando tu propia clave API).
- Dirigido por HF (en este caso, no necesitas un token del proveedor, y los cargos se aplican directamente a tu cuenta de HF).

- Las páginas de los modelos muestran proveedores de inferencia de terceros (los compatibles con el modelo actual, ordenados por preferencia del usuario).

Desde los SDKs de cliente
DeepInfra está disponible a través de los SDKs de Hugging Face – huggingface_hub (>= 1.11.2) para Python y @huggingface/inference para JavaScript.
A continuación, se muestran ejemplos de cómo utilizar DeepSeek V4 Pro a través de DeepInfra. Usa un token de Hugging Face para autenticarte; la solicitud se dirigirá automáticamente a DeepInfra.
Desde tu herramienta de agente favorita
Los proveedores de inferencia de Hugging Face están integrados en la mayoría de las herramientas de agente, incluyendo Pi, OpenCode, Hermes Agents y OpenClaw. Esto significa que puedes conectar modelos alojados en DeepInfra directamente en tus herramientas favoritas sin necesidad de código adicional. Consulta la lista completa de integraciones aquí.
Desde Python
import os from openai import OpenAI client = OpenAI( base_url="https://router.huggingface.co/v1", api_key=os.environ["HF_TOKEN"], ) completion = client.chat.completions.create( model="deepseek-ai/DeepSeek-V4-Pro:deepinfra", messages=[ { "role": "user", "content": "Escribe una función en Python que devuelva el n-ésimo número de Fibonacci usando memoización." } ], ) print(completion.choices[0].message)
Desde JavaScript
import { OpenAI } from "openai"; const client = new OpenAI({ baseURL: "https://router.huggingface.co/v1", apiKey: process.env.HF_TOKEN, }); const chatCompletion = await client.chat.completions.create({ model: "deepseek-ai/DeepSeek-V4-Pro:deepinfra", messages: [ { role: "user", content: "Escribe una función en Python que devuelva el n-ésimo número de Fibonacci usando memoización.", }, ], }); console.log(chatCompletion.choices[0].message);
Facturación
Las solicitudes directas, es decir, cuando utilizas la clave de un proveedor de inferencia, se facturan al proveedor correspondiente. Por ejemplo, si usas una clave API de DeepInfra, se te cobrará en tu cuenta de DeepInfra.
Para las solicitudes dirigidas, es decir, cuando autenticas a través de Hugging Face Hub, solo pagarás las tarifas estándar del API del proveedor. No hay ningún recargo adicional; simplemente pasamos los costos del proveedor directamente. En el futuro, podríamos establecer acuerdos de reparto de ingresos con nuestros socios proveedores.
Nota importante
Los usuarios PRO reciben $2 en créditos de inferencia cada mes, que pueden utilizarse entre proveedores. 
Suscríbete al plan PRO de Hugging Face para acceder a créditos de inferencia, ZeroGPU, modo de desarrollo de Spaces, límites 20 veces mayores y más.
También ofrecemos inferencia gratuita con una pequeña cuota para nuestros usuarios gratuitos registrados, pero te recomendamos actualizar a PRO si es posible.
Comentarios y próximos pasos
Nos encantaría conocer tu opinión. Comparte tus pensamientos y/o comentarios aquí: https://huggingface.co/spaces/huggingface/HuggingDiscussions/discussions/49


