Baseten se suma como proveedor de inferencia en Hugging Face
Baseten, la plataforma de infraestructura de IA valorada en US$13.000 millones, se convirtió oficialmente en proveedor de inferencia en el Hugging Face Hub. La integración, anunciada el 6 de agosto de 2026, permite a desarrolladores acceder a modelos de lenguaje avanzados como Kimi K3, DeepSeek V4 Flash y GLM-5.2 directamente desde las páginas de modelos de Hugging Face, con facturación unificada y sin costos adicionales de servicio.
Esta movida estratégica posiciona a Baseten junto a otros proveedores como Groq, Together AI y Fireworks en el ecosistema de Hugging Face, que alberga más de 2 millones de modelos. Según el anuncio oficial, Baseten inicialmente soporta tareas de conversación y generación de texto, con planes de expandir a otras modalidades en el futuro.
Por qué esta integración marca un punto de inflexión
La entrada de Baseten al ecosistema de Hugging Face no es solo otra integración técnica. Según Value Add VC, Baseten alcanzó un run-rate anualizado de US$600 millones en marzo de 2026, un crecimiento del 1.900% interanual desde diciembre de 2025. La plataforma procesa más de 1.000 millones de llamadas de inferencia diarias a través de 87 clusters distribuidos en 18 nubes diferentes.
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidadLo que hace especial esta integración es que Hugging Face no cobra comisiones adicionales por el uso de proveedores externos. Los usuarios pueden elegir entre dos modos: usar sus propias claves API de Baseten (facturación directa) o autenticarse con un token de Hugging Face (facturación a través de HF). En ambos casos, pagan las tarifas estándar del proveedor sin markup.
Cómo funciona la integración técnica
La integración está disponible tanto en la interfaz web como en los SDKs oficiales de Hugging Face:
En la interfaz web:
- Los usuarios configuran sus claves API de proveedores en las preferencias de cuenta
- Pueden ordenar proveedores por preferencia personal
- Las páginas de modelos muestran proveedores compatibles ordenados según esa preferencia
Desde los SDKs:
- Python:
huggingface_hub(versión ≥ 1.26.1) - JavaScript:
@huggingface/inference - Compatible con frameworks de agentes como Pi, OpenCode, Hermes Agents y OpenClaw
El código de ejemplo proporcionado en el anuncio muestra cómo usar DeepSeek V4 Flash a través de Baseten con la API OpenAI-compatible de Hugging Face, usando solo un token de HF para autenticación.
El contexto competitivo del mercado de inferencia
Según el análisis de Value Add VC, Baseten compite en un mercado cada vez más concurrido:
- Together AI: inferencia de modelos abiertos + entrenamiento
- Fireworks AI: servicio rápido y de bajo costo
- Modal/Replicate: computación amigable para desarrolladores
- AWS/Azure/GCP: inferencia integrada en sus nubes
- Nvidia: propietaria del silicio + software
La ventaja competitiva de Baseten radica en su capacidad multi-nube (18 nubes, 87 clusters) que le permite arbitrar disponibilidad y precio de GPUs entre proveedores, ofreciendo una capa de servicio neutral y de alta confiabilidad.
Qué significa esto para tu startup
1. Simplifica tu stack de inferencia
Si tu startup usa modelos de Hugging Face en producción, ahora puedes cambiar entre proveedores sin reescribir código. La integración de Baseten significa acceso inmediato a modelos frontera optimizados, con la posibilidad de comparar rendimiento y costo entre proveedores desde una misma interfaz.
2. Reduce el riesgo de dependencia de un solo proveedor
La arquitectura multi-nube de Baseten te protege contra interrupciones de servicio o aumentos de precio repentinos en un solo proveedor de cloud. Si AWS tiene problemas de disponibilidad de GPUs, tu carga de trabajo puede redirigirse automáticamente a otra nube.
3. Acceso a créditos de inferencia gratuitos
Los usuarios PRO de Hugging Face reciben US$2 en créditos de inferencia mensuales que pueden usar en cualquier proveedor, incluido Baseten. Para startups en etapa temprana, esto representa una oportunidad para probar modelos en producción sin costo inicial.
Acciones concretas que puedes tomar hoy
1. Configura tu cuenta de Hugging Face PRO
Si aún no lo has hecho, suscríbete al plan PRO (US$9/mes) para acceder a los US$2 mensuales en créditos de inferencia, ZeroGPU, Spaces Dev Mode y límites 20x más altos.
2. Prueba DeepSeek V4 Flash a través de Baseten
Usa el código de ejemplo del anuncio para generar una función Python con memoización. Compara latencia y costo con otros proveedores disponibles en Hugging Face.
3. Evalúa modelos específicos para tu caso de uso
Baseten soporta inicialmente modelos como Kimi K3 (2,8T parámetros), DeepSeek V4 Flash (304B) y GLM-5.2 (753B). Crea un benchmark con datos reales de tu aplicación para determinar cuál ofrece el mejor balance costo-rendimiento.
El futuro de la inferencia como infraestructura independiente
La tesis detrás del crecimiento explosivo de Baseten es que la inferencia se está convirtiendo en su propia guerra de infraestructura. Mientras el entrenamiento de modelos es un costo único y discontinuo, la inferencia es la factura recurrente que crece cada vez que un modelo se usa.
Con la migración de cargas de trabajo hacia modelos de código abierto y personalizados, la demanda por una capa de servicio neutral, de alto rendimiento y multi-nube se multiplica. Baseten, con su valoración de US$13.000 millones y run-rate de US$600 millones, es una de las apuestas más claras sobre este cambio estructural.
Para founders hispanohablantes, esta integración representa una oportunidad para construir productos de IA más robustos y escalables, sin depender exclusivamente de los hyperscalers tradicionales. La neutralidad del ecosistema de Hugging Face combinada con la capacidad multi-nube de Baseten crea un espacio competitivo donde el rendimiento y el costo, no el lock-in, determinan qué proveedor usar.
Fuentes
- Baseten on Hugging Face Inference Providers
- Baseten ARR 2026: $600M Run-Rate, $13B Valuation
- Hugging Face – The AI community building the future
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidad













