¿Qué cambia con los presupuestos por usuario en AI Gateway?
Vercel lanzó una función en AI Gateway que permite fijar un límite de gasto en dólares para cada miembro del equipo de forma individual. Hasta ahora, los presupuestos eran por proyecto, por clave de API o globales para todo el equipo. La nueva capa agrega control a nivel de persona.
Hay dos modos. El presupuesto por defecto se aplica a cada integrante del equipo que no tenga uno personalizado, incluidos los que se sumen después: cada uno recibe su propio cupo, no comparten un límite colectivo. El presupuesto personalizado sobrescribe al por defecto para un usuario concreto y se identifica por email, nombre de usuario o ID.
Cuando un usuario supera su tope, AI Gateway rechaza las nuevas peticiones hasta que se reinicie el período o se suba el límite. Los presupuestos admiten alerta por email al 50%, 75% y 100% del consumo, y se reinician por defecto cada mes, aunque se pueden cambiar a diario, semanal o nunca.
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidadLa función no sustituye a los presupuestos de clave de API, proyecto o equipo: una petición tiene que pasar todos los presupuestos que le apliquen. Si llega a cualquiera de los límites, se bloquea. Las claves creadas antes de esta release se atribuyen al equipo por retrocompatibilidad, así que conviene rotarlas para que el consumo reciente caiga bajo el nuevo alcance por usuario. El gasto con credenciales Bring Your Own Key (BYOK) no se contabiliza en los presupuestos por usuario.
Para configurarlos se necesita la última versión del Vercel CLI. Los comandos de ejemplo que publica Vercel son:
vercel ai-gateway budgets defaults set user --limit 50 --refresh-period monthly(fija el presupuesto por defecto en US$50 mensuales)vercel ai-gateway budgets set user [email protected] --limit 100 --refresh-period monthly(fija un presupuesto personalizado de US$100 mensuales para un miembro)
Solo los dueños del equipo pueden gestionar presupuestos por usuario, aunque pueden otorgar permisos de AI Gateway Budget Manager a otros miembros desde la configuración de team.
¿Por qué Vercel lanza esto ahora? El contexto del gasto en IA
En su conferencia Ship del 17 de junio de 2026, Vercel compartió cifras que ilustran por qué el control fino de gasto dejó de ser opcional. Según reportó Yahoo Finance, el volumen de tokens que atraviesa AI Gateway pasó de unos dos billones a veinte billones al mes en seis meses. En el mismo período, los despliegues disparados por agentes de código pasaron de menos del 3% del total a superar el 50%.
Es decir: hoy, más de la mitad de los despliegues en Vercel los inicia un agente autónomo que trabaja sin supervisión humana directa. Eso encaja exactamente con el caso de uso que cita la propia Vercel para esta función: controlar el gasto de agentes de código y otras cargas de trabajo que corren sin supervisión, y evitar que un solo usuario consuma todo el presupuesto compartido del equipo.
Los presupuestos por usuario apuntan a un punto ciego muy concreto: cuando un agente ejecuta en bucle tareas largas, una sola sesión puede agotar el presupuesto colectivo del equipo antes de que nadie lo note.
¿Qué otras empresas están poniendo topes al gasto en IA?
El movimiento de Vercel no llega en vacío. Varias grandes tecnológicas ya chocaron contra el mismo problema.
Tesla implantó un tope de US$200 semanales al gasto en herramientas de IA de terceros para empleados, vigente desde el 6 de julio de 2026, según reportó Tech Times. El límite aplica a modelos de Anthropic, OpenAI y Google; las herramientas de xAI — empresa del propio Elon Musk en la que Tesla invirtió US$2.000 millones en enero de 2026 — quedan exentas.
Uber agotó todo su presupuesto de IA de 2026 en abril y respondió con un tope de US$1.500 mensuales por empleado, según el mismo reporte. Meta, Amazon y Walmart también implementaron límites equivalentes o redirigieron a los empleados hacia modelos de menor costo.
En el lado de los proveedores, el sector se mueve en paralelo. Databricks lanzó Unity AI Gateway con enrutamiento inteligente entre modelos; Anthropic publicó un dashboard de uso para que sus clientes rastreen y optimicen el consumo de Claude; y NVIDIA está desarrollando estándares de transparencia de costos a través de la Open Secure AI Alliance. AICC, un agregador de APIs con sede en Singapur, asegura que su marco de optimización por enrutamiento logra reducciones de entre 30% y 80% en el gasto de startups al derivar cada tarea al modelo más económico capaz de resolverla.
La conclusión transversal: el gasto en IA pasó de ser un rubro experimental a una línea de costo que requiere governance como cualquier otra.
¿Qué significa esto para tu startup?
1. Activa presupuestos por usuario desde el primer despliegue de agentes. Si tu equipo usa Claude Code, Codex o cualquier agente similar conectado a AI Gateway, asigna un presupuesto por defecto conservador (por ejemplo, US$20-US$50 por persona y mes) antes de que aparezca la primera factura sorpresa. Si el uso es heterogéneo, sube el tope solo para quienes demuestren ROI claro.
2. Audita qué claves de API están atribuidas a personas y cuáles al equipo. Las claves de producción que ejecutan workloads compartidos deben atribuirse al equipo, no a la persona que las creó. Sin ese paso, el consumo legítimo de tu app se le cobrará al developer que la dio de alta y le bloqueará el trabajo.
3. Configura alertas de email al 50%, 75% y 100%. No basta con tener el límite: necesitas saberlo antes de que el agente agote su cuota a las 3 de la madrugada. Las alertas por email que ofrece AI Gateway en esos tres umbrales son la diferencia entre un ajuste de presupuesto y una interrupción de servicio.
4. Rota las claves creadas antes de la release. Si tu equipo lleva meses usando AI Gateway, las claves preexistentes están atribuidas al equipo por retrocompatibilidad. Si quieres que el consumo más reciente caiga bajo el alcance por usuario, rotar las claves es un paso necesario y rápido.
Conclusión
El techo de gasto por usuario deja de ser un lujo de grandes empresas y se convierte en una función de plataforma. Para founders que ya desplegaron agentes en producción, el mensaje es directo: el costo de IA ya no se controla solo eligiendo el modelo, sino decidiendo quién puede gastar cuánto y bajo qué señal de alerta. Las herramientas para hacerlo ya están en la pasarela de Vercel — falta aplicarlas.
Fuentes
- Set per-user budgets on AI Gateway
- Vercel Brings New Agent Framework, Full-Stack Capabilities, and Enterprise Controls to Its Agentic Infrastructure Platform
- Tesla Limits AI Tool Spending to $200 Weekly While Musk’s Grok Stays Exempt
- AICC Launches Cost Optimization Framework to Help Startups Reduce AI API Spending by Up to 80 Percent
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidad













