Anthropic lleva Claude Code a la era de los agentes mutables

El contexto: Anthropic a las puertas de salir a bolsa

Para entender hacia dónde va Claude Code hay que mirar primero las cifras de su creador. En mayo de 2026, Anthropic cerró una Serie H de US$65.000M a una valoración post-money de US$965.000M, según los datos publicados por CryptoBriefing al repasar la documentación previa al IPO. Un mes después, el 1 de junio, la compañía presentó de forma confidencial el formulario S-1 ante la SEC: apunta a una salida a bolsa en torno a los US$2 billones, de acuerdo con TechRepublic, que cita fuentes familiarizadas con la operación. La ronda de marketing con inversores arrancaría en mid-October, y la cotización pública podría concretarse antes de las elecciones legislativas de noviembre en EEUU.

El motor de esa valoración es el crecimiento. Anthropic pasó de un run rate de ingresos (ARR) de unos US$9.000M a finales de 2025 a más de US$65.000M en julio de 2026, según la misma fuente. Las proyecciones que circulan en las conversaciones pre-IPO con bancos como Morgan Stanley, Goldman Sachs, JPMorgan y Citi contemplan US$100.000M a US$120.000M de ARR a fin de 2026 y US$190.000M a US$200.000M hacia 2028, según Yahoo Finance. Para dimensionar la apuesta: el laboratorio perdió US$42.000M en 2025 y ya tiene compromisos de compute por US$518.000M a futuro.

Este telón de fondo es el que enmarca la conversación entre Thariq Shihipar y el equipo de Latent Space, publicada el 29 de septiembre de 2026, sobre la siguiente era de Claude Code.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

¿Qué trae el nuevo Claude Code?

El episodio funciona como un mapa de producto. Shihipar, descrito por el propio Latent Space como el «explainer-king» de Anthropic, repasa los lanzamientos que han reconfigurado la herramienta en los últimos meses:

  • Sonnet 5.5, presentado el 28 de septiembre de 2026, es el primer Sonnet que supera a Opus 5.5 en Terminal-Bench 4.0 (70,6% frente a 66,4%) y que termina Pokémon Red trabajando solo con capturas de pantalla, según el anuncio reportado por Mashable. Su precio se mantiene en US$2 por millón de tokens de entrada y US$10 de salida, la mitad que Opus 5.5, y reduce el costo por tarea hasta un 30% en escenarios cotidianos.
  • Cloud Sessions, Claude Projects y Plugins se lanzaron la semana previa al episodio, llevando la experiencia de Claude Code más allá del CLI local hacia un modelo donde el «cerebro» corre en la nube y las «hands» pueden ser locales, remotas o en sandbox.
  • Claude Mods, una primicia que se filtró durante la grabación, permite customizar el propio loop de ejecución: la interfaz, los subagentes, el enrutamiento entre modelos y hasta el comportamiento del harness. Shihipar lo describe como una vista previa del «software mutable», una categoría donde la aplicación se reescribe a sí misma según el usuario.

A esto se suma la arquitectura de tres capas que el equipo está consolidando: la UI generativa (los Artifacts persistentes, con base de datos propia y capacidad de alimentar de vuelta al modelo), la inferencia en la nube (cerebro) y las «hands» locales o remotas donde el agente efectivamente ejecuta. Shihipar señala que la versión actual de Claude Code, donde todo ocurre en el mismo proceso, se va a desempaquetar.

¿Por qué el prompting ya no es suficiente?

Una de las tesis más fuertes del episodio es el desplazamiento de la habilidad central. Shihipar lo dice sin rodeos: la capacidad de prompting sigue siendo «high-skill ceiling», pero ya no alcanza. Lo que se viene es diseñar loops: sistemas que sostienen contexto externo, deciden cuándo y cómo invocar al modelo y verifican si el trabajo está hecho.

El propio creador de Claude Code, Boris Cherny, lo resumió en una frase que citó TechTimes en su cobertura de junio de 2026: «Ya no le hago prompts a Claude. Tengo loops corriendo que le hacen prompts y deciden qué hacer. Mi trabajo es escribir loops». El /goal command, disponible en Claude Code desde la versión 2.1.139 de mayo de 2026, formaliza esa idea: un modelo separado, más rápido y barato, verifica tras cada turno si la condición de éxito se cumple. Es la separación entre el «maker» que escribe código y el «checker» que evalúa.

Shihipar conecta esta transición con otra tendencia: el archivo Claude.md podría desaparecer. La razón no es que el contexto estático sea inútil, sino que los Mods, los skills y la memoria externa persistente lo hacen redundante en muchos casos. «Mutable software» significa que la aplicación se ajusta a ti, en lugar de que tú te adaptes a ella escribiendo mejores instrucciones.

¿Cuánto cuesta realmente automatizar con Claude Code?

La conversación también es honesta sobre los costos. En el propio episodio, Thariq advierte que los loops desatendidos con un verificador débil se convierten en «máquinas de generar código malo con alta confianza». El dato que rescata TechTimes es concreto: con Opus 4.8 a US$5 por millón de tokens de entrada, un solo paso tardío de un loop puede costar US$0,25, y una sesión autónoma de 200 iteraciones sobre una tarea abierta puede superar los US$80. Un caso real documentado: un desarrollador gastó US$4.200 en un fin de semana en un refactor autónomo.

Anthropic lleva meses ajustando la economía. Desde el 15 de junio de 2026, las cargas automatizadas (Agent SDK, scripts claude -p y Claude Code en GitHub Actions) se facturan contra un pool de créditos separado: US$20 para Pro y hasta US$200 para Max. Cuando se agota, las requests automatizadas se detienen. Es la respuesta directa al caso de Uber, que quemó todo su presupuesto 2026 de Claude Code en cuatro meses, con costos por ingeniero entre US$500 y US$2.000 mensuales y tasas de uso del 95% hacia abril, según el mismo reportaje.

¿Qué significa esto para tu startup?

Si estás construyendo con Claude Code o estás a punto de hacerlo, el episodio de Latent Space con Thariq Shihipar deja varias señales prácticas:

  • Diseña verificador primero, prompt después. Antes de lanzar un loop, escribe una condición de éxito que un modelo más barato pueda chequear de forma mecánica. Sin eso, no tienes automatización, tienes una factura sorpresa.
  • Separa el maker del checker desde el día uno. Si delegas la generación y la evaluación en el mismo agente, te está aprobando su propio trabajo. Asigna subagentes distintos o, mejor aún, usa /goal con su modelo verificador independiente.
  • Empieza sin Claude.md. Suena contraintuitivo, pero la propia Anthropic está empujando hacia Mods y memoria persistente externa. Empezar limpio y dejar que el sistema acumule contexto por ti suele ser más mantenible que escribir a mano un archivo que se vuelve obsoleto al primer cambio de modelo.
  • Mira el costo por tarea, no por token. Sonnet 5.5 cuesta lo mismo por token que Sonnet 5, pero gasta hasta un 30% menos por tarea, según Mashable. Si tu workload cabe en ese perfil, el upgrade es rentable sin tocar presupuesto.
  • Prepárate para la opcionalidad del IPO. La salida a bolsa de Anthropic, en torno a los US$2 billones según los reportes pre-IPO, traerá volatilidad en la cadena de proveedores (AWS, GCP, Azure) y posiblemente nuevos tiers de precios. Si tu arquitectura depende de Claude a nivel crítico, diversifica modelo y proveedor antes de que el mercado fije las nuevas reglas.

Fuentes

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...