Google presenta RRSI para evitar que agentes de IA memoricen

Qué es RRSI y por qué debería importarte a un founder

Un harness es la capa de software que envuelve a un modelo de lenguaje: los prompts que recibe, las herramientas que puede llamar, la memoria, el flujo de control y la lógica que decide qué hace en cada paso. Si el modelo es el motor, el harness es el resto del coche: volante, transmisión, panel y guantera. Cuando le pides a un agente que lea el archivo correcto antes de editarlo, que se recupere de un error o que entregue el resultado en un formato concreto, todo eso lo decide el harness, no el modelo.

RRSI (Regularized Recursive Self-Improvement of Agent Harnesses) es un framework open source publicado por Google Cloud AI Research junto a la UNC-Chapel Hill, Stanford y la Washington University in St. Louis el 21 de septiembre de 2026. Su propuesta: dejar que un agente reescriba su propio harness de forma recursiva, pero con una serie de «frenos» para que no termine memorizando las pruebas que usa para evaluarse. El código está disponible en GitHub bajo licencia Apache 2.0 y acepta cualquier modelo compatible con LiteLLM, aunque por defecto apunta a Claude Opus 4.8 en Vertex AI (cifras confirmadas por MarkTechPost).

El problema: los agentes que se estudian sus propios exámenes

Hasta hace poco, mejorar el harness era tarea humana: alguien revisaba ejecuciones fallidas y corregía prompts o herramientas a mano. Los métodos más nuevos automatizan ese ciclo: un modelo propone cambios al harness, los evalúa sobre un conjunto fijo de tareas de prueba y se queda con los que mejor resultado dan. Después repite. Es una forma práctica de mejora recursiva.

👥 ¿Quieres ir más allá de la noticia?

En nuestra comunidad discutimos las tendencias, compartimos oportunidades y nos ayudamos entre emprendedores. Sin humo, solo acción.

👥 Unirme a la comunidad

El problema es que ese ciclo, sin control, memoriza las pruebas en lugar de mejorar la capacidad general. Los investigadores identifican tres modos de fallo: ajustes que solo encajan con un benchmark concreto, mejoras que son puro ruido estadístico y acumulación de complejidad inútil que sube la nota sin subir la capacidad. El resultado: la puntuación en las tareas de entrenamiento sube, pero al pasar a tareas nuevas la ganancia se diluye o desaparece, y dos de los cuatro métodos comparados en el paper incluso quedaron por debajo del harness base en los benchmarks inéditos.

Un caso extremo lo recoge TechCrunch: con un harness a medida, Claude Opus 5 logró un 100% en el benchmark ARC-AGI-3, frente al 30% sin ese harness. Pero el mismo modelo, con un harness familiar distinto, se quedó en 0% al pasar a un entorno desconocido. La lección es incómoda: la métrica que celebramos puede ser humo.

Cómo RRSI frena la memorización sin frenar la mejora

RRSI no prohíbe reescribir el harness; limita cómo se reescribe y qué se queda. Lo hace en dos frentes.

Del lado de la propuesta, usa un presupuesto de ediciones que se reduce con el tiempo (annealed edit budget). Al principio permite cambios amplios, casi una reescritura. En rondas posteriores, fuerza modificaciones pequeñas y atribuibles a un resultado concreto. También mantiene un historial de intentos anteriores para no perseguir ideas que ya fallaron, y si el progreso se estanca, redirige la búsqueda a partes del harness que aún no ha tocado.

Del lado de la selección, hay cuatro filtros que toda propuesta debe pasar antes de quedar incorporada:

  • Crítico de filtraciones: descarta cambios que contengan nombres de tareas, soluciones o atajos asociados a un benchmark específico.
  • Piso de ruido: ignora mejoras tan pequeñas que no se distinguen de la variación aleatoria del harness base.
  • Regla de costo: solo acepta más gasto computacional si viene acompañado de una mejora de rendimiento medible.
  • Poda: elimina componentes que ya no aportan beneficio.

El equipo de Google lo describe con una analogía útil para cualquier founder que haya entrenado modelos: el presupuesto de ediciones mapea a una regularización L0, la poda a Lasso (L1) y la regla de costo a Ridge (L2). Es, literalmente, aplicar el libro de texto de regularización al problema del harness.

Los resultados: menos ganancia en lo conocido, más en lo nuevo

El método se probó sobre ocho benchmarks en programación, tareas de oficina agentic y diseño de ingeniería, con el modelo subyacente congelado durante todo el experimento. Los cambios de rendimiento se deben al harness, no a los pesos del modelo.

Sobre las tareas usadas durante la optimización, RRSI logró una mejora máxima de 14,1 puntos. Sobre cinco benchmarks que el agente nunca vio durante el entrenamiento, la mejora máxima fue de 4,7 puntos (en JobBench) y el rendimiento nunca cayó por debajo de la línea base. El detalle clave: fue el único método de los cinco comparados cuyo promedio en tareas nuevas quedó más de un punto por encima del baseline, según la Tabla 1 del paper (datos recogidos por MarkTechPost).

Las cifras más concretas, atribuidas por MarkTechPost al paper original:

  • Terminal-Bench 2.1: 74,2% → 80,2% (+6,0 puntos).
  • SWE-bench Verified (no usado para selección): 82,0% → 83,8%.
  • GDPval: +3,5 puntos. APEX-Agents: +3,7 puntos.
  • Harvey LAB: +1,1 en el split de evolución, +2,3 en el split held-out.

Y el dato que más mira un founder: RRSI usó cerca de un 30% menos tokens en la instancia de workspace agentic (2,42M frente a 3,80M por ensayo), según el abstract del paper. En un mundo donde el costo de los agentes se mide por tokens de inferencia, eso es un ahorro directo.

El contexto: el harness es el verdadero cuello de botella

RRSI no aparece en el vacío. Es la confirmación experimental de una idea que el resto del sector ya estaba persiguiendo: que el modelo importa menos que el harness, sobre todo en tareas de horizonte largo.

Nvidia lo demostró en agosto de 2026 con su investigación sobre ARC-AGI-3: un componente «supervisor» añadido al harness permitió a Claude Opus 5 pasar de 30% a 100% en ese benchmark, según reportó TechCrunch. Databricks, por su parte, publicó en julio que «elegir el mismo modelo con distintos harnesses puede duplicar el costo» (cifra y cita atribuidas por TechCrunch al CEO Ali Ghodsi).

En paralelo, Meta, Duke y UC Davis publicaron el 29 de septiembre de 2026 un paper llamado Mixture of Self-Improving Branches que mejora a Meta-Harness (su propio sistema, lanzado el 30 de marzo de 2026): dividen la búsqueda en ramas especializadas y un router elige la mejor por tarea. Su resultado estrella: pasar de 46,0% a 62,0% en razonamiento matemático de nivel olimpiada con Gemini 3 Flash, sin tocar los pesos del modelo (cifra reportada por CryptoBriefing).

Qué significa esto para tu startup

Si estás construyendo un agente, el RRSI confirma algo que va a definir la próxima oleada de herramientas: competir por el modelo es la pelea equivocada. La ventaja va a estar en el harness.

Dos acciones concretas que puedes tomar esta semana:

  • Audita tu harness antes que tu modelo. Si tu agente falla en producción, no asumas que necesitas un modelo más grande. Mide con un set held-out propio (no con tus benchmarks de dev) cuánto se degrada el rendimiento. Si la caída es grande, el problema es el harness, no el LLM. Ahí es donde RRSI o Meta-Harness pueden ayudarte, porque atacan exactamente esa degradación.
  • Prueba RRSI en tu stack. El repositorio google-research/rrsi en GitHub corre sobre Python 3.10+, Docker y harbor para la instancia de coding. Antes de invertir en un upgrade de modelo, dedica una semana a ver cuánto te mejora un harness evolucionado con RRSI. La métrica que importa no es la del benchmark de entrenamiento, sino la del benchmark que tu agente nunca ha visto.

Conclusión

RRSI no es una noticia de laboratorio: es una pieza más de un cambio de paradigma. El modelo de lenguaje ya no es el cuello de botella; lo es todo lo que se construye alrededor. Y la diferencia entre un agente que mejora y un agente que solo aprueba su propio examen está, literalmente, en los frenos que le pongas al ciclo de optimización.

Fuentes

¿te gustó o sirvió lo que leíste?, Por favor, comparte.

👥 ¿Quieres ir más allá de la noticia?

En nuestra comunidad discutimos las tendencias, compartimos oportunidades y nos ayudamos entre emprendedores. Sin humo, solo acción.

👥 Unirme a la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...