OpenAI y Microsoft sabían que estaban destruyendo la web

Documentos judiciales prueban que OpenAI y Microsoft conocían el "doom loop" que desataron

El 18 de septiembre de 2026 se desclasificaron documentos internos del caso que el New York Times y otros once editores mantienen contra OpenAI y Microsoft ante el Tribunal de Distrito de Estados Unidos, con el juez Sidney Stein a cargo. Lo que contienen es una confesión corporativa en toda regla: un documento interno de Microsoft de 2023 advertía que su estrategia de contenido con IA había iniciado un "doom loop" que "dañará el rendimiento de nuestros modelos y de toda la web al mismo tiempo". Las propias mediciones de Microsoft muestran que cuando los usuarios consultaban Bing Chat en lugar del buscador tradicional, el click-through hacia sitios del New York Times cayó entre un 87% y un 93%. La compañía sabía que estaba socavando su propia cadena de suministro y siguió adelante.

El expediente, de 92 páginas, fue presentado de forma conjunta por el New York Times y otros medios demandantes para pedir al juez que resuelva a su favor antes del juicio. El Times demandó originalmente en diciembre de 2023; en 2024 se unieron al caso el New York Daily News, el Chicago Tribune y otros seis periódicos, según reportó The New York Post. Los demandantes reclaman "miles de millones de dólares" en daños estatutarios y reales.

Las frases más duras del expediente: lo que sus propios ejecutivos dijeron

El personaje más incómodo para Microsoft es Brent Hecht, director de Applied Science de la empresa. En documentos internos, Hecht calificó el scraping de noticias para entrenar modelos como el "mayor robo de mano de obra en la historia de la humanidad" y sostuvo que la defensa legal de Microsoft "convierte en una completa farsa la idea del fair use". Cuando un portavoz de Microsoft intentó distanciarse, argumentando que son "opiniones individuales" y no "la posición de la compañía", otro ejecutivo —Jordan Usdan, GM de Data Strategy en Microsoft AI— reconoció que Hecht fue contratado precisamente por sostener "puntos de vista asimétricos y académicos" sobre el futuro de los datos en IA.

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Hay más. Nick Turley, jefe de ChatGPT en OpenAI, escribió que sus productos son "en gran medida sustitutivos, punto" y que "serán cada vez más sustitutivos a medida que mejoren". Jack Clark, entonces director de política de OpenAI (y futuro cofundador de Anthropic), advirtió en 2020 al presidente Greg Brockman y al CEO Sam Altman que estaban "creando sistemas que sustituyen la mano de obra de la gente que define la cultura de la sociedad" y que OpenAI se convertiría en "el símbolo de cómo Silicon Valley irrumpe sin pensar en otras partes de la vida y deja un desastre en la alfombra".

Sobre el bypass de paywalls, un investigador le escribió a Brockman sobre un "hack para saltarse el paywall del New York Times" y Brockman respondió: "ah, qué bien". Otro documento interno reconocía que GPT-4 "memorizó una tonelada de datos y por eso será increíblemente bueno regurgitando" contenido casi verbatim. The Hollywood Reporter documentó que Bing Chat llegó a copiar 394 de las primeras 396 palabras de un artículo del Times sobre Hamas. Y cuando el CEO de Microsoft, Satya Nadella, testificó que "todo lo que esté detrás de un paywall debería ser licenciado" por quien quiera usarlo, un representante de OpenAI admitió no tener "conocimiento" de ningún esfuerzo por detectar y eliminar contenido de pago de los datos de entrenamiento.

Google Zero ya es real: cuánto tráfico han perdido los publishers

El "Google Zero" —el mundo donde llega poco o nada de tráfico desde buscadores— dejó de ser hipótesis en 2026. Un informe de Cloudflare reportado por Kotaku muestra que más del 50% del tráfico de internet ya no es humano y que entre junio de 2025 y abril de 2026 el tráfico humano cayó al menos un 35% en todas las industrias. Google concentra alrededor del 88% del tráfico de referral, por lo que cuando Gemini absorbe la respuesta dentro del AI Overview, el sitio fuente pierde la visita.

El caso más documentado es el de Reach, el mayor editor comercial de Reino Unido e Irlanda (detrás de Mirror, Express y Daily Record, entre más de 120 marcas). Según reportó Subscription Insider, Reach anunció el recorte de unos 220 puestos editoriales después de que sus referrals desde Google cayeran 55% interanual en el primer semestre de 2026, con page views en plataforma cayendo 40% e ingresos digitales -11,4%. Define Media Group, analizando una cartera de 64 sitios editoriales, encontró que el tráfico orgánico desde Google cayó 42% respecto a los niveles previos a la expansión de AI Overviews. La dirección ya es estructural, no cíclica.

Cloudflare también documentó que las peticiones de crawlers para entrenamiento de IA pasaron del 22% en primavera de 2025 al 52% en junio de 2026, y que Google usa un único crawler tanto para indexar como para entrenar, lo que obliga a los editores a elegir entre aparecer en el buscador o alimentar gratis a Gemini. La Competition and Markets Authority del Reino Unido forzó a Google a habilitar un opt-out en junio de 2026. En el resto del mundo, esa opción todavía no existe.

¿Cómo están respondiendo los medios? El nuevo mapa de licencias

La presión regulatoria y los juicios están empujando a los editores hacia acuerdos de licenciamiento con las grandes IA. Un estudio conjunto de Press Ranger y OtterlyAI publicado en agosto de 2026 cruzó 129,3 millones de citaciones en siete plataformas de búsqueda con IA contra 91 acuerdos confirmados entre empresas de IA y publishers, cubriendo 314 dominios. El hallazgo central: las páginas de publishers con acuerdo de licenciamiento con OpenAI reciben un 48% más de citaciones en ChatGPT que las de publishers sin acuerdo (10,2 vs 6,9 citaciones por página citada). Sumando las siete plataformas, la prima es del 46%.

El estudio también expone la concentración: cinco grupos mediáticos —Future plc, Forbes, People Inc., Condé Nast y Hearst— capturan el 69% de todas las citaciones a publishers licenciados. Las noticias representan solo el 7,2% del total de citaciones que hacen los modelos, y el resto se lo reparten contenido comercial, listas de "lo mejor de", guías de compra y reseñas de productos. Para los editores pequeños, el mensaje es claro: el licenciamiento ayuda, pero la oportunidad grande sigue estando en los nichos y en los formatos evergreen que las IA ya citan sin necesidad de contrato.

¿Qué significa esto para tu startup?

Si tu producto depende del tráfico orgánico desde Google o desde ChatGPT, el plan de negocio cambió. Las respuestas generadas ya no mandan al usuario al sitio; lo retienen en la interfaz de la IA. Tres acciones concretas:

  • Audita tu dependencia del referral de búsqueda. Si más del 40% de tus usuarios nuevos llegan desde Google, considera ese canal como en decadencia estructural. Reach perdió 55% interanual y sigue siendo un actor rentable; tu runway quizás no aguante la misma transición. Empieza a construir canales propios (lista de email, comunidad, producto con identidad).
  • Optimiza para ser citado, no solo para rankear. El estudio de OtterlyAI muestra que las IA citan sobre todo guías de compra, comparativas y listas evergreen. Si tu contenido responde "qué herramienta usar para X" o "mejor X para Y", tienes un activo citacional. Reescribe tu SEO pensando en lo que un LLM necesitaría extraer.
  • Evalúa un acuerdo de licenciamiento si tienes contenido único. Las citaciones de ChatGPT a publishers con acuerdo de OpenAI son 48% más altas. Si tu vertical es de las que las IA citan con frecuencia (legal, salud, finanzas, programación), un contrato puede valer más que el tráfico que estás perdiendo. Y si no quieres licenciar, al menos rastrea quién está citando tu contenido para negociar o, en su defecto, para construir defensivamente.

El expediente del caso NYT no es solo una batalla legal entre editores y big tech: es la prueba documental de que el modelo de la web abierta basado en"indexar y enviar tráfico a cambio de contenido" se rompió. Los fundadores que entiendan esto rápido y pivoten hacia distribución propia, contenido citacional y relaciones directas con usuarios van a salir mejor parados que los que sigan optimizando para un acuerdo que ya no existe.

Fuentes

🤖 La IA no es solo para leer sobre ella

En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.

👥 Aplicarla en la comunidad

Daily Shot: Tu ventaja táctica

Lo que pasó en las últimas 24 horas, resumido para que tú no tengas que filtrarlo.

Suscríbete para recibir cada mañana la curaduría definitiva del ecosistema startup e inversionista. Sin ruido ni rodeos, solo la información estratégica que necesitas para avanzar:

  • Venture Capital & Inversiones: Rondas, fondos y movimientos de capital.
  • IA & Tecnología: Tendencias, Web3 y herramientas de automatización.
  • Modelos de Negocio: Actualidad en SaaS, Fintech y Cripto.
  • Propósito: Erradicar el estancamiento informativo dándote claridad desde tu primer café.

📡 El Daily Shot Startupero

Noticias del ecosistema startup en 2 minutos. Gratis, todos los días.

Share to...