El caso que reabrió el debate: US$1.500M para entrenar IA con libros
En septiembre de 2025, el juez federal William Alsup ordenó a Anthropic pagar US$1.500M en un acuerdo con autores y editores que la acusaban de haber usado sus obras para entrenar a Claude. La cifra, confirmada por Reuters y recogida por eWeek, es el mayor acuerdo de copyright de la historia en Estados Unidos. Pero lo más importante del fallo no es el monto: el juez concluyó que entrenar un modelo de IA con libros puede considerarse fair use (uso legítimo), siempre que las obras se hayan obtenido legalmente. Lo que Alsup castigó fue el método: Anthropic descargó más de 7 millones de libros piratas desde bibliotecas digitales ilegales para crear su propio repositorio interno.
Según Gizmodo, cada obra cubierta por el acuerdo recibió aproximadamente US$3.000 antes de honorarios legales, y más del 91% de los autores y editores elegibles reclamaron su parte, según declaró Aparna Sridhar, directora legal adjunta de Anthropic. La aprobación final del acuerdo llegó en julio de 2026, a cargo de la jueza Araceli Martínez-Olguín, del Distrito Norte de California.
¿Qué dice la ley de copyright sobre entrenar una IA?
La respuesta corta: la ley de copyright de Estados Unidos no se ha actualizado desde 1976, según subrayan los abogados consultados por TechCrunch. Las cortes tienen que aplicar reglas de hace 50 años a tecnologías que no existían cuando se escribieron.
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidadEl meollo está en si el entrenamiento es «transformativo»: si el modelo usa las obras para crear algo nuevo en lugar de replicarlas. El juez Alsup comparó el entrenamiento con la lectura intensiva de un escritor que estudia a sus maestros, no con la copia de una obra. «Copyright se basa en copiar, no en usar o experimentar la obra», resumió la abogada Cathy Gellis, especialista en propiedad intelectual, en TechCrunch.
La otra vara de medir es si el producto final compite directamente con las obras originales. En el caso Thomson Reuters vs Ross Intelligence, el juez Stephanos Bibas falló en contra de Ross porque entrenó un sistema legal que competía directamente con Reuters. Para los autores que demandan a chatbots por generar novelas sintéticas, esa línea argumental todavía no ha prosperado en los tribunales.
¿Ganaron los autores con la sentencia contra Anthropic?
Depende a quién le preguntes. El acuerdo es récord, pero repartir US$1.500M entre cientos de miles de obras y luego descontar honorarios deja a cada creador con un cheque modesto. Charles Graeber, autor de best-sellers del New York Times y uno de los tres demandantes principales, dijo a NPR que está «orgulloso» del resultado pero también «mucho más pobre» tras dos años litigando.
Para las empresas de IA, el fallo fue una victoria disfrazada. «¿Qué son US$1.500M para una empresa que proyecta unos US$200.000M de ingresos anuales en 2028?», cuestionó Gellis en TechCrunch. Si Anthropic hubiera ido a juicio, la exposición potencial era mucho mayor: hasta US$150.000 por obra infringida intencionalmente, según la ley de copyright, según reportó eWeek.
La estrategia legal, sin embargo, quedó en un limbo. Como Anthropic firmó un acuerdo antes de apelar, la sentencia original de Alsup solo aplica como precedente en su distrito, no como estándar nacional.
Otros casos abiertos que pueden cambiar las reglas
El acuerdo con Anthropic es solo la primera ficha en caer. Google enfrenta una demanda colectiva en Nueva York de Hachette, Cengage, Elsevier y el autor Scott Turow, que según TechRepublic alegan que Gemini fue entrenado con millones de libros sin permiso. El documento cita un informe interno de Google que advertía de multas potenciales entre US$10.000M y US$100.000M si la práctica llegaba a litigarse.
Otros casos activos incluyen demandas contra OpenAI (consolidadas en una corte federal de Manhattan y que incluyen a autores como George R.R. Martin, John Grisham y Ta-Nehisi Coates), Meta y plataformas generativas de música e imágenes como Suno y Midjourney. En paralelo, el caso Thaler v. Perlmutter ya estableció que una obra 100% generada por IA no es protegible por copyright, lo que abre otro flanco: ¿cómo se demuestra qué porcentaje de un texto fue escrito o asistido por IA?
¿Qué significa esto para tu startup?
Si tu producto usa modelos de terceros como Claude, GPT o Gemini, el riesgo legal no es directamente tuyo, pero tampoco es cero. Los tribunales empiezan a separar dos cosas: cómo se entrenó el modelo y para qué se usa comercialmente. Lo segundo te toca a ti.
Acciones concretas que puedes tomar hoy:
- Audita la procedencia de tus datos de entrenamiento. Si entrenas un modelo propio o haces fine-tuning con datasets descargados de sitios como Library Genesis, LibGen o torrents, replicas exactamente lo que Anthropic hizo. Documenta el origen y la licencia de cada corpus antes de gastarte un centavo en GPU.
- Evalúa mercados de licenciamiento. Existen plataformas como Created by Humans y acuerdos directos con editores (Perplexity con Los Angeles Times y Le Monde, por ejemplo) que te permiten entrenar con obras compensando al autor. Es más caro, pero elimina la incertidumbre de una statutory damages que en EE. UU. puede llegar a US$150.000 por obra.
- Cuidado con competir con la fuente. La línea roja en los tribunales hoy no es tanto entrenar con obras protegidas como construir un producto que las sustituya comercialmente. Si tu SaaS genera ebooks, artículos o música con IA, documenta que tu propuesta de valor no compite directamente con catálogos protegidos. La demanda contra Google alega exactamente eso con Gemini.
La conclusión práctica: la ley todavía no resolvió la pregunta grande, pero las primeras decisiones privilegian la forma de obtención sobre el uso en sí. Para una startup hispanohablante que entrena o ajusta modelos, la jugada defensiva más barata en 2026 es pagar por datos limpios antes que pagar después por datos sucios.
Fuentes
- Is it legal to train AI models on copyrighted books? It’s complicated – TechCrunch
- Anthropic Wins Final Approval For $1.5B AI Copyright Settlement With Authors – eWeek
- Google Hit With New Copyright Lawsuit Over Gemini AI Training – TechRepublic
- The AI Copyright Lawsuits Have Finally Produced an Actual Payout – Gizmodo
- Authors have mixed feelings about the $1.5B Anthropic copyright infringement ruling – NPR/WWNO
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidad













