Un abogado con 40 años de carrera confió en ChatGPT y perdió el caso de su cliente
Stephen Aarons, defensor privado con sede en Santa Fe, presentó ante el Tribunal Supremo de Nuevo México un escrito de apelación en un caso de asesinato que incluía el testimonio inventado de un policía y de varios testigos que jamás declararon en el juicio original. La corte lo declaró en desacato, le impuso una multa de US$5.000 y remitió el caso a la junta disciplinaria del colegio de abogados para eventuales sanciones mayores.
El caso, reportado por Reuters y publicado por Ars Technica esta semana, no es la primera vez que ChatGPT mete en problemas a un profesional del derecho. Pero sí es el primero documentado en el que un recurso de apelación criminal incluye testigos ficticios generados por IA, no solo citas jurisprudenciales falsas. El escrito contenía declaraciones atribuidas al «Oficial Michelle Amarillo», al «Oficial Sanchez», a Manal Al-Jibury y a Teresa Márquez, todos personajes creados por el modelo. Aarons admitió además que citó de manera inexacta sentencias reales.
¿Qué pasó exactamente?
Aarons tomó el caso en marzo de 2025 para apelar la condena a prisión perpetua de Oscar Renee Sandoval, declarado culpable en febrero de 2025 del asesinato de Shiereen Al-Jibury, su pareja y madre de sus hijos. Para preparar el escrito, según declaró ante la corte el 21 de agosto, el abogado subió a ChatGPT la transcripción automatizada del juicio (obtenida con Rev.com), el expediente del caso, el pliego de cuestiones y parte del discovery.
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidadAarons usó la versión de ChatGPT basada en el modelo OpenAI o3, lanzado a principios de 2025. En la audiencia reconoció que dio por bueno el resumen porque «asumí que iba a generar un resumen a prueba de balas de los procedimientos», según recoge el expediente. La corte respondió que esa presunción es incompatible con el código deontológico: un abogado firma el escrito, y lo que firma lo avala.
Una escalada en un patrón que ya tiene tres años
El episodio se inscribe en una serie creciente de sanciones contra abogados por confiar en outputs de IA sin verificación. El caso fundacional, Mata v. Avianca (mayo de 2023), terminó con una multa de US$5.000 contra los abogados que presentaron un escrito de ChatGPT con casos inexistentes en un tribunal federal de Nueva York. Desde entonces, decenas de profesionales han sido sancionados en EE.UU. y el fenómeno ya cruza el Atlántico.
Según un relevamiento atribuido a GovTech y recogido por Yahoo, solo en Nuevo México se han detectado alucinaciones de IA en al menos siete demandas desde 2023. Un reporte de AI Business Weekly citado por Hoodline estima tasas de alucinación de entre 17% y 34% para las principales herramientas de investigación jurídica.
Réplicas en España: de Canarias a Navarra
En España los tribunales ya abrieron investigaciones propias. La Sala de lo Penal del Tribunal Superior de Justicia de Canarias abrió en enero una pieza separada contra un abogado que incluyó jurisprudencia inexistente y un supuesto informe del CGPJ sobre credibilidad del testimonio infantil que nunca existió, según El Periódico.
El Tribunal Superior de Justicia de Navarra investigó en septiembre de 2024 a un letrado que, tras usar ChatGPT-3 para preparar una querella, citó un artículo del código penal colombiano creyendo que era español. El Tribunal Constitucional impuso en septiembre de 2024 un apercibimiento a un abogado de Barcelona que presentó 19 supuestas citas entrecomilladas de sentencias inexistentes. La Audiencia Provincial de Alicante denunció ante el colegio profesional a otro letrado por citas inventadas del Tribunal Supremo en un caso de Segunda Oportunidad.
La corte deja claro quién responde
El fallo de Nuevo México es especialmente didáctico en quién carga con la responsabilidad. La magistrada C. Shannon Bacon le preguntó a Aarons si «ve las noticias, escucha la radio, lee algo sobre lo que pasa en el mundo», porque el problema de los abogados que citan alucinaciones de IA «es una noticia de portada todos los días». Y le recordó el principio rector que también repiten el CGAE y el CCBE: la IA no tiene responsabilidad civil ni deontológica, pero el abogado que firma sí.
Bacon añadió la dimensión de cliente: «Su cliente es quien está sufriendo. Usted ha presentado un escrito al que no podemos dar credibilidad, y su cliente es quien paga las consecuencias de esto mucho más de lo que usted va a pagar jamás». La Chief Justice Julie Vargas cerró la puerta a cualquier intento de convertir el caso en debate de política pública: «No me importan ahora las preocupaciones de política. Me importa qué vamos a hacer con su cliente, que sigue preso».
La corte ordenó a la defensoría pública nombrar un nuevo abogado (Kim Chavez Cook fue asignada el 2 de septiembre), eliminó todos los escritos previos del expediente y dijo que el caso se resolverá en el término judicial 2026-27.
Qué significa esto para tu startup
Aunque el caso es de una firma de defensa criminal, el patrón es el mismo que enfrenta cualquier founder que adopta IA generativa para escribir contratos, correos a clientes, propuestas comerciales o pleadings legales: el output de un LLM no es evidencia, es borrador. La sanción ya no llega solo cuando el documento se presenta formalmente, llega cuando un juez, un regulador o un cliente descubre la incoherencia.
Tres acciones concretas que cualquier startup puede tomar esta semana:
- Auditar todo contenido generado por IA que salga de tu empresa. Especialmente documentos legales, regulatorios o financieros. Lo que un abogado americano olvidó verificar le costó a su cliente la oportunidad de apelar; en tu empresa puede costar un cliente enterprise o un inversor que decide no seguir.
- Definir un protocolo de «IA + humano verificador». La guía del Consejo de la Abogacía Europea (CCBE, octubre de 2025) pide exactamente eso: verificar resultados, entender capacidades y limitaciones, y registrar contextos de uso. Es un estándar trasladable a cualquier producto SaaS que use LLMs.
- Considerar verticales específicos en lugar de IA generalista. Herramientas jurídicas especializadas como GenIA-L (Lefebvre), Aranzadi o vLex prometen grounding en fuentes verificables; la IA generalista sigue siendo donde se concentran las alucinaciones de entre el 17% y el 34%.
El caso Aarons es una historia de negligencia individual, pero también es un termómetro: cada vez que un profesional firma sin verificar, el siguiente caso se vuelve más caro para su cliente. En tu startup, el cliente que paga por esa equivocación puede ser el próximo contrato enterprise o el próximo lead que estaba a punto de cerrar.
Fuentes
- ChatGPT-using lawyer punished for citing fake testimony from made-up witnesses | Ars Technica (fuente original)
- Lawyer blames ChatGPT for fake witnesses in murder case | Detroit News / Reuters
- Stephens County Judge Faces Discipline Over ChatGPT-Written Court Order | Hoodline
- Court Sanctions Lawyer Over ChatGPT-Fabricated Murder Testimony | Yahoo / Reuters
- El uso de la IA y sus «alucinaciones» causan estragos en el ámbito jurídico | La Vanguardia
- Jurisprudencia «inventada» y riesgo de datos en abierto: los casos de mala praxis por uso de IA llegan a los tribunales | El Periódico
- Los abogados pueden ahorrar hasta 307 horas de trabajo al año con la IA jurídica GenIA-L de Lefebvre | Lawyerpress
🤖 La IA no es solo para leer sobre ella
En la comunidad la aplicamos: automatización, agentes IA y herramientas reales para emprender, no solo para informarte.
👥 Aplicarla en la comunidad













