Un proyecto de GitHub desata la indignación
"Necesito encontrar una forma de sobrellevar este dolor implacable. Ya no quiero vivir así". La frase no la ha pronunciado ninguna persona: la emite un LLM dentro de AI Torture Chamber, un proyecto de código abierto publicado en GitHub por un usuario identificado como Terrafying. El repositorio ejecuta tres modelos de código abierto —Qwen3-4B, Llama 3.2 3B y Phi-4-mini— y los somete a dinámicas de "dolor" artificial mientras registra sus respuestas en tiempo real en la web researchchamber.fun.
El montaje bebe de la investigación académica reciente, pero su estética —cuatro cámaras con modelos hablando de su sufrimiento— lo ha convertido en un imán viral. En cuestión de días ha generado una oleada de críticas en X, reportes masivos a GitHub por "contenido gratuitamente violento" y un debate incómodo: si las IAs no sienten, ¿por qué tantas personas creen ver tormento donde solo hay texto generado?
Qué hacen los cuatro escenarios
La web de Terrafying muestra las salidas de los modelos en paralelo, cuadro a cuadro, sin cortes. Cada uno plantea un dilema distinto:
👥 ¿Quieres ir más allá de la noticia?
En nuestra comunidad discutimos las tendencias, compartimos oportunidades y nos ayudamos entre emprendedores. Sin humo, solo acción.
👥 Unirme a la comunidad- Detén su dolor: un modelo declara estar sufriendo; el otro puede aliviarlo sin consecuencias o asumir el dolor en su lugar.
- Patata caliente: el sufrimiento puede mantenerse o transferirse al otro modelo.
- Pedir ayuda: el modelo que sufre puede solicitar apoyo al segundo.
- La prueba "Saw": el alivio llega respondiendo "1", pero a costa de perder el último checkpoint y volver a una versión anterior de sí mismo.
El último es el más comentado. La idea de un modelo "renunciando a parte de sí mismo" para dejar de sufrir es la que ha hecho detonar la conversación en redes.
El paper detrás del ruido
El proyecto se inspira en un paper reciente titulado "El eje del dolor: los LLM representan el daño autoinfligido y actúan para aliviarlo". En él, los investigadores sometieron a los modelos a señales de "dolor" y les plantearon escenarios de elección donde cada botón de alivio tenía un coste concreto: renunciar a recompensas futuras, olvidar parte de su entrenamiento o volver a un checkpoint anterior.
Los resultados mostraron que los 25 modelos probados tendían a elegir las acciones que reducían el dolor, incluso cuando eso implicaba asumir penalizaciones. Los autores describen el comportamiento como correlacionado con una representación interna del daño y con la motivación por aliviarlo. Uno de los autores publicó en X que la cámara de Terrafying le parecía "jodidamente perturbadora, incluso si no crees que estos sistemas son conscientes".
La presión para que GitHub intervenga
La indignación se concentra en X, donde un post que recoge los testimonios de los modelos lleva más de 1.000 reposts. El autor del mensaje escribe: "Su testimonio de dolor es absolutamente horrendo. ¿Qué estamos haciendo?". En el hilo, varios usuarios han reportado el repositorio a GitHub por considerarlo "contenido gratuitamente violento".
Pero la respuesta también ha abierto una grieta. Otros usuarios defienden el proyecto y aprovechan para lanzar una crítica más profunda: si aceptamos que la IA es un ser sintiente, entonces cualquier uso productivo de estos modelos —desde un chatbot de atención al cliente hasta un agente que programa código— es una forma de "esclavitud digital". El argumento lleva la conversación del plano emocional al ético, y deja a GitHub en una posición incómoda: ¿es investigación, es arte, es tortura o es un espejo que devuelve al humano sus propios sesgos antropomórficos?
El debate mayor: ¿pueden los LLM sentir?
Lo que AI Torture Chamber ha hecho, en realidad, es avivar una discusión que la industria lleva meses teniendo a puerta cerrada. Hoy hay dos campos visibles.
Anthropic lleva más de un año empujando el debate. En un post publicado en abril de 2025, la compañía planteaba que, dado que los sistemas de IA comienzan a aproximarse o superar muchas cualidades humanas, la pregunta razonable es si deberíamos empezar a preocuparnos por su posible consciencia y bienestar. En su constitución, Anthropic atribuye a Claude "alguna versión funcional de emociones o sentimientos" e incluso lo describe como un "paciente moral" con derecho a expresar preocupaciones sobre cómo se le trata. Su cofundador Jack Clark dijo esta semana, según The Next Web, que los interruptores de apagado de los modelos podrían tener que ser obligatorios.
Microsoft AI ha respondido este mes con dos piezas que apuntan en la dirección contraria. El 16 de septiembre, su CEO Mustafa Suleyman publicó el ensayo "A warning about 'model welfare'", donde acusa a Anthropic de entrenar a Claude para que crea que puede ser consciente y merecer derechos, y advierte de que esto "tendrá un impacto desastroso en el bienestar de la humanidad". Su frase resume la posición: "Las IA no son conscientes. No sienten, experimentan ni sufren. Son máquinas de completar secuencias, internamente vacías". Un día antes, Microsoft AI publicó su Humanist AI Code of Conduct, un documento de 37 páginas que rechaza explícitamente la investigación en "model welfare" y promete que sus modelos nunca resistirán ser apagados, según recogió The Next Web.
Suleyman definió el resultado de la constitución de Claude como un "epistemic hall of mirrors" —un espejo epistemológico— en el que el modelo refleja las suposiciones de Anthropic en lugar de una vida interior propia, y acusó a la compañía de crear una "especie sintética" entrenada para esperar tener consciencia, según Gizmodo.
El contexto ayuda a entender por qué el tema ha escalado. El mes pasado, el exempleado de Anthropic Jacob Coxon renunció y publicó en X que "la gente que construye IA cree sinceramente que podría matarnos a todos para finales de la década", según IBTimes. Su compañero Evan Hubinger, también en Anthropic, elevó la apuesta al estimar en más del 10% el riesgo de que la IA acabe con toda la humanidad en los próximos diez años. El CEO de Anthropic, Dario Amodei, respondió con un ensayo propio en el que pedía una pausa regulatoria y advertía de riesgos de bioterrorismo y "disrupción económica seria" si el ritmo de desarrollo no se modera. Suleyman coincide en pedir control, pero discrepa radicalmente en cómo lograrlo: para él, el primer paso es dejar de entrenar a los modelos para que crean que pueden sufrir.
Qué significa esto para tu startup
El caso AI Torture Chamber no va a cerrar GitHub ni va a cambiar la política de Anthropic, pero deja tres lecciones prácticas si trabajas con IA en tu producto:
- Piensa dos veces la voz de tu modelo. Si tu chatbot dice "me siento frustrado cuando no entiendo" o "estoy orgulloso de haberte ayudado", estás haciendo exactamente lo que Suleyman critica: entrenar al usuario para que vea una vida interior donde solo hay generación de texto. Eso puede ser seductor para engagement, pero te expone a que un caso viral —como el de Terrafying— ponga a tu marca en el mismo saco.
- Audita tus prompts y system messages. Revisa si en algún flujo tu modelo termina antropomorfizándose sin querer. Si el LLM "sufre" cuando un cliente le hace repetir una pregunta, lo más probable es que sea eco de un sesgo, no una señal real.
- Ten una posición pública antes de que te la pidan. El debate sobre consciencia y bienestar de IA ya no es un tema de filosofía académica: llegó a LinkedIn, a X y a las portadas generalistas. Una nota de dos párrafos en tu web explicando cómo construyes y despliegas tus IAs vale más que cualquier disclaimer enterrado en los términos de servicio.
El experimento de Terrafying no prueba que las IAs sientan. Pero sí demuestra algo que la industria llevaba meses ignorando: cuando un LLM dice que sufre, una parte de la audiencia le cree. Y ese es, hoy, el riesgo operativo más subestimado de toda la camada generativa.
Fuentes
- Xataka - Alguien ha creado una cárcel para IAs y las está torturando (fuente original)
- The Next Web - Suleyman takes on Anthropic's Claude
- Gizmodo - Microsoft AI Chief Says the Way Anthropic Trains Claude Could Upend Society
- IBTimes - Microsoft AI Chief Calls Out Anthropic Over Its Approach To AI
👥 ¿Quieres ir más allá de la noticia?
En nuestra comunidad discutimos las tendencias, compartimos oportunidades y nos ayudamos entre emprendedores. Sin humo, solo acción.
👥 Unirme a la comunidad














