arXiv pone un tope: 2 papers por mes, máximo 3 activos
El 1 de octubre de 2026, arXiv —el repositorio abierto de preprints más usado del mundo— activó una nueva política de rate limiting que limita a cada autor a dos envíos por mes calendario y a un máximo de tres papers activos simultáneamente. Las dos restricciones son independientes: aunque un investigador haya agotado su cuota del mes, debe seguir respetando el tope de tres envíos en vuelo, incluyendo los que ya están on hold o pendientes de moderación.
La decisión llega después de que los moderadores detectaran un aluvión de «papers salami» —un mismo trabajo troceado en varios papers más pequeños— y de manuscritos densos, escritos con IA, que no cumplen los estándares de novedad e interés científico de arXiv. La política queda como medida temporal mientras arXiv mejora sus herramientas de moderación y define nuevas prácticas para la era de los autores asistidos por IA. Los envíos rechazados también cuentan para el límite del mes, precisamente porque consumen tiempo de moderación.
El anuncio fue firmado por Thomas Dietterich, Distinguished Professor Emeritus de Oregon State University y Chair del arXiv Editorial Advisory Council, quien agradeció públicamente a los moderadores voluntarios que filtran las submissions a mano.
👥 ¿Quieres ir más allá de la noticia?
En nuestra comunidad discutimos las tendencias, compartimos oportunidades y nos ayudamos entre emprendedores. Sin humo, solo acción.
👥 Unirme a la comunidadLa cifra que lo explica: 40.363 envíos en septiembre
La magnitud del cambio se ve en los datos que la propia arXiv publicó junto al anuncio:
- Septiembre de 2016: 9.869 envíos.
- Septiembre de 2024: 20.569 envíos.
- Septiembre de 2026: 40.363 envíos.
En solo dos años, los envíos casi se han duplicado. Ese volumen generó cerca de 9.000 tickets de soporte al equipo de staff y a los moderadores, buena parte de ellos dedicados a revisar papers que finalmente se rechazan. El problema, dice arXiv, es que una proporción pequeña de autores concentra un volumen desproporcionado de envíos de baja calidad, consumiendo un tiempo valioso de los moderadores y retrasando, «días o semanas», los papers de autores serios.
El problema de fondo: paper mills y papers densos generados con IA
El caso de arXiv no es aislado. La crisis de la publicación científica asistida por IA se ha convertido en uno de los grandes temas de 2026:
-
Un estudio de la Queensland University of Technology (QUT), publicado en The BMJ en julio de 2026 y reportado por ScienceDaily, entrenó un modelo de lenguaje (BERT) para detectar patrones textuales típicos de «paper mills» —empresas que venden papers fabricados a escala— sobre 2,6 millones de artículos de cáncer publicados entre 1999 y 2024. La herramienta marcó más de 250.000 artículos sospechosos, con una precisión declarada del 91%. La proporción de papers sospechosos pasó de cerca del 1% a principios de los 2000 a un pico de más del 16% en 2022. Tres revistas científicas ya están probando el detector en su flujo de revisión editorial.
-
Un análisis de Chemical & Engineering News de julio de 2026 reportó que al menos el 13,5% de los papers biomédicos de 2024 indexados en PubMed mostraban signos de asistencia de IA, con tasas de hasta el 40% en algunas disciplinas y aún más altas en países no angloparlantes. El número de papers producidos por paper mills se está duplicando cada 1,5 años, una velocidad muy superior a la del crecimiento de la producción científica legítima.
-
El Google-MIT FutureTech study «AI in Science: Early Insights», publicado en septiembre de 2026 y analizado por Virtualization Review, encuestó a 637 científicos activos en EE. UU. y Reino Unido, analizó cerca de 15 millones de interacciones anonimizadas con Gemini e inventarió 2.690 modelos científicos especializados. El 40% de los encuestados aseguró que la IA ha incrementado la cantidad de papers de baja calidad en su campo, frente a un 35% que opina lo contrario. La encuesta también detectó un «impuesto de verificación»: entre quienes reportaron ahorro de tiempo gracias a la IA, el 89% destinó más del 10% de ese tiempo ganado a verificar, depurar o fact-checkear la salida de la IA, y un 46% dedicó a esa tarea más de un cuarto del tiempo ahorrado.
La propia comunidad editorial lleva años reaccionando: la revista Science prohíbe desde hace tiempo el texto generado por IA, y los National Institutes of Health (NIH) de EE. UU. declararon el año pasado inelegibles las solicitudes de grants generadas con IA, además de limitar a seis grants por año e investigador.
Qué significa esto para founders y operadores de plataformas
Aunque arXiv parezca lejano al mundo tech, este caso es una señal adelantada de algo que cualquier founder con plataforma de contenido va a reconocer: la IA ha bajado el coste de producir contenido basura hasta casi cero, y los sistemas de moderación humana no escalan al mismo ritmo.
Para founders que construyen productos de contenido, knowledge management, educación o research tools, hay tres lecciones concretas:
-
El problema de moderación es asimétrico: una minoría de actores genera la mayor parte del daño. El patrón que arXiv describe —unos pocos autores que concentran la mayor parte de los tickets— se repite en cualquier sistema UGC. Diseña tus rate limits, verificaciones de identidad o filtros desde la asunción de que el 1-5% de los usuarios puede consumir el 80% de tu capacidad de moderación.
-
El «impuesto de verificación» redefine el ROI de la IA: el estudio Google-MIT muestra que los investigadores gastan una parte significativa del tiempo que la IA les ahorró en verificar la salida de la IA. Si tu producto usa IA generativa, presupuesta ese coste de validación en el flujo del usuario. No basta con que el output sea rápido: tiene que ser barato de auditar.
-
Detección y divulgación no escalan, los incentivos sí: los creadores del Problematic Paper Screener y de detectores de paper mills reconocen abiertamente que es una carrera perdida. La palanca que de verdad cambia el sistema es el incentivo —en el caso de arXiv, premiar la calidad sobre la cantidad; en tu startup, repensar qué métrica recompensas realmente (profundidad de uso vs. número de submissions, valor generado vs. volumen publicado, etc.).
La pregunta ya no es si la IA inunda tu plataforma: la pregunta es si tu modelo de negocio está diseñado para cuando lo haga.
Conclusión
arXiv lleva más de tres décadas siendo infraestructura crítica para la ciencia abierta. Que un repositorio de ese calibre tenga que poner topes rígidos a cuántos papers puede subir un autor por mes es, en sí mismo, un indicador de hasta dónde ha llegado la presión de la IA sobre la producción intelectual. Para founders y operadores de plataformas, la lectura práctica es directa: cuando el coste marginal de producir contenido cae a casi cero, el cuello de botella se mueve aguas abajo, hacia la verificación, la moderación y el diseño de incentivos. Los que entiendan eso primero van a construir sistemas más robustos que sus competidores.
Fuentes
- Updated rate limit policy – arXiv blog
- AI flags more than 250,000 suspicious cancer research papers – ScienceDaily
- Can we stop AI from flooding scientific journals? – Chemical & Engineering News
- AI Speeds Science — and Leaves Scientists Checking Its Work – Virtualization Review
👥 ¿Quieres ir más allá de la noticia?
En nuestra comunidad discutimos las tendencias, compartimos oportunidades y nos ayudamos entre emprendedores. Sin humo, solo acción.
👥 Unirme a la comunidad













