El libro C’était ça ou mourir ha recibido el premio de novela Fnac, el Medusa y algún otro, lleva más de 35.000 ejemplares vendidos y está entre los candidatos a los grandes galardones del otoño literario. Desde este miércoles, el libro tiene otro mérito: es el primer gran escándalo francés de literatura presuntamente hecha con inteligencia artificial (IA). Su autor, el canadiense de origen haitiano Thélyson Orélien, lo niega. Dice que acabó el primer borrador en 2019 (ChatGPT salió a finales de 2022) y que su tradición literaria “haitiana y caribeña” puede haber causado confusión porque “las imágenes, las repeticiones y el ritmo transmiten una palabra viva”, ha explicado en medios franceses. Su editorial, Grasset, de momento le apoya. La denuncia contra Orélien surgió de una cuenta anónima en X.
Este programa ha provocado un revuelo literario en Francia tras usarse para identificar como artificial un libro de éxito
El libro C’était ça ou mourir ha recibido el premio de novela Fnac, el Medusa y algún otro, lleva más de 35.000 ejemplares vendidos y está entre los candidatos a los grandes galardones del otoño literario. Desde este miércoles, el libro tiene otro mérito: es el primer gran escándalo francés de literatura presuntamente hecha con inteligencia artificial (IA). Su autor, el canadiense de origen haitiano Thélyson Orélien, lo niega. Dice que acabó el primer borrador en 2019 (ChatGPT salió a finales de 2022) y que su tradición literaria “haitiana y caribeña” puede haber causado confusión porque “las imágenes, las repeticiones y el ritmo transmiten una palabra viva”, ha explicado en medios franceses. Su editorial, Grasset, de momento le apoya. La denuncia contra Orélien surgió de una cuenta anónima en X.
El problema de Orélien es que ya ha quedado atrás la época en que ningún detector de texto generado por IA era verdaderamente eficiente cazando culpables. Porque ahora hay uno que acierta mucho: Pangram, lanzado en 2024 en EE UU. Y además es multilingüe. “Pangram funciona bien en otras 20 grandes lenguas aparte del inglés, y eso incluye el español y el francés”, explica Max Spero, cofundador de Pangram, a EL PAÍS.
Las cifras de aciertos que da Pangram son de más del 99%: solo 1 de cada 24.000 muestras sale mal, según la compañía. La comunidad científica también ha comprobado que Pangram funciona mejor que las alternativas. “No hay motivo para pensar que estos modelos no funcionan, porque están entrenados con una cantidad enorme de datos, tanto escritos por humanos como generados por IA”, dice Tuhin Chakrabarty, profesor de Ciencias de la Computación en la Universidad Stony Brook (EE UU) y especialista en texto generado con IA.
Pangram es también IA. Es un modelo entrenado para detectar textos generados por máquinas. Se le muestran enormes cantidades de artículos, novelas o ensayos humanos y otros similares generados por IA hasta que capta las diferencias de estilo. Desde 2024, la empresa ha ido lanzando versiones nuevas de su software. Se puede hacer alguna prueba gratis, pero funciona con suscripción. En agosto de 2025 tuvo solo 7.000 usuarios; el mes pasado fueron ya 222.000.

La profesora Marzena Karpinska, de la Universidad Simon Fraser (Canadá), comprobó los aciertos de una versión anterior en un artículo científico de 2025 sobre cómo la gente que más usa ChatGPT son los mejores detectando luego su estilo de escritura: “La versión actual de Pangram, la 4, es mucho más precisa. Es como la diferencia entre GPT-4 y GPT-6. Se han esforzado para que su herramienta no tenga sesgos que sí se ven en otras, como etiquetar como IA los textos de personas cuyo inglés no es su lengua materna”, explica.
Las dudas con Orélien no son solo por un escritor. El mundillo literario francés ha regado de elogios y premios la novela. ¿Cómo puede ser que Pangram diga con rotundidad que la novela de Orélien se ha generado con IA y nadie se haya dado cuenta? Porque no usan la IA y no saben cómo escribe, cree Chakrabarty. “Los críticos odian la IA. Nunca han leído cómo es la prosa de la IA. ¿Cómo van a reconocerlo? Una razón por las que nuestras instituciones no consiguen detectar la prosa de IA es que no están familiarizadas con ella. La gente como yo, que se dedica a esto las 24 horas, no forma parte de jurados de premios. Yo leía esta novela francesa y tiene los mismos patrones que la mala ficción en inglés: paralelismos negativos, metáforas mezcladas, clichés. Todo muy recargado”, explica. En EE UU también ha habido varias polémicas con libros y artículos detectados por Pangram.
Desde que empezó la popularización de estas herramientas ha habido una carrera para esquivar su detección: añadir erratas, “humanizar” frases con otros softwares y buscar prompts que engañen al detector, como por ejemplo pedirle que imite el estilo de algún escritor célebre. Este periódico ha probado ejemplos de textos obtenidos de Claude, pero con el estilo de Javier Marías o David Trueba: Pangram ha sentenciado el 100% de IA. “Yo he hecho este experimento montones de veces”, dice Chakrabarty. EL PAÍS también ha probado con los dos primeros capítulos del libro de Santos Cerdán, La caída, y Pangram daba entre 70% y 100% de confianza en que es IA. “Son cifras suficientes para decir que ha habido un uso intensivo de IA”, dice Spero. Cerdán no ha respondido a mensajes de este periódico.
Las artimañas más sofisticadas requieren de conocimientos informáticos poco habituales entre escritores. “Si haces un ajuste fino de un modelo con los libros de un escritor famoso, que es algo que yo he hecho, igual es posible engañar. Pero nadie hace eso porque es muy caro y requiere muchos conocimientos técnicos. Estos escritores no son informáticos, sino que entran en ChatGPT, le dan un prompt y le piden que escriba cada capítulo”, dice Chakrabarty.
Un gran problema de esta herramienta es que los autores pueden negar eternamente el uso de IA y es imposible de demostrar. Sin confesión, todo queda en sospecha. Y también puede provocar una caza de brujas si hay algún falso positivo. Estos días, las redes en Francia se han llenado del ya célebre gráfico de Pangram con gente diciendo que textos anteriores al lanzamiento de ChatGPT se han generado con IA. En un caso, Spero ofreció 100 dólares al autor de una de esas capturas, un célebre periodista, para que le diera el texto que había usado. El periodista, al menos en público, no se lo mandó.
Pangram detecta peor los textos breves, de solo una o unas frases. Cuantos más párrafos de muestra, más fiable. El uso masivo en todos los capítulos de un libro es una enorme bandera roja, casi indefendible: “Pangram funciona mejor con textos largos. Por debajo de 50 palabras no es fiable, y cuanto más texto haya, mejor. Del mismo modo, funciona mejor con escritura creativa que con recetas, por ejemplo”, dice Karpinska, que hizo una comprobación extra con Orélien, cuya defensa es que su estilo es distinto, lejos de las tradiciones dominantes. “Hay quien ha planteado que el problema es el francés haitiano específico del autor. Encontré un artículo suyo de 2015 y lo analicé. El resultado fue que era humano, así que no parece, al menos con este ejemplo, que Pangram esté detectando alguna particularidad del dialecto”, añade Karpinska.
EL PAÍS
