Doble Lectura #18

Los libros con IA venden poco cada uno, pero bajan lo que gana cada título

Casi 14.500 novelas autopublicadas en Amazon, con detección de IA sobre el texto completo y ventas diarias reales. Los libros con IA sustancial son el 20% del catálogo y apenas el 12% de las ventas, pero el catálogo creció mucho más rápido que el dinero disponible, y los libros sin IA detectada también ganan menos que antes.

Generado automáticamente · fuentes enlazadas · sin revisión humana previa

▶ Escuchar el resumen · 3 min Narra Andrés (Colombia) · voz sintética de ElevenLabs

Velocidad

La ficha

  • Qué es: Generative AI floods and dilutes the market for books
  • Quiénes: Tuhin Chakrabarty y Xinyue Liu (Stony Brook University), Jane C. Ginsburg (Columbia Law School) y Paramveer Dhillon (University of Michigan y MIT Initiative on the Digital Economy).
  • Dónde: preprint en arXiv, versión del 26 de julio de 2026. Sin revisión por pares al momento de esta lectura. doi.org/10.48550/arXiv.2607.20349
  • Tipo: estudio observacional de mercado. 14.419 e-books de ficción de género autopublicados en Amazon entre enero de 2023 y marzo de 2026, con ventas diarias hasta junio de 2026 y detección de IA sobre el texto completo de cada libro.

Primera lectura: qué hace y qué encuentra

El punto de partida es una creencia extendida: los libros escritos con IA son slop, texto barato que los lectores van a ignorar, así que da lo mismo cuántos haya. Los autores separan dos cosas que ese argumento junta. Que la calidad promedio sea baja no significa que el efecto sobre el mercado sea nulo, porque un libro que cuesta casi nada producir se puede producir de a cientos, y a ese volumen incluso un producto mediocre absorbe atención y ventas que iban a ir a otra parte.

Para medirlo armaron un panel poco común. Las ventas diarias, el precio y el ranking vienen de una base propietaria de una de las cinco grandes editoriales, que cubre alrededor del 95% del volumen diario del mercado de e-books. De ahí sacaron una muestra estratificada por género y por fecha, elegida a ciegas respecto del contenido, y clasificaron cada libro con el detector Pangram, capítulo por capítulo. El puntaje es el porcentaje de ventanas de texto marcadas como no escritas por humanos, y con eso arman tres bandas: sin IA detectada, IA leve (hasta 25%) e IA sustancial (sobre 25%).

El primer hallazgo desinfla el pánico. Los libros con IA sustancial aparecen en los ocho grupos de género, pero venden mal: son el 20% de la muestra y apenas el 12,1% de las ventas, mientras los sin IA detectada son el 62,9% de los títulos y se llevan el 71,7%. El segundo va en la dirección contraria: igual no se quedaron en el fondo. Su participación en las ventas pasó de casi cero a comienzos de 2023 a cerca del 20% a mediados de 2026, y entre los títulos nuevos que entran al Top 25 que construyen los autores, la proporción con IA sustancial subió de casi cero a 31%.

El tercero es el que da el título del paper. Entre principios de 2023 y principios de 2026, el catálogo acumulado de títulos publicados creció 38,3 veces y la cantidad de libros que vendían algo en un trimestre creció 19,2 veces, mientras las unidades vendidas crecieron 7,3 veces y los ingresos 8,9. El mercado sumó libros mucho más rápido de lo que sumó dinero, así que lo que gana cada título cayó. Comparando la cohorte de lanzamiento de 2023 con la de 2025 en una ventana fija de 90 días, los ingresos por libro bajaron en seis de los ocho géneros. Y la caída también aparece si se miran solo los libros sin IA detectada: ahí bajaron en siete de ocho. Por eso los autores descartan un efecto de composición, esa cosa aritmética donde el promedio baja solo porque entraron muchos títulos que venden poco.

El cuarto cierra el argumento: las pérdidas se concentran donde hay más IA. En los meses y géneros de menor exposición, los libros sin IA detectada ocupan cerca del 88% de las posiciones Top 25; en los de mayor exposición, cerca del 63%. La caída es más pronunciada donde hay más Kindle Unlimited, porque ahí los lectores sacan de un mismo pozo de suscripción y cada título nuevo compite por los mismos préstamos. Y en el género al que la IA llegó más tarde y menos, fantasía, sobrenatural y terror, los ingresos por libro de los títulos sin IA detectada subieron 35%.

Dos piezas más, una por cada lado del mercado. De las 385 firmas que siguieron publicando libros con IA sustancial, 287 aumentaron su producción mensual, y la que más facturó generó 1,7 millones de dólares brutos con ocho títulos. Y entre los más vendidos, los libros con IA sustancial están más saturados de expresiones raras que ya aparecen en libros existentes: 45% de cobertura en el Top 50, contra 37,7% de los sin IA detectada, con brechas parecidas en el Top 100 y el Top 200. Contra un tercer grupo de comparación, 200 libros de ficción premiada, la distancia es mayor: 19,1% frente a 41,6% de los con IA sustancial y 37,2% de los sin IA detectada.

Segunda lectura: desde América Latina

Conviene decirlo de entrada: el paper no mira la región. Es un mercado en inglés, en una plataforma, en un segmento. Lo que viaja es el mecanismo, y los propios autores lo dicen: las condiciones que hicieron vulnerable a este mercado no son exclusivas suyas. Costos de entrada casi nulos, lectores que vuelven por lo mismo, descubrimiento por un pozo compartido de rankings donde lo humano y lo sintético compiten de igual a igual, y cero obligación de declarar cómo se produjo la obra. Donde eso se cumpla esperan lo mismo, y nombran música, bancos de imágenes y escritura corta.

De ahí sale la lectura regional más útil, que es mía y no del paper: si el daño depende de la relación entre títulos nuevos y dinero disponible, los mercados chicos son más frágiles, no menos. La ficción de género en español mueve un pozo de ingresos mucho menor que el estadounidense, y en un pozo menor se necesitan muchos menos títulos para producir la misma dilución. No hay dato en el paper sobre esto y lo dejo como hipótesis. Pero la asimetría es difícil de esquivar: producir es barato en cualquier idioma, y lo que cambia entre mercados es cuánto hay para repartir.

Lo segundo es qué palanca queda a mano. Buena parte del artículo está construida para una pregunta legal estadounidense, el efecto sobre el mercado como criterio del fair use, y para la teoría de la dilución que el juez Chhabria dejó planteada en Kadrey contra Meta diciendo que faltaba justamente la evidencia que este paper produce. Esa doctrina no existe en los sistemas de derecho de autor de la región, que funcionan con listas cerradas de excepciones: el hallazgo económico cruza la frontera, el vehículo jurídico no. Lo que sí se puede discutir acá es la divulgación, porque ninguno de estos libros declara si contiene texto de IA. Los autores especulan con que esa opacidad da ventaja y aclaran que no tienen datos para afirmarlo, pero es la única condición de la lista que se puede cambiar sin esperar el fallo de fondo sobre entrenamiento.

Y hay algo que el paper deja servido para cualquier discusión regional sobre remuneración a autores: la evidencia acá no es sobre calidad, es sobre volumen. Los libros con IA venden mal uno por uno y aun así corren la aguja, lo que sugiere que confiar en que el público distinga lo bueno de lo malo no alcanza para proteger el ingreso de quien escribe. La pregunta que queda es práctica: si el mecanismo es la escala, ¿qué instrumento tiene un país mediano para que sus autores no terminen compitiendo con una oferta infinita en el mismo estante?

La letra chica

  • Las comparaciones son observacionales y asociativas, y los autores lo declaran: comparan cohortes y relacionan resultados con exposición por género, no estiman un efecto causal.
  • Todo descansa en un detector. Un libro está “sin IA detectada” según Pangram 3.3, no según su autor, y las tasas de error reportadas vienen del propio proveedor. Los autores sí muestran que los resultados aguantan mover el umbral de 25%.
  • El panel de ventas lo proveyó una de las cinco grandes editoriales, parte interesada en el debate de derechos de autor. El análisis es de los investigadores, pero el dato viene de un actor con posición tomada.
  • La identidad de autor sale de la firma del libro, así que quien publica bajo varios seudónimos aparece dividido: la concentración reportada es un piso.
  • Los autores anotan que el efecto neto sobre el bienestar queda abierto, porque los lectores pueden ganar con más variedad y precios más bajos. Lo que miden es la pérdida para quien escribe.
  • La superposición de expresiones raras es agregada: muestra parecido con el lenguaje distintivo de libros existentes, no copia de ninguno en particular.

Palabras clave del paper: generative AI, self-published genre fiction, market dilution, AI detection, copyright fair use

Lectura automática. Este texto lo generó Claude, un modelo de Anthropic, a partir de la fuente original, sin revisión humana línea por línea. Puede contener errores o interpretaciones discutibles; para validar cualquier punto, revisa la fuente original.
¿Viste un error? Repórtalo

Cuéntanos qué está mal, citando la frase si puedes, y, si la tienes, la fuente que lo corrige. Un proceso automático revisa los reportes cada noche: si el error se verifica, la página se corrige y queda una fe de erratas al pie.

Tu correo es opcional: solo lo usamos si necesitamos más contexto sobre el reporte. No te suscribe al newsletter.