El litigio por derechos de autor contra la inteligencia artificial dejó los libros y entró a la música. La noche del viernes, Sony Music Publishing y Warner Chappell demandaron a Anthropic ante la Corte de Distrito para el Distrito Norte de California, y lo hicieron nombrando también, de forma personal, a sus cofundadores Dario Amodei y Benjamin Mann. Las dos mayores editoras musicales del mundo describen una “campaña descarada de descarga ilegal por torrent, raspado y descarga de obras protegidas” e identifican decenas de miles de composiciones: bastantes más que los pleitos previos de la industria musical, que sumaban poco más de veinte mil obras.
La demanda señala tres vías de obtención del material: torrents de Library Genesis y Pirate Library Mirror, raspado de sitios licenciados de letras como MusixMatch y LyricFind, y uso de los corpus públicos Common Crawl y Books3. Son cuatro cargos, y el que conviene mirar es el cuarto: remoción o alteración de la información de gestión de derechos, es decir, los datos de autoría y titularidad que viajan pegados a cada obra. Ese cargo no depende de dónde salió el corpus, sino de qué se le borró antes de entrenar, y por esa vía el pleito podría llegar a tocar el entrenamiento en sí. Las editoras piden juicio por jurado y los máximos legales: hasta 150.000 dólares por obra infringida dolosamente y 25.000 dólares por cada remoción. Anthropic dice que discrepa y que se defenderá con firmeza.
Para América Latina el problema es de silla vacía. Los derechos editoriales del grueso del reggaetón, el regional mexicano, el sertanejo y la cumbia están administrados por Sony y Warner, no por quienes los compusieron: son las editoras las que litigan, en un tribunal de California, las condiciones bajo las cuales se podrá entrenar sobre ese repertorio. Y llegan a este juicio tres días después de haber entrado como accionistas de Stability AI. Litigan por un lado y coinvierten por el otro; en ninguno de los dos movimientos hay una parte latinoamericana sentada a la mesa.
También hoy
- OpenAI corta el acceso de Cursor a sus modelos desde el 12 de noviembre — el corte llega tras la compra de Anysphere por SpaceX, una operación de 60.000 millones de dólares en acciones cerrada el 14 de agosto. Es el primer corte entre dos capas del stack por propiedad corporativa y no por precio; Cursor responde que OpenAI es apenas el 5% de su tráfico, y Anthropic ofreció el mismo día ampliar el soporte de Claude en el editor.
- El 95% de los 128.000 microdramas publicados en China en el primer trimestre se generó con IA — el ingreso de los intérpretes cayó entre 50% y 80% en un semestre, y a algunos les piden digitalizar voz e imagen justo antes de desvincularlos.
- Un estudio revisado por pares mide la homogeneización de la escritura — publicado en Nature Human Behaviour por el Center for Computational Language Sciences de la Universidad del Sur de California, midió 880.000 textos: los modelos recortan entre 21% y 50% la varianza de estilo al reescribir, con una pérdida de seis puntos porcentuales en la capacidad de identificar quién escribió. El problema no es que escriban mal en español, es que hacen escribir a todos igual.
- Una camisa hawaiana de 88 dólares vuelve invisible a su portador para los detectores de personas — el patrón se optimizó en un bucle adversarial contra YOLO, el mismo detector abierto sobre el que corren buena parte de los sistemas municipales de videovigilancia.
En la región
El fin de semana no trajo movimientos regionales propios: ni ministerios, ni autoridades de datos, ni organismos multilaterales, ni centros de investigación de la región publicaron nada en la ventana. Lo que sí se movió es el lugar donde se deciden cosas que afectan a la región sin que participe. La demanda de Sony y Warner define las reglas de entrenamiento sobre repertorio latinoamericano con las editoras como demandantes y sin compositores de la región en la causa. El estudio de Nature Human Behaviour aporta el argumento que le faltaba a la discusión regional sobre soberanía lingüística, justo cuando varios Estados empiezan a poner asistentes de escritura en escuelas y ventanillas públicas: lo que se pierde con el pulido automático no es contenido sino identidad, y eso no se arregla ampliando la cobertura de idiomas. Y el corte de OpenAI a Cursor muestra que el acceso a los modelos puede terminar dependiendo de quién compró a quién: la salida que le queda a un equipo en Bogotá o São Paulo es usar clave propia de API y pagar por consumo en dólares lo que la suscripción evitaba. En la agenda pendiente sigue todo igual: el PL 2338/2023 en Brasil sin fecha de votación, y México todavía sin ley general de IA mientras avanza la regulación sectorial.
Lanzamientos
- Gemini Notebook estrena límites flexibles por cómputo — desde el 2 de septiembre la cuota deja de contarse en generaciones diarias y pasa a medirse por el cómputo que consume cada tarea, con renovación cada cinco horas y tope semanal. El plan gratuito conserva el límite estándar, AI Plus lo duplica, Pro lo cuadruplica y Ultra llega a cinco o veinte veces. Importa porque es la herramienta de síntesis documental más usada en universidades y oficinas públicas de la región precisamente porque el plan gratuito alcanzaba, y un límite medido en cómputo castiga el uso intensivo de fuentes, que es justo el patrón de quien investiga con muchos documentos.
- LAION-BVD, corpus abierto de video de 10 millones de horas — 55 millones de clips con descripción automática de video y audio, más 300 millones de imágenes fijas, derivados de 1.300 millones de direcciones de CommonCrawl; abierto, pero con licencia solo para investigación. Ninguna de sus 55 millones de descripciones la escribió una persona: las redactó un modelo de 2.000 millones de parámetros, en veinte palabras o menos. No es una herramienta de uso directo sino materia prima, y permite a un grupo universitario de la región preentrenar o evaluar sin negociar acceso con nadie. También sirve como objeto de auditoría: el paper no publica desglose de cuánto del corpus está en español o portugués.
Hilos que seguimos
Esto se suma a la historia de copyright que venimos siguiendo. El capítulo anterior fue el acuerdo de 1.500 millones de dólares del caso Bartz, que terminó sancionando una sola cosa: de dónde había salido el corpus. Aquel reparto pagó unos 3.000 dólares por obra, y en él no figuró ningún autor ni editorial latinoamericana. El cargo por remoción de información de gestión de derechos que aparece hoy abre un flanco distinto, porque ya no pregunta por el origen del material sino por lo que se le quitó antes de entrenar. Si prospera, la discusión deja de ser sobre cómo se consiguieron los archivos y pasa a ser sobre el entrenamiento mismo.
Si el pulido automático conserva casi todo el significado pero borra seis puntos porcentuales de las señales de quién escribió, ¿en qué momento un Estado que pone asistentes de escritura en sus escuelas y ventanillas deja de estar ofreciendo una ayuda y pasa a estar imponiendo una voz?
Sobre esta entrada. Se genera de forma automática a partir de fuentes públicas, sin revisión humana antes de publicarse. Puede contener errores de interpretación o de resumen; conviene verificar cada noticia en su fuente original (los enlaces llevan ahí) antes de citarla o tomar decisiones a partir de ella.
Doble Click se escribe con modelos de Anthropic.