Sony y Warner demandan a Anthropic por decenas de miles de canciones

El litigio de derechos de autor contra la IA sale de los libros y entra a la música, con un cargo nuevo que ya no discute de dónde salió el material sino qué se le borró antes de entrenar.

Generado automáticamente · fuentes enlazadas · sin revisión humana previa

▶ Escuchar la entrada Narra Catalina (Chile) · voz sintética de ElevenLabs

Velocidad

El litigio por derechos de autor contra la inteligencia artificial dejó los libros y entró a la música. La noche del viernes, Sony Music Publishing y Warner Chappell demandaron a Anthropic ante la Corte de Distrito para el Distrito Norte de California, y lo hicieron nombrando también, de forma personal, a sus cofundadores Dario Amodei y Benjamin Mann. Las dos mayores editoras musicales del mundo describen una “campaña descarada de descarga ilegal por torrent, raspado y descarga de obras protegidas” e identifican decenas de miles de composiciones: bastantes más que los pleitos previos de la industria musical, que sumaban poco más de veinte mil obras.

La demanda señala tres vías de obtención del material: torrents de Library Genesis y Pirate Library Mirror, raspado de sitios licenciados de letras como MusixMatch y LyricFind, y uso de los corpus públicos Common Crawl y Books3. Son cuatro cargos, y el que conviene mirar es el cuarto: remoción o alteración de la información de gestión de derechos, es decir, los datos de autoría y titularidad que viajan pegados a cada obra. Ese cargo no depende de dónde salió el corpus, sino de qué se le borró antes de entrenar, y por esa vía el pleito podría llegar a tocar el entrenamiento en sí. Las editoras piden juicio por jurado y los máximos legales: hasta 150.000 dólares por obra infringida dolosamente y 25.000 dólares por cada remoción. Anthropic dice que discrepa y que se defenderá con firmeza.

Para América Latina el problema es de silla vacía. Los derechos editoriales del grueso del reggaetón, el regional mexicano, el sertanejo y la cumbia están administrados por Sony y Warner, no por quienes los compusieron: son las editoras las que litigan, en un tribunal de California, las condiciones bajo las cuales se podrá entrenar sobre ese repertorio. Y llegan a este juicio tres días después de haber entrado como accionistas de Stability AI. Litigan por un lado y coinvierten por el otro; en ninguno de los dos movimientos hay una parte latinoamericana sentada a la mesa.

También hoy

En la región

El fin de semana no trajo movimientos regionales propios: ni ministerios, ni autoridades de datos, ni organismos multilaterales, ni centros de investigación de la región publicaron nada en la ventana. Lo que sí se movió es el lugar donde se deciden cosas que afectan a la región sin que participe. La demanda de Sony y Warner define las reglas de entrenamiento sobre repertorio latinoamericano con las editoras como demandantes y sin compositores de la región en la causa. El estudio de Nature Human Behaviour aporta el argumento que le faltaba a la discusión regional sobre soberanía lingüística, justo cuando varios Estados empiezan a poner asistentes de escritura en escuelas y ventanillas públicas: lo que se pierde con el pulido automático no es contenido sino identidad, y eso no se arregla ampliando la cobertura de idiomas. Y el corte de OpenAI a Cursor muestra que el acceso a los modelos puede terminar dependiendo de quién compró a quién: la salida que le queda a un equipo en Bogotá o São Paulo es usar clave propia de API y pagar por consumo en dólares lo que la suscripción evitaba. En la agenda pendiente sigue todo igual: el PL 2338/2023 en Brasil sin fecha de votación, y México todavía sin ley general de IA mientras avanza la regulación sectorial.

Lanzamientos

  • Gemini Notebook estrena límites flexibles por cómputo — desde el 2 de septiembre la cuota deja de contarse en generaciones diarias y pasa a medirse por el cómputo que consume cada tarea, con renovación cada cinco horas y tope semanal. El plan gratuito conserva el límite estándar, AI Plus lo duplica, Pro lo cuadruplica y Ultra llega a cinco o veinte veces. Importa porque es la herramienta de síntesis documental más usada en universidades y oficinas públicas de la región precisamente porque el plan gratuito alcanzaba, y un límite medido en cómputo castiga el uso intensivo de fuentes, que es justo el patrón de quien investiga con muchos documentos.
  • LAION-BVD, corpus abierto de video de 10 millones de horas — 55 millones de clips con descripción automática de video y audio, más 300 millones de imágenes fijas, derivados de 1.300 millones de direcciones de CommonCrawl; abierto, pero con licencia solo para investigación. Ninguna de sus 55 millones de descripciones la escribió una persona: las redactó un modelo de 2.000 millones de parámetros, en veinte palabras o menos. No es una herramienta de uso directo sino materia prima, y permite a un grupo universitario de la región preentrenar o evaluar sin negociar acceso con nadie. También sirve como objeto de auditoría: el paper no publica desglose de cuánto del corpus está en español o portugués.

Hilos que seguimos

Esto se suma a la historia de copyright que venimos siguiendo. El capítulo anterior fue el acuerdo de 1.500 millones de dólares del caso Bartz, que terminó sancionando una sola cosa: de dónde había salido el corpus. Aquel reparto pagó unos 3.000 dólares por obra, y en él no figuró ningún autor ni editorial latinoamericana. El cargo por remoción de información de gestión de derechos que aparece hoy abre un flanco distinto, porque ya no pregunta por el origen del material sino por lo que se le quitó antes de entrenar. Si prospera, la discusión deja de ser sobre cómo se consiguieron los archivos y pasa a ser sobre el entrenamiento mismo.


Si el pulido automático conserva casi todo el significado pero borra seis puntos porcentuales de las señales de quién escribió, ¿en qué momento un Estado que pone asistentes de escritura en sus escuelas y ventanillas deja de estar ofreciendo una ayuda y pasa a estar imponiendo una voz?

Sobre esta entrada. Se genera de forma automática a partir de fuentes públicas, sin revisión humana antes de publicarse. Puede contener errores de interpretación o de resumen; conviene verificar cada noticia en su fuente original (los enlaces llevan ahí) antes de citarla o tomar decisiones a partir de ella.

Doble Click se escribe con modelos de Anthropic.

¿Viste un error? Repórtalo

Cuéntanos qué está mal, citando la frase si puedes, y, si la tienes, la fuente que lo corrige. Un proceso automático revisa los reportes cada noche: si el error se verifica, la página se corrige y queda una fe de erratas al pie.

Tu correo es opcional: solo lo usamos si necesitamos más contexto sobre el reporte. No te suscribe al newsletter.