Una Demanda Construida sobre Terreno Controvertido

Apple enfrenta una nueva demanda de derechos de autor de inteligencia artificial presentada por Chicken Soup for the Soul, el editor conocido por su larga serie de libros de antología. La demanda, reportada primero por Reuters, alega que Apple utilizó el contenido del editor sin autorización para entrenar sistemas de IA, pero Apple ya se ha distanciado del conjunto de datos en el centro de la queja.

Según Apple, la colección de datos nombrada en la demanda no alimenta Apple Intelligence, el conjunto de funciones de IA en dispositivo y basadas en la nube de la compañía implementadas en iPhone, iPad y Mac. La distinción es importante: si el conjunto de datos disputado nunca se utilizó para entrenar los modelos que se ejecutan en los productos de Apple, la base de la demanda se vuelve significativamente más débil.

Lo que Alega la Demanda

La demanda sigue una ola de acciones de derechos de autor similares tomadas por editores, autores y compañías de medios contra desarrolladores de IA durante los últimos dos años. Los demandantes han argumentado que las compañías de IA rasparon e ingirieron su contenido sin consentimiento, licencia o compensación para entrenar modelos de lenguaje grandes y que hacerlo constituye infracción de derechos de autor a gran escala.

Chicken Soup for the Soul se encuentra entre muchos editores que han tomado acciones legales en este espacio, uniéndose a las filas de organizaciones como New York Times, que presentó una demanda de alto perfil contra OpenAI y Microsoft. Los objetivos varían, pero la teoría del daño es ampliamente similar: el texto protegido por derechos de autor fue tomado sin permiso y utilizado comercialmente.

Lo que distingue a esta demanda en particular es la negación preventiva de Apple. La compañía ha sido inusualmente directa al afirmar que el conjunto de datos citado, creído que es un rastreo web disponible públicamente, no es parte del pipeline de capacitación para Apple Intelligence. Esa afirmación, si se sustancia, podría complicar el caso del demandante considerablemente.

Apple Intelligence y Sus Datos de Entrenamiento

Apple ha sido reservada sobre los detalles de cómo se entrenan sus modelos de IA, al igual que la mayoría de desarrolladores principales de IA. La compañía lanzó Apple Intelligence con iOS 18 y ha continuado expandiendo el sistema con cada actualización de software. Las características incluyen herramientas de escritura, generación de imágenes, limpieza de fotos e integración con ChatGPT para solicitudes más complejas.

Apple ha dicho que sus modelos en dispositivo se entrenan usando una combinación de datos autorizados y datos sintéticos generados por Apple misma, un enfoque diseñado para limitar la exposición legal y mejorar la privacidad. La compañía no ha divulgado una lista completa de fuentes de datos, lo cual es estándar en toda la industria.

El conjunto de datos al que se hace referencia en la demanda de Chicken Soup for the Soul parece ser un corpus web abierto separado que circula ampliamente en la investigación de IA. La posición de Apple es que incluso si existen datos de ese corpus en algún lugar de su infraestructura de investigación, no fluyó hacia los modelos que constituyen Apple Intelligence como producto.

Panorama Legal Más Amplio

La ola de litigio de derechos de autor de IA no muestra signos de desaceleración. Los tribunales aún están trabajando en preguntas fundamentales, incluido si entrenar una IA en texto protegido por derechos de autor constituye uso justo, cuáles podrían ser los daños a escala y si los resultados de los modelos de IA constituyen obras derivadas.

Los resultados de demandas históricas contra OpenAI y otros son observados de cerca por toda la industria. Una sentencia que encuentre entrenamientos de IA categóricamente infractor tendría consecuencias generalizadas. Una sentencia que mantenga una defensa de uso justo amplia, por el contrario, establecería el entorno legal a favor de los desarrolladores de IA durante años.

Para Apple, las apuestas se extienden más allá de esta demanda única. La compañía se ha posicionado la privacidad y el desarrollo responsable de IA como valores principales de marca. Estar asociado con uso de datos a gran escala no autorizado, incluso si la acusación es finalmente desestimada, va en contra de esa narrativa.

Qué Viene Después

El caso está en etapas tempranas y no se ha establecido fecha de comparecencia. Se espera que Apple impugne la demanda con la base de que el conjunto de datos específico citado no fue utilizado en sus productos de IA, posiblemente buscando desestimación temprana.

Los analistas legales señalan que la divulgación proactiva de Apple, declarando públicamente que el conjunto de datos no alimenta Apple Intelligence antes de que la demanda ganara tracción, es un movimiento estratégico para establecer el registro temprano. También señala que Apple anticipó esta línea de ataque legal y preparó una respuesta de antemano.

Si esa defensa se sostiene dependerá de lo que descubra el descubrimiento sobre el pipeline real de entrenamiento de Apple. Si los registros de adquisición de datos internos de Apple apoyan sus reclamaciones públicas, el camino del editor hacia daños se vuelve estrecho. Si no, la compañía enfrenta la misma exposición legal que ha envuelto a otros desarrolladores de IA.

La demanda subraya una creciente tensión en la industria tecnológica: los sistemas de IA requieren enormes cantidades de texto para alcanzar viabilidad comercial, y el marco legal para adquirir ese texto responsablemente aún se está escribiendo en tiempo real.

Este artículo se basa en reportes de 9to5Mac. Lea el artículo original.

Originally published on 9to5mac.com