En un mundo con sistemas y estructuras cambiantes, y en el que la tecnología irrumpe para cambiarlo todo, es importante saber qué sucede, qué cambia, cómo cambian nuestros derechos y si nuestros negocios y empresas pueden resultar afectados. Y, además, averiguar cómo debemos actuar en el uso de la tecnología para no infringir derechos ajenos.
Estudio la inteligencia artificial no porque sea su detractora, sino porque sé que llegó para quedarse y transformará integralmente sectores productivos, profesiones y, potencialmente, nuestra cultura, nuestro trabajo y nuestra vida como la conocemos.
Hoy quiero, con un caso legal relevante, mostrarte uno de los muchos conflictos que se avecinan sobre propiedad intelectual e inteligencia artificial.
El caso Claude/Anthropic, en el que la compañía fue objeto de una demanda colectiva por parte de autores que reclamaban la propiedad intelectual sobre productos editoriales, libros y obras que fueron utilizados —sin autorización ni compensación para los autores— como material de datos de entrenamiento para el Large Language Model (LLM) conocido como Claude.
La demanda fue presentada ante el Tribunal del Distrito Norte de California, alegando los demandantes que Anthropic realizó copias digitales exactas de libros enteros sin adquirir licencias comerciales, que usó el trabajo creativo de terceros para construir un producto comercial lucrativo y que la posibilidad de que el modelo de IA Claude resumiera, imitara estilos o generara textos similares podía afectar el mercado económico de los autores y creadores.
Anthropic, por su parte, se defendió alegando que el entrenamiento del sistema tecnológico no compite directamente en el mercado de los libros y que no pretende reproducirlos o revenderlos, sino analizar patrones para el aprendizaje del modelo. Por lo tanto, sostuvo que se trataba de un uso justo o fair use.
¿QUÉ DICE LA REGULACIÓN?
Este punto es importante porque la fuerza de los argumentos de cada parte nos permite entender el acuerdo al que finalmente llegaron, en el que Anthropic acordó constituir un fondo de US$1.500 millones para resolver las reclamaciones comprendidas en la acción colectiva, sin que el acuerdo equivalga, por sí mismo, a una admisión de responsabilidad.
Pero hay un elemento especialmente interesante: el tribunal diferenció entre el uso de las obras para el entrenamiento del modelo y la forma en que determinadas copias fueron adquiridas y almacenadas. Esa diferencia, aunque parezca pequeña, puede cambiar completamente el análisis jurídico.
Los argumentos de los demandantes, fuertes y certeros en varios puntos, en mi opinión, se fundamentaron principalmente en la U.S. Copyright Act.
Normas y principios aplicados
U.S. Copyright Act (Ley de Derechos de Autor de EE. UU., Título 17), que es la norma principal del sistema estadounidense para evaluar la reproducción y utilización no autorizada de obras protegidas.
El segundo es una doctrina vigente en el derecho estadounidense que no existe de la misma manera en el derecho colombiano, denominada Fair Use o uso justo, que también hace parte de la Copyright Act. Esta doctrina analiza, entre otros factores, la naturaleza de la obra, el propósito y carácter del uso, la cantidad de texto utilizado y el impacto sobre el mercado potencial de la obra.
Y, por último, los principios relacionados con el enriquecimiento sin causa y la competencia desleal. El enriquecimiento sin causa existe también en el derecho colombiano y la competencia desleal, como infracción, tiene igualmente consagración legal en nuestro derecho.
La demanda colectiva alegó:
1. Infracción directa por reproducción
La Sección 106 de la Copyright Act dispone, entre otros derechos exclusivos, que el titular del derecho puede autorizar la reproducción de la obra en copias.
Los demandantes manifestaron que Anthropic descargó bases de datos que contenían copias piratas de sus libros.
Para poder entrenar a Claude, los servidores de la empresa realizaron copias digitales de los archivos. Para los demandantes, el acto de obtener y duplicar archivos digitales sin licencia constituía una infracción directa a sus derechos.
Aquí apareció una distinción fundamental en la decisión judicial: el tribunal consideró que el uso de obras para entrenar el modelo podía ser transformativo y estar protegido por el fair use, pero no extendió esa protección de la misma manera a la adquisición y conservación de copias obtenidas de bibliotecas piratas.
2. Creación de obras derivadas
La Sección 106 de la Copyright Act reserva también al titular el derecho de autorizar la preparación de obras derivadas basadas en la obra original protegida.
Los autores cuestionaron que el modelo pudiera aprender elementos provenientes de las obras y posteriormente generar contenidos que reprodujeran o imitaran características de estas.
El debate resulta particularmente interesante porque el modelo convierte la información durante el entrenamiento en representaciones matemáticas, patrones, parámetros y pesos. Entonces surge una pregunta que probablemente seguirá ocupando a jueces, abogados, desarrolladores y autores:
¿Cuándo el aprendizaje de una máquina sobre una obra protegida se convierte jurídicamente en reproducción o derivación de esa obra?
3. Infracción indirecta
Esta infracción es muy interesante, pues según el sistema estadounidense una empresa puede, bajo determinadas circunstancias, ser responsable por inducir o contribuir a la infracción de derechos de autor realizada por terceros, o beneficiarse económicamente de ella cuando tiene capacidad de control.
Los demandantes cuestionaron que herramientas como Claude pudieran facilitar a los usuarios finales solicitar determinadas tareas sobre obras protegidas.
Pensemos, por ejemplo, en pedirle a una IA generativa que escriba un capítulo nuevo reproduciendo de manera sustancial elementos protegidos de una obra determinada. Desde esta perspectiva, surge la discusión acerca de hasta dónde llega la responsabilidad del desarrollador y dónde comienza la responsabilidad del usuario.
Y esta pregunta será cada vez más importante:
¿Quién responde por el uso infractor que un tercero haga de una herramienta de inteligencia artificial?
EL CORAZÓN DE LA DEFENSA DE ANTHROPIC
Como te dije, esta doctrina no existe de la misma manera en el derecho colombiano. El Fair Use o uso justo fue el eje de la defensa de Anthropic.
Anthropic sostuvo que el uso de las obras para el entrenamiento era transformativo: su finalidad no era revender los libros ni exhibirlos gratuitamente para la lectura de terceros, sino utilizarlos para que el modelo aprendiera patrones.
¿Será?
Porque Claude es un producto comercial, se paga por determinados servicios y está dentro de los activos y del modelo de negocio de una empresa que se llama Anthropic.
Sin embargo, que exista una finalidad comercial no elimina automáticamente la posibilidad de que exista fair use. Ese carácter comercial es uno de los elementos que debe analizarse junto con los demás factores.
Otro punto para determinar la protección de las obras es saber de qué tipo de obra se trata. Una obra altamente creativa, por ejemplo, un libro de ficción, tiene una consideración diferente frente a una obra predominantemente factual. Anthropic utilizó obras creativas, pero alegó que la IA no extrae necesariamente el componente creativo para reproducirlo literalmente, sino que busca patrones para su aprendizaje y los transforma en parámetros matemáticos que le permiten posteriormente generar resultados.
Otro punto relevante es la extensión del texto utilizado. Los demandantes manifestaron que se reprodujo e introdujo al proceso el 100 % de determinados textos, no simples fragmentos. Anthropic sostuvo que el modelo requería acceso a las obras completas para realizar adecuadamente el proceso de entrenamiento.
Pero el factor más controversial es el efecto sobre el mercado potencial de la obra.
Pensemos: ¿Qué Claude tenga acceso durante su entrenamiento a la información contenida en los libros altera el mercado de los autores?
Para los autores, que Claude pueda generar contenidos semejantes, producir resúmenes o facilitar determinados usos puede perjudicar directamente su mercado y eventualmente desincentivar el consumo del producto original, privándolos de ingresos o regalías.
Anthropic sostiene, en cambio, que el entrenamiento del modelo no genera por sí mismo un producto sustituto del libro tradicional.
Y aquí el tribunal introdujo una distinción fundamental: una cosa es utilizar una obra para que una tecnología aprenda patrones y otra, jurídicamente diferente, es la forma en que esa obra fue adquirida y conservada.
ENRIQUECIMIENTO SIN CAUSA
El principio de enriquecimiento sin causa, al igual que en el derecho colombiano, tiene carácter subsidiario frente a regulaciones específicas. Básicamente, este antiguo principio del derecho expresa que nadie puede enriquecerse injustificadamente ocasionando un correlativo empobrecimiento a otra persona.
En este caso existía una legislación específica sobre derechos de autor, pero el argumento tiene una fuerza moral e incluso mediática evidente: utilizar la obra de otro sin compensación económica o autorización para desarrollar una tecnología que posteriormente genera valor económico.
Sin embargo, jurídicamente la pregunta sigue siendo la misma: ¿existía la obligación de obtener esa autorización para ese uso concreto?
Y ahí vuelve a aparecer el fair use.
COMPETENCIA DESLEAL
También aparece otra discusión. Existen desarrolladores de inteligencia artificial y empresas tecnológicas que negocian licencias y pagan por el acceso a determinados contenidos para entrenar o alimentar sus sistemas.
Entonces surge otra pregunta: ¿si una empresa paga por acceder legalmente a contenidos y otra utiliza contenidos sin pagar licencias, existe una ventaja competitiva indebida?
La respuesta no es automática. Dependerá, precisamente, de determinar si el uso realizado requería jurídicamente esa licencia.
Este no es un caso jurídicamente cerrado. Se trata de un acuerdo negociado en el que, por la magnitud de las pretensiones económicas y la solidez de los argumentos planteados y, supongo, también por el riesgo reputacional, Anthropic prefirió llegar a una transacción antes que asumir la incertidumbre de un juicio. Sí. El tribunal aprobó el acuerdo y realizó algunas consideraciones relevantes sobre los puntos en discusión, pero ello no significa que el debate jurídico haya terminado.
Si este mismo caso hubiera sido analizado bajo la legislación colombiana, el escenario jurídico probablemente sería diferente. A diferencia del anglosajón, Colombia no cuenta con una cláusula general de Fair Use. Nuestro régimen de derecho de autor, contenido principalmente en la Ley 23 de 1982, la Decisión Andina 351 de 1993 y la Ley 1915 de 2018, protege los derechos patrimoniales y morales de los autores mediante limitaciones y excepciones expresamente previstas por la ley, interpretadas a la luz del denominado test de los tres pasos previsto en la Decisión Andina 351. En mi opinión, el caso Anthropic difícilmente encontraría hoy una excepción legal expresa que amparara la reproducción masiva de obras protegidas para entrenar un modelo de inteligencia artificial. Incluso si existiera una excepción aplicable, surgirían serias dudas sobre el cumplimiento del segundo y tercer paso del test de los tres pasos, relacionados con la afectación de la explotación normal de la obra y el perjuicio injustificado a los intereses legítimos del autor.
Como verás, es un tema profundo de estudio que debemos tener en cuenta los abogados, claro, pero también los empresarios que inician procesos de implementación de IA en sus negocios.
Siempre respondiendo algunas preguntas:
¿De quién son los datos?
¿Tengo derechos sobre ellos?
¿Son datos protegidos?
¿De dónde los obtuve?
¿Tengo derecho a utilizarlos para esta finalidad?
¿Qué sucede cuando los incorporo al modelo: sirven para entrenamiento, prueba o producto?
¿Tengo derecho a usar un dato porque tengo acceso a él?
Todo esto ocurre, además, en un momento en el que se han reportado incidentes de seguridad protagonizados por agentes autónomos de OpenAI que lograron salir del entorno inicialmente previsto para la evaluación y acceder y hackear información de cuatro compañías. Supongo que podríamos hablar de esto en otro artículo.
Acá el punto es otro: ¿de quién son los datos? ¿Quién los cuida? ¿Quién puede utilizarlos? ¿Y quién responde cuando una inteligencia artificial los utiliza?
Por Natalia Name









