Todas las Historias
Empresa

Un Enfoque Responsable hacia la IA en Contenido Deportivo

Un Enfoque Responsable hacia la IA en Contenido Deportivo

Cuando construimos Fillip sobre la base de IP deportiva licenciada, la cuestion de como operar responsablemente no fue algo que agregamos despues. Fue una de las primeras conversaciones que tuvimos como equipo. La premisa del producto, generar contenido desde activos que alguien mas posee, trae consigo una responsabilidad que no podemos ignorar ni delegar en los titulares de derechos.

Este articulo no es una declaracion de principios abstractos. Es un recuento practico de las decisiones que hemos tomado, los limites que hemos puesto, y los casos donde tuvimos que decir que no a algo que tecnicamente era posible pero que no era correcto hacer.

El acuerdo de derechos es el punto de partida, no un obstaculo

Hay una tension comun en el sector de tecnologia de contenido: el equipo tecnico ve lo que el sistema puede hacer y quiere habilitarlo todo; el equipo legal ve el acuerdo de derechos y ve lo que esta permitido. En Fillip tratamos esa tension al reves. El acuerdo de derechos no es un obstaculo que navegar, es la especificacion funcional del sistema.

Cuando un titular de derechos incorpora su IP en nuestra plataforma, la primera tarea no es empezar a generar contenido. Es mapear exactamente que esta permitido bajo el acuerdo vigente. Que formatos, para que territorios, con que duraciones, para que plataformas de distribucion. Si el acuerdo no lo dice explicitamente, tratamos ese silencio como una restriccion, no como un permiso implicito.

Esto puede parecer conservador en exceso. Pero la alternativa es generar contenido que potencialmente viola los terminos del acuerdo, y cuando eso ocurre el problema lo tiene el titular de derechos, no la plataforma que lo genero. No queremos construir herramientas que expongan a nuestros socios a disputas legales.

La diferencia entre derivacion y fabricacion

Hay una linea que consideramos fundamental y que hemos codificado en la logica de Fillip: la diferencia entre contenido derivado y contenido fabricado.

Contenido derivado es un clip de un gol real, una estadistica de un partido real, una imagen de un momento que ocurrio. Todo eso puede procesarse y reformatearse desde el material licenciado sin que estemos inventando nada. El hecho es real, el evento ocurrio, la IP es del titular.

Contenido fabricado es cualquier pieza que implique que un jugador dijo algo que no dijo, que un evento ocurrio de una manera que no ocurrio, o que atribuye a personas reales comportamientos o declaraciones sinteticas. Esto no lo hacemos. No porque no sea tecnicamente posible, sino porque hacerlo seria un fraude.

El riesgo no es hipotetico. A medida que los sistemas de generacion de texto e imagen se vuelven mas capaces, la tentacion de generar citas de jugadores, reacciones de entrenadores o analisis atribuidos a personas reales se vuelve real. Hemos visto plataformas que generan exactamente eso, presentandolo como contenido editorial. Ese camino no es el nuestro.

Trazabilidad: cada pieza sabe de donde viene

Cada pieza de contenido generada por Fillip lleva metadatos internos que vinculan el output al evento fuente. Que partido, que momento en el partido, que feed de datos y que archivo de video lo originaron. Esto no es solo buena practica de ingenieria; es un requerimiento operativo para que los titulares de derechos puedan responder a una auditoria de derechos en cualquier momento.

Cuando un licenciatario o un organismo regulador pregunta "de donde vino este clip", la respuesta tiene que estar disponible en segundos. Si no podemos trazar un output hasta su fuente con precision, ese output no debio haberse generado.

Este nivel de trazabilidad tambien nos protege colectivamente de errores involuntarios. Un titular de derechos puede tener en su archivo footage de partidos con condiciones de licencia diferentes. Un evento de 2018 puede tener terminos distintos a un evento de 2022 del mismo torneo. Sin trazabilidad a nivel de evento, es imposible saber si cada pieza generada esta dentro del alcance correcto.

Cuando el material es ambiguo, nos detenemos

Trabajamos con una federacion regional que tenia footage de partidos de 2019 y 2020 en su archivo. Al intentar incorporar ese material al sistema, descubrimos que sus derechos sobre algunos de esos partidos habian vencido en 2021 sin renovacion. El archivo fisico existia, pero los derechos para activarlo digitalmente no.

La decision fue sencilla: ese material quedo fuera del alcance de la pipeline hasta que la federacion resolviera la situacion legal con los organismos correspondientes. No lo procesamos, no lo indexamos para generacion, no lo usamos de ningun modo. Aunque tecnicamente habriamos podido hacerlo sin que nadie se diera cuenta en lo inmediato.

Este tipo de caso ocurre con mas frecuencia de lo que parece. Los archivos de las federaciones y ligas acumulan material durante anos sin que siempre exista un inventario preciso de los estados de licencia de cada contenido. Parte de lo que hacemos al incorporar un nuevo socio es ayudarlos a hacer ese inventario con claridad.

La objecion que tomamos en serio

Hay una posicion que algunos colegas del sector defienden con argumentos solidos: que cualquier contenido generado desde IP licenciada reduce el valor economico del material original porque satura el mercado con derivados. Un fan que consume veinte clips generados automaticamente cada semana ya no tiene el mismo apetito por el contenido premium original.

No estamos diciendo que esa preocupacion es invalida. Lo que si decimos es que la evidencia en mercados adyacentes apunta en la direccion contraria: los fans que consumen mas contenido intermedio entre partidos llegan al partido con mayor engagement, no con menor. El contenido entre jornadas no canibaliza el partido; prepara al fan para verlo con mas atencion.

Dicho esto, la pregunta sobre saturacion es real y depende del volumen y la calidad del contenido generado. Un sistema que produce cincuenta piezas de baja calidad al dia puede hacer exactamente el dano que la objecion describe. Parte de la responsabilidad operativa es calibrar el volumen de salida para que complemente la estrategia de contenido del titular, no para inundarlo.

Como evolucionara el marco legal y por que debemos anticiparlo

Los acuerdos de derechos que la mayoria de las ligas y federaciones tienen vigentes hoy fueron escritos en un momento donde la generacion automatizada de contenido desde footage era una posibilidad remota. La clausula tipica sobre derechos digitales fue pensada para video bajo demanda y transmision en vivo, no para pipelines de generacion continua.

Esto va a cambiar. Algunos organismos de derechos en Europa ya estan incorporando clausulas especificas sobre generacion automatizada en sus nuevos contratos. Exigen atribucion clara, limites en el numero de derivados por evento, y en algunos casos royalties por el contenido generado. Esos modelos van a llegar a LATAM, probablemente en los proximos dos o tres anos.

Nuestra posicion es prepararnos para ese marco desde ahora, no esperar a que sea obligatorio para cumplirlo. Eso significa documentar el volumen de contenido generado por IP, mantener la trazabilidad a nivel de evento, y estar en posicion de demostrar a cualquier organismo que cada pieza producida tiene su origen en un evento especifico con derechos claros.

Los titulares de derechos que trabajan con nosotros hoy estan construyendo ese historial de compliance desde el primer dia. Cuando los nuevos marcos regulatorios lleguen, no van a necesitar hacer un inventario retroactivo de lo que se genero y desde donde. Ya lo tendran.

Lo que significa esto en la practica diaria

Traducido a operaciones concretas, este enfoque implica algunas cosas que ralentizan el proceso en los margenes pero que consideramos no negociables.

Primero: antes de activar cualquier nuevo conjunto de IP, hacemos una revision del estado de derechos con el titular. No es una auditoria legal formal, pero si una conversacion estructurada sobre que esta incluido, que esta excluido y que es ambiguo.

Segundo: cualquier formato de contenido que implique texto atribuido a personas reales pasa por una revision antes de habilitarse en la pipeline. No generamos citas de jugadores, reacciones de entrenadores ni declaraciones de directivos. Si el titular quiere ese tipo de contenido, tiene que producirlo editorialmente y nosotros lo podemos distribuir, pero no lo fabricamos.

Tercero: cuando un titular recibe una notificacion de posible infraccion desde una plataforma social, trabajamos con ellos para trazar el contenido hasta su origen y determinar si el problema esta en nuestra generacion o en otro lado. Hasta ahora, todos los casos que hemos investigado tenian origen en contenido subido manualmente fuera de nuestra pipeline, pero mantenemos el proceso porque la responsabilidad de demostrarlo es nuestra.

Esto no es perfecto. Habra casos donde nos equivoquemos y donde algun aspecto del proceso falle. Lo que si podemos decir es que cuando falla, tenemos los registros para entender exactamente que paso y por que, y para no repetirlo.