Cómo evitar que Amazon use tus transmisiones de Twitch para entrenar IA
Twitch agregó una opción para que los creadores decidan si su contenido puede usarse para entrenar modelos de IA de Amazon, una función que antes venía activada por defecto. Aunque permite mayor control, deja dudas sobre qué se ha hecho hasta ahora y qué usos alternativos siguen permitidos.
Resumen: qué cambió en Twitch
Twitch anunció una actualización en las opciones de privacidad que permite a los creadores decidir si su contenido puede utilizarse para entrenar modelos de IA generativa de Amazon, la empresa matriz. Antes de este cambio, la posibilidad de usar publicaciones, transmisiones y videos con ese fin estaba habilitada por defecto, y la plataforma no había dejado claro desde cuándo ni en qué alcance se aplicaba ese uso.
La nueva opción busca devolver a los creadores cierto control sobre sus materiales, pero no elimina todas las preocupaciones sobre cómo las grandes tecnológicas manejan los datos públicos y de usuarios.
Cómo desactivar el uso de tu contenido para entrenar IA
El procedimiento para impedir que Twitch comparta tu contenido con fines de entrenamiento de IA es sencillo:
- Desde la web o la aplicación móvil, hagan clic en el avatar de la cuenta.
- Seleccionen “Configuración”.
- Ingresen al apartado “Seguridad y privacidad”.
- Allí encontrarán la opción “Entrenamiento para IA generativa” y podrán desactivarla.
Es importante notar que, según Twitch, desactivar esta casilla no impide que la plataforma y Amazon utilicen el contenido para otros fines descritos en el aviso de privacidad. Entre esos usos se mencionan funciones con soporte de IA diseñadas para ayudar al crecimiento y la monetización de los streamers, como asistencia en campañas de patrocinio, recomendaciones para el descubrimiento de audiencia y herramientas de seguridad de la comunidad (por ejemplo, AutoMod).
Reacciones de la comunidad y transparencia limitada
La medida trajo alivio a algunos creadores, pero también generó críticas porque no queda claro desde cuándo Twitch y Amazon han estado utilizando el material para entrenar modelos. En un foro dedicado al tema, más de 15,800 creadores manifestaron su rechazo a que esa práctica estuviera activada por defecto.
Durante una transmisión en vivo, Mary Kish, jefa de comunidad de Twitch, presentó la nueva configuración y reconoció que generaría malestar. Mike Minton, jefe de producto, dijo que mantener la opción activada por defecto era “una necesidad”, porque de lo contrario, según él, “nadie se sumaría” al proceso. También planteó que es razonable suponer que “casi cualquier contenido disponible públicamente se utiliza para entrenar modelos de una forma u otra, con o sin permiso”.
Esas declaraciones abrieron nuevas preguntas: ¿desde cuándo se usan estos contenidos?, ¿Amazon es la única empresa implicada?, ¿participan socios comerciales?, y ¿cómo se respeta la autoría de los creadores?
Marco legal y términos de uso
Hasta marzo de 2024, los términos de uso de Twitch establecían que los usuarios concedían a la plataforma y a sus sublicenciatarios derechos para usar, reproducir, modificar, adaptar, distribuir y crear obras derivadas a partir de su contenido. Sin embargo, esos términos no mencionaban explícitamente el uso de materiales para entrenar modelos de IA generativa, lo que aumenta la sensación de vacío legal y falta de transparencia.
Para creadores y tomadores de decisión en América Latina, esto destaca la importancia de monitorear las condiciones de las plataformas y la necesidad de marcos regulatorios claros sobre el uso de datos y derechos de autor en el entrenamiento de IA.
Contexto más amplio: la escasez de datos para entrenar IA
El caso de Twitch refleja un problema estructural en la industria de la inteligencia artificial: la creciente dificultad de acceder a datos de entrenamiento de calidad. A medida que la demanda por modelos avanzados crece, las fuentes fáciles de datos se vuelven más escasas o están sujetas a acuerdos y restricciones.
Algunas empresas han cerrado acuerdos formales con editores para acceder a contenidos; otras recurren a datos generados por sus propias plataformas. Ejemplos públicos incluyen a Meta, que utiliza publicaciones e imágenes de Facebook e Instagram, y reportes sobre la extracción de actividad interna o de dispositivos en ciertos casos. También se ha informado de prácticas similares en relación con Google y YouTube.
Esta competencia por datos convierte al material de usuarios y creadores en un activo estratégico: a cambio del acceso gratuito a servicios, los usuarios aportan contenido que puede alimentar modelos comerciales.
Implicaciones para creadores y empresas en América Latina
Para los creadores latinoamericanos en Twitch (y en plataformas similares), las implicaciones son varias:
- Control y monetización: la posibilidad de bloquear el uso de su contenido en entrenamiento de IA puede proteger intereses creativos, pero no garantiza que los creadores recuperen derechos económicos sobre usos derivados por terceros.
- Riesgo reputacional: el uso de material sin consentimiento explícito puede generar rechazo de audiencias y marcas, afectando oportunidades de patrocinio.
- Necesidad de diversificar: depender exclusivamente de plataformas que pueden usar su contenido con fines de IA aumenta la vulnerabilidad; diversificar audiencias y canales es una estrategia prudente.
Para empresas y reguladores en la región, el episodio subraya la urgencia de normas más claras sobre consentimiento, transparencia y límites en el uso de datos para entrenamiento de sistemas de IA.
Recomendaciones prácticas
- Revisen y actualicen las configuraciones de privacidad: si desean evitar que Amazon use sus materiales de Twitch para entrenar IA, desactiven la opción en “Seguridad y privacidad”.
- Lean los avisos y términos: conozcan qué otros usos permite la plataforma según su política de privacidad y términos de servicio.
- Documenten su contenido original: mantener registros claros de creación y publicación ayuda ante disputas sobre autoría.
- Diversifiquen presencia: considerar plataformas alternativas y respaldos locales para reducir dependencia.
- Estén atentos a la regulación: los cambios legales sobre datos y derechos de autor pueden modificar el marco en el que operan estas prácticas.
Conclusión
La nueva opción de Twitch representa un avance en el control que los creadores pueden ejercer sobre su contenido, pero no resuelve todas las dudas sobre prácticas pasadas ni sobre usos alternativos permitidos por las políticas de la plataforma. El episodio pone sobre la mesa debates más amplios: la escasez de datos de entrenamiento, la opacidad en algunas prácticas de las big tech y la necesidad de marcos claros que protejan tanto la innovación como los derechos de los creadores.
Para profesionales y tomadores de decisión en América Latina, la recomendación es clara: monitorear políticas, educar a creadores locales sobre opciones de privacidad y promover políticas públicas que exijan mayor transparencia y protección en el uso de contenidos para la inteligencia artificial.
Fuente original: Wired