La UE estudia permitir a las tecnológicas el uso de datos personales para entrenar sus sistemas de IA
La Unión Europea sopesa un cambio de gran alcance en sus reglas sobre inteligencia artificial: permitir que las empresas tecnológicas utilicen determinados datos personales para entrenar sus modelos. La medida supondría un giro relevante respecto a la línea seguida hasta ahora por las instituciones comunitarias, centrada en limitar el tratamiento de información personal y reforzar el control de los ciudadanos.
El debate llega en un momento de fuerte competencia internacional por el desarrollo de sistemas de inteligencia artificial generativa. Las grandes plataformas necesitan enormes volúmenes de información para mejorar sus modelos de lenguaje, buscadores, asistentes virtuales y herramientas de creación de contenidos. Sin embargo, buena parte de esos datos puede incluir información vinculada directa o indirectamente a personas.
Un posible cambio en la interpretación de las normas
La cuestión central es determinar en qué circunstancias podrían utilizarse los datos personales para entrenar una inteligencia artificial. El debate europeo no implica necesariamente una autorización general para recopilar cualquier contenido disponible en internet. El objetivo sería establecer un marco que permita ciertos usos bajo condiciones concretas, con límites y obligaciones para las compañías.
Actualmente, el Reglamento General de Protección de Datos exige que las empresas justifiquen la base legal para recoger y procesar información personal. También obliga a informar a los usuarios, respetar determinados derechos y aplicar principios como la minimización de datos, la limitación de la finalidad y la proporcionalidad.
Una modificación o reinterpretación de estas reglas podría facilitar el entrenamiento de modelos de IA, pero también abriría nuevas dudas sobre el consentimiento, el derecho de oposición y la posibilidad real de borrar información de un sistema ya entrenado.
La presión de las empresas tecnológicas
Las compañías del sector sostienen que el acceso a grandes cantidades de datos resulta esencial para desarrollar modelos más precisos y competitivos. Según este argumento, unas exigencias demasiado estrictas podrían dejar a Europa en desventaja frente a Estados Unidos, China y otras regiones que están acelerando sus inversiones en inteligencia artificial.
El problema es que los modelos no siempre distinguen con facilidad entre información pública, datos personales y contenidos protegidos por derechos de autor. Una fotografía, una publicación en una red social o un comentario en una página web pueden contener nombres, ubicaciones, opiniones, datos profesionales o detalles sobre la vida privada de una persona.
Por ello, cualquier cambio tendría que aclarar qué datos se pueden utilizar, con qué finalidad, durante cuánto tiempo y bajo qué controles. También debería establecer responsabilidades concretas cuando un modelo reproduce información sensible o genera respuestas que permiten identificar a una persona.
Privacidad y derechos de los ciudadanos
Las organizaciones defensoras de la privacidad temen que una flexibilización de las normas reduzca la capacidad de los usuarios para decidir sobre el uso de sus datos. Una de las principales dificultades es que muchas personas no saben si sus publicaciones, imágenes o documentos han sido incorporados a los conjuntos de datos empleados para entrenar una herramienta.
Además, retirar una información de una página web no garantiza que desaparezca de un modelo de inteligencia artificial. El sistema puede haber aprendido patrones a partir de ese contenido y conservar parte de sus efectos incluso después de que el material original haya sido eliminado.
El derecho de supresión, conocido también como derecho al olvido, plantea así un reto técnico y jurídico. Las empresas podrían verse obligadas a demostrar que cuentan con procedimientos eficaces para corregir o excluir datos, aunque todavía no existe una solución universal para borrar de forma completa una información de todos los modelos entrenados.
Un equilibrio entre innovación y protección
La posible apertura no supondría necesariamente el abandono de las garantías europeas. El escenario que se estudia podría incluir requisitos como la anonimización de los datos, evaluaciones de impacto, controles independientes y sistemas para que los ciudadanos puedan oponerse al tratamiento de su información.
- Definir con claridad qué categorías de datos personales pueden utilizarse.
- Exigir transparencia sobre las fuentes empleadas para entrenar los modelos.
- Garantizar mecanismos sencillos para ejercer los derechos de acceso, rectificación y supresión.
- Aplicar medidas reforzadas cuando se trate de menores o información especialmente sensible.
- Establecer sanciones y responsabilidades en caso de uso indebido.
El reto para las instituciones comunitarias será evitar dos extremos: una regulación tan restrictiva que frene el desarrollo tecnológico europeo y una liberalización que convierta la privacidad en un coste asumido por los ciudadanos.
Un debate con efectos en todo el sector
La decisión de la Unión Europea tendría consecuencias que irían más allá de las grandes compañías. También afectaría a desarrolladores de aplicaciones, proveedores de servicios en la nube, plataformas digitales, universidades y empresas que emplean inteligencia artificial para analizar información o automatizar procesos.
Si Bruselas permite determinados usos de datos personales, las tecnológicas ganarían margen para entrenar sus sistemas dentro del mercado europeo. Si mantiene el enfoque actual, las empresas tendrían que seguir recurriendo a datos anonimizados, conjuntos de información obtenidos con consentimiento o contenidos cuya utilización esté respaldada por otra base jurídica.
Por ahora, el cambio se encuentra en fase de debate y todavía deberá concretarse su alcance. La decisión final determinará hasta qué punto Europa está dispuesta a adaptar sus normas de privacidad a la velocidad de la inteligencia artificial sin renunciar a uno de sus principales principios: que la innovación tecnológica no quede por encima de los derechos fundamentales.



