Publicidad

ChatGPT empezará a marcar sus textos con una señal invisible en España y otros países

OpenAI prepara la llegada de una marca de agua invisible para los textos generados por ChatGPT y Codex. El sistema, denominado textGrain, permitirá identificar mediante herramientas automáticas si un contenido puede haber sido redactado por un modelo de inteligencia artificial.

La función se activará próximamente en España y en el resto del Espacio Económico Europeo, previsiblemente durante las próximas semanas. Su despliegue responde a las obligaciones de transparencia previstas en el Reglamento europeo de Inteligencia Artificial, que exige que determinados contenidos generados por IA incorporen una huella reconocible por las máquinas.

Una marca que no cambiará el aspecto del texto

A diferencia de las marcas visibles que pueden aparecer en algunas imágenes generadas por IA, la señal de textGrain no podrá apreciarse a simple vista. Los usuarios seguirán viendo un texto normal, sin iconos, avisos ni caracteres especiales que indiquen su origen.

El sistema introduce una señal estadística durante la generación del contenido. En términos sencillos, el modelo ajusta ligeramente la probabilidad de escoger unas palabras frente a otras mientras redacta. Ese patrón se mantiene dentro de unos márgenes que pretenden conservar la naturalidad, la coherencia y el estilo del texto.

Después, un detector analiza el fragmento y busca esa distribución de palabras. Si encuentra suficientes indicios, puede estimar que el contenido incluye la marca de agua de OpenAI. No se trata, por tanto, de una etiqueta visible, sino de una firma matemática integrada en la forma de construir las frases.

El detector no estará disponible para todo el mundo

OpenAI ha indicado que su herramienta de comprobación no se ofrecerá inicialmente al público general. El acceso quedará reservado a investigadores y organizaciones especializadas que soliciten utilizarla y cumplan determinados requisitos.

El detector solo informará de si encuentra la marca asociada al sistema. No revelará el mensaje utilizado para generar el contenido, no identificará al usuario y tampoco compartirá datos personales relacionados con la conversación de ChatGPT.

La compañía también advierte de que la herramienta no puede determinar cuánto trabajo humano hay detrás de un texto. Un contenido puede haber sido generado por una IA y posteriormente revisado por una persona, o haber sido escrito por alguien que se ha ayudado de un modelo para corregirlo, resumirlo o traducirlo.

La eficacia depende del tipo de contenido

OpenAI sostiene que textGrain ofrece resultados similares o superiores a otras técnicas que ha evaluado, entre ellas SynthID. Sin embargo, la marca no es infalible y su capacidad de detección cambia según la extensión y la naturaleza del texto.

En sus pruebas, el sistema localizó la señal en el 80% de los contenidos de aproximadamente 200 tokens y en cerca del 95% de los textos de 400 tokens relacionados con psicología. Un token es una unidad de texto que el modelo procesa, como una palabra completa, una parte de ella o un signo de puntuación.

Los resultados fueron peores en matemáticas y en otros ámbitos con un vocabulario más limitado. Cuando el redactor tiene pocas formas alternativas de expresar una idea, el modelo dispone de menos margen para introducir la señal estadística sin afectar al contenido.

Editar un texto puede ocultar la marca

Las modificaciones posteriores reducen considerablemente la precisión del detector. En una de las pruebas, cambiar un 10% de las palabras por sinónimos hizo que la tasa de detección bajara del 92% al 66%.

Cuando se sustituyó el 25% del vocabulario, la capacidad para encontrar la marca se desplomó hasta el 17%. La traducción, la reescritura, los cambios de estilo o una edición intensa pueden alterar el patrón hasta hacerlo irreconocible.

Por este motivo, la ausencia de la marca no demuestra que un texto haya sido escrito por una persona. Puede tratarse de un contenido editado, traducido o creado con una versión anterior del modelo que todavía no utilizaba este sistema.

Los desarrolladores podrán activarlo en la API

El funcionamiento será diferente para las empresas que emplean los modelos de OpenAI mediante su API, el sistema que permite integrar estas tecnologías en aplicaciones y servicios externos.

En determinados modelos, el marcado puede activarse de forma voluntaria. La función estará deshabilitada por defecto y cada compañía decidirá cuándo utilizarla para cumplir sus propias obligaciones de transparencia. OpenAI también trabaja con sus socios de servicios en la nube para extender esta opción durante las próximas semanas.

Más transparencia, pero sin certezas absolutas

La llegada de textGrain pretende facilitar la identificación de contenidos sintéticos en redes sociales, medios de comunicación, documentos y correos electrónicos. Aun así, no permitirá certificar por sí sola que una información sea verdadera ni establecer quién la ha escrito.

La tecnología tampoco mide la cantidad de intervención humana. Un texto con la marca puede haber sido revisado a fondo, mientras que uno sin ella puede haber recibido ayuda de una herramienta de IA que no incorpora ningún sistema de identificación.

OpenAI prevé que el despliegue genere nuevas ofertas de servicios para detectar o humanizar textos. No obstante, las propias limitaciones de textGrain y de otros sistemas similares aconsejan desconfiar de cualquier herramienta que prometa resultados completamente seguros. Ningún detector puede determinar con certeza absoluta el origen de todos los contenidos generados con inteligencia artificial.

Artículo anteriorEl truco para borrar Apple Intelligence del Mac y recuperar 12 GB
Artículo siguienteChatGPT mostrará anuncios junto a las imágenes que crea