Así funcionará la marca invisible de ChatGPT y Codex para detectar textos de IA

ChatGPT"

Los textos generados por ChatGPT y Codex tendrán una marca de agua invisible en la Unión Europea. OpenAI comenzará a desplegarla durante las próximas semanas entre los usuarios elegibles de todos sus planes en la región, como parte de las medidas de transparencia contempladas por la normativa europea sobre inteligencia artificial.

La marca no aparecerá como un aviso, símbolo o etiqueta que el lector pueda ver. OpenAI desarrolló un sistema llamado textGrain, que introduce una señal estadística en la elección de palabras del modelo. Un detector puede analizar posteriormente ese patrón para determinar si un texto contiene una marca de agua de la compañía.

La decisión está relacionada con las disposiciones de transparencia del AI Act de la Unión Europea, que establecen requisitos para que el contenido generado por inteligencia artificial pueda ser identificado mediante sistemas automatizados. OpenAI decidió aplicar inicialmente el sistema en la UE y no convertirlo en una función predeterminada para todos sus usuarios a nivel mundial.

Para quienes utilizan la API de OpenAI, el funcionamiento será diferente. Desde ahora, los clientes podrán activar voluntariamente el marcado en determinados modelos, sin importar en qué país se encuentren. La función estará desactivada por defecto.

La marca puede desaparecer con una edición

Uno de los puntos más relevantes de la propuesta es que una marca de agua no garantiza que un texto pueda ser identificado en cualquier circunstancia. Las propias pruebas de OpenAI muestran que modificar el contenido puede reducir considerablemente la capacidad del detector para encontrar la señal.

En una de las evaluaciones, sustituir el 10 % de las palabras de un texto por sinónimos redujo la detección de aproximadamente 92 % a 66 %. Cuando el cambio llegó al 25 %, la detección cayó hasta 17 %. Los textos cortos también presentan mayores dificultades, al igual que algunos contenidos con menor variedad posible de palabras, como determinadas respuestas matemáticas.

La traducción y la edición también pueden afectar la señal. Por eso, OpenAI advierte que encontrar una marca puede indicar que uno de sus sistemas generó o procesó parte del contenido, pero no permite determinar cuánto trabajo humano hubo detrás.

Te puede interesar: Google Vids ya permite personalizar los subtítulos: así puede cambiar su estilo

La situación también funciona al contrario. Que un detector no encuentre una marca de agua no demuestra que un texto haya sido escrito por una persona. Puede haber sido editado, traducido, ser demasiado corto, haber sido producido antes de la implementación del sistema o proceder de otra herramienta de inteligencia artificial.

OpenAI tampoco pretende que el detector esté disponible para cualquier usuario desde el comienzo. El acceso inicial estará limitado a investigadores y organizaciones especializadas que sean aprobados por la compañía. La herramienta indicará si detecta una marca de agua de OpenAI, pero no revelará la identidad del usuario, sus instrucciones ni sus conversaciones.

El despliegue en ChatGPT y Codex comenzará en las próximas semanas para los usuarios elegibles de todos los planes dentro de la Unión Europea. La compañía señala que revisará el sistema a medida que avance la tecnología y exista más evidencia sobre su funcionamiento en situaciones reales.

Avatar photo

Digna Irene Urrea

Comunicadora social y periodista apasionada por las buenas historias, el periodismo literario y el lenguaje audiovisual. Aficionada a la tecnología y la ciencia. Email: [email protected]

View all posts

Archivos