OpenAI añadirá una marca de agua de texto invisible en ChatGPT y Codex en la UE
En breve
OpenAI dijo que añadirá una marca de agua invisible, llamada textGrain, al texto generado por ChatGPT y Codex en la Unión Europea, que se implementará en las próximas semanas para los usuarios elegibles de todos los planes. Los clientes de la API de todo el mundo pueden optar por ella para modelos seleccionados a partir de hoy, desactivada por defecto, mientras que el acceso al detector se concederá inicialmente a investigadores aprobados y organizaciones expertas. OpenAI dijo que la medida busca cumplir las normas de transparencia de la Ley de IA de la UE; Anthropic anunció un sistema similar anteriormente.
Leer la noticia completa 2 min de lectura
OpenAI dijo que añadirá una marca de agua invisible y legible por máquina al texto generado por ChatGPT y Codex en la Unión Europea, una medida que la empresa describió como cumplimiento de las normas de transparencia de la Ley de IA de la UE. La empresa dijo que la marca de agua se implementará en las próximas semanas para los usuarios elegibles de ChatGPT y Codex en todos los planes, pero solo en la UE, y que no convertirá la marca de agua de texto en una opción global por defecto en su lanzamiento. [ 1 , 2 , 3 ]
La marca de agua, llamada textGrain, funciona dando forma sutil a las elecciones de palabras del modelo para dejar un patrón que los lectores no pueden ver pero que un detector puede captar, según los informes. OpenAI dijo que los clientes de la API de cualquier parte del mundo pueden optar por salidas con marca de agua para modelos seleccionados a partir de hoy, con la función desactivada por defecto. El acceso al detector se concederá inicialmente a investigadores aprobados y organizaciones expertas caso por caso; OpenAI dijo que la herramienta informa de si detecta una marca de agua de OpenAI sin identificar al usuario ni revelar los prompts o las conversaciones. [ 1 , 2 , 3 , 4 ]
OpenAI publicó un informe técnico junto con el anuncio, escrito conjuntamente con investigadores de la Universidad de Pensilvania y Yale, informó TechCrunch. OpenAI dijo que no observó ningún cambio significativo en el rendimiento del modelo con la marca de agua activada, y que, como la señal reside en las propias palabras, viaja con el texto cuando se copia y pega. [ 2 , 3 ]
OpenAI también expuso los límites. Según TechCrunch, una prueba encontró que sustituir el 10 por ciento de las palabras por sinónimos redujo la detección de alrededor del 92 por ciento al 66 por ciento; Engadget informó de una tasa de éxito de alrededor del 80 por ciento para textos más cortos. OpenAI dijo que los pasajes cortos, las matemáticas y el texto traducido son más difíciles de detectar, y que la marca de agua “no garantiza una detección fiable”, ni verifica la exactitud, establece la propiedad, mide la contribución humana ni prueba la autoría humana. [ 1 , 2 , 3 ]
Las normas que respaldan el cambio son los requisitos de transparencia de la Ley de IA de la UE, que según Engadget entraron en vigor el 2 de agosto. El artículo 50 exige que los proveedores de sistemas de IA generativa hagan que las salidas de texto sean identificables de forma legible por máquina; los nuevos entrantes ya están cubiertos, mientras que los proveedores preexistentes como OpenAI, Anthropic, Microsoft, Google y Meta tienen hasta el 2 de diciembre para cumplir. Anthropic anunció anteriormente una medida similar de marca de agua de texto, también citando las normas de la UE, y dijo en ese momento que otros grandes proveedores también estaban implementando sistemas de marcado. [ 1 , 2 , 4 ]
Por qué importa
Las normas de transparencia de la Ley de IA de la UE empujan ahora a los principales proveedores de IA a marcar el texto generado por máquinas, y la implementación de OpenAI sitúa a textGrain como una alternativa a los enfoques de Anthropic y Google DeepMind. Debido a que el acceso al detector es limitado al principio y la propia OpenAI afirma que la detección no es fiable, el efecto práctico para los lectores e instituciones fuera de la UE probablemente será gradual.
Datos clave
- OpenAI dijo que añadirá una marca de agua de texto invisible a la salida de ChatGPT y Codex para los usuarios elegibles en la Unión Europea en las próximas semanas, en todos los planes. [ 1 , 3 ]
- Los clientes de la API en todo el mundo pueden optar por salidas con marca de agua para modelos seleccionados a partir de hoy; la función está desactivada por defecto. [ 1 , 3 , 4 ]
- OpenAI dijo que no convertirá la marca de agua de texto en una opción global por defecto en su lanzamiento. [ 1 , 3 ]
- El sistema se llama textGrain y funciona dando forma sutil a las elecciones de palabras del modelo para que un detector pueda identificar un patrón. [ 2 , 3 ]
- El acceso al detector se limitará inicialmente a investigadores aprobados y organizaciones expertas; el detector no identifica a los usuarios ni revela los prompts o las conversaciones. [ 1 , 2 , 3 ]
- OpenAI dijo que los pasajes cortos, las respuestas matemáticas y el texto traducido son más difíciles de detectar, y que su marca de agua “no garantiza una detección fiable”. [ 1 , 2 , 3 ]
- Las normas de transparencia de la Ley de IA de la UE entraron en vigor el 2 de agosto, y los proveedores preexistentes debían cumplirlas antes del 2 de diciembre. [ 2 ]
Confirmado por varias fuentes
- OpenAI anunció que añadirá una marca de agua a la salida de texto de ChatGPT y Codex en la UE para cumplir la Ley de IA de la UE. [ 1 , 2 , 3 , 4 ]
- El sistema de marca de agua de OpenAI se llama textGrain y funciona dando forma sutil a las elecciones de palabras para dejar un patrón detectable por máquina. [ 2 , 3 ]
- Los clientes de la API en todo el mundo pueden optar por la marca de agua para modelos seleccionados, con la función desactivada por defecto. [ 1 , 3 , 4 ]
- El acceso al detector se limita inicialmente a investigadores aprobados y organizaciones expertas, y no identifica a los usuarios ni revela los prompts. [ 1 , 2 , 3 ]
- Anthropic anunció previamente una medida comparable de marca de agua de texto vinculada a la Ley de IA de la UE. [ 1 , 2 , 4 ]
- OpenAI dijo que la marca de agua no verifica la exactitud, la propiedad ni la autoría humana y no garantiza una detección fiable. [ 1 , 2 , 3 ]
Aún sin aclarar
- Qué modelos podrán marcar con agua los clientes de la API. Engadget informó de que OpenAI no especificó qué modelos estarían disponibles para el público general global.
- Si la marca de agua se aplicará finalmente fuera de la UE. OpenAI dijo que no es un valor global por defecto “en el lanzamiento” y describió la implementación en la UE como un enfoque regional para aprender del uso en el mundo real, sin especificar el alcance a largo plazo.
- Qué fiabilidad tendrá la detección en el uso cotidiano. OpenAI publicó puntuaciones de referencia y un ejemplo en el que sustituir el 10 por ciento de las palabras por sinónimos redujo la detección de alrededor del 92 por ciento al 66 por ciento, pero dijo que el rendimiento en condiciones ideales no garantiza una detección fiable.
- La relación entre textGrain de OpenAI y SynthID de Google DeepMind para texto. Un medio dijo que textGrain igualaba o superaba otros enfoques como SynthID, que describió como la base de la marca de agua de Anthropic; otros medios no establecieron ese vínculo.
Qué dicen los medios locales
Cronología, hora local
- The Verge informa de que OpenAI está implementando su marca de agua textGrain en ChatGPT y Codex en la UE y abriendo la opción de marca de agua para los clientes de la API. [ 1 ]
- Engadget informa de que OpenAI añadirá una marca de agua digital al texto y al código generados en la UE para cumplir las nuevas normas de transparencia. [ 2 ]
- TechCrunch informa de que OpenAI comenzará a aplicar marcas de agua al texto de ChatGPT en la UE, citando la publicación del blog de la empresa. [ 3 ]
- 9to5Mac informa de que OpenAI detalló su sistema de marca de agua para ChatGPT, Codex y la API, incluida la apertura de solicitudes de detector para investigadores aprobados. [ 4 ]