OpenAI comenzará a identificar automáticamente los textos generados por ChatGPT y Codex mediante un patrón estadístico que puede trampearse con pequeñas modificaciones
IA
OpenAI comenzará a identificar automáticamente los textos generados por ChatGPT y Codex mediante un patrón estadístico que puede trampearse con pequeñas modificacionesLa abundancia de contenido generado por IA ha llevado a las empresas tecnológicas a desarrollar métodos para insertar marcas de agua invisibles en imágenes y vídeos que identifiquen su origen sintético, pero hacerlo en textos es un desafío técnico mayor. Aunque existen diversas herramientas en el mercado que aseguran detectar los textos generados por IA, lo cierto es que sus resultados suelen ser poco fiables. Ahora es OpenAI quien comienza a introducir marcas de agua en los textos generados por ChatGPT, pero solo dentro de la Unión Europea.
El motivo de que sea así es la Ley de IA europea, que exige a los proveedores de modelos de IA generativa que hagan posible identificar mediante sistemas legibles por máquinas los contenidos generados por inteligencia artificial. Desde hoy, los clientes de la API de OpenAI podrán activar las marcas de agua para determinados modelos y durante las próximas semanas, la compañía comenzará a añadir automáticamente marcas de agua invisibles a los textos generados por ChatGPT y Codex dentro de la UE.
Cómo funciona textGrainLa marca de agua de ChatGPT no añadirá caracteres ocultos, signos de puntuación inusuales, espacios invisibles ni tokens adicionales al texto. En su lugar, la técnica textGrain de OpenAI modifica de forma sutil el patrón estadístico de las palabras y los tokens seleccionados por el modelo.
Cuando una IA genera texto asigna distintas probabilidades a los posibles tokens que pueden aparecer a continuación; estos son pequeñas unidades en las que divide el texto y que pueden corresponder a una palabra, una parte de ella o un signo de puntuación. TextGrain modifica ligeramente esas probabilidades siguiendo un patrón secreto para favorecer que el modelo seleccione determinadas alternativas. Es una idea similar a la que avanzó Anthropic para Claude en agosto.
OpenAI asegura que su técnica textGrain iguala o supera los resultados de otros métodos que ha probado, incluido SynthID para texto de Google. La compañía también pondrá esta tecnología a disposición de investigadores y otras organizaciones para que puedan desarrollar herramientas destinadas a detectar textos generados mediante inteligencia artificial.
OpenAI explica cómo engañar la detección de IA en textosLa propia OpenAI reconoce, sin embargo, que las marcas de agua en textos son mucho menos fiables que las utilizadas en imágenes o audio. Cuanto más corto es un texto, más difícil resulta determinar si ha sido generado por una IA.
Según las pruebas internas de la compañía, su detector pudo identificar alrededor del 80% de los fragmentos con marca de agua de 200 tokens y aproximadamente el 95% de los fragmentos de 400 tokens.
Pero las modificaciones, incluso pequeñas, pueden debilitar considerablemente la marca de agua. En las pruebas realizadas por OpenAI, sustituir únicamente el 10 % de las palabras por otras diferentes redujo la tasa de detección desde aproximadamente el 92 % hasta el 66 %. Al sustituir el 25 % de las palabras, la tasa cayó hasta solo el 17 %.
Para evitar que los falsos positivos puedan acabar provocando acusaciones injustificadas, OpenAI advierte de que detectar una marca de agua no debe considerarse una prueba de que alguien haya creado un texto con ChatGPT. Una marca puede indicar que un modelo de OpenAI generó o procesó una parte del contenido, pero no permite determinar cuánto lo modificó posteriormente el usuario ni qué proporción del resultado final corresponde a trabajo humano.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | ChatGPT introduces invisible text watermarks in the EU, though they're not hard to remove | 0 | 12.03 | 05-10-2026 |
| 2 | ChatGPT начнет незаметно маркировать тексты в ЕС: что это значит и как бизнесу использовать водяные знаки | 0 | 4.17 | 06-10-2026 |
| 3 | OpenAI объявила о добавлении невидимых водяных знаков в тексты ChatGPT в ЕС | 0 | 6.89 | 06-10-2026 |
| 4 | ChatGPT в Евросоюзе начнёт помечать тексты водяными знаками | 0 | 10 | 06-10-2026 |
| 5 | OpenAI lance son filigrane textGrain en Europe | 0 | 7.66 | 07-10-2026 |
| 6 | Google abre a todo el mundo su herramienta para detectar si una imagen, vídeo o audio ha sido creado con IA | 0 | 8.4 | 07-10-2026 |
| 7 | В ChatGPT появились рекламные материалы | 0 | 10.4 | 10-02-2026 |
| 8 | Wasserzeichen für KI-Texte: Anthropic weitet Anwendung aus | 0 | 19.17 | 25-09-2026 |
| 9 | OpenAI brings GPT-6 to 1.2 billion ChatGPT users with new Intelligent UI | 0 | 18.53 | 07-10-2026 |
| 10 | ChatGPT quiere plantar cara a Google Maps: así funcionan los mapas de OpenAI | 0 | 19.22 | 26-09-2026 |