Publicado el · actualizado el · IA responsable

¿Se puede saber si un texto lo ha escrito una IA?

Marcas de agua y detectores de texto generado por IA: cómo funcionan, por qué fallan con textos humanos y por qué en audio e imagen el problema va más avanzado.

¿Lo ha escrito una IA?

En enero de 2026, una alumna del máster de IA en UNIR en el que doy clase sobre IA Generativa preguntó en el foro por qué un detector marcaba como escrito por IA el trabajo de fin de máster que había escrito ella. La respuesta corta es que esos detectores no son fiables, y que saber con certeza si un texto lo ha escrito una IA sigue siendo, en general, un problema sin resolver. La respuesta larga explica por qué, y por qué en audio e imagen la situación es distinta.

Hay dos formas de intentarlo: marcar el texto mientras se genera o adivinarlo después.

Marcar el texto al generarlo

Un modelo de lenguaje escribe eligiendo la siguiente palabra (en realidad, el siguiente fragmento de palabra, o token) según unas probabilidades. Una marca de agua aprovecha ese momento para dejar una señal estadística en el texto.

La idea más conocida la publicaron John Kirchenbauer y sus colegas de la Universidad de Maryland en 2023. Antes de elegir cada palabra, el sistema divide el vocabulario en una lista «verde» y otra «roja» de forma pseudoaleatoria, y favorece ligeramente las verdes. Una persona no nota nada al leer, pero quien conoce la clave puede contar cuántas palabras verdes hay y calcular si es demasiada casualidad (Kirchenbauer et al., 2023).

Google usa un sistema de este tipo, SynthID Text, en las respuestas de Gemini. En un artículo publicado en Nature en 2024 explicaron cómo funciona y lo probaron con cerca de 20 millones de respuestas reales, sin que los usuarios notaran pérdida de calidad (Dathathri et al., 2024). El equipo de Hugging Face tiene una buena introducción a estas técnicas para texto, imagen y audio (Hugging Face, 2024).

Por qué la marca de agua no lo resuelve todo

Una marca de agua solo sirve si el modelo que generó el texto la puso y si tienes el detector de ese proveedor. Un texto escrito con un modelo que no marca, o con uno cuyo detector no es público, no lleva ninguna señal que buscar.

Además, la marca se debilita si se reescribe el texto, si se traduce o si se mezcla con texto propio. Y hay que equilibrar: cuanto más fuerte es la marca, más fácil de detectar, pero más puede afectar a la calidad del texto. Es el equilibrio difícil que encontró WaterBench al comparar varios métodos (Tu et al., 2024).

Los modelos abiertos complican todavía más las cosas. Si cualquiera puede descargar el modelo, puede generar sin marca. Y un estudio de 2025 mostró que las marcas de agua integradas en los propios modelos abiertos desaparecen con modificaciones habituales como reentrenarlos con otros datos, comprimirlos o combinarlos con otros modelos (Gloaguen et al., 2025).

Adivinar después: los detectores

Los detectores que usa la mayoría de la gente no buscan marcas de agua. Son clasificadores que estiman si un texto «parece» generado, sobre todo por lo predecible que es: los modelos de lenguaje tienden a elegir las palabras más probables, y un texto muy predecible les resulta sospechoso.

El problema es que muchos textos humanos también son predecibles. Un trabajo académico está escrito con un lenguaje formal, ordenado y sin sorpresas, justo el estilo que imitan los modelos. Por eso mi alumna tenía un falso positivo. Un estudio de Stanford encontró que varios detectores clasificaban de forma sistemática como generados por IA textos escritos por personas que no tenían el inglés como lengua materna, con un vocabulario más limitado (Liang et al., 2023).

La propia OpenAI retiró su detector en julio de 2023 por su baja precisión: identificaba como probablemente generado solo el 26 % de los textos escritos por IA, y marcaba como IA el 9 % de los escritos por personas (OpenAI, 2023). A eso se suma que cada modelo escribe de una forma distinta, y un detector entrenado con unos no reconoce bien a otros.

La investigación sigue buscando alternativas. RepreGuard, publicado en 2025, propone mirar las activaciones internas de un modelo al procesar el texto, en lugar del texto final, y obtiene buenos resultados en sus pruebas (Chen et al., 2025). Es prometedor, pero todavía está lejos de ser una herramienta en la que confiar para acusar a nadie.

En audio e imagen, el problema está más avanzado

Con la voz y las imágenes hay mucho más margen para esconder una señal que las personas no perciben. AudioSeal, de Meta, marca el audio con una señal imperceptible, la detecta incluso en fragmentos concretos de una grabación y resiste bien las manipulaciones habituales (San Roman et al., 2024). Google aplica SynthID a imágenes, vídeo y al audio de algunos de sus productos, y ofrece un portal para comprobar si un contenido lleva su marca (Google DeepMind).

Esto importa especialmente para las voces clonadas, de las que hemos hablado en cuántos minutos hacen falta para clonar una voz y en antes de clonar una voz, pregunta de quién es. Y la normativa empuja en esa dirección: desde agosto de 2026, el Reglamento europeo de IA exige que los proveedores marquen el contenido sintético de forma que una máquina pueda detectarlo (Reglamento (UE) 2024/1689, artículo 50).

Las mismas limitaciones siguen ahí: la marca solo está si alguien la puso, y solo la encuentra quien tiene el detector adecuado.

Qué hacer con un detector

Si eres docente o evalúas textos, un detector puede ser, como mucho, un indicio para empezar una conversación. Nunca una prueba. Sirve más preguntar por el proceso: los borradores, el historial de versiones, las fuentes consultadas o una defensa oral del trabajo.

Si tu organización genera contenido con IA, la vía más sólida es la contraria: marcarlo y decirlo. Es más fácil demostrar que algo lo ha generado una IA cuando quien lo genera lo declara, que intentar adivinarlo después.

Referencias

Escrito por

Carlos Muñoz-Romero

Cofundador de Monoceros Labs

Cofundador de Monoceros Labs. Ingeniero informático y máster en ciencia de datos, dirige la tecnología de voz de Fonos. Antes Chief Innovation Officer de BEEVA (ahora BBVA Technology).

Compartir este artículo:

Artículos relacionados

Portada: ¿Cómo sonaría esta cara? Voces sintéticas a partir de una sola foto. IberSpeech 2026.

¿Cómo sonaría esta cara? Voces sintéticas a partir de una sola foto

Presentamos en IberSpeech 2026 un método que genera una voz plausible a partir de una foto. Te contamos cómo funciona, qué hemos medido y hasta dónde llega.

Los prejuicios de los datos

Un asistente repite los prejuicios de sus datos

De dónde vienen los sesgos de los asistentes y agentes de IA, cómo se notan en una conversación o en una voz y qué se puede medir para reducirlos.

¿De quién es una voz?

Antes de clonar una voz, pregunta de quién es

La voz identifica a una persona y la ley la protege. Qué dicen las normas española y europea, qué casos lo muestran y qué debe incluir un acuerdo de cesión.