Archivo editorial

CiberseguridadGuía

Cómo detectar y verificar contenido generado por IA: texto, imagen y voz

Guía práctica para comprobar si un texto, una imagen o un audio los generó una IA, con las herramientas reales disponibles en 2026 (C2PA, SynthID Detector, clasificadores de voz) y sus límites honestos.

Publicado
15 de junio de 2026
Tiempo
5 min de lectura
Autoría
Redacción Cubix Academia
Profundidad
intermedio
Una onda de sonido representada en una pantalla oscura

La pregunta "¿esto lo ha hecho una IA?" rara vez tiene una respuesta binaria. Lo que existe hoy son señales de distinta fiabilidad: procedencia firmada, marcas de agua y clasificadores estadísticos. Esta guía enseña a combinarlas por tipo de medio y, sobre todo, a interpretar qué prueba y qué no prueba cada una. El error más caro no es no detectar la IA, sino confiar en un detector que se equivoca.

Antes de empezar: tres mecanismos distintos

  • Procedencia (C2PA / Content Credentials): metadatos firmados criptográficamente que declaran cómo se creó y editó un archivo. Es opt-in y se puede borrar.
  • Marca de agua (SynthID y similares): una señal imperceptible incrustada en el propio contenido por el modelo que lo generó. Solo la detecta quien la puso.
  • Clasificador estadístico: un modelo que estima probabilidad de origen IA. No hay firma ni marca: es una conjetura, con falsos positivos.

Ninguno es suficiente por sí solo. La verificación seria cruza al menos dos.

Texto: el caso más difícil

No existe un detector de texto fiable, y conviene decirlo sin matices comerciales. Stanford HAI documentó un 61 % de falsos positivos sobre ensayos de escritores no nativos de inglés, y en enero de 2026 la Universidad de Curtin desactivó la detección de IA de Turnitin por problemas de fiabilidad. La precisión cae a 60-80 % en texto parafraseado y los textos por debajo de ~200 palabras no dan señal suficiente.

Método razonable:

  1. Trata cualquier detector (GPTZero, Turnitin, Copyleaks) como indicio débil, nunca como prueba. Nunca acuses a una persona a partir de un porcentaje.
  2. Si el texto vino de la app o web de Gemini, puede llevar marca de agua SynthID (Google ajusta las probabilidades de los tokens al generar). Súbelo al SynthID Detector si tienes acceso.
  3. Prioriza señales no estadísticas: incoherencias factuales, citas inventadas, fechas imposibles, uniformidad de estilo sospechosa.