Ciberseguridad · Guía

Cómo detectar y verificar contenido generado por IA: texto, imagen y voz

15 de junio de 2026 · 5 min de lectura · Por Redacción Cubix Academia · Nivel intermedio

Guía práctica para comprobar si un texto, una imagen o un audio los generó una IA, con las herramientas reales disponibles en 2026 (C2PA, SynthID Detector, clasificadores de voz) y sus límites honestos.

La pregunta "¿esto lo ha hecho una IA?" rara vez tiene una respuesta binaria. Lo que existe hoy son señales de distinta fiabilidad: procedencia firmada, marcas de agua y clasificadores estadísticos. Esta guía enseña a combinarlas por tipo de medio y, sobre todo, a interpretar qué prueba y qué no prueba cada una. El error más caro no es no detectar la IA, sino confiar en un detector que se equivoca.

Antes de empezar: tres mecanismos distintos

  • Procedencia (C2PA / Content Credentials): metadatos firmados criptográficamente que declaran cómo se creó y editó un archivo. Es opt-in y se puede borrar.
  • Marca de agua (SynthID y similares): una señal imperceptible incrustada en el propio contenido por el modelo que lo generó. Solo la detecta quien la puso.
  • Clasificador estadístico: un modelo que estima probabilidad de origen IA. No hay firma ni marca: es una conjetura, con falsos positivos.

Ninguno es suficiente por sí solo. La verificación seria cruza al menos dos.

Texto: el caso más difícil

No existe un detector de texto fiable, y conviene decirlo sin matices comerciales. Stanford HAI documentó un 61 % de falsos positivos sobre ensayos de escritores no nativos de inglés, y en enero de 2026 la Universidad de Curtin desactivó la detección de IA de Turnitin por problemas de fiabilidad. La precisión cae a 60-80 % en texto parafraseado y los textos por debajo de ~200 palabras no dan señal suficiente.

Método razonable:

  1. Trata cualquier detector (GPTZero, Turnitin, Copyleaks) como indicio débil, nunca como prueba. Nunca acuses a una persona a partir de un porcentaje.
  2. Si el texto vino de la app o web de Gemini, puede llevar marca de agua SynthID (Google ajusta las probabilidades de los tokens al generar). Súbelo al SynthID Detector si tienes acceso.
  3. Prioriza señales no estadísticas: incoherencias factuales, citas inventadas, fechas imposibles, uniformidad de estilo sospechosa.

Este artículo es para suscriptores

Desbloquea el blog completo con cualquier plan.

Cómo detectar y verificar contenido generado por IA: texto, imagen y voz | Blog Cubix Academia