Ciberseguridad · Guía
Cómo detectar y verificar contenido generado por IA: texto, imagen y voz
15 de junio de 2026 · 5 min de lectura · Por Redacción Cubix Academia · Nivel intermedio
Guía práctica para comprobar si un texto, una imagen o un audio los generó una IA, con las herramientas reales disponibles en 2026 (C2PA, SynthID Detector, clasificadores de voz) y sus límites honestos.
La pregunta "¿esto lo ha hecho una IA?" rara vez tiene una respuesta binaria. Lo que existe hoy son señales de distinta fiabilidad: procedencia firmada, marcas de agua y clasificadores estadísticos. Esta guía enseña a combinarlas por tipo de medio y, sobre todo, a interpretar qué prueba y qué no prueba cada una. El error más caro no es no detectar la IA, sino confiar en un detector que se equivoca.
Antes de empezar: tres mecanismos distintos
- Procedencia (C2PA / Content Credentials): metadatos firmados criptográficamente que declaran cómo se creó y editó un archivo. Es opt-in y se puede borrar.
- Marca de agua (SynthID y similares): una señal imperceptible incrustada en el propio contenido por el modelo que lo generó. Solo la detecta quien la puso.
- Clasificador estadístico: un modelo que estima probabilidad de origen IA. No hay firma ni marca: es una conjetura, con falsos positivos.
Ninguno es suficiente por sí solo. La verificación seria cruza al menos dos.
Texto: el caso más difícil
No existe un detector de texto fiable, y conviene decirlo sin matices comerciales. Stanford HAI documentó un 61 % de falsos positivos sobre ensayos de escritores no nativos de inglés, y en enero de 2026 la Universidad de Curtin desactivó la detección de IA de Turnitin por problemas de fiabilidad. La precisión cae a 60-80 % en texto parafraseado y los textos por debajo de ~200 palabras no dan señal suficiente.
Método razonable:
- Trata cualquier detector (GPTZero, Turnitin, Copyleaks) como indicio débil, nunca como prueba. Nunca acuses a una persona a partir de un porcentaje.
- Si el texto vino de la app o web de Gemini, puede llevar marca de agua SynthID (Google ajusta las probabilidades de los tokens al generar). Súbelo al SynthID Detector si tienes acceso.
- Prioriza señales no estadísticas: incoherencias factuales, citas inventadas, fechas imposibles, uniformidad de estilo sospechosa.