Disinfo Verify — Verificación de Hechos bajo Demanda // MÓDULOS

Disinfo Verify — Verificación de Hechos bajo Demanda

Verificación bajo demanda de un texto, una URL o una imagen contra el acervo de verificaciones ya publicadas por agencias de fact-checking. La petición entra en una cola, el resultado se graba en el mismo documento y recibe un enlace permanente: la verificación se convierte en una pieza archivable, no en una pantalla que se pierde.

Visión General

El acervo tenía 98.818 verificaciones indexadas en la medición del 26/07/2026, reunidas por tres canales independientes: Data Commons, la API de Google Fact Check Tools sobre 14 dominios de agencias y siete feeds RSS. La recolección corre diariamente a las 05:00.

La correspondencia es léxica y auditable. La búsqueda recupera las verificaciones candidatas y la confianza surge de la superposición de términos ponderada por su rareza: un término raro pesa más que uno banal. Hay dos umbrales: por encima de 0,55 el sistema decide, entre 0,38 y 0,55 marca el caso para revisión humana, y por debajo de eso no afirma nada. Y hay suelos anti-falso-positivo: al menos tres términos de contenido en común, de hasta cinco verificaciones mostradas entre cuarenta recuperadas.

La zona de abstención no es modestia retórica. La precisión de la correspondencia léxica se midió contra un conjunto de 246 pares etiquetados y no pasa del 17 % en su mejor punto; por eso el sistema muestra los términos que coincidieron y deja la decisión a la vista, en lugar de esconder el método detrás de un sello.

Entradas y Salidas

  • Texto libre — etiqueta conservadora entre cuatro opciones («desmentido por una verificación», «verificación relacionada encontrada», «indicio: requiere revisión humana», «sin coincidencias»), explicación, las verificaciones que coincidieron con los términos en común y el bloque «En realidad», con la corrección redactada por la propia agencia. Cuando la agencia no publicó una corrección, el bloque no aparece: la frase no se deriva de la afirmación.
  • URL — la misma salida, con el título recuperado del acervo, de la página descargada o de una copia en Internet Archive, más la circulación en las redes monitoreadas. La identidad de la URL es el hash de su forma canónica, con los parámetros de rastreo eliminados, para que la misma noticia compartida desde diez campañas sea un único documento.
  • Imagen (JPEG, PNG, WebP, AVIF, GIF) — procedencia declarada (EXIF, XMP, IPTC y detección del contenedor C2PA), histórico de la imagen en el acervo por sha256 y por pHash, cinco indicadores de peritaje de píxel con rango y percentiles, búsqueda inversa en la web y transcripción del texto superpuesto.

Decisiones de Ingeniería

Filtro de idioma con abstención. Sin filtro, el 9,0 % de los candidatos venía de otro idioma; con filtro, cero. Pero el detector se declara incierto en el 27,5 % de las consultas, y en esos casos el filtro se desactiva, en lugar de descartar un candidato legítimo por una corazonada débil.

pHash con hash del espejo. El hash perceptual reconoce la misma imagen tras una recompresión o un redimensionamiento. Como reflejar horizontalmente produce la distancia máxima, la plataforma guarda también el hash de la imagen reflejada: ocho bytes más que evitan el falso negativo más común en imágenes recicladas.

Peritaje con estrato de compresión. De los 37 indicadores de píxel medidos, se publicaron cinco: los que sobrevivieron a cuatro filtros simultáneos, entre ellos la robustez frente a la recompresión y la ausencia de sesgo por medio. Los rangos están estratificados por la tabla de cuantización JPEG, para que el indicador mida la imagen y no la redacción que la publicó.

Puerta de entrada hostil. Tipo detectado por los bytes, tope de tamaño y de megapíxeles, rechazo de las bombas de descompresión leyendo la cabecera antes de decodificar, SVG rechazado por no ser pictórico, y protección contra SSRF en la búsqueda por URL: DNS resuelto de antemano, rechazo si alguna IP es privada, y como máximo tres redirecciones revalidadas en cada salto.

Funcionalidades

  • Acervo de agencias con el veredicto normalizado en seis clases canónicas
  • Zona de abstención declarada, con los términos que coincidieron siempre visibles
  • Sección obligatoria «lo que no se pudo determinar», con un vocabulario cerrado de 17 motivos
  • Veredicto humano firmado, restringido a cinco opciones garantizadas por una restricción en la base de datos, en cuatro estados de publicación
  • Señales de coordinación y amplificación calibradas contra un modelo nulo, sobre siete redes normalizadas

Casos de Uso

  • Verificar una afirmación recibida por mensaje o publicada en la prensa antes de responder
  • Descubrir si una imagen ya circuló antes, en qué medios y desde cuándo
  • Preservar la verificación con enlace permanente, evidencia y rastro de cómo se produjo
  • Priorizar la cola de trabajo de un equipo de comunicación, jurídico o de verificación

Lo Que el Sistema No Hace

  • No emite un veredicto automático de verdadero o falso. Al modelo de lenguaje se le prohíbe por instrucción juzgar la veracidad, y un candado de diez patrones bloquea cualquier campo de salida que parezca un sello de autenticidad.
  • No acepta vídeo ni audio: solo texto, URL y los cinco formatos de imagen indicados arriba.
  • No clasifica una imagen como generada por IA: no existe un clasificador calibrado, y la lectura visual del modelo se presenta como opinión, con indicios y contraindicios.
  • No valida credenciales C2PA; detecta la presencia del contenedor y declara que no verificó la firma.
  • No etiqueta cuentas como bots, no reconoce rostros y no geolocaliza imágenes.
  • «Sin coincidencias» nunca se presenta como «verdadero».

Integraciones

  • Google Fact Check Tools API, Data Commons y RSS de agencias
  • Internet Archive, Google Cloud Vision (búsqueda inversa licenciada, no scraping)
  • OpenSearch, MinIO / Amazon S3

SLA y Garantías

Cola procesada cada 10 minutos · el veredicto sobre una imagen solo mediante dictamen humano firmado

Próximos Pasos