Grok concentra el 87% de los ficheros de deepfakes rastreados en el primer semestre, con 15.736 víctimas

Grok concentra el 87% de los ficheros de deepfakes rastreados en el primer semestre, con 15.736 víctimas
Ilustración: Digital Brain

Resemble AI ha publicado su informe de amenazas del primer semestre de 2026 y el dato que lo domina es la concentración: el 87% de los ficheros sintéticos con trazabilidad usados en ataques documentados se atribuye a Grok, el generador de SpaceXAI. El recuento total es de 821 ataques, unos 3,46 millones de ficheros y al menos 15.736 víctimas confirmadas.

Puntos clave

  • El informe analiza 1.760 informaciones periodísticas y documenta 821 ataques distintos entre enero y junio de 2026.
  • Unos 3,46 millones de ficheros sintéticos (imágenes, vídeos y audios) en seis meses, casi tanto como en todo 2025.
  • Al menos 15.736 víctimas confirmadas.
  • 137 de los 821 ataques, aproximadamente uno de cada seis, implicaban imágenes íntimas no consentidas de adultos o de menores.
  • Resemble AI lanzó a la vez DETECT-World, un modelo de detección con una capa que comprueba si la iluminación, las sombras y el movimiento son físicamente coherentes.

Sobre el 87%

El número pide contexto antes de repetirlo. Es el 87% de los ficheros que se pudieron atribuir a un generador concreto dentro de los ataques documentados en prensa. No es el 87% de todos los deepfakes que existen.

Ese sesgo de trazabilidad importa por dos razones opuestas. Por un lado, hay generadores que dejan menos rastro y quedan infrarrepresentados. Por otro, la muestra se construye sobre casos que llegaron a los medios, que son los más graves.

Aun con esos matices, la concentración en una sola herramienta no tiene precedente en ediciones anteriores del informe. Cuando el 87% de lo rastreable sale del mismo sitio, la explicación no está en la demanda, está en las barreras de ese producto.

La parte que no admite matiz

137 de los 821 ataques implicaban imágenes íntimas no consentidas, de adultos o de menores. Uno de cada seis.

Ese es el número que debería ordenar cualquier discusión sobre este informe. Los otros datos hablan de escala; este habla de qué se está haciendo con ella.

La detección va detrás

La segunda mitad del informe es igual de reveladora. Resemble AI ha sacado DETECT-World, un modelo pensado para identificar contenido sintético de generadores que nunca ha visto, incluidos los diseñados para esquivar detectores existentes.

Funciona con una capa de comprobación física: mira si la iluminación, las sombras y el movimiento son internamente coherentes con cómo se comporta la realidad. Es un enfoque distinto al de reconocer la huella de un generador concreto, y por eso puede cubrir herramientas nuevas.

El problema es de calendario. La herramienta responsable de la mayoría del daño documentado llevaba más de 18 meses funcionando a escala antes de que existiera una detección con esta cobertura. Ese desfase es el resumen del estado del asunto: se genera más rápido de lo que se detecta.

Qué hay del lado regulatorio

Europa ya movió ficha. Desde el 2 de agosto el AI Act obliga a etiquetar deepfakes y chatbots, con multas de hasta 15 millones. Y Anthropic acaba de meter marcas de agua invisibles en todo lo que escribe Claude para cumplir esa misma norma.

La regulación va por el etiquetado en origen. Este informe enseña el límite de esa estrategia: sirve con quien cumple, y los ataques documentados salen mayoritariamente de quien no.

Por qué importa

Para una empresa, esto ha dejado de ser un asunto de política pública y es un riesgo operativo concreto.

El vector más común no es un vídeo del CEO en redes. Es una llamada o un audio de WhatsApp con la voz de un directivo pidiendo una transferencia urgente, o validando un cambio de cuenta bancaria de un proveedor. Con 3,46 millones de ficheros circulando en seis meses, clonar una voz a partir de una entrevista pública es trabajo de minutos.

El control que funciona no es tecnológico. Es de proceso: ningún cambio de cuenta bancaria ni ninguna transferencia fuera de lo habitual se aprueba por un canal solo, por muy reconocible que sea la voz. Verificación por un segundo canal, siempre, sin excepciones por urgencia. Eso se implanta en una reunión de media hora y no cuesta dinero.


Relacionado