El Oversight Board tumba los vídeos deepfake de Meta y llama "insuficientes" sus defensas

El consejo de supervisión de Meta exige retirar dos vídeos falsos creados con IA que atacaban a una concejala escocesa y a una activista musulmana, y acusa a la compañía de tener unas salvaguardas "fundamentalmente inadecuadas". Meta dice que acatará en siete días.
Meta se ha comprometido a retirar de sus plataformas dos vídeos generados con inteligencia artificial que atacaban a dos mujeres, una de ellas una política británica, después de que su propio consejo de supervisión (el Oversight Board) calificara de "fundamentalmente inadecuadas" las defensas de la compañía contra los deepfakes. El consejo, el órgano cuasi independiente que Meta financia para revisar sus decisiones de moderación, reclamó el jueves la retirada de los vídeos al considerar que los dos casos chocan de lleno con las propias normas de la empresa sobre discurso de odio, desinformación y acoso. Meta respondió que acepta la decisión en ambos casos y que la cumplirá en un plazo de siete días.
El primer vídeo fabricado mostraba a una concejala del Partido Laborista en Escocia haciendo comentarios incendiarios sobre refugiados. No existía ningún registro público de que la política hubiera dicho algo semejante y el montaje presentaba las señales típicas de una manipulación: entre ellas, un audio que no iba sincronizado con el movimiento de sus labios. El segundo vídeo se cebaba con una activista musulmana en Europa y buscaba desacreditar su labor como divulgadora de salud, mostrándola falsamente comiendo comida basura mientras daba consejos sobre alimentación consciente y haciendo ejercicios absurdos. "De los políticos a los ciudadanos de a pie, los deepfakes generados con IA se usan cada vez más para acosar y silenciar a las mujeres que participan en el debate público", señaló Pamela San Martin, copresidenta del Oversight Board, que advirtió de un patrón más amplio: las mujeres que se pronuncian en público sufren de forma desproporcionada acoso y desinformación.
La clave está en cuánto pesa realmente este varapalo. Las decisiones del consejo sobre casos concretos son vinculantes para Meta, pero sus recomendaciones generales de política no lo son. Es decir, la empresa está obligada a bajar estos dos vídeos, pero no a reescribir sus normas. Y ahí es donde aprieta el consejo: sostiene que sus políticas son "sistemática y fundamentalmente insuficientes" ante la marea de contenido generado por IA en Facebook e Instagram, y pide un enfoque mucho más duro para etiquetar el contenido engañoso, sanciones más severas para los reincidentes y la retirada de los deepfakes que acosan a personas particulares.
El pulso no llega solo. La semana anterior, el mismo órgano pidió a Meta que no sustituyera el fact-checking profesional por las Notas de la Comunidad, el modelo de verificación colaborativa que popularizó X, la plataforma de Elon Musk. La petición se produjo después de que Meta anunciara que había empezado a probar ese sistema en 16 países hispanohablantes de Latinoamérica, un paso más hacia la eliminación de su programa de verificación. La agencia AFP trabaja actualmente en 26 idiomas dentro del programa global de fact-checking de Meta, incluida Latinoamérica.
Para el inversor, lo relevante no es un titular de reputación aislado, sino la tensión de fondo que revela: fabricar un deepfake es cada vez más barato y detectarlo y moderarlo, cada vez más caro. Cada episodio de este tipo presiona a Meta en dos frentes que sí tocan la cuenta de resultados a medio plazo: el coste de moderar y verificar contenido a escala, y el riesgo de que los anunciantes perciban sus plataformas como un entorno poco seguro para su marca. No hay cifras de negocio en juego hoy, pero sí un goteo de decisiones que van marcando el terreno por el que se moverá la compañía (y sus competidoras) en el negocio publicitario.
El análisis de Salseo
- Lo decisivo del fallo no es el vídeo, es la letra pequeña: las resoluciones sobre casos concretos obligan a Meta, pero las recomendaciones de política no. La empresa puede cumplir retirando dos vídeos sin tocar una sola norma, así que la presión real no viene del consejo, sino del precedente que acumula de cara a futuras exigencias regulatorias más difíciles de esquivar.
- El caso de las Notas de la Comunidad es el hilo del que tirar: Meta prueba ese sistema en 16 países hispanohablantes de Latinoamérica, un paso hacia eliminar su verificación profesional, justo cuando el consejo le pide lo contrario. Traducido a negocio: la compañía intenta abaratar moderación mientras la IA generativa multiplica el contenido que hay que moderar. Esa pinza de costes es la que el mercado debería vigilar, no el comunicado.
- Aquí hay un riesgo publicitario clásico de seguridad de marca. Un deepfake viral contra una persona concreta no cuesta dinero directamente, pero erosiona la confianza de los anunciantes en que su mensaje no acabará junto a contenido tóxico o falso. En una empresa que vive de la publicidad, la percepción de que la plataforma es un entorno poco seguro se paga en presupuesto de marketing y en precios.
- La señal concreta que vigilar: si Meta endurece de verdad el etiquetado de contenido engañoso y las sanciones a reincidentes, o si se limita a cumplir el mínimo obligatorio. La diferencia entre una cosa y otra marca si el episodio se queda en un titular incómodo o se convierte en el próximo frente de costes y regulación del sector.
- Matiz que el titular no cuenta: el consejo también apunta a un sesgo de género concreto, los deepfakes se ceban de forma desproporcionada con mujeres que participan en el debate público. Además del ángulo reputacional, esto anticipa una presión política y social específica sobre cómo se detectan y retiran este tipo de montajes, un terreno donde las plataformas pueden acabar obligadas a invertir en herramientas de detección propias.