Meta ordenada a eliminar deepfake de concejala escocesa mientras el Consejo Asesor califica de inadecuadas sus reglas de IA
Puntos clave
- •El Consejo Asesor de Meta ordenó la eliminación de un video generado por IA que usaba la imagen de una concejala laborista escocesa para representar falsamente que avalaba la violencia sexual por parte de refugiados, revirtiendo la decisión inicial de la empresa de mantenerlo en línea.
- •La mayoría del Consejo determinó que el clip violaba la política de Conducta Odiosa de Meta por acusar a los refugiados como un grupo entero de criminalidad grave, aunque coincidió en que las reglas de acoso no requerían la eliminación porque la concejala es una figura pública.
- •El video permaneció accesible tras dos reportes y apelaciones de usuarios sin llegar nunca a un revisor humano, y Meta tampoco le aplicó una etiqueta de IA.
- •Tras sus dos fallos, el Consejo calificó de inadecuadas las salvaguardas de Meta y recomendó ampliar el etiquetado de IA de alto riesgo, desmonetizar o degradar dicho contenido y priorizar la revisión humana del material reportado, con 60 días para que Meta responda.
- •Las decisiones llegan en medio de un endurecimiento global de las reglas sobre medios sintéticos, que incluye las nuevas reglas de responsabilidad de China, el código de transparencia de contenido de IA de la UE y políticas de plataformas como la prohibición de deepfakes sin consentimiento en Google Play.

El Consejo Asesor de Meta ordenó a la empresa eliminar un video generado por IA que utilizaba la imagen de una concejala laborista escocesa para representar falsamente que avalaba la violencia sexual por parte de refugiados. Meta había decidido inicialmente mantener el clip en línea y, más allá de revertir esa decisión, el Consejo advirtió que la forma en que la empresa maneja los deepfakes expone a los usuarios al riesgo de engaño.
El Consejo, un panel independiente que Meta estableció en 2020 para revisar las decisiones de moderación de contenido de la empresa, anunció su decisión en un comunicado, centrado en un clip que circuló en Facebook en noviembre de 2025. El video mostraba a una política local del Partido Laborista en Escocia aparentemente diciendo: "Los refugiados son bienvenidos aquí, incluso si violan a nuestras mujeres, porque los blancos también lo hacen".
El Consejo describió la representación como realista pero sintética, señalando que el audio no coincidía con los movimientos faciales de la concejala. El clip aparecía en un álbum que también contenía una fotografía de varias mujeres identificadas, incluida la concejala, en una protesta contra la extrema derecha.
Dos usuarios, uno de ellos la propia concejala, reportaron el video bajo las reglas de acoso e intimidación de Meta, pero los sistemas de la empresa nunca lo remitieron a un revisor humano, y permaneció en línea a través de dos apelaciones. Un tercer usuario llevó entonces el caso al Consejo. Incluso después de esa escalada, Meta sostuvo que el video no violaba ninguna regla y que no merecía una etiqueta de IA. La concejala dijo al Consejo que el video fue "bastante traumático".
La mayoría del Consejo determinó que el clip violaba la política de Conducta Odiosa de Meta porque acusaba a los refugiados como un grupo entero de criminalidad grave y comportamiento sexual depredador, rechazando la afirmación de Meta de que solo se dirigía a algunos refugiados. El Consejo no lo consideró desinformación eliminable, pero señaló que debía llevar una etiqueta de "IA de Alto Riesgo".
El Consejo sí estuvo de acuerdo con Meta en un punto: las reglas de acoso e intimidación no requerían la eliminación, porque un funcionario electo es una figura pública con derecho a menor protección que una persona privada.
Segundo caso y recomendaciones
El Consejo también intervino en un segundo caso relacionado con una entrevista manipulada por IA de una mujer que promovía la educación sobre salud menstrual. Tras la intervención del Consejo, Metaó ese video por acoso. El Consejo, por separado, emitió recomendaciones de políticas en las que insta a las plataformas a identificar y etiquetar a gran escala el audio y video manipulados por IA.
En conjunto, los dos fallos llevaron al Consejo a calificar las salvaguardas de Meta de "consistente y fundamentalmente inadecuadas".
El Consejo recomendó que Meta reduzca el umbral de las etiquetas de "alto riesgo" para que no se reserven solo para elecciones o crisis, y que reemplace algunas etiquetas por una pantalla intersticial de clic obligatorio. También sugirió que el contenido de IA de alto riesgo sea desmonetizado, degradado o eliminado de las recomendaciones, con penalizaciones crecientes para quienes lo compartan repetidamente.
El Consejo también quiere que Meta priorice la revisión humana del contenido sospechoso de ser generado por IA cuando sea reportado, publique datos anuales sobre la frecuencia con la que aplica etiquetas de IA, incluidas las publicaciones sobre políticos, y redacte sus reglas de votación y censo para que se apliquen globalmente y no solo en Estados Unidos. Meta tiene 60 días para responder al Consejo. El fallo del Consejo sobre el video en sí es vinculante para la empresa, pero sus recomendaciones de políticas más amplias solo requieren una respuesta, dejando a Meta decidir cuáles de los cambios propuestos adopta.
Endurecimiento global de las reglas sobre medios sintéticos
Los fallos llegan mientras los gobiernos y las plataformas de todo el mundo endurecen sus reglas sobre medios sintéticos, un impulso paralelo que presiona a las empresas a identificar y etiquetar a gran escala el audio y video manipulados. La Corte Suprema Popular de China estableció reglas de responsabilidad el 7 de septiembre que establecen que crear o compartir una réplica por IA del rostro o la voz de una persona sin permiso constituye una infracción. Cryptopolitan informó que Beijing, por separado, eliminó más de 14,000 productos de IA en la primera fase de su limpieza "Qinglang" a principios de este año.
El Código de Buenas Prácticas de la Unión Europea sobre Transparencia del Contenido Generado por IA insta a los proveedores a marcar el contenido de IA y a los implementadores a etiquetar los deepfakes.
La política de Contenido Generado por IA de Google Play prohíbe a los usuarios publicar material sexual deepfake sin consentimiento y contenido electoral que sea "demostrablemente engañoso o falso".
Solo algunos usuarios pueden usar IA en la escritura sin revelarlo en Medium, y la plataforma prohíbe categóricamente la desinformación generada por IA.