Vigilantes de seguridad de IA enfrentan cuestionamientos por conflictos de interés mientras el personal rota entre evaluadores y laboratorios
Puntos clave
- •El personal de METR, un evaluador prominente, incluye ex empleados de OpenAI y Anthropic, y algunos evaluadores tienen vínculos personales o familiares con personal de los laboratorios que evalúan.
- •El financiamiento de vigilantes como METR y Redwood Research fluye en parte a través de redes de Effective Altruism respaldadas por fundaciones vinculadas a Dustin Moskovitz, quien posee acciones de Anthropic.
- •El análisis de Kevin Bass de septiembre de 2026 sobre estas conexiones obtuvo casi 5 millones de vistas e hizo un llamado explícito a una investigación del Congreso sobre conflictos de interés estructurales.
- •METR declaró que no recibe dinero de laboratorios de IA ni de sus empleados y que ha rechazado ciertas fuentes de financiamiento para mantener su independencia.
- •Más de 100 expertos, incluido el ganador del Premio Turing Geoffrey Hinton, firmaron una carta el 18 de septiembre de 2026 que exige autonomía editorial para los evaluadores, transparencia total y protección contra represalias.

El creciente escrutinio de la puerta giratoria entre las organizaciones de evaluación de seguridad de inteligencia artificial y las empresas que deben supervisar ha puesto los conflictos de interés en el centro de la atención. Las personas que evalúan la seguridad de la IA pueden, en algunos casos, tener vínculos profesionales o financieros con los mismos laboratorios que examinan. Dado que esas evaluaciones están destinadas a determinar si los modelos de frontera son lo suficientemente seguros para su despliegue, las preguntas sobre la independencia de los evaluadores se extienden ahora a toda la industria.
Las propuestas del CEO de Anthropic, Dario Amodei, y del CEO de OpenAI, Sam Altman, de integrar evaluadores externos directamente dentro de sus laboratorios han intensificado el debate, convirtiendo una preocupación latente en un tema público prominente. Esta estructura colocaría a los organismos de vigilancia dentro de los mismos entornos que deben examinar, agudizando las dudas sobre cómo se preservaría la independencia.
La red de conexiones
En el centro de la controversia se encuentra METR, o Model Evaluation and Threat Research, una de las organizaciones más prominentes encargadas de evaluar si los modelos de IA de frontera son lo suficientemente seguros para su despliegue. El personal de METR incluye personas que trabajaron previamente en OpenAI y Anthropic, y la superposición va más allá de los currículums individuales.
El panorama de financiamiento es especialmente enredado. Dustin Moskovitz, cofundador de Facebook, posee acciones de Anthropic. Sus fundaciones filantrópicas canalizan dinero a través de redes de Effective Altruism que han proporcionado financiamiento significativo a organizaciones evaluadoras como METR y Redwood Research. El resultado es un ecosistema en el que el dinero que fluye hacia los vigilantes de seguridad puede rastrearse, a veces con solo uno o dos pasos, hasta las empresas evaluadas.
Varios evaluadores también tienen vínculos personales o familiares con empleados de los laboratorios que evalúan.
El investigador Kevin Bass publicó un análisis el 14 y 15 de septiembre de 2026 que mapea estas conexiones en detalle. El hilo atrajo casi 5 millones de vistas e incluía un llamado explícito a una investigación del Congreso sobre lo que Bass caracterizó como conflictos de interés estructurales.
La industria responde
METR ha respondido directamente a las acusaciones, afirmando que no acepta compensaciones ni donaciones de laboratorios de IA o de su personal. La organización dijo que ha rechazado activamente ciertas fuentes de financiamiento para mantener su independencia y subrayó su compromiso de divulgar posibles conflictos.
Los defensores del esquema actual señalan que evaluar modelos de IA de frontera requiere conocimientos técnicos extremadamente especializados. El talento disponible es inherentemente limitado, y las personas con las habilidades pertinentes casi con certeza han trabajado en laboratorios de IA o han recibido fondos de ellos en algún momento. E escasez ayuda a explicar por qué las superposiciones de personal y financiamiento persisten incluso entre organizaciones comprometidas con la independencia: la misma pequeña comunidad construye sistemas de frontera, integra a los evaluadores y está aguas arriba del dinero filantrópico que los financia.
La carta de expertos y lo que sigue
El 18 de septiembre de 2026, más de 100 expertos en IA firmaron una carta abierta exigiendo reformas estructurales. Entre los firmantes estaba Geoffrey Hinton, ganador del Premio Turing, que se ha convertido en uno de los críticos más vocales de cómo la industria de la IA se autorregula.
La carta pedía que los evaluadores tuvieran plena autonomía editorial sobre sus hallazgos, transparencia completa sobre metodologías y resultados, y protección explícita contra represalias por parte de las empresas que revisan.
No se han aprobado cambios regulatorios significativos hasta ahora, pero la presión política sigue aumentando. Las preguntas a seguir incluyen si el Congreso actúa ante el llamado a una investigación planteado en el análisis de Bass, si los laboratorios o evaluadores adoptan las demandas específicas de la carta, y si las propuestas de evaluadores integrados de Amodei y Altman toman forma de alguna manera.