Más de cien expertos en IA exigen evaluadores independientes dentro de los laboratorios
Más de cien especialistas y evaluadores firmaron el 18 de septiembre de 2026 una carta organizada por el AI Evaluator Forum, solicitando que los evaluadores integrados mantengan independencia jurídica y financiera, control editorial de sus conclusiones y acceso transparente a métodos, resultados, datos, herramientas, instalaciones y entrevistas directas con los equipos del laboratorio.

Una histórica coalición de expertos en IA pide evaluadores independientes
El 18 de septiembre de 2026, más de cien especialistas y evaluadores firmaron una carta colectiva que fue coordinada por el Foro de Evaluadores de IA. Los firmantes representan una sección transversal de la comunidad de IA, que abarca desde investigadores líderes hasta jefes de organizaciones de evaluación. Su acción unificada marca una demanda pública sin precedentes de un cambio estructural en la forma en que se auditan los laboratorios de IA.
Entre los firmantes se encuentran figuras prominentes como Geoffrey Hinton, Stuart Russell y Yejin Choi. Su inclusión indica que las preocupaciones planteadas no se limitan a un grupo de nicho, sino que son compartidas por personas que han moldeado el campo de la inteligencia artificial durante décadas. La presencia tanto de líderes académicos como de funcionarios de evaluación subraya la amplitud de la experiencia detrás de la petición.
Demandas centrales: independencia, transparencia y acceso
La carta articula un conjunto claro de requisitos. Primero, insiste en que los evaluadores incorporados en los laboratorios de IA mantengan independencia legal y financiera de las entidades que evalúan. Esta independencia está destinada a salvaguardar la capacidad de los evaluadores para formar juicios sin una influencia indebida de la organización anfitriona.
En segundo lugar, los firmantes solicitan total transparencia respecto a las metodologías empleadas, los resultados obtenidos, las condiciones bajo las cuales se concede el acceso y cualquier posible conflicto de intereses. Al exigir la divulgación de estos elementos, la coalición pretende que el propio proceso de evaluación esté sujeto a escrutinio, reduciendo así el riesgo de evaluaciones opacas o sesgadas.
En tercer lugar, la carta pide que a los evaluadores se les conceda un acceso comparable al que disfrutan los empleados internos altamente privilegiados. Esto incluye entrada sin restricciones a los sistemas del laboratorio, repositorios de datos, herramientas especializadas, instalaciones físicas y entrevistas directas con los equipos responsables de los proyectos de IA bajo revisión. La lógica es que solo mediante un acceso tan amplio los evaluadores pueden verificar las afirmaciones y detectar riesgos ocultos.
Mecanismos de comunicación y protección
Otro elemento de la propuesta es el establecimiento de canales formales para que los evaluadores se comuniquen directamente con los consejos de administración de los laboratorios. Esto permitiría a los evaluadores presentar sus hallazgos al nivel más alto de gobernanza, asegurando que las decisiones estratégicas se informen con análisis independientes. Además, la carta permite la publicación de la evidencia recopilada por los evaluadores, sujeta a un enmascaramiento limitado y temporal diseñado para proteger la seguridad, la privacidad y la propiedad intelectual.
De manera crucial, los firmantes exigen salvaguardas legales que protejan a los evaluadores de represalias judiciales o financieras en caso de que sus conclusiones resulten indeseables para el laboratorio examinado. Esta protección pretende eliminar un importante disuasivo que actualmente desalienta los informes críticos y rigurosos.
La coalición posiciona explícitamente su propuesta como complementaria y no sustitutiva. Afirma que el marco sugerido reforzaría los controles internos existentes y los mecanismos de transparencia pública, sin reemplazar los regímenes regulatorios ni la responsabilidad de los proveedores de IA. Este encuadre reconoce el papel del derecho y de las fuerzas del mercado, al tiempo que destaca una brecha que la evaluación independiente podría cubrir.
Implicaciones y preguntas sin respuesta
Si se adoptan, las medidas descritas podrían remodelar la dinámica de poder entre los desarrolladores de IA y los vigilantes externos. Los evaluadores independientes, con autonomía legal y financiera, podrían revelar riesgos que los equipos de auditoría interna pasen por alto o minimicen. El requisito de comunicación a nivel de consejo también podría elevar la visibilidad de los problemas de seguridad dentro de la estrategia corporativa.
Sin embargo, la viabilidad de conceder a los evaluadores el nivel de acceso descrito sigue siendo incierta. Proporcionar entrada sin restricciones a sistemas y datos propietarios plantea interrogantes sobre cómo se protegerán los secretos comerciales mientras se cumple la cláusula de transparencia. La disposición de enmascaramiento temporal intenta equilibrar estos intereses, pero los criterios que definan qué constituye un enmascaramiento necesario no están especificados en la carta.
Otro asunto abierto concierne a la aplicación de la garantía anti‑represalias. Aunque la carta solicita protección contra represalias legales y financieras, no detalla los mecanismos mediante los cuales dicha protección sería monitoreada o ejecutada. Queda por examinar si las leyes laborales vigentes podrían ampliarse para cubrir a los evaluadores independientes, o si se requerirían nuevos marcos contractuales.
La propuesta también plantea la cuestión de cómo se seleccionarían y financiarían los evaluadores independientes. Mantener la independencia financiera de los laboratorios implica que los evaluadores deben recibir recursos de fuentes que no tengan intereses creados en los resultados. La carta no elabora modelos de financiación potenciales, dejando sin resolver un detalle operativo crítico.
- Autonomía legal y financiera para los evaluadores
- Divulgación completa de métodos, resultados y conflictos de intereses
- Paridad de acceso con el personal interno privilegiado
- Canales de reporte directo a los consejos corporativos
Desde una perspectiva más amplia, las demandas de la coalición podrían influir en futuros debates políticos. Los reguladores podrían ver el marco voluntario como un referente para normas obligatorias, especialmente si la industria demuestra disposición a autorregularse. Por otro lado, la ausencia de un lenguaje regulatorio explícito en la carta sugiere que los firmantes anticipan que los cuerpos legislativos seguirán desempeñando un papel distinto.
El énfasis en una supervisión complementaria insinúa un enfoque estratificado de la gobernanza de la IA. La evaluación independiente podría servir como una capa intermedia entre los programas internos de cumplimiento y las auditorías regulatorias externas, capturando potencialmente problemas en etapas más tempranas del ciclo de desarrollo.
Finalmente, el gran número de firmantes —más de cien— brinda una medida de legitimidad que podría presionar a los laboratorios de IA a considerar seriamente las propuestas. La inclusión de investigadores de alto perfil aporta peso al argumento de que las prácticas de evaluación actuales pueden ser insuficientes para la escala e impacto de los sistemas de IA modernos.
Fuentes
- Anthropic and OpenAI need truly independent safety evaluatorsCNBC · 18 de septiembre de 2026
- Minimum Conditions for Embedding EvaluatorsAI Evaluator Forum · 18 de septiembre de 2026



