百余位AI专家呼吁在实验室内设立独立评估员
超过一百名专家与评估员于2026年9月18日签署AI Evaluator Forum组织的信件,要求嵌入式评估员在法律和财务上保持独立,保留结论的编辑控制权,并对方法、结果、数据、工具、场所以及与实验室团队的直接访谈拥有透明访问。

一个历史性的AI专家联盟呼吁独立评估员
2026年9月18日,超过一百名专家和评估员签署了一封由AI评估员论坛协调的联名信。签署者代表了AI社区的各个层面,从领先的研究者到评估组织的负责人不等。他们的统一行动标志着对AI实验室审计方式进行结构性转变的前所未有的公开呼声。
签署者中包括杰弗里·辛顿、斯图尔特·拉塞尔和崔业进等知名人物。他们的加入表明所提出的关切并非局限于小众群体,而是被那些在人工智能领域耕耘数十年的人物所共享。学术领袖与评估官员的共同出现凸显了请愿背后广泛的专业知识。
核心诉求:独立、透明和访问权
该信阐明了一套明确的要求。首先,它坚持要求嵌入AI实验室的评估员在法律和财务上保持对其评估对象的独立性。这种独立旨在保障评估员能够在不受所在组织不当影响的情况下作出判断。
其次,签署者呼吁对所采用的方法、获得的结果、获取访问的条件以及任何潜在的利益冲突进行全面透明。通过要求披露这些要素,联盟旨在使评估过程本身接受审查,从而降低不透明或有偏见的评估风险。
第三,该信请求评估员获得与高度特权的内部员工相当的访问权限。这包括对实验室系统、数据仓库、专用工具、实体场所以及对负责AI项目团队的直接访谈的无限制进入。其理由是,只有通过如此全面的访问,评估员才能核实声明并发现隐藏风险。
沟通与保护机制
提案的另一要素是为评估员设立正式渠道,以直接向实验室董事会报告。这将使评估员能够在最高治理层面呈现发现,确保战略决策受到独立分析的影响。此外,信中允许评估员发布所收集的证据,但需进行有限且暂时的遮蔽,以保护安全、隐私和知识产权。
关键的是,签署者要求提供法律保障,以防评估员因其结论不受实验室欢迎而遭受司法或财务报复。这种保护旨在消除当前阻碍严格、批判性报告的主要威慑因素。
该联盟明确将其提案定位为补充而非替代。它声明所建议的框架将增强现有的内部控制和公共透明机制,而不会取代监管制度或AI提供者的责任。这一表述承认法律和市场力量的作用,同时凸显独立评估能够填补的空白。
影响与未解之问
如果被采纳,所列措施可能会重塑AI开发者与外部监督者之间的权力动态。拥有法律和财务自主权的独立评估员,或许能够揭示内部审计团队忽视或淡化的风险。向董事会层面的沟通要求也可能提升安全关切在公司战略中的可见度。
然而,授予评估员如此程度的访问权限的可行性仍不确定。对专有系统和数据的无限制进入会引发如何在保护商业机密的同时满足透明条款的问题。临时遮蔽条款试图在两者之间取得平衡,但信中并未定义何种情况构成必要的遮蔽。
另一个悬而未决的问题是反报复保证的执行方式。虽然信中呼吁防止法律和财务报复,却未具体说明这种保护将通过何种机制进行监测或强制执行。是现有劳动法可以扩展覆盖独立评估员,还是需要新的合同框架,仍需进一步审查。
该提案还提出了独立评估员的选拔和资金来源问题。保持与实验室的财务独立意味着评估员必须获得不持有既得利益的来源的资源。信中未阐述潜在的资助模式,留下了关键的运营细节未解。
- 评估员的法律和财务自主权
- 对方法、结果和利益冲突的全面披露
- 与特权内部员工同等的访问权限
- 直接向公司董事会报告的渠道
从更广阔的视角看,联盟的诉求可能影响未来的政策讨论。监管机构可能将自愿框架视为强制标准的基准,尤其是在行业表现出自我监管意愿时。相反,信中缺乏明确的监管语言表明签署者预期立法机构将继续发挥独特作用。
对互补监督的强调暗示了一种分层的AI治理方式。独立评估可以作为内部合规计划与外部监管审计之间的中间层,可能在开发流水线的更早阶段捕捉问题。
最后,超过一百人的签署人数本身提供了一种合法性衡量,可能迫使AI实验室认真考虑这些提案。高调研究者的加入为当前评估实践可能不足以应对现代AI系统规模和影响的论点增添了分量。
信息来源
- Anthropic and OpenAI need truly independent safety evaluatorsCNBC · 2026年9月18日
- Minimum Conditions for Embedding EvaluatorsAI Evaluator Forum · 2026年9月18日



