百餘位AI專家要求在實驗室內設立獨立評估員
超過一百名專家與評估員於2026年9月18日簽署AI Evaluator Forum組織的信件,要求嵌入式評估員在法律與財務上保持獨立,保留結論的編輯控制權,並對方法、結果、資料、工具、場所以及與實驗室團隊的直接訪談擁有透明的存取。

AI 專家歷史性聯盟呼籲獨立評估者
2026 年 9 月 18 日,超過一百位專家與評估者簽署了一封由 AI 評估者論壇協調的聯合信函。簽署者代表了 AI 社群的各個層面,從領先的研究者到評估機構的負責人不等。他們的統一行動標誌著對 AI 實驗室審計方式進行結構性轉變的前所未有的公開呼聲。
簽署者中包括 Geoffrey Hinton、Stuart Russell 與 Yejin Choi 等知名人物。他們的加入顯示所提出的關切並非僅限於小眾群體,而是被那些在人工智慧領域耕耘了數十年的人物所共享。學術領袖與評估官員的同時出席,凸顯了請願背後廣泛的專業知識。
核心訴求:獨立性、透明度與存取權
該信函闡明了一套明確的要求。首先,它堅持嵌入於 AI 實驗室內的評估者必須在法律與財務上保持對其評估對象的獨立性。此種獨立性旨在保障評估者能在不受主辦組織不當影響的情況下作出判斷。
其次,簽署者要求對所採用的方法、取得的結果、准入條件以及任何潛在的利益衝突進行全面透明。透過要求揭露這些要素,聯盟希望使評估過程本身受到審查,從而降低不透明或有偏見的評估風險。
第三,該信函請求賦予評估者與高度特權的內部員工相當的存取權。這包括對實驗室系統、資料庫、專業工具、實體場域以及與負責 AI 專案團隊的直接訪談的無限制進入。其理由在於,只有透過如此全面的存取,評估者才能驗證聲稱並偵測隱蔽風險。
溝通與保護機制
提案的另一要素是為評估者與實驗室董事會之間建立正式的直接溝通渠道。這將允許評估者在最高治理層面呈報發現,確保策略決策受到獨立分析的資訊支援。此外,信函允許評估者發布所蒐集的證據,僅在有限且暫時的遮蔽下進行,以保護安全、隱私與智慧財產權。
關鍵的是,簽署者要求提供法律保障,以防評估者因其結論不被實驗室接受而遭受司法或財務報復。此種保護旨在消除目前阻礙嚴謹、批判性報告的主要障礙。
聯盟明確將其提案定位為補充而非替代。它指出,建議的框架將增強現有的內部控制與公共透明機制,並不取代監管制度或 AI 供應者的責任。此說法承認法律與市場力量的角色,同時突顯獨立評估可填補的缺口。
影響與未解之問
若獲採納,所列措施可能重塑 AI 開發者與外部監督者之間的權力動態。具備法律與財務自主性的獨立評估者,或能揭露內部稽核團隊忽視或淡化的風險。董事會層級的溝通要求亦可能提升安全關切在企業策略中的能見度。
然而,賦予評估者如此程度的存取權的可行性仍存疑。對專有系統與資料的無限制進入會引發如何在保護商業機密的同時仍符合透明條款的問題。暫時遮蔽條款試圖平衡這些利益,但信函未定義何種情況下需要進行必要的遮蔽。
另一未解之題是反報復保證的執行。雖然信函呼籲防止法律與財務報復,但未說明將透過何種機制監督或執行此類保護。現行勞動法是否能延伸至獨立評估者,或是否需新契約框架,仍待進一步檢視。
提案亦提出獨立評估者的選拔與資金來源問題。維持與實驗室的財務獨立意味著評估者必須從不對結果有既得利益的來源獲取資源。信函未闡述可能的資金模式,留下關鍵的營運細節未解。
- 評估者的法律與財務自主性
- 完整披露方法、結果與利益衝突
- 與特權內部員工同等的存取權
- 直接向公司董事會報告的渠道
從更廣闊的視角看,聯盟的訴求可能影響未來的政策討論。監管機構或將此自願框架視為強制標準的基準,尤其在產業展現自我規範意願時。相對地,信函缺乏明確的監管語言,表明簽署者預期立法機關仍將扮演獨立角色。
對互補式監督的強調暗示了一種分層的 AI 治理方法。獨立評估可作為內部合規計畫與外部監管稽核之間的中間層,或能在開發流程較早階段捕捉問題。
最後,超過百位簽署者的龐大規模提供了合法性指標,可能迫使 AI 實驗室認真考慮這些提案。高調研究者的參與為當前評估實務可能不足以應對現代 AI 系統規模與影響的論點增添分量。
資料來源
- Anthropic and OpenAI need truly independent safety evaluatorsCNBC · 2026年9月18日
- Minimum Conditions for Embedding EvaluatorsAI Evaluator Forum · 2026年9月18日



