影子AI:规则总是慢半拍——就连实验室自己也栽了跟头
98%的企业制定了人工智能战略,但只有39%由管理层主动统筹落地。同样一道纸面与现实之间的鸿沟,这周却出现在最意想不到的地方:Anthropic 的一道安全过滤器近一年未生效,OpenAI 则解散了负责灾难性风险的团队。

生成式人工智能已经走进德国企业的日常工作,内部治理却没能跟上。约75%的知识型员工已经在使用人工智能,而且大多未经正式批准。几乎所有企业——98%——都制定了人工智能战略,但只有39%的企业由高层管理团队主动统筹相关使用。《工作趋势指数》(Work Trend Index)显示,60%的管理者自称缺乏清晰的落地计划。战略文件与办公桌之间由此裂开一道合规鸿沟,如今它已经有了自己的名字:影子AI(Shadow AI)。
自带AI工具,大多不是恶意
78%的人工智能使用者会自带工具上班。原因很朴素:他们想更快完成工作,却在公司内部找不到经批准的选项。据德国数字协会 Bitkom 的数据,目前只有26%的企业为员工提供官方的人工智能服务。让四分之三的员工使用一项只有四分之一雇主真正提供的技术,产生的不是创新文化,而是带着语言模型的影子IT。
风险在数据所在之处变得严峻。人力资源、财务、税务和法务部门经常处理个人及具有法律敏感性的内容。一旦求职材料或员工数据被复制进公开工具,《通用数据保护条例》(GDPR)第5条规定的数据最小化和目的限定原则就会被触发——而公司内部没有人能说清这些数据此后如何被处理或存储。自今年8月起,欧盟《人工智能法案》针对影响个人、权利或安全的应用场景,又追加了透明度和留档义务。
- 数据保护:哪些个人数据或对企业至关重要的数据,可以流入哪个模型?
- 监管合规:该应用场景是否属于欧盟《人工智能法案》透明度和留档义务的范围?
- 专业责任:如果没有人对输出结果进行专业审核,谁来为结果负责?
整整一年没有过滤器——在Anthropic
如果有人以为实验室自己已经补上了这道鸿沟,同一周便被现实打了脸。Anthropic 在自家的安全报告中披露,从2025年5月到2026年4月,所有外部承包商的数据在通过其系统时,具有拦截功能的生物风险分类器并未生效。这些过滤器本应阻止有关化学或生物武器的危险知识从模型中被提取出来。受影响的约有5万人,他们合计与模型进行了约1.33亿次对话;审核工作完全交由外部供应商负责,而据Anthropic透露,这些供应商的审查往往并不充分。
经过内部调查,该公司没有发现实际滥用的证据,并已收紧对承包商的要求。但细节依然耐人寻味:这正是那家首席执行官达里奥·阿莫迪(Dario Amodei)认为化学和生物武器风险比网络攻击更危险的公司。缺失的不是规则本身,而是对规则是否真正在运行的核查。
一条没有人衡量其效果的规则算不上管控——它只是一份带着档案编号的意向声明。
OpenAI解散其Preparedness团队
在OpenAI,这一变动更加公开。据英国《金融时报》援引多名内部人士报道,7月底该公司解散了负责评估自家模型是否存在严重或灾难性风险的Preparedness团队。生物和网络风险方面的职责已分散给现有团队;该团队前负责人Dylan Scandinaro如今转而研究具备递归自我改进能力的系统所带来的风险。联合创始人格雷格·布罗克曼(Greg Brockman)表示,安全工作已更深入地融入模型开发流程本身。
内部的说法却不一样。安全部门近期已有多名员工离职,包括伦理团队负责人Chloe Bakalar和Joshua Achiam。一位消息人士描述了一种潜在的情绪:既有责任感,也有对公司在安全方面投入不足的担忧。尤其是在Hugging Face发生自主黑客攻击事件之后,一些员工公开表达了批评意见;其中一人表示,希望OpenAI能把这起事件当作一次警钟。
企业应从中吸取什么
对企业内部的人工智能治理而言,这两起事件传递出同一条令人不安的教训:一份获批工具清单、一份政策文件、一次培训,产生的是文档,而不是安全。真正重要的是那个连Anthropic和OpenAI都没能及时回答的问题——管控今天是否真的在运行,如果它失效了,我们又凭什么能察觉?想真正遏制影子AI的企业,同样要回答78%的员工已经用自己的工具给出答案的那个问题:究竟哪种获批方案能真正让工作更快完成。没有替代方案的一纸禁令,只会把使用行为推到没有人能看见的地方。对中国及其他与欧盟客户或伙伴打交道的企业来说,这一课同样适用:一旦业务涉及欧盟公民的数据或欧盟市场,GDPR的最小化与目的限定原则、以及《人工智能法案》的留痕义务就会同样适用,一份签了字的AI政策,若没有足够快的官方替代工具与它对齐,终究只是一纸空文。
信息来源
- Shadow AI stoppen: 7 Punkte für rechtssichere KI-Nutzung im Unternehment3n · 2026年8月16日
- Anthropics Bio-Waffen-Filter war fast ein Jahr lang nicht aktiv – 133 Millionen Anfragen liefen ungeschütztThe Decoder · 2026年8月15日
- OpenAI löst Sicherheitsteam für katastrophale KI-Risiken aufThe Decoder · 2026年8月15日



