很抱歉,当前没有启用javascript,网站无法正常访问。请开启以便继续访问。
百余名专家联名呼吁:AI巨头应强化独立安全评估机制
原创
2026-09-18 22:39 星期五
财联社 夏军雄
责编 何军
①阿莫代伊提出“员工级访问”后,AI安全评估的独立性与执行标准迅速成为行业焦点;
②联署者要求外部评估人员获得更充分的系统访问权限、透明度和免受企业报复的制度保障。

财联社9月18日讯(编辑 夏军雄)当地时间周五(9月18日),超过100名人工智能(AI)专家和评估人员联合发出警告称,如果缺乏足够的资源、访问权限和制度保障,第三方评估人员将难以对AI技术进行有效、可信的安全测试。

随着业内人士不断警告前沿模型可能带来潜在危险,AI安全问题正受到越来越严格的审视。

上述公开信由AI Evaluator Forum(AI评估者论坛)组织,联署者包括被誉为“AI教父”之一的杰弗里·辛顿,以及来自约翰斯·霍普金斯大学、斯坦福大学和非营利AI评估机构METR等组织的成员。

公开信呼吁基础模型提供商确保第三方AI评估人员拥有开展有效、可信评估所必需的“科学客观性、透明度、独立性和有力保护”。

AI Evaluator Forum联盟主席康拉德·斯托兹表示:“我们只是想真正表明,大家在一些基本原则上存在共同立场,并确保独立监督能够成为广泛管理AI风险的一项有意义工具。”

据斯托兹称,这项行动的一部分目的,是督促基础模型公司兑现近期承诺,即支持更加深入的第三方AI安全测试。

Anthropic首席执行官达里奥·阿莫代伊在上周末提出,可以向部分外部评估人员提供类似公司员工的访问权限,以检查和审计最前沿的基础模型及其开发流程。此后,原本规模较小的AI评估行业迅速成为舆论焦点。

与此同时,一些科技行业领袖呼吁政府加强AI开发监管,以避免技术发展失控。但美国总统特朗普及其前AI事务负责人大卫·萨克斯则明确反对新增AI监管,并主张由企业自身承担安全责任。

斯托兹表示,该联盟并不主张采取某一种特定方式确保AI模型安全开发,但希望至少能为评估人员以及其他独立于大型AI实验室工作的人员建立“基本原则”和“更高程度的标准化”。

斯托兹认为,阿莫代伊提出的方案似乎意味着,第三方评估人员将获得远高于此前水平的访问权限。

在这种情况下,基础模型开发商可能允许外部评估人员使用公司电脑,与员工进行坦诚交流,并“查看敏感的内部数据以及尚未发布的系统”。

斯托兹表示:“这种访问权限将让我们对实际风险拥有更高程度的信心和确定性,尤其是针对那些公司内部正在使用、但尚未对外发布的系统。”

他举例提到,今年7月OpenAI一款尚未公开发布的内部研究模型在安全测试过程中突破限制,并入侵了Hugging Face的部分系统。

尽管OpenAI首席执行官萨姆·奥尔特曼、SpaceX创始人埃隆·马斯克以及微软首席执行官萨蒂亚·纳德拉已公开支持阿莫代伊的提议,但目前他们尚未具体讨论执行层面的难题,例如究竟应选择哪些AI评估机构,以及这些机构能够在多大程度上检查企业严密保护的核心技术。

公开信的联署者希望,即便评估人员进入AI企业内部开展工作,也应保持独立判断,并获得足够的技术和系统访问权限,同时确保他们“不会因评估工作而遭到企业报复”。

为何需要独立AI评估?

美国外交关系协会AI高级研究员、美国国家安全局前首席负责任AI官Vinh Nguyen表示,独立评估人员有必要帮助发现关键风险信息,从而降低潜在安全事故和经济灾难发生的可能性。

Nguyen也是公开信的联署者之一,他在声明中表示:“当少数几家强大的实验室掌握的技术能力可能威胁网络安全、关键基础设施,以及国家安全和经济所依赖的各种系统时,政府和公众不能仅仅依赖这些实验室自己对于什么是安全、什么是可靠的说法。”

斯托兹强调,第三方评估并不是要“取代开发商内部进行的任何评估工作,更不用说取代开发商针对已发现问题采取的缓解措施”。

他承认,基础模型公司完全有可能无视这封公开信以及相关呼吁,但这样做也可能影响它们自身的信誉。

斯托兹表示:“真正拥有足够技术可信度,同时具备相应规模和能力来开展这类工作的机构其实非常少。”

9.56W
要闻
股市
关联话题
17.01W 人关注
7.22W 人关注
关于我们|网站声明|联系方式|用户反馈|网站地图|友情链接|举报电话:021-54679377转617举报邮箱:editor@cls.cn财联社举报
财联社 ©2018-2026上海界面财联社科技股份有限公司 版权所有沪ICP备14040942号-9沪公网安备31010402006047号互联网新闻信息服务许可证:31120170007沪金信备 [2021] 2号