由多家监督组织组成的AI评估机构论坛近日发布一封公开信,为AI实验室与第三方风险评估机构的合作划出一套最低条件。该公开信获得数十名AI领域人士联署,其中包括有“AI教父”之称的计算机科学先驱杰弗里·辛顿和斯图尔特·罗素。
公开信的核心主张是,Anthropic和OpenAI等AI实验室只有满足特定要求,才能与外部评估机构开展更有效的合作。论坛认为,第三方评估人员不仅应获准公开透明地开展工作,还应能够直接与公司董事会及其他拥有特殊监督权限的机构沟通,不受企业过滤或限制,并有权公开发布评估结果。
在具体操作层面,公开信提出,驻场第三方评估人员必须保持科学客观性、透明度和独立性,并得到充分保护,免受被评估企业干预。这些评估人员还应受到保护,避免因评估工作遭到AI实验室报复,同时获得与企业内部评估人员相同的系统、数据、工具和实体场所访问权限。此外,每家AI实验室都应引入观点和专业背景不同的评估人员,以覆盖生物科学风险、AI失控风险等多种风险领域。
这封公开信的发布,是对AI实验室近期承诺的直接回应。Anthropic CEO达里奥·阿莫迪和OpenAI CEO萨姆·奥尔特曼此前均承诺向第三方评估人员开放公司内部资源并评估AI风险,给予其与员工同等级别的信息访问权限。论坛的公开信意在为这类承诺设定可验证的执行标准。
本周,围绕AI风险的讨论在科技行业高层中迅速升温。微软CEO萨提亚·纳德拉表示,公司欢迎让第三方评估人员直接进驻AI企业开展评估的构想。这一表态与公开信的诉求方向一致,但公开信进一步明确了评估人员独立性和保护机制的具体要求。
从行业影响看,随着AI模型能力快速提升,外部独立评估已成为治理框架中的关键环节。公开信提出的最低条件,实质上是在企业与评估机构之间建立一套权责边界:企业提供访问权限和资源,评估机构保持独立判断并承担公开披露义务。若这一框架被主要AI实验室采纳,第三方评估将从自愿性安排向制度化协作演进,评估结果的公信力也将取决于这些条件能否得到切实执行。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。