辛顿联署公开信:呼吁保障第三方评估独立性
「AI评估机构论坛发布公开信,为第三方风险评估划定最低条件,获杰弗里·辛顿、斯图尔特·罗素等数十名AI领域人士联署。公开信要求驻场评估人员保持科学客观性与独立性,可直接与董事会沟通、公开发布评估结果,并免遭企业干预与报复。此前Anthropic与OpenAI CEO均承诺向第三方开放内部资源。」
据《商业内幕》报道,由多家监督组织组成的AI评估机构论坛近日发布一封公开信,为第三方风险评估划定了一套最低条件。论坛认为,Anthropic和OpenAI等AI实验室只有满足特定要求,才能与外部评估机构开展更有效的合作。这封公开信获得了数十名AI领域人士联署,其中包括被誉为“AI教父”的计算机科学先驱杰弗里·辛顿和斯图尔特·罗素。
公开信的出台有着明确的现实背景。就在本周,Anthropic CEO达里奥·阿莫迪和OpenAI CEO萨姆·奥尔特曼此前都承诺,将向第三方评估人员开放公司内部资源用于评估AI风险,并给予其与公司员工同等级别的信息访问权限。论坛的公开信正是对这一系列表态作出的回应。
论坛在信中强调:“要具备公信力,驻场第三方评估人员必须保持科学客观性、透明度和独立性,并得到充分保护,免受被评估企业干预。”这一表述点明了第三方评估当前面临的核心矛盾:评估者的独立性从何而来,又由谁来保障。
围绕独立性,公开信提出了一系列具体要求。首先,第三方评估人员不仅应获准公开透明地开展工作,还应能够直接与公司董事会及其他拥有特殊监督权限的机构沟通,不受企业过滤或限制;同时,评估人员有权公开发布评估结果,而不是让结论停留在企业内部。
其次,评估人员应受到保护,避免因评估工作遭到AI实验室报复。这一点被视为独立评估能否持续的关键:如果评估者担心结论会影响自身处境,客观性就难以真正成立。
第三,在资源权限上,公开信主张第三方评估人员应获得与企业内部评估人员相同的系统、数据、工具和实体场所访问权限。只有访问深度对等,外部评估才可能触及真实的风险面,而非停留在表面材料上。
公开信还就评估人员的构成提出建议,主张每家AI实验室都应引入观点和专业背景不同的评估人员,以覆盖生物科学风险、AI失控风险等多种风险领域。单一视角的评估团队,容易在风险类型上留下盲区。
值得注意的是,这场讨论并非只局限于评估机构一方。本周早些时候,其他科技行业领袖也加入了讨论。微软CEO萨提亚·纳德拉表示,公司欢迎让第三方评估人员直接进驻AI企业开展评估的构想。来自大型AI实验室掌门人的表态,与评估机构论坛提出的最低条件形成了呼应,也让第三方评估的制度化路径成为行业关注的焦点。
从公开信的内容看,第三方评估正在从一种姿态性的承诺,转向对具体机制的讨论:沟通渠道是否绕开企业过滤、结果能否公开发布、人员是否免于报复、权限是否与内部对等。这些条件能否被真正落实,将决定AI风险评估是停留在流程层面,还是具备实质约束力。
来源:Heooo AI工具导航