微软总裁表态支持独立评估AI安全
「微软总裁布拉德·史密斯公开支持引入独立评估方对AI进行安全评估,认为安全不应只由一两家机构负责。他透露微软与OpenAI设有双方共同派员组成的安全委员会,并支持为先进系统设置多重关闭开关,确保系统处于人类控制之下。」
微软总裁布拉德·史密斯近日公开表态,支持引入独立评估方,对人工智能进行安全评估。在他看来,AI安全如果只由一两家机构负责,就很难取得真正的进展。这一表态,把AI安全评估的主体问题摆到了台面上:谁来评、按什么标准评、评完之后谁负责。
史密斯特别强调,在AI安全这件事上,模型公司固然至关重要,但像微软这样提供软件层、负责控制AI智能体并监控智能体行为的公司同样重要。这句话指向的是一个常被忽略的事实:模型本身只是能力来源,真正把能力包装成产品、接入业务流程、驱动智能体行动的,是上层的软件与平台。智能体一旦开始自主调用工具、读写数据、执行操作,风险就不再只存在于模型权重里,而是分散在整个调度与执行链条上。
据史密斯介绍,微软与其亲密合作伙伴OpenAI设有一个双方共同派员组成的安全委员会。微软通过这一委员会参与双方的AI安全讨论,并协助判断模型何时达到可以发布的安全水平。这种联合机制的意义在于,模型能力的迭代节奏与安全门槛的判定被绑定在同一张时间表上,避免出现能力先跑、安全后追的局面。
除了独立评估,史密斯还提到微软支持为先进系统设置关闭开关,确保系统处于人类控制之下。他表示,安全机制真正需要部署在多个层面,既然可以在三个或四个地方设置开关,为什么只把开关放在一个地方。这实际上是一种冗余思路:任何单点都可能失效,因此不应让整套系统的可控性系于一处。对开发者而言,这意味着安全设计要像容灾设计一样,在模型、平台、应用、运维等多个层级各自留出可干预的入口。
值得注意的是,史密斯还承认微软需要调整气候目标。按照微软此前的承诺,到2030年从大气中清除的碳将超过自身排放量,但这一目标的时间表似乎越来越难以实现,部分原因是微软采用能够迅速投运的天然气发电厂,为AI数据中心供电。他表示,气候仍是本世纪最重要的问题之一,但需要重新审视还能否按照六年前设想的方式实现这些目标,并认为必须作出一些调整。这一细节折射出当下AI基础设施扩张的现实压力:算力需求的增长速度,正在与既定的能源与环保承诺产生摩擦。
把这几条信息放在一起看,可以梳理出一条清晰的思路。独立评估解决的是“谁来监督”的问题,联合安全委员会解决的是“发布前如何判定”的问题,多重关闭开关解决的则是“运行中如何干预”的问题。三者共同构成一个分层结构:外部有第三方视角,内部有合作方共审,系统层面保留人工兜底。对于正在把智能体推向生产环境的开发团队来说,这套思路同样具备参考价值,尤其是多重开关这一条,落到工程实践上就是权限分级、操作审计与紧急中断机制的具体设计。
来源:Heooo AI工具导航