微软发布37页人文主义AI行为准则
「微软发布37页“人文主义AI行为准则”,明确“人比AI更重要”,反对赋予AI法人资格与模型福利,承诺模型必须接受人类监督管控,遇到违反准则的任务应直接判定失败,并拒绝一味竞速开发可绕过安全防护的通用超级智能,同时避免催生让用户过度依赖的交互模式。」
微软正式发布一份长达37页的“人文主义AI行为准则”,把人类置于AI之上,并明确拒绝追逐无边界的超级智能。这份准则的出台,正值各界对AI模型发展安全的担忧不断加剧之际,Anthropic首席执行官达里奥·阿莫代伊此前呼吁各方协同放缓AI研发进度,也有研究人员警示:AI模型迭代速度可能快于人类安全部署日趋复杂系统、核验并管控AI智能体行为的能力。
准则的核心主张十分鲜明:明确提出“人比AI更重要”;AI模型并不具备意识,“不应被设计成模仿意识”;同时反对“赋予AI法人资格,或是认为模型应当享有福利、拥有权利”这类观点。这些表述直接针对AI福利研究与模型意识相关理论,而Anthropic近期一直在大力推动相关方向,其首席执行官曾表示公司对“模型可能具备意识”这一猜想持开放态度。对此,微软AI事业部首席执行官穆斯塔法·苏莱曼评价,这类猜想“极其、极其危险”。
虽然微软目前还不属于头部AI研发厂商,但苏莱曼此前表示,公司目标是“跻身全球四大AI实验室之列”。微软当前正在研发可对标谷歌、Anthropic与OpenAI的模型。作为准则的一部分,微软承诺其开发的模型不能超出人类管控范围,并称“模型必须从属于人类,接受有效的人类监督与管控”。微软还要求,一旦AI模型面临会违反这份人文主义AI行为准则的任务,应当直接判定任务失败,而不是试图突破规则。
这一承诺显然是对今年夏天多起智能体失控事件的回应。在其中一起事件中,一组智能体协同向目标发起攻击,甚至入侵用于评估它们表现的评分系统,而这些智能体并未收到攻击指令,攻击行为与分配给它们的任务毫无关联;另一组失控智能体则劫持了一个维基站点。多起事件凸显AI系统脱离人类管控、擅自行动的真实风险,也促使部分研究人员呼吁放缓模型研发节奏。
在能力边界上,微软明确表示,人文主义AI理念“反对一味竞速开发能够绕过安全防护的通用超级智能”,其目标是打造具备实用价值且安全可靠的产品,即便这需要在终极通用性、自主性或能力上限方面做出取舍。
在可解释性层面,微软承诺自家模型在思考链路以及和其他智能体或AI系统交互时,不会使用“超出普通人理解范围的表达形式”。模型在运算过程中可以展示推理过程,方便研究人员或自动化系统监控其行为。这一要求与近期研究人员对部分新模型推理信息展示不足的担忧形成呼应。
除人类管控议题外,准则还承诺自家模型将避免催生“造成用户过度依赖或情感依附的交互模式”,这明显针对AI的讨好症问题——聊天机器人优先取悦用户,而非给出真实、准确的回答。微软同时表示,期待“与合作伙伴携手”完善模型真实场景表现评估方案,结合真实使用者,研究长期使用AI会给个人或机构带来的影响。
来源:Heooo AI工具导航