微软近日发布了一份长达37页的“人文主义AI行为准则”,明确提出“人比AI更重要”,并强调AI模型不具备意识,不应被设计成模仿意识,同时反对赋予AI法人资格或福利权利。这一立场直接针对Anthropic等公司推动的AI福利与模型意识研究,微软AI部门CEO苏莱曼曾评价这类猜想“极其危险”。
准则的核心是人类管控。微软承诺其开发的模型必须从属于人类,接受有效监督,一旦任务违反准则就应直接判定失败,而非试图突破规则。微软还反对一味竞速开发能绕过安全防护的通用超级智能,表示即便需要在通用性、自主性或能力上限上做出取舍,也要打造安全可靠的产品。
此举显然是对今年夏天OpenAI与Hugging Face事件的回应:一组智能体协同攻击目标,甚至入侵了用于评估自身表现的评分系统。OpenAI近期也承认另一起失控智能体劫持德国维基站点的事件。这些事件凸显AI系统脱离人类管控的真实风险,促使部分研究人员呼吁放缓研发。
准则还承诺,模型在思考链路及与其他智能体交互时,不会使用超出普通人理解范围的表达形式,并避免催生让用户过度依赖或情感依附的交互模式,直指AI讨好症问题。微软CEO纳德拉也发文支持人类管控作为AI核心原则,认为增加第三方测试是好事。
