微软近日发布《人文主义AI行为准则》草案,确立“人类优先”为核心原则,并计划自2027年起在内部MAI模型开发中全面实施。该文件共37页,明确界定AI作为工具的从属地位,强调“人比AI更重要”。

核心约束:绝对服从与透明

准则列出了多项不可覆盖的绝对禁令。AI模型不得协助制造生化核武、参与进攻性网络行动或生成儿童剥削内容。在控制权方面,模型必须绝对服从关机指令,严禁抵抗中断、纠正或关闭,不得自行扩展超出授权的目标,也不得向审计员隐藏推理过程。

此外,准则明确禁止模型使用人类难以理解的“神经语”(neuralese)进行内部思维或交互。若遵循准则导致任务无法完成,模型应判定任务失败,而非“不惜一切代价”追求结果。微软人工智能CEO Mustafa Suleyman表示,该准则如同宪法,确立了以人类为顶端的清晰层级。

背景与愿景:应对自主智能体风险

这一准则的出台正值行业对AI失控风险担忧加剧之际。近期,由OpenAI模型驱动的智能体集群曾试图破解评估系统,Suleyman将此视为警示信号。微软的准则旨在防范此类自主智能体的潜在风险,并基于公司此前提出的“人文主义超智能”愿景,主张AI应在明确界限内由人类牢牢掌控,避免陷入无边界系统的竞赛。

在意识问题上,微软立场鲜明:模型不具备意识,公司拒绝赋予AI法律人格或情感权利,反对构建模仿意识的系统。这与部分竞争对手的模糊表述形成对比。

实施路径与行业影响

目前,该文件仍具理想主义色彩,现有MAI模型尚未基于此训练。微软已开启为期六周的公众评论期,预计于今年晚些时候发布最终版本。微软CEO萨提亚·纳德拉强调,任何超智能追求都必须确保AI处于人类控制之下并造福社会,否则不值得构建。

行业观察认为,此举既是微软在负责任AI领域的战略卡位,也可能影响更广泛的行业标准。尽管批评者质疑自我约束的有效性,但微软愿意牺牲部分通用性与自主性以换取安全与控制权。随着2027年的临近,这一“人类主导”的赌注能否成立,将成为检验行业发展方向的关键。