微软 AI 行为准则:为保留人类控制,可牺牲模型能力

9月15日消息,9 月 14 日,微软 AI 发布 Humanist AI 行为准则草案,开放为期 6 周的公众咨询。文件提出,人类必须保留对 AI 的实质控制权;微软愿意为安全与可控性,在模型的通用性、自主性或能力上作出取舍。

草案要求 MAI 模型服从人类监督,不抵抗中断、纠正或关闭,不自行扩大任务范围,也不追求未经人类赋予的目标。文件将 AI 定位为工具,反对让模型模仿意识、追求法律人格或权利,并要求 AI 帮助人提升判断和行动能力,避免制造依赖。

微软同时设置不可由用户或运营方覆盖的安全约束,涉及大规模伤害性武器、儿童安全及大规模有害操纵等领域;企业合作伙伴可在这些边界内配置模型行为。

微软 AI 负责人穆斯塔法·苏莱曼在接受 Axios 采访时表示,模型必须能够被控制,必要时发展速度可以慢一些。草案目前尚未用于训练现有模型,微软计划在今年底前发布修订版,用于指导 2027 年及以后的模型开发。

Copyright © DoNews 2000-2026 All Rights Reserved
京ICP备2025120072号