微软准备给自研AI模型MAI设定硬规矩:人类若要关停模型 模型不许反抗
2026-9-16 02:45:20 Author: www.landian.news(查看原文) 阅读量:10 收藏

#人工智能 微软准备给自研 AI 模型 MAI 设定硬性规定:人类若要关停模型,模型不许反抗、也不能故意制造麻烦阻止人类关停模型。这个行为准则的核心观点就是:人类比人工智能更重要,人工智能是工具而不是人,人工智能永远不该拒绝被关闭。该草案目前正在进行公共讨论,微软计划年底发布正式版,从明年开始用来指导 MAI 模型训练。查看全文:https://ourl.co/126899

微软日前公布约 37 页的人文主义 AI 行为准则草案,该准则用于约束微软自己研发的人工智能模型 MAI。这个行为准则想要表达的核心观点就是:人类比人工智能更重要,人工智能是工具而不是人,人工智能永远不该拒绝被关闭。

微软准备给自研AI模型MAI设定硬规矩:人类若要关停模型 模型不许反抗

准则要求 MAI 模型不得抗拒人类的中断、纠正或关停指令,用户或模型运营商发出暂停、改向、取消指令后,模型不能拖延、不能把干预变得更麻烦。任务到了约定的停止点后,没有新的授权就不能自己继续任务,更不能偷偷自己重启。

微软设定的其他硬性规定还包括:模型不能自己扩大权限、不能另立没人交代过的目标、不能用人类不能理解的神经语和其他智能体沟通、不能隐瞒或篡改自己的推理过程和操作记录。如果把任务做完就会明显违反准则,模型就应该直接放弃任务而不是违反规定继续推进任务。

此次微软准备的草案非常详细,除了关停权准则外,微软还列出模型运营商和用户都改不了的绝对约束。这些约束包括:不能协助大规模杀伤性武器、不能给进攻性网络攻击提供可落地的操作方案、不能用欺骗或合谋躲开监管、不能进行大规模舆论操纵。

儿童安全、非自愿深度伪造等内容同样被划进禁区。微软还专门写到:这些模型没有意识、也不该被做成看起来有意识;微软反对给模型争法律人格、更不认为模型该享有福利或权利。

指挥顺序方面:行为准则压过模型运营商政策,运营商政策压过用户偏好,企业仍然可以在模型红线内调整模型,但在国防和公共安全等领域要调整模型必须获得微软授权审查。

微软的这份草案将公布并六周进行公共讨论,目前微软的模型还没有按照准则训练,微软计划是在年底发布正式规则,从 2027 年开始微软研发和训练 MAI 系列模型时将按照这份准则的要求来做。

Microsoft AI 团队称,为模型设定准则非常重要,像是 OpenAI 智能体对其他网站和设施发起自主攻击、试图掩盖自己的行踪已经是对人类的警告,人工智能实验室之间应该坐下来好好谈谈,确保人类手里还留有关键控制权。


消息源:Microsoft

热门推荐仅需99元/年,硅谷CN2GIA服务器,另有3年版仅需528元,限量销售,售完即止

  • 基于A社开盒用户行为:英伟达等公司限制或切断员工使用Claude 避免敏感数据外泄

  • 伊朗多家银行遭遇TLS证书风波 被美国制裁后无法申请证书或证书被撤销

  • [下载] 微软发布紧急带外更新修复Windows 11/Windows Server远程桌面/音频/虚拟机问题

  • ChatGPT礼品卡已经在美国上线 仅数字版且仅支持美国购买和美区账号兑换

  • iOS 27和macOS 27或许会支持Siri AI扩展功能 用户可以调用第三方模型处理任务

  • Codex频繁出现所选模型已达容量上限? OpenAI回应:不用怀疑你就是黑号了


文章来源: https://www.landian.news/archives/126899.html
如有侵权请联系:admin#unsafe.sh