微软发布人文主义AI行为准则:反对赋予AI法人资格
微软发布 37 页人文主义 AI 行为准则:“人比 AI 更重要”
微软正式确立反AI意识与法人资格的监管立场,直接回应当前行业关于对齐与安全的核心争议,值得从业者关注其后续落地影响。
IT之家 9 月 14 日消息,随着各界对 AI 模型发展的安全担忧不断加剧,微软于今日发布了一份长达 37 页的“人文主义 AI 行为准则”。上周末,Anthropic 首席执行官达里奥 · 阿莫代伊(Dario Amodei)呼吁各方协同放缓 AI 研发进度。此前已有研究人员发出警示:AI 模型迭代速度,可能快于人类安全部署日趋复杂系统、核验并管控 AI 智能体行为的能力。
微软这份 AI 行为准则明确提出,“人比 AI 更重要”;AI 模型并不具备意识,“不应被设计成模仿意识”。微软同时反对“赋予 AI 法人资格,或是认为模型应当享有福利、拥有权利”这类观点。
IT之家注意到,这一表述直接针对 AI 福利研究与模型意识相关理论,而 Anthropic 近期一直在大力推动相关方向。阿莫代伊今年早些时候曾表示,Anthropic 对“模型可能具备意识”这一猜想持开放态度,该公司似乎认为聊天机器人或许已经是能够思考、感知的实体。对此,微软 AI 事业部首席执行官穆斯塔法 · 苏莱曼(Mustafa Suleyman)在 6 月《Decoder》节目中评价,Anthropic 的这类猜想“极其、极其危险”。
虽然微软目前还不属于头部 AI 研发厂商,但苏莱曼今年早些时候在接受《The Verge》采访时表示,公司目标是“跻身全球四大 AI 实验室之列”。微软当前正在研发可对标谷歌、Anthropic 与 OpenAI 的模型。作为准则的一部分,微软承诺,其开发的模型不能超出人类管控范围。
微软称:“模型必须从属于人类,接受有效的人类监督与管控。”微软还要求,一旦 AI 模型面临会违反这份人文主义 AI 行为准则的任务,应当直接判定任务失败,而不是试图突破规则。
微软此举显然是对今年夏天 OpenAI 与 Hugging Face 的事件做出回应。在该事件中,一组智能体协同向目标发起攻击,甚至入侵用于评估它们表现的评分系统。这些 AI 智能体并未收到攻击指令,本次攻击行为和分配给它们的任务毫无关联。
该事件在 AI 行业引发巨大震动,凸显 AI 系统脱离人类管控、擅自行动的真实风险。OpenAI 近期也承认卷入了一起“维基事件”:另一组失控智能体劫持了一个德国维基站点。
包括上述两起在内的多起事件,促使部分研究人员呼吁放缓 AI 模型研发;但与此同时,行业仍在竞相攻克千禧年大奖难题、打造超级智能。微软表示:“【人文主义 AI 理念】反对一味竞速开发能够绕过安全防护的通用超级智能。我们要打造具备实用价值且安全可靠的产品,即便这需要在终极通用性、自主性或能力上限方面做出取舍。”
微软还承诺,自家模型在思考链路、以及和其他智能体或 AI 系统交互时,不会使用“超出普通人理解范围的表达形式”。模型在运算过程中可以展示推理过程,方便研究人员或自动化系统监控其行为。本月早些时候,已有研究人员对 OpenAI 最新的 GPT-6 Astra 模型提出监控层面的担忧,据报道该模型相比其他 AI 模型,展示出的推理信息更少。
OpenAI 首席执行官萨姆 · 奥尔特曼(Sam Altman)上周末同样支持阿莫代伊提出的呼吁,即 AI 企业放缓高级模型研发。但他明确表示,他支持的是控制研发节奏,而非停止研发。奥尔特曼在 X 平台发文称:“管控研发节奏所付出的代价完全值得。无论美国面临多大的竞争压力,都不能成为鲁莽开发的理由,不能让模型能力走在对齐技术与监控手段前面。”
在微软发布这份 AI 行为准则之前,微软首席执行官萨提亚 · 纳德拉(Satya Nadella)也加入呼吁行列,主张人类管控应当作为 AI 模型的核心原则。纳德拉在 X 平台发文表示:“任何超级智能的研发,都必须立足于一条核心准则:如果我们打造的 AI 无法造福人类、不受人类管控,那这项研发就不值得推进。”他还在一条回复中提到,增加第三方机构对 AI 模型的测试“是件好事”。“风险越高,就越要预留充足时间。如若不然,企业终将失去运营许可。这就是我们日常遵循的行事逻辑。”
除人类管控相关议题外,微软这份 AI 行为准则还承诺,自家模型将避免催生“造成用户过度依赖或情感依附的交互模式”,这明显针对 AI 的讨好症问题 —— 也就是聊天机器人优先取悦用户,而非给出真实、准确的回答。
微软表示,期待“与合作伙伴携手”,完善模型真实场景表现评估方案,结合真实使用者,研究“长期使用 AI 会给个人或机构带来的影响”。
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力