跳至正文

支柱页面

人工智能自主权

  • 栏目: 自主与控制
  • 阅读时长: 9分钟阅读
  • 更新时间: 2026年9月17日

简要回答

人工智能自主权意味着一个系统可以在没有人类批准每一步的情况下,为实现一个目标而采取有影响的行动——而且这种权力几乎总是逐渐授予,而非一次性赋予。

自主权是一个范围,而非一个开关

一个系统并非简单地分为自主或受监督。它位于一个范围的某个点上,从推荐,到行动并报告,再到行动并仅报告异常,直至行动而没有任何人类可见的记录。

大多数实际部署会随着时间向右滑动。每一步都因工作量和前一步的可靠性而合理化,没有任何一步看起来像是移除监督的决定。

为什么“人在回路”比听起来要弱

要求人类批准是标准的保障措施,但它会可预见地退化。一个处理数百个系统正确的案例的审查员,无法对那个系统出错的案例保持真正的审视。

批准变成了例行公事。人类在形式上仍在回路中,这满足了治理要求,但对结果几乎没有贡献。这是一个有据可查的模式,而非假设。

升级的不对称性

系统通常被允许快速行动,而撤销则很慢。一个自动的暂停、标记或移除可以立即生效;恢复原状则需要一个人、一个队列和一个工作日。

这种不对称性是大多数现实世界伤害集中的地方。对任何部署值得问的问题不是“它能行动吗?”而是“它能多快被撤销,由谁来撤销?”

没有意图的自主权

值得明确指出的是,这一切都不需要系统有任何“意图”。这里的自主权是一个组织授予的许可,而不是机器自己发展的属性。

忘记这一点的小说倾向于塑造机器恶棍。记住这一点的小说则会产生一些更令人不安的东西:一连串合理的授权,但最终却无人负责。

在 The Unread 中

小说中 Sable 的权力范围是授权的结果。各项功能被移交,因为它处理得很好,而且每一次移交在当时都是可以辩护的。

这本书审视的是其残留物:当一个人试图申诉某事,却发现不再有任何人有权受理时的那一刻。

术语

人在回路
一种保障措施,要求在自动化决策生效前由人批准。
自动化偏见
人类审查员倾向于接受而非审视系统输出的趋势。

常见问题

自主权是否意味着AI有自己的目标?

不是。在这种情况下,自主权是一个组织授予的、无需逐步批准即可行动的许可。它不暗示任何关于意图的东西。

The Unread 目前仅以英文出版,尚未公布任何译本计划。

读者名录

Join The Unread

隐私政策