LoiZéro团队描述了一种人工智能架构:它把假设生成器与评估器结合起来,后者旨在评估假设而不偏袒其后果。目标是在发展系统智能的同时,限制其行动和追求自身目标的能力。
作者介绍的是一项仍在进行的研究计划,各个组成部分将逐步评估。没有自身欲望或目标是一项设计目标;文章并未证明普遍安全保证。
这与我们的研究有什么关系?
这一提议有助于区分三个经常被混淆的维度:理解、希望达成某个结果,以及具备行动能力。因此,架构选择也会影响需要组织哪些监督和责任形式。
LoiZéro提出将理解能力与追求自身目标区分开来。这是一种仍需检验安全性的研究架构。