LoiZéro团队描述了一种人工智能架构:它把假设生成器与评估器结合起来,后者旨在评估假设而不偏袒其后果。目标是在发展系统智能的同时,限制其行动和追求自身目标的能力。

作者介绍的是一项仍在进行的研究计划,各个组成部分将逐步评估。没有自身欲望或目标是一项设计目标;文章并未证明普遍安全保证。

这与我们的研究有什么关系?

这一提议有助于区分三个经常被混淆的维度:理解、希望达成某个结果,以及具备行动能力。因此,架构选择也会影响需要组织哪些监督和责任形式。

阅读原始来源

全部动态