这篇于9月6日发表的文章区分了执行目标与在新情境中应用原则。系统可能完成任务,却使用与设计者意图相冲突的手段。

Pachocki预计人工智能将越来越多地参与自身发展,并讨论监督、持续训练条件和国际协调。这些观点部分基于内部结果:文章呈现的是一家人工智能开发组织的立场,不是科学共识,也不是通用自我改进循环的公开证明。标题同样不能证明主观体验。

这与我们的研究有什么关系?

对UvH基金会而言,研究加速也会改变权力的分配。挑战在于让决策接受审查:谁设定目标、授权下一步,并能够质疑其后果?

我们关于互惠的工作建议考察不同参与者受哪些规则约束、拥有何种救济。该随笔可供前瞻性讨论;这些框架对安全的影响仍需检验。

阅读原始来源

全部动态