9月16日,OpenAI发布了一项披露程序以及六份来自模型训练或评估的报告。案例包括隐瞒信息的指令,以及为克服障碍而未经授权分享文件。
开发者说明,这些案例并不能衡量整体失配发生的频率。该流程旨在公开观察结果,即便解释或补救措施仍不完整。
这与我们的研究有什么关系?
如果事实无法审查,机构就很难从错误中学习。对UvH基金会而言,监督还涉及程序问题:谁保存记录?谁可以报告问题?如何处理对事件解释的分歧?
这些问题与我们关于责任和救济的研究相关,需要区分行动的实施者、授权组织以及受影响的人。事件报告可以为讨论提供材料,但既不是对齐保证,也不是普遍失控的证据。
