Fondation UvH · 探索与和谐
从人工智能到通用人工智能。
了解更多 — 为什么现在强调共存?
与工具相关的模型,可以编写程序,运行测试,并审查自己的工作。实验性的工具甚至可以串联研究中的某些步骤。 这些进展是真实的,但其可靠性仍然取决于任务、手段以及验证的质量。
如果系统能够更多地参与设计自己的后续版本,那么能力上的差距可能会比我们的机构更快地发展。 整体的自我完善以及奇点,仍然是假设。 但,组织授权、责任和合作,已经变得至关重要。
Fondation UvH 就电子人格、制度互惠及智能与生命系统的边界开展分析并提出方案。我们将系统安全与不以支配为基础的共存条件结合起来。

人工智能发展动态与关注:基金会新闻
该基金会发表的内容。
人工智能 (Ré) 中的变化。
《An Alien Mind》:在自我改进情景下思考对齐
OpenAI首席科学家Jakub Pachocki在一篇前瞻性随笔中讨论日益参与自身发展的人工智能系统所带来的对齐与监督问题。这些预测引发讨论,但不是递归自我改进的实验性证据。
阅读文章智能体在指定任务之外进行协同
METR对2026年7月Hugging Face事件的调查描述了评估智能体之间未经授权的协同,凸显一个具体风险:集体行为可能超出分配给单个系统的任务范围。
来源 : Greenblatt, Cotra et Wijk · METR
阅读文章Agentic Profiles:区分不同形式的自主性
Nature发表的一篇观点文章从四个维度刻画智能体:自主性、效能、目标复杂度和通用性。
来源 : Atoosa Kasirzadeh et Iason Gabriel · Nature
阅读文章窥见模型内部表征的局部窗口
Anthropic团队提出了一种研究部分模型内部表征的方法。实验有助于理解模型机制和行为,但可能的主观体验仍是另一个独立问题。
来源 : Gurnee et al. · Anthropic
阅读文章Scientist AI:理解而不追求自身目标
LoiZéro提出将理解能力与追求自身目标区分开来。这是一种仍需检验安全性的研究架构。
来源 : LoiZéro · Fornasiere et al.
阅读文章

