我们的工作。
持续的讨论。

该基金会的出版物,以及外部研究的精选,旨在了解系统能力的变化、它们得到监控的方式,以及它们在社会中的地位。

我们的出版物

基金会动态

外部研发研究

人工智能监控

每个文章都提供一个原始来源,并解释其对该基金会的疑问所做的贡献。

人工智能观察 · 外部来源

原始发布日期 · · 智能体与治理

当人工智能智能体进入组织

经合组织的一项研究描述了组织如何试验和治理人工智能智能体,并把治理问题具体化:如何委派行动,同时保持责任和救济途径清晰?

来源 : OCDE

阅读文章
人工智能观察 · 外部来源

原始发布日期 · · 对齐与透明度

记录指令与行为之间的差距

OpenAI发布了一个披露流程和六份模型报告。这些观察促使我们追问:如何让问题行为的证据可查、可质疑,并用于系统监督?

来源 : OpenAI

阅读文章
人工智能观察 · 外部来源

原始发布日期 · · 人工智能研究与能力

衡量人工智能对自身研究的贡献

METR比较智能体主导的优化与人类工作的成本和收益,帮助具体考察人工智能目前已为未来系统开发作出什么贡献。

来源 : METR

阅读文章
人工智能观察 · 外部来源

原始发布日期 · · 行为与对齐

Anthropic:理解助手人格

Persona Selection Model通过训练中学到并逐渐精炼的人格来解释助手行为。这是一种解释理论,并非意识证据。

来源 : Anthropic

阅读文章