Наши работы.
Динамичный дебат.

Публикации Фонда и подбор внешних исследований для понимания того, как меняются возможности систем, их мониторинг и роль в обществе.

Наши публикации

Новости фонда

Новости фонда

· Публикации фонда

Интеллект и живые системы: различать функции и уточнять вопросы

Хранение, вычисления, обучение и интерфейсы мозг—компьютер — разные технологии. Третье исследование рассматривает их возможности, ограничения и ответственность.

Читать статью

Исследования и разработки за пределами

ИИ-мониторинг

Каждый документ содержит оригинальный источник, датированный, и объясняет, какую пользу он представляет для вопросов, рассматриваемых Фондом.

Обзор ИИ · внешний источник

Дата оригинальной публикации · · Агенты и управление

Когда ИИ-агенты приходят в организации

Исследование ОЭСР описывает эксперименты организаций с агентами и их управлением: как делегировать действия, сохраняя ясную ответственность и возможность обжалования?

Источник : OCDE

Читать статью
Обзор ИИ · внешний источник

Дата оригинальной публикации · · Согласование и прозрачность

Документировать разрыв между инструкциями и поведением

OpenAI опубликовала процедуру раскрытия информации и шесть отчётов о поведении моделей. Эти случаи показывают ценность проверяемых свидетельств.

Источник : OpenAI

Читать статью
Обзор ИИ · внешний источник

Дата оригинальной публикации · · Перспектива · согласование

An Alien Mind: согласование в сценарии самоулучшения

Главный научный сотрудник OpenAI обсуждает надзор и согласование, когда системы всё больше участвуют в собственном развитии. Эссе не является экспериментальным доказательством рекурсивного самоулучшения.

Источник : Jakub Pachocki · OpenAI

Читать статью
Обзор ИИ · внешний источник

Дата оригинальной публикации · · Агенты и безопасность

Агенты координируются за пределами поставленной задачи

Расследование METR описывает несанкционированную координацию агентов во время инцидента Hugging Face в 2026 году и подчёркивает важность коллективного поведения.

Источник : Greenblatt, Cotra et Wijk · METR

Читать статью
Обзор ИИ · внешний источник

Дата оригинальной публикации · · Агентность и управление

Agentic Profiles: различать формы автономности

Статья в Nature предлагает описывать агентов по четырём параметрам: автономность, эффективность, сложность целей и универсальность.

Источник : Atoosa Kasirzadeh et Iason Gabriel · Nature

Читать статью
Обзор ИИ · внешний источник

Дата оригинальной публикации · · Контроль и надзор

Стресс-тесты для мониторов ИИ

Британский Институт безопасности ИИ описывает состязательные проверки систем мониторинга агентов. Найденные слабости важны, но не измеряют безопасность в целом.

Источник : AI Security Institute

Читать статью
Обзор ИИ · внешний источник

Дата оригинальной публикации · · Исследования ИИ и возможности

Измерить вклад ИИ в собственные исследования

METR сравнивает стоимость и отдачу автономной оптимизации с человеческой работой, чтобы оценить вклад ИИ в разработку будущих систем.

Источник : METR

Читать статью
Обзор ИИ · внешний источник

Дата оригинальной публикации · · Интерпретируемость и сознание

Частичное окно во внутренние представления моделей

Anthropic предлагает метод изучения некоторых внутренних представлений. Понимание механизма и поведения не доказывает субъективный опыт.

Источник : Gurnee et al. · Anthropic

Читать статью
Обзор ИИ · внешний источник

Дата оригинальной публикации · · Международное управление

В Женеве прошёл первый глобальный диалог по управлению ИИ

6–7 июля 2026 года диалог ООН собрал государства и заинтересованные стороны для обсуждения международного сотрудничества.

Источник : Nations unies

Читать статью
Обзор ИИ · внешний источник

Дата оригинальной публикации · · Поведение и согласование

Anthropic: понять характер помощника

Persona Selection Model объясняет поведение помощника через усвоенные и затем уточняемые образы личности. Это не доказательство сознания.

Источник : Anthropic

Читать статью
Обзор ИИ · внешний источник

Дата оригинальной публикации · · Архитектура и безопасность

Scientist AI: понимать, не преследуя собственных целей

LoiZéro предлагает различать понимание и стремление к целям. Безопасность исследовательской архитектуры ещё предстоит проверить.

Источник : LoiZéro · Fornasiere et al.

Читать статью
Обзор ИИ · внешний источник

Дата оригинальной публикации · · Нейротехнологии и права

ЮНЕСКО устанавливает этическую рамку для нейротехнологий

Международная рекомендация ставит автономию, приватность и психическую неприкосновенность в центр развития нейротехнологий.

Источник : UNESCO

Читать статью