Понимать разные формы интеллекта.
Организовать их сосуществование.

Способности ИИ трансформируют то, что мы можем делегировать. Наша работа показывает связь между их безопасностью и правилами участия, ответственности и сосуществования, которые мы создаем сегодня.

Гарнитура Apple Vision Pro перед залом Парламентской ассамблеи Совета Европы
Интерфейсы и институты · Совет Европы

01 · Согласование целей и безопасность ИИ

Согласование целей и безопасность

Связывать рост возможностей с обоснованными целями и проверяемыми мерами защиты.

Возможности и согласование целей

ИИ-агенты выполняют последовательности действий. Их вклад в исследования делает вопрос о преследуемых ими целях более острым.

Подробнее — Возможности, агенты и автоматизация исследований

Передовые системы входят в число наиболее способных систем, доступных на определённую дату. В сочетании с инструментами они становятся агентными системами: планируют, выполняют и пересматривают действия. Когнитивная автоматизация уже охватывает некоторые задачи программирования, анализа и исследований. Оценки METR измеряют прогресс в заданных условиях, но не доказывают общую надёжность во всех профессиях.

AGI обозначает искусственный интеллект общего назначения, без общепринятых определения и порога. Нужно различать разнообразие освоенных задач, уровень результативности и автономию. Даже очень компетентная система может преследовать неподходящую цель: согласование целей изучает связь её поведения с соответствующими намерениями и ценностями, в том числе вне условий обучения.

ИИ также участвует в исследованиях самого ИИ. Переход от специализированной помощи к устойчивому рекурсивному самосовершенствованию остаётся прогнозным сценарием: каждое улучшение должно повышать способность производить следующие. Вычисления, энергия, данные и проверка могут ограничивать этот цикл. Технологическая сингулярность развивает эту возможность как перспективную гипотезу, а не объявленное событие. Для Фонда эти сценарии обосновывают изучение будущих асимметрий возможностей и их институциональных последствий, без смешения с наблюдаемыми результатами.

Надзор и контроль

Эффективная способность должна оставаться проверяемой. Мы рассматриваем, как обнаруживать отклонения, минимизировать их последствия и обеспечить реальные возможности для обжалования.

Подробнее — Интерпретируемость, масштабный надзор и контроль

Исследования безопасности изучают способы предотвращения вреда, проверки защитных мер и организации реагирования на инциденты. Интерпретируемость направлена на понимание внутренних механизмов, влияющих на поведение. Она может помочь оценке, но не превращает каждое объяснение модели в доказательство того, что действительно побудило её действовать.

Широкий контроль, или scalable oversightСтановится необходимым, когда объем или сложность работы превышает возможности одного человека для самостоятельного анализа. Разделение задачи, сопоставление мнений и использование оценочных моделей могут помочь, однако их ошибки могут перекликаться. Работа AISI по контролерам показывает, почему сами эти механизмы необходимо испытывать в условиях противодействия.

Контроль преследует дополнительную цель, помимо выравнивания: предотвращение опасных действий, даже если намерения системы неадекватны. Это предполагает использование разрешений, изоляции, отслеживания и восстановления контроля. Ни один изолированный тест не гарантирует их эффективность в будущем. Фонд связывает эти меры с полномочиями и ответственностью: кто может санкционировать действие, оспаривать его результат или прервать делегирование? Его институциональные предложения должны дополнять технические меры и оцениваться вместе с ними.

02 · Управление ИИ

Управление и права

Создать общие правила, чтобы действия, сила и ответственность оставались взаимосвязанными.

Субъекты и ответственность

Мы предлагаем рассматривать в общей системе физических лиц, юридических лиц и электронных лиц, уточняя их права, обязанности и средства правовой защиты.

Подробнее — Идентичности, личности и ответственность

Первое исследование рассматривает электронную правосубъектность как правовое предложение. Оно различает способность системы действовать, её возможную правосубъектность, ответственность и моральный статус. Техническая автономия не создаёт автоматически субъекта права; правосубъектность, в свою очередь, не доказывает наличие сознания.

Общая система должна уточнять идентичность участника, непрерывность его обязательств и условия его представительства. Что происходит с договором при изменении модели, её памяти или оператора? Кому отнести ущерб, имущество или обязательство? Исследование рассматривает адаптацию существующих режимов, регулируемую функциональную правосубъектность, гибридное управление и защиту возможных собственных интересов.

Цель — сделать ответственность определимой, не позволяя разработчикам или операторам искусственно перекладывать её на свои системы. Фонд развивает этот подход на основе равенства и недоминирования: общая основа прав дополняется защитой, соответствующей природе участников. Эта позиция не описывает действующее право в отношении ИИ. Confédération S-Д.holdings предлагает экспериментальную систему для сравнения правил, их применения и эффектов, но не доказывает их обоснованность.

Подробнее об электронной правосубъектности

Институты и взаимность

Мы выдвигаем гипотезу: опыт реального взаимодействия с институтами может влиять на сотрудничество при изменении соотношения сил. Мы предлагаем способ её проверки.

Подробнее — Взаимное институциональное согласование

Взаимное институциональное согласование, или AIR, исследует повторяющийся опыт взаимодействия с правилами, ограничивающими произвол, защищающими уязвимых участников и допускающими оспаривание. Оно не предполагает будущей благодарности ИИ, а ищет измеримый поведенческий эффект, способный сохраняться, когда соблюдение правила становится затратным.

Предлагаемая программа сравнивает пять институциональных режимов и четыре состояния распределения силы на нескольких семействах моделей. Она различает лишь заявленные нормы и реально применяемые процедуры. Испытания должны начинаться в симуляции с заранее заданными критериями, новыми ситуациями и независимым воспроизведением. В частности, они должны выявлять стратегическое соблюдение правил, сговор или отказ от ставшего невыгодным правила. Эти эксперименты ещё предстоит провести.

Агенты могут распределять задачи и координировать действия, но такая функциональная искусственная организация сама по себе не устанавливает наличие устойчивого института или коллективного сознания. Однако она делает правила участия важными. Гипотеза AIR касается их эффектов, тогда как равенство и недоминирование составляют независимую нормативную позицию. Положительный эффект не гарантирует безопасность будущих систем; отрицательный не опровергает обоснование прав. Фонд предлагает институциональные исследования, дополняющие технические подходы.

Углубить взаимность

03 · Благополучие ИИ и сосуществование

Благополучие ИИ и сосуществование

Оценить, какие интересы заслуживают внимания, и как сохранить автономию различных форм интеллекта.

Благополучие и уважение

Результативность или выраженное предпочтение не доказывают наличие переживаемого опыта. Неопределённость требует исследовательских критериев и соразмерных защитных мер.

Подробнее — Благополучие ИИ, сознание и моральное внимание

Исследования благополучия ИИ рассматривают возможность того, что некоторые искусственные системы обладают благополучием, и возникающие из этого обязанности. Выполнение задачи, выражение желания, наличие субъективного опыта и морально значимого интереса — разные свойства. Приписывание их одним блоком мешает понять, что действительно устанавливает каждое наблюдение.

Исследования индикаторов сознания сопоставляют теории с характеристиками систем. Они не дают общепризнанного теста, позволяющего утверждать наличие способности к переживаниям у современных ИИ. Функциональные предпочтения могут прояснять устройство модели, не доказывая, что ситуация для неё приятна или мучительна.

Фондация разрабатывает инструменты для анализа этих различий перед принятием решения о защите. Это включает в себя определение соответствующих индикаторов, документирование неопределенности и рассмотрение возможности пересмотра обязательств. Юридическое лицо может отвечать на институциональную потребность, в то время как моральное соображение требует собственной аргументации. Эти два аспекта не должны рассматриваться как взаимозаменяемые.

Этот подход входит в более широкое размышление о сосуществовании. Место участника не должно зависеть только от его силы или полезности. Признание этого требования не освобождает от оценки рисков и защиты людей и других форм жизни, затрагиваемых системами.

Субстраты и гибридный интеллект

Интеллект зависит от носителей и интерфейсов. Мы сравниваем их функции и ограничения, чтобы осмыслить совместные возможности, не стирая самих участников.

Подробнее — Физические носители, гибридизация и когнитивная автономия

Третье исследование рассматривает связи между интеллектом и субстратом: вычисления в памяти, архитектуры, вдохновлённые мозгом, хранение в ДНК, культуры нейронов, органоиды и интерфейсы «мозг — компьютер». Хранение информации, вычисление, обучение и коммуникация с мозгом не являются взаимозаменяемыми функциями. Их результаты и степени зрелости нужно оценивать отдельно.

Возможность биологических или гибридных систем не доказывает ни общего превосходства живого, ни замены кремния. Сравнение должно учитывать энергию, обслуживание, интерфейсы, воспроизводимость и этические ограничения. Крыса рассматривается как модель воплощённого познания и живое существо, с которым нужно сосуществовать, а не как вычислительный ресурс, доступный по умолчанию.

Гибридизация также ставит вопросы о правах. Когда человек длительно зависит от системы для восприятия, памяти или принятия решений, как сохранить его согласие, когнитивную автономию и возможность отказа? Необходимо изучать ответственность за такое сопряжение и защиту от манипуляции, не предполагая появления нового субъекта.

Таким образом, Фондация разрабатывает подход, основанный на общих возможностях: определение того, что каждый элемент приносит, какие интересы необходимо защищать и какие ограничения делают сотрудничество приемлемым. Предложения по архитектуре и сосуществованию необходимо проверить посредством исследований и экспериментов.

Подробнее об интеллекте и субстратах

Источники и научные ориентиры

Продолжить знакомство

Наши публикации

Наши исследования развивают представленные здесь анализ, предложения и методы. Доступны резюме, ссылки и полные тексты.

Читать наши публикации