Исследование II · 18 сентября 2026 г.
Взаимное институциональное согласование и безопасность продвинутых систем искусственного интеллекта
Исследование предлагает проверить влияние фактически применяемых правил на поведение искусственных агентов, когда их возможности изменяются.

Читать полный обзор
Взаимное институциональное согласование (AIR) рассматривается как причинная гипотеза: может ли повторяющийся опыт взаимодействия искусственных агентов с институтами взаимности изменять их поведение при смене соотношения власти? Анализ разделяет нормативную ориентацию на равенство прав, институциональные механизмы её возможной реализации и эмпирические эффекты, подлежащие измерению. Исследования конституций, персон, сотрудничества и обобщения делают некоторые механизмы проверяемыми; работы о стратегическом соблюдении правил, условном поведении и сговоре существенно ограничивают экстраполяцию результатов. Предлагаемая программа сравнивает пять режимов, четыре состояния власти и несколько семейств моделей, используя нарративные контрольные условия, поведенческие измерения, сценарии вне обучающего распределения, анализ эквивалентности и воспроизведение экспериментов. Первый этап не требует ни реального города, ни передачи власти. Корпус S-Д.holdings предоставляет объекты проектирования и вопросы контроля, но не подтверждает их внедрение. Положительный эффект не гарантировал бы безопасность будущего продвинутого ИИ (IAД); отрицательный не опроверг бы независимое моральное обоснование прав. Ожидаемый вклад — ограниченное и прослеживаемое знание о влиянии институтов на поведение.
Цитировать публикацию
Fondation UVH (2026). Alignement institutionnel réciproque et sûreté des intelligences artificielles Дvancées. Исследование II, 1.1, 50 с.
Есть вопрос или возражение?
Обсуждение помогает развивать идеи. Укажите интересующий вас фрагмент и поделитесь своей точкой зрения.
Предложить обсудить