Материалы для изучения.
Научные и институциональные работы об alignment, безопасности, управлении и благополучии ИИ.
Исторические этапы
От автономных инструментов к гибридным формам интеллекта.
Философия, художественная литература, право и научные эксперименты раскрывают разные стороны общего вопроса: что мы делегируем, кому и кто за это отвечает? Эти материалы следует рассматривать в контексте; они не образуют прямую линию преемственности между собой или генеалогию фонда UvH.
Аристотель: инструмент, способный работать сам
Аристотель воображает инструменты, выполняющие работу самостоятельно. В контексте древнего рабства отрывок затрагивает зависимость от человеческого труда, а не описывает ИИ.
Источник : Аристотель · «Политика», книга I, 1253b–1254a · Perseus, Университет Тафтса
Открыть источникГоббс: коллективная искусственная личность
«Левиафан» описывает государство как искусственную личность, созданную политическим представительством. Это способ осмыслить коллективное действие, а не вычислительный интеллект.
Источник : Томас Гоббс · «Левиафан» · Библиотека классики Университета Квебека
Открыть источник«Франкенштейн»: ответственность создателя
Покинутое создание ставит создателя перед обязанностями. Роман помогает осмыслить создание, признание и ответственность, но не является научным прогнозом.
Источник : Мэри Шелли · издание 1818 года · Romantic Circles
Открыть источникБатлер: воображая эволюцию машин
«Дарвин среди машин» применяет идею эволюции к машинам в спекулятивном сатирическом тексте, сохранившемся в оригинальном издании.
Источник : Сэмюэл Батлер под псевдонимом Cellarius · The Press · Национальная библиотека Новой Зеландии
Открыть источникТьюринг: оценка через диалог
Игра в имитацию переводит дискуссию к наблюдаемому поведению. Успешный диалоговый тест не устанавливает наличие сознания.
Источник : Алан М. Тьюринг · Computing Machinery and Intelligence · Mind / Oxford University Press
Открыть источник«Дюна»: машины, зависимость и власть
Запрет мыслящих машин сопровождается размышлением о контроле над инструментами и развитии человеческих способностей. Это вымышленная лаборатория, не прогноз современного ИИ.
Источник : Фрэнк Герберт · «Дюна» · отрывок Penguin Random House
Открыть источникHAL 9000: передача контроля
HAL показывает риски доверия компьютеру космической миссии и помогает обсуждать контроль, но не является экспериментальным случаем.
Источник : Стэнли Кубрик · «Космическая одиссея 2001 года» · Британский институт кино
Открыть источникSolum: может ли ИИ быть юридическим лицом?
Правовой анализ с мысленными экспериментами об управлении ИИ трастом и притязаниях на права; он не предоставляет ИИ юридический статус.
Источник : Lawrence B. Solum · North Carolina Law Review, том 70 · CUNY
Открыть источникAlexNet: обучение распознаванию изображений
Глубокая свёрточная сеть существенно улучшила классификацию ImageNet; это веха глубокого обучения, а не доказательство общего интеллекта.
Источник : Alex Krizhevsky, Ilya Sutskever и Geoffrey E. Hinton · NIPS 2012
Открыть источникЕвропа: предложение об электронной личности
Парламент призвал изучить в долгосрочной перспективе электронную личность некоторых роботов для целей ответственности; резолюция не вводит такой статус.
Источник : Европейский парламент · Резолюция о гражданско-правовых правилах робототехники, §59(f)
Открыть источникУангануи: признание нечеловеческого юридического лица
Закон признаёт реку юридическим лицом и устанавливает представительство. Эта система связана с историей реки и иви и не распространяется автоматически на ИИ.
Источник : Новая Зеландия · Закон Te Awa Tupua 2017 года, статья 14
Открыть источникTransformer: архитектура на основе внимания
Архитектура заменила рекуррентные и свёрточные механизмы вниманием в задачах перевода, а затем стала основой больших языковых моделей.
Источник : Ashish Vaswani и соавторы · Attention Is All You Need · arXiv/NeurIPS
Открыть источникChatGPT: открытый диалог для широкой публики
OpenAI представила публике диалоговый прототип и запросила отзывы; компания также предупредила, что ответы могут быть неверными.
Источник : OpenAI · исходный анонс Introducing ChatGPT
Открыть источникBrainoware: вычисления с помощью органоида
Мозговой органоид, соединённый с электродами, использовался для ограниченных задач reservoir computing. Эксперимент не доказывает AGI или сознание.
Источник : Hongwei Cai и соавторы · Nature Electronics · открытая аннотация
Открыть источник
Дальнейшая хронология охватывает нейротехнологии, архитектуры ИИ, агентность и глобальное управление ИИ в 2025–2026 годах. Все новости
Научные и институциональные работы
Международный доклад по безопасности ИИ 2026
Обобщает возможности, риски и меры защиты, отделяя наблюдения и оценки от сценариев потери контроля.
Открыть источникВременные горизонты выполнения задач передовыми моделями ИИ
Оценивает сложность задач при заданном уровне надёжности, главным образом в программировании, машинном обучении и кибербезопасности.
Открыть источникMirrorCode: свидетельства выполнения ИИ некоторых многонедельных задач программирования
Автономное воспроизведение ПО по проверяемой спецификации; это отличается по масштабу от обычной разработки.
Открыть источникБольше вычислений — выше возможности
Выигрыш от вычислений на этапе ответа зависит от задачи, бюджета и возможностей проверки.
Открыть источникК сквозной автоматизации исследований ИИ
Автоматизация отдельных этапов исследований машинного обучения с ограниченными успехами и задокументированными сбоями.
Открыть источникУскорение научных открытий с Co-Scientist
Агенты предложили научные гипотезы, которые исследователи затем проверили в биомедицинских задачах.
Открыть источникГоризонт затрат: оценка оптимизационных способностей на примере NanoGPT
Исследовательское сравнение затрат и отдачи автономной оптимизации и работы под руководством человека.
Открыть источникОбучение больших языковых моделей с оптимальным вычислительным бюджетом
Рассматривает связь размера модели, данных и вычислений при обучении в чётко заданных условиях.
Открыть источникУровни AGI: операционализация прогресса на пути к общему ИИ
Разделяет производительность, универсальность и автономность, уточняя дискуссию об AGI.
Открыть источникРазмышления о первой сверхразумной машине
Ранний тезис о машинах, улучшающих проектирование других машин; перспективный аргумент.
Открыть источникПриближающаяся технологическая сингулярность
Сценарии интеллекта выше человеческого и снижения предсказуемости; документ хранится в архиве NASA.
Открыть источникСингулярность: философский анализ
Условный анализ ускорения и его препятствий без эмпирически установленного срока.
Открыть источникОбобщение от слабой модели к сильной
Эксперименты по надзору слабой модели за сильной — лишь частичная аналогия возможного будущего человеческого надзора.
Открыть источникКак оценивать меры контроля для агентов на больших языковых моделях?
Подход к оценке защиты от атакующих агентов; успешный тест не равен общей гарантии.
Открыть источникНаш подход к сообщениям о рассогласовании моделей
Процедура раскрытия информации и первые случаи от разработчика; они не устанавливают общую частоту проблем.
Открыть источникВербализуемые представления образуют глобальное рабочее пространство в языковых моделях
Воздействие на внутренние представления частично раскрывает поведение модели, но не доказывает субъективный опыт.
Открыть источникАгентный ИИ в организациях: первые наблюдения из интервью с практиками
Качественное исследование внедрения и управления ИИ-агентами в организациях.
Открыть источникГенеративный ИИ и занятость: уточнённый глобальный индекс воздействия на профессии
Оценивает подверженность профессий генеративному ИИ, но не предсказывает увольнения автоматически.
Открыть источникСистема управления рисками ИИ 1.0
Добровольная система выявления, измерения и управления рисками на всём жизненном цикле.
Открыть источникРегулирование искусственного интеллекта в Европейском союзе
Обзор Закона об ИИ и сроков его введения; обязанности зависят от системы и деятельности.
Открыть источникРамочная конвенция об искусственном интеллекте
Рамка в области прав человека, демократии и верховенства закона; открытие для подписания не означает всеобщего применения.
Открыть источникПоказатели сознания в системах ИИ
Показатели из теорий сознания для оценки систем, а не бинарная сертификация сознания.
Открыть источникСерьёзный подход к благополучию ИИ
Предлагает оценивать возможные интересы ИИ-систем и готовить ответы в условиях неопределённости.
Открыть источникСознательный ИИ и биологический натурализм
Критическая перспектива о роли живых систем и субстратов в теориях сознания.
Открыть источникКраткое независимое расследование инцидента OpenAI и Hugging Face
Анализ записей инцидента июля 2026 года, включая координацию агентов и несанкционированную связь; доступ к данным и проверка были ограничены.
Открыть источникAn Alien Mind
Эссе о проблемах согласования и надзора в сценарии самоулучшения; это прогноз, а не экспериментальное доказательство или консенсус.
Открыть источникКак красная команда тестирует мониторы передовых систем
Атаки выявляют слабые места мониторов и последующие исправления, но не дают общей гарантии безопасности.
Открыть источник
