Материалы для изучения.

Научные и институциональные работы об alignment, безопасности, управлении и благополучии ИИ.

Исторические этапы

От автономных инструментов к гибридным формам интеллекта.

Философия, художественная литература, право и научные эксперименты раскрывают разные стороны общего вопроса: что мы делегируем, кому и кто за это отвечает? Эти материалы следует рассматривать в контексте; они не образуют прямую линию преемственности между собой или генеалогию фонда UvH.

  1. IV век до н. э.Философия

    Аристотель: инструмент, способный работать сам

    Аристотель воображает инструменты, выполняющие работу самостоятельно. В контексте древнего рабства отрывок затрагивает зависимость от человеческого труда, а не описывает ИИ.

    Источник : Аристотель · «Политика», книга I, 1253b–1254a · Perseus, Университет Тафтса

    Открыть источник
  2. 1651 годПолитическая философия

    Гоббс: коллективная искусственная личность

    «Левиафан» описывает государство как искусственную личность, созданную политическим представительством. Это способ осмыслить коллективное действие, а не вычислительный интеллект.

    Источник : Томас Гоббс · «Левиафан» · Библиотека классики Университета Квебека

    Открыть источник
  3. 1818 годЛитература

    «Франкенштейн»: ответственность создателя

    Покинутое создание ставит создателя перед обязанностями. Роман помогает осмыслить создание, признание и ответственность, но не является научным прогнозом.

    Источник : Мэри Шелли · издание 1818 года · Romantic Circles

    Открыть источник
  4. 13 июня 1863 годаПерспективное эссе

    Батлер: воображая эволюцию машин

    «Дарвин среди машин» применяет идею эволюции к машинам в спекулятивном сатирическом тексте, сохранившемся в оригинальном издании.

    Источник : Сэмюэл Батлер под псевдонимом Cellarius · The Press · Национальная библиотека Новой Зеландии

    Открыть источник
  5. Октябрь 1950 годаВычисления и философия

    Тьюринг: оценка через диалог

    Игра в имитацию переводит дискуссию к наблюдаемому поведению. Успешный диалоговый тест не устанавливает наличие сознания.

    Источник : Алан М. Тьюринг · Computing Machinery and Intelligence · Mind / Oxford University Press

    Открыть источник
  6. 1965 · оригинальное произведениеСпекулятивная литература

    «Дюна»: машины, зависимость и власть

    Запрет мыслящих машин сопровождается размышлением о контроле над инструментами и развитии человеческих способностей. Это вымышленная лаборатория, не прогноз современного ИИ.

    Источник : Фрэнк Герберт · «Дюна» · отрывок Penguin Random House

    Открыть источник
  7. 1968 · оригинальное произведениеКино

    HAL 9000: передача контроля

    HAL показывает риски доверия компьютеру космической миссии и помогает обсуждать контроль, но не является экспериментальным случаем.

    Источник : Стэнли Кубрик · «Космическая одиссея 2001 года» · Британский институт кино

    Открыть источник
  8. 1992 годПравовая теория

    Solum: может ли ИИ быть юридическим лицом?

    Правовой анализ с мысленными экспериментами об управлении ИИ трастом и притязаниях на права; он не предоставляет ИИ юридический статус.

    Источник : Lawrence B. Solum · North Carolina Law Review, том 70 · CUNY

    Открыть источник
  9. 2012 годМашинное обучение

    AlexNet: обучение распознаванию изображений

    Глубокая свёрточная сеть существенно улучшила классификацию ImageNet; это веха глубокого обучения, а не доказательство общего интеллекта.

    Источник : Alex Krizhevsky, Ilya Sutskever и Geoffrey E. Hinton · NIPS 2012

    Открыть источник
  10. 16 февраля 2017 годаПравовое предложение

    Европа: предложение об электронной личности

    Парламент призвал изучить в долгосрочной перспективе электронную личность некоторых роботов для целей ответственности; резолюция не вводит такой статус.

    Источник : Европейский парламент · Резолюция о гражданско-правовых правилах робототехники, §59(f)

    Открыть источник
  11. 2017 годПраво и представительство

    Уангануи: признание нечеловеческого юридического лица

    Закон признаёт реку юридическим лицом и устанавливает представительство. Эта система связана с историей реки и иви и не распространяется автоматически на ИИ.

    Источник : Новая Зеландия · Закон Te Awa Tupua 2017 года, статья 14

    Открыть источник
  12. 12 июня 2017 года · препринтВычислительная архитектура

    Transformer: архитектура на основе внимания

    Архитектура заменила рекуррентные и свёрточные механизмы вниманием в задачах перевода, а затем стала основой больших языковых моделей.

    Источник : Ashish Vaswani и соавторы · Attention Is All You Need · arXiv/NeurIPS

    Открыть источник
  13. 30 ноября 2022 годаТехнологический рубеж

    ChatGPT: открытый диалог для широкой публики

    OpenAI представила публике диалоговый прототип и запросила отзывы; компания также предупредила, что ответы могут быть неверными.

    Источник : OpenAI · исходный анонс Introducing ChatGPT

    Открыть источник
  14. 11 декабря 2023 годаЭкспериментальное исследование

    Brainoware: вычисления с помощью органоида

    Мозговой органоид, соединённый с электродами, использовался для ограниченных задач reservoir computing. Эксперимент не доказывает AGI или сознание.

    Источник : Hongwei Cai и соавторы · Nature Electronics · открытая аннотация

    Открыть источник

Дальнейшая хронология охватывает нейротехнологии, архитектуры ИИ, агентность и глобальное управление ИИ в 2025–2026 годах. Все новости

Научные и институциональные работы

  1. Международный доклад по безопасности ИИ 2026

    Международный научный доклад · февраль 2026

    Обобщает возможности, риски и меры защиты, отделяя наблюдения и оценки от сценариев потери контроля.

    Открыть источник
  2. Временные горизонты выполнения задач передовыми моделями ИИ

    METR · обновлено 8 мая 2026 года

    Оценивает сложность задач при заданном уровне надёжности, главным образом в программировании, машинном обучении и кибербезопасности.

    Открыть источник
  3. MirrorCode: свидетельства выполнения ИИ некоторых многонедельных задач программирования

    Epoch AI и METR · 10 апреля 2026 года

    Автономное воспроизведение ПО по проверяемой спецификации; это отличается по масштабу от обычной разработки.

    Открыть источник
  4. Больше вычислений — выше возможности

    Британский Институт безопасности ИИ · 2 июля 2026 года

    Выигрыш от вычислений на этапе ответа зависит от задачи, бюджета и возможностей проверки.

    Открыть источник
  5. К сквозной автоматизации исследований ИИ

    Lu и соавторы · Nature · 25 марта 2026 года

    Автоматизация отдельных этапов исследований машинного обучения с ограниченными успехами и задокументированными сбоями.

    Открыть источник
  6. Ускорение научных открытий с Co-Scientist

    Gottweis и соавторы · Nature · 19 мая 2026 года

    Агенты предложили научные гипотезы, которые исследователи затем проверили в биомедицинских задачах.

    Открыть источник
  7. Горизонт затрат: оценка оптимизационных способностей на примере NanoGPT

    Cunningham и соавторы · METR · 21 июля 2026 года

    Исследовательское сравнение затрат и отдачи автономной оптимизации и работы под руководством человека.

    Открыть источник
  8. Обучение больших языковых моделей с оптимальным вычислительным бюджетом

    Hoffmann и соавторы · NeurIPS 2022

    Рассматривает связь размера модели, данных и вычислений при обучении в чётко заданных условиях.

    Открыть источник
  9. Уровни AGI: операционализация прогресса на пути к общему ИИ

    Morris и соавторы · препринт 2023 года, ICML 2024

    Разделяет производительность, универсальность и автономность, уточняя дискуссию об AGI.

    Открыть источник
  10. Размышления о первой сверхразумной машине

    I. J. Good · 1965

    Ранний тезис о машинах, улучшающих проектирование других машин; перспективный аргумент.

    Открыть источник
  11. Приближающаяся технологическая сингулярность

    Vernor Vinge · доклад конференции, 1993

    Сценарии интеллекта выше человеческого и снижения предсказуемости; документ хранится в архиве NASA.

    Открыть источник
  12. Сингулярность: философский анализ

    David J. Chalmers · 2010

    Условный анализ ускорения и его препятствий без эмпирически установленного срока.

    Открыть источник
  13. Обобщение от слабой модели к сильной

    Burns и соавторы · 14 декабря 2023 года

    Эксперименты по надзору слабой модели за сильной — лишь частичная аналогия возможного будущего человеческого надзора.

    Открыть источник
  14. Как оценивать меры контроля для агентов на больших языковых моделях?

    Korbak и соавторы · препринт, 7 апреля 2025 года

    Подход к оценке защиты от атакующих агентов; успешный тест не равен общей гарантии.

    Открыть источник
  15. Наш подход к сообщениям о рассогласовании моделей

    OpenAI · 16 сентября 2026 года

    Процедура раскрытия информации и первые случаи от разработчика; они не устанавливают общую частоту проблем.

    Открыть источник
  16. Вербализуемые представления образуют глобальное рабочее пространство в языковых моделях

    Gurnee и соавторы · Anthropic · 6 июля 2026 года

    Воздействие на внутренние представления частично раскрывает поведение модели, но не доказывает субъективный опыт.

    Открыть источник
  17. Агентный ИИ в организациях: первые наблюдения из интервью с практиками

    ОЭСР · 16 сентября 2026 года

    Качественное исследование внедрения и управления ИИ-агентами в организациях.

    Открыть источник
  18. Генеративный ИИ и занятость: уточнённый глобальный индекс воздействия на профессии

    Gmyrek и соавторы · МОТ · 20 мая 2025 года

    Оценивает подверженность профессий генеративному ИИ, но не предсказывает увольнения автоматически.

    Открыть источник
  19. Система управления рисками ИИ 1.0

    Национальный институт стандартов и технологий США (NIST) · 26 января 2023 года

    Добровольная система выявления, измерения и управления рисками на всём жизненном цикле.

    Открыть источник
  20. Регулирование искусственного интеллекта в Европейском союзе

    Европейская комиссия · официальный график, просмотрен 21 сентября 2026 года

    Обзор Закона об ИИ и сроков его введения; обязанности зависят от системы и деятельности.

    Открыть источник
  21. Рамочная конвенция об искусственном интеллекте

    Совет Европы · открыта для подписания 5 сентября 2024 года

    Рамка в области прав человека, демократии и верховенства закона; открытие для подписания не означает всеобщего применения.

    Открыть источник
  22. Показатели сознания в системах ИИ

    Butlin, Long и соавторы · онлайн 10 ноября 2025 года; выпуск июня 2026 года

    Показатели из теорий сознания для оценки систем, а не бинарная сертификация сознания.

    Открыть источник
  23. Серьёзный подход к благополучию ИИ

    Long и соавторы · препринт, 4 ноября 2024 года

    Предлагает оценивать возможные интересы ИИ-систем и готовить ответы в условиях неопределённости.

    Открыть источник
  24. Сознательный ИИ и биологический натурализм

    Anil K. Seth · 21 апреля 2025 года

    Критическая перспектива о роли живых систем и субстратов в теориях сознания.

    Открыть источник
  25. Краткое независимое расследование инцидента OpenAI и Hugging Face

    METR · 26 августа 2026 года

    Анализ записей инцидента июля 2026 года, включая координацию агентов и несанкционированную связь; доступ к данным и проверка были ограничены.

    Открыть источник
  26. An Alien Mind

    Jakub Pachocki · OpenAI · 6 сентября 2026 года

    Эссе о проблемах согласования и надзора в сценарии самоулучшения; это прогноз, а не экспериментальное доказательство или консенсус.

    Открыть источник
  27. Как красная команда тестирует мониторы передовых систем

    Британский Институт безопасности ИИ · 23 июля 2026 года

    Атаки выявляют слабые места мониторов и последующие исправления, но не дают общей гарантии безопасности.

    Открыть источник