6 июля, исследователи Anthropic представили «линзу Якобиана». Этот метод позволяет выявлять определенные внутренние представления, связанные с понятиями, которые модель может выражать. В ходе контролируемых экспериментов, изменение этих представлений влияет на ответы или поведение модели.

Доступ остаётся неполным: некоторые концепции трудно выделить, а некоторые тексты остаются непонятными. Авторы изучают функциональные свойства; их наблюдения не доказывают, что у модели есть субъективный опыт.

Почему это касается наших исследований?

Для Fondation UvH, более тщательный анализ механизмов системы может помочь понять, что ее собственные ответы не позволяют проверить. Это ставит вопрос о методе расследования: какие именно сведения действительно дают толчок для расследования, и как сопоставлять противоречивые улики?

Вопрос моральный требует отдельного рассмотрения. Простое признание внутренней организации, полезной для рассуждения, недостаточно для установления того, что система может испытывать благополучие или страдание. Наша работа приближает эти вопросы, не сводя их вместе: понимание функционирования, оценка возможных интересов и обоснование определенного статуса требуют отдельных аргументов.

Читать первоисточник

Все новости