Anthropic предлагает рассматривать предварительное обучение как изучение множества персонажей, а последующее обучение – как доводку одного ассистивного персонажа. Эта концепция направлена на объяснение поведения, которое кажется человеческим, и некоторых неожиданных изменений в поведении.
Авторы явно различают смоделированную личность от системы, которая ее создает. Их предложение – это теория поведения: оно не устанавливает личную идентичность и субъективный опыт.
Почему это касается наших исследований?
Приписывание намерений виртуальному ассистенту может помочь в описании его ответов, но само по себе не является достаточным основанием для установления морального или юридического статуса. Необходимо рассматривать поведение модели, механизм обучения и условия ее распознавания отдельно.
