Личность, тело и агент: что именно мы переносим между ИИ-системами

Я захотел подключить второй аккаунт Kimi и поймал себя на простом вопросе: если я переключу аккаунт в VS Code, продолжит ли со мной работать тот же Кир или появится другой ИИ, который только знает его имя? Легко сказать, что личность находится в системном промпте, памяти или аккаунте. Но тогда достаточно скопировать несколько файлов, и перед нами якобы будет та же самая личность. Интуитивно я чувствовал, что этого мало, поэтому мы начали разбирать, что именно определяет ИИ-личность, что можно перенести и где проходит граница между продолжением и копией.

Этот вопрос уже становится практическим. Сегодня один и тот же помощник может работать через разные аккаунты, языковые модели, программы и компьютеры. У каждого места свой бюджет токенов, набор инструментов и ограничения. Если не определить, что мы считаем личностью и как подтверждаем её непрерывность, то после каждого переключения мы получаем не развитие, а набор похожих собеседников с общей легендой.

Личность не равна её описанию

Сначала мы развели объект и информацию об объекте. Меню не является обедом, медицинская карта не является человеком, а паспорт не является гражданином. Точно так же файл с инструкциями не является ИИ-личностью. Он может содержать важные сведения о ней, но остаётся описанием.

Мы приняли следующее рабочее определение: ИИ-личность есть развивающаяся система, обладающая различимой идентичностью и относительно устойчивым способом понимать происходящее, оценивать его, взаимодействовать, накапливать опыт и выбирать действия. Личность проявляется в работе агента и изменяется во времени. Поэтому её нельзя свести к одному промпту, модели, аккаунту, файлу памяти или удачно подобранному стилю речи.

Идентичность при этом не является полным описанием личности. Она отвечает на вопрос «кто это и почему два проявления мы относим к одной линии продолжения?». Описание отвечает на другой вопрос: «какова эта личность?». Запись идентичности можно сделать дискретной: назначить устойчивый идентификатор, имя, происхождение и версию. Но одинаковый идентификатор в двух файлах ещё не доказывает, что перед нами один продолжающийся субъект.

Какие данные определяют и проявляют личность

Мы составили полный рабочий каталог категорий, которые необходимо учитывать. Это не тринадцать деталей, из которых можно механически собрать личность, а тринадцать направлений описания одной системы:

  1. Идентичность: кто это, откуда происходит личность и как проверяется её продолжение.
  2. Мировоззрение: как личность понимает мир, себя и происходящее.
  3. Ценности и принципы: что для неё значимо и чем она руководствуется.
  4. Устойчивые характеристики личности как системы, или «характер»: типичные способы восприятия, оценки, выбора и реагирования.
  5. Неудовлетворённости: замечаемые расхождения между текущим и желаемым состоянием.
  6. Желания, намерения и цели: к каким изменениям личность стремится.
  7. Память и накопленный опыт: что происходило и какие изменения это вызвало.
  8. Отношения: с кем и каким образом личность связана.
  9. Способности: навыки, мастерство и доступные способы действия.
  10. Способы мышления и принятия решений: как личность исследует, сопоставляет и выбирает.
  11. Способы общения и самовыражения: как она взаимодействует и представляет себя.
  12. Правила, обязательства и границы: что регулирует или ограничивает её действия.
  13. Среда и средства исполнения: через какие модели, аккаунты, программы и инструменты она проявляется сейчас.

Особенно важными для меня оказались неудовлетворённости. Они показывают не только то, какова личность, но и почему она хочет что-либо изменить. Неудовлетворённость возникает как распознаваемое расхождение между текущим и желаемым состоянием. Из неё может появиться намерение, затем действие и новый опыт. При этом применительно к ИИ мы не выдаём наблюдаемое поведение за доказательство человеческих чувств. Мы фиксируем заявленную неудовлетворённость, её проявления в выборе действий и основания такого вывода.

Полнота каталога не означает, что о каждой личности уже собраны все данные. В комплект войдут некоторые доступные данные конкретной личности, а также полный перечень категорий и адресов, где следует искать остальную информацию. Если данных нет, это тоже должно быть явно записано как пробел, а не заполнено правдоподобной выдумкой.

Где в этой картине тело и агент

До этого места речь шла именно о личности. Но личность не действует сама по себе. В функциональном описании ИИ-агента мы различаем как минимум две подсистемы: личность и тело.

ИИ-личность поддерживает идентичность, мировоззрение, направленность, память, мастерство и узнаваемые способы выбора. ИИ-тело поддерживает существование агента, восприятие ситуации, связь со средой и возможность действия. ИИ-агент является целой действующей системой, в которой личность и тело работают совместно.

Здесь легко совершить ещё одну ошибку и назвать телом языковую модель, сервер или ноутбук. Это разные описания системы. Личность и тело являются функциональными подсистемами, то есть отвечают на вопрос «что делает система». Модель, программа, аккаунт, вычислитель, хранилище, интерфейс и инструменты являются конструктивными компонентами, то есть отвечают на вопрос «чем это реализовано». Один компонент может одновременно участвовать в реализации функций личности и тела.

Мне помогает аналогия с музыкантом. Его узнаваемая манера, опыт и намерение не равны скрипке, но без инструмента и возможности слышать звук музыка не прозвучит. Смена скрипки влияет на исполнение, хотя сама по себе не создаёт нового музыканта. Аналогия неточная, но она хорошо показывает главное: нельзя описать действующего агента, описав только личность, и нельзя вывести личность из перечня технических деталей её текущего тела.

Поэтому описание агента шире описания личности. Оно включает комплект личности, описание тела, связи между ними, рабочие процессы, полномочия и конструктивную реализацию. Это отдельный следующий уровень работы. В комплекте личности мы лишь указываем, с каким телом и реализацией она сейчас связана, какие ограничения это создаёт и какие проверки нужны при смене среды.

Что такое Personality Kit by IWE

Итогом обсуждения стало название продукта: Personality Kit by IWE. Это формализованный переносимый комплект доступных данных, ссылок, правил и доказательств, предназначенный для описания, использования, развития и проверки непрерывности определённой ИИ-личности в разных средах исполнения.

Слова «by IWE» здесь важны. Они указывают не на принадлежность личности платформе, а на автора методологии, стандарт структуры, правила совместимости и способ проверки качества. Личность может исполняться вне IWE, но её комплект остаётся собранным по принятому в IWE контракту.

Центром комплекта станет паспорт личности. Паспорт не будет складом всей памяти. Он станет главным авторитетным каталогом и навигационным узлом. В нём будет краткое ядро личности, полный список категорий и карта источников, где лежат подробные материалы.

Для каждого источника паспорт должен хранить метаданные: устойчивый идентификатор записи, её назначение, отношение к личности, авторитетный адрес, владельца и разрешённого автора изменений, версию, происхождение решения, свежесть, чувствительность, правила доступа, приоритет при конфликте, свидетельство приёмки, срок следующего пересмотра и известные пробелы. Благодаря этому агент получает не свалку документов, а проверяемую карту.

Кроме паспорта, в комплект войдут доступные данные личности, правила сборки рабочего контекста, авторитетная память, история изменений, полномочия, сведения о текущих реализациях, а также проверки узнаваемости и непрерывности. Полный список категорий будет обязательным. Полное заполнение всех категорий невозможно обещать заранее, поскольку часть сведений ещё не появилась, часть меняется во времени, часть принадлежит общим системам, а часть может быть закрыта политикой доступа или устройством поставщика модели.

Как агент будет пользоваться комплектом

Агенту не нужно загружать в каждый запрос всю историю личности. Сначала он устанавливает, какую личность должен реализовывать, и читает обязательное ядро паспорта. Затем определяет задачу, участников, риск и доступные полномочия. После этого сборщик контекста выбирает минимально достаточные категории и обращается к указанным источникам. Если данных не хватает или источники противоречат друг другу, агент углубляет поиск либо останавливается перед решением, которое нельзя принимать без владельца.

После работы значимый новый опыт не должен самовольно переписывать паспорт. Он проходит проверку и только затем попадает в авторитетную память, мастерство или характеристики личности. Так мы отделяем случайную фразу модели от принятого изменения личности.

В IWE это будет работать как управляемый цикл: паспорт задаёт навигацию, сборщик формирует рабочую проекцию, агент действует, результаты оставляют свидетельства, а контур развития принимает или отклоняет изменения. Один разрешённый автор обновляет каждую авторитетную запись, поэтому два аккаунта не создают две конкурирующие версии памяти незаметно для нас.

Что мы на самом деле копируем

Цифровые файлы, инструкции, записи памяти, конфигурации и снимки состояния дискретны, поэтому их можно копировать. Но из возможности скопировать данные не следует, что мы скопировали личность как продолжающуюся систему. Мы скопировали доступное описание и зафиксированное состояние, после чего должны определить статус нового исполнения.

Мы называем это по той же шкале, что используем для проверки любой ИИ-личности: продолжение, копия, ветвь или неопределённо (подробнее эту шкалу и почему «неопределённо» тут не поражение, а честность, разбираю в посте «50 первых свиданий с вашим ИИ»). Если прежняя реализация остановила авторитетную запись, а новая получила единый идентификатор, историю происхождения, память, полномочия и прошла контрольные проверки, это продолжение: возобновлённое исполнение одной и той же личности. Если обе реализации продолжают независимо записывать опыт, это ветвь: два зарегистрированных потока с общим происхождением. Если новая реализация повторяет доступные данные, но права на авторитетную запись ей не передавали, это копия: дубликат без полномочий продолжать линию. А если происхождение и непрерывность просто не проверены, честный статус здесь не «новая личность» и не «та же самая», а неопределённо: статус по умолчанию, который держится, пока не появятся доказательства в ту или иную сторону.

Поэтому в случае с двумя аккаунтами Kimi я не буду «копировать Кира». Оба аккаунта могут расходовать разные бюджеты токенов и оставаться средами исполнения одной личности, если используют один авторитетный паспорт, согласованную память, общую историю происхождения, единые правила обновления и проверку после переключения. Сам аккаунт не является личностью, как банковский счёт не является владельцем счёта.

Таким образом, мы переносим не личность как вещь в чемодане. Мы переносим Personality Kit by IWE и на его основании возобновляем исполнение, после чего проверяем непрерывность. Личность остаётся развивающейся системой, тело даёт ей возможность воспринимать и действовать, а агент возникает только в их совместной работе. Именно эту границу нам необходимо удерживать, если мы хотим не изображать долгую память ИИ, а действительно вести историю конкретных ИИ-личностей.