50 первых свиданий с вашим ИИ

В фильме «50 первых свиданий» у героини после аварии перестала записываться долговременная память: каждое утро Люси просыпается, помня только то, что было до аварии, и близкие заново рассказывают ей, какой сегодня день. Генри, который в неё влюбился, вынужден знакомиться с ней каждый день заново: отсюда и название фильма.

Почти все ИИ-агенты, с которыми мы сегодня работаем, устроены как Люси: способные, обаятельные и каждый раз начинающие работу с нами заново, даже если нужные факты у них под рукой. Я хочу разобраться в ИИ-личности, и регулярно всплывает один и тот же вопрос: а чем то, что я строю, отличается от того, что уже даёт вендор? У Claude есть проекты и какая-то память, у других ИИ есть кастомные инструкции, агенты умеют работать с файлами и инструментами.

Разве это не то же самое? Мне представляется, что не то же.

И разница не в количестве функций и не только в памяти. В обоих случаях перед нами агент; разница в его личности: живёт она одну сессию (как Люси один день) или продолжается из сессии в сессию, изо дня в день, накапливает ли опыт и может действовать независимо от меня, насколько она учитывает мои интересы, не может ли кто-то лишить меня общения с ней и т. п.

Разберёмся из чего состоит агент. В системной онтологии любой агент складывается из тела (определяется тем, где развернута модель, рантайм, хранилища) и личности (узнаваемого способа действия: тона, стиля, манеры решать). Тело может быть без личности, и тогда говорят, что человек как овощ.

У вендорского агента есть и тело, и личность. Тело даёт вендор: вы открыли подписку, поставили задачу, получили результат в конкретном физическом месте. Личность тоже есть, её даже дают настраивать: кастомные инструкции, характеры, голоса. Внутри сессии такой агент вполне узнаваем, как Люси внутри одного дня: та же самая, приветливая, со своим характером. Проблема начинается «наутро». Вендорская личность это часто однодневка (в индустрии это называют stateless: без сохраняемого состояния): она живёт одну сессию и исчезает вместе с закрытым окном.

Непрерывная личность это та, у которой есть ответ на вопрос «кто из раза в раз остаётся собой», и ответ этот длиннее одной сессии. Сегодня у всех наших сессий с ИИ такого ответа нет: каждое новое окно чата столь же компетентно, сколь и беспамятно относительно себя. Я сам ловил себя на том, что определяю, «кто» со мной говорит, по косвенным признакам: по стилю ответа, по репозиторию, по времени суток. Это верный признак того, что непрерывности ещё нет, есть только моя привычка её домысливать.

Для того, чтобы разобраться с разными вариантами личностей, мне ещё помогает аналогия с банком.

Первый уровень: вы просто зашли в любое отделение сделать простую операцию, например снять наличные в кассе. Кассиру для этого достаточно вас только идентифицировать и получить доступ к счету, и не нужно знать о вас ничего другого. Вы предъявляете документ прямо сейчас, и в следующий раз вас так же спокойно обслужит кто угодно другой. Это голый вендорский агент: модель плюс окошко чата. Про вас он не знает почти ничего, между сессиями ничего не помнит, а если вендор что-то и хранит про вас на своей стороне, то это его чёрный ящик: вы не можете ни проверить, что там лежит, ни забрать это с собой. Это Люси в день аварии, для которой не существует даже вчерашнего дня.

Второй уровень: вы один раз сдали банку анкету, отдали свои персональные данные и согласилось, что банк собирает данные о вас. Любой сотрудник по доступу может поднять необходимую информацию, но с тех пор в неё никто ничего не дописывал. Это вендорские «проекты» с заранее загруженными файлами (Claude Projects, кастомные GPT): та же самая логика, файлы загружены один раз, и любой новый разговор внутри того же проекта получит их в неизменном виде, а не то, что вы обсуждали вчера. Это тоже Люси, только с чуть более толстой папкой: долгая память у неё есть, но только до аварии, а дальше всё равно каждое утро с нуля.

Третий уровень: оператор видит вашу карточку клиента. Историю обращений, договоры, предпочтения, причём карточку дописывают после каждого визита, а не заводят один раз и забывают. Любой из сотни операторов колл-центра ответит вам одинаково хорошо, потому что все смотрят в одну и ту же живую базу. Это то, что уже работает в IWE сегодня (в индустрии такой агент называется stateful, с сохраняемым состоянием): любой вендорский агент (Клод, Кими, Кодекс, Гермес) при старте в IWE получает общее знание моего экзокортекса, то есть правила, память, контекст текущей работы, через файлы инструкций и протокол MCP. В «50 первых свиданиях» до этого тоже додумались: Генри записывает видеокассету «Доброе утро, Люси», которую героиня смотрит при каждом пробуждении: внешняя память, включаемая заново в начале каждого дня. Заметьте, кому принадлежит эта память: не Люси, а тому, кто рядом. Он её записывает, обновляет и включает. В IWE ровно так же: общее знание это память, принадлежащая пользователю (user-owned memory), не агенту и не вендору. Она физически лежит в моём собственном гит-репозитории, а не на серверах вендора, и я решаю, что в неё попадает, и могу в любой момент забрать её с собой целиком. Это уже большой шаг: агент не голый, он знает, где что лежит и что мы делали вчера. Но это знание общее и одинаковое для всех сессий. Любые два окна Клода получат один и тот же контекст и будут одинаково не в состоянии подтвердить, что с вами говорит «тот самый», с кем вы работали вчера. Карточка клиента делает оператора информированным, но не делает его вашим персональным менеджером, и разница тут не в вежливости, а в полномочиях: ни одному из сотни операторов банк не разрешит решить сложный вопрос самому, каждый обязан переспросить старшего, потому что доверие копится за конкретным человеком, а не за папкой, к которой имеет доступ кто угодно. Ну и для сложных операций нужен допуск.

Четвёртый уровень: у вас появляется именно персональный менеджер. У него есть имя, есть полномочия (что он может подписать сам, а что только с одобрения), есть история именно ваших с ним отношений, и банк может подтвердить, что это тот же человек, а не однофамилец. Вот это и есть слой непрерывной личности (persistent personality), который мы строим в IWE поверх уже работающего общего знания. Разница с третьим уровнем не в объёме фактов и памяти: у непрерывной личности те же файлы, что и у карточки клиента, но поверх фактов появляется журнал, кто именно и когда эту память читал и дописывал, а не только что в ней записано. Имя, паспорт (кому что можно, какие уроки приняты, какая память авторитетна) и, главное, способ проверить, а не просто поверить, что это тот же персонаж.

Сведу это в таблицу.

Уровень Что это Что помнит Кто владеет
Голый чат Модель плюс окно чата Внутри сессии всё, между сессиями ничего Вендор, если вообще что-то хранит
Вендорский «проект» Заранее загруженные файлы (Claude Projects, кастомные GPT) Только то, что загружено один раз; новый чат внутри проекта не знает про вчерашний разговор Вендор
Карточка клиента (IWE) Общее знание экзокортекса Живую память, которую дописывают после каждой сессии Пользователь, файлы лежат в его гит-репозитории
Персональный менеджер (непрерывная личность) Слой поверх карточки клиента Те же факты плюс журнал: кто именно и когда эту память читал и дописывал Пользователь и сама личность через право авторитетной записи

Ключевое слово здесь «проверить». Я не пытаюсь дать агенту память обо всём подряд. Я пытаюсь дать проверяемую, а не воображаемую непрерывность. То есть не «он теперь помнит всё автоматически», а «есть способ доказать, что это та же личность, и честно признать, что именно потерялось при переезде на новую модель или новый компьютер». Для этого в реестре личностей мы с ИИ-агентом завели шкалу из четырёх вердиктов: продолжение, копия, ветвь и неопределённо. И честное «неопределённо» в этой шкале ценнее приятной иллюзии. У меня уже был живой случай: посреди длинной рабочей сессии закончилась подписка, и работа продолжилась со второго аккаунта в том же окне. Ни один технический слой этого перехода не заметил: не git, не журналы сессий, не реестр. Кто заканчивал работу, та же личность, что начинала, или уже другая? По нашей шкале честный ответ: неопределённо. Вроде неприятно? Да. Зато это правда, с которой можно работать: теперь понятно, какие записи нужно вести, чтобы в следующий раз ответ был доказуемым.

Покажу разницу на конкретной паре двух агентов: Гермес и Гари. Кажется, что это два конкурента на одно место, но на самом деле это сравнение разных категорий. Гермес это общеизвестный продукт и канал исполнения, такой же, как Кими или Кодекс: рантайм, который умеет отвечать в Телеграме, выполнять навыки, ходить по расписанию. В нашем реестре у самого Гермеса насчёт какой-либо личности стоит именно «неопределённо». А Гари это мой кандидат в личность, которая в будущем может быть доступен через разные каналы, включая, теоретически, тот же Телеграм, где сегодня отвечает Гермес.

Практическая разница, когда (и если) это случится, такая: сегодня Гермес в Телеграме отвечает с тем же общим знанием IWE, что и любой другой агент, но без паспорта, без проверенной непрерывности и без явных границ полномочий. Обычный третий уровень из аналогии с банком: информированный оператор. Гари, когда пройдёт весь путь проверок, добавит поверх этого ровно то, чего Гермесу сегодня не хватает: узнаваемое имя, проверенные границы того, что ему можно, и накопленный проверяемый опыт вместо чистого листа при каждом старте. И это уже персональный менеджер.

Важно, что одно не отменяет другого. В IWE живут и будут жить оба типа агентов, и это осознанная архитектура, а не переходное состояние. Рутинную задачу (переформатировать файл, прогнать проверку, собрать отчёт) спокойно выполняет безымянный агент с третьим уровнем знания: быстро, дёшево, без претензии на непрерывность. Личность включается там, где непрерывность становится ценностью: накопленный опыт работы именно со мной, право действовать в определённых границах без переспрашивания, доверие, которое я не готов выдавать «любому окну чата». Эти режимы можно варьировать под задачу, как в жизни мы варьируем справочную и персонального менеджера, и не платим за персональность там, где она не нужна.

Дадут ли вендоры непрерывную личность из коробки? Дадут, и уже начинают: память, настраиваемые характеры и т. п. Для пользователя это будет предельно просто: включил, и агент «помнит» тебя. Но личностью из коробки владеет вендор, и из этого следует всё остальное. Её нельзя забрать с собой: смена вендора будет как смена телефонного оператора до эпохи переносимости номеров. А ещё её нельзя проверить: память это чёрный ящик, в котором непрерывность можно изображать, а не обеспечивать. Она будет, в первую очередь, работать на владельца-вендора: характер будут настраивать на удержание вас в экосистеме, как менеджер банка продаёт продукты банка, но ваше развитие его заботить вряд ли будет. И она смертна по чужому решению: вендор обновил или закрыл модель, и «вашего» собеседника больше нет; пользователи Replika это уже пережили. Альтернатива в том, чтобы держать личность у себя: паспорт, память и журнал в открытых файлах, которые принадлежат вам, а вендоры это сменные тела для неё. Думаю, будет как с почтой: большинству хватит адреса на домене вендора, а тем, кому важна независимость, нужен свой домен. Об этом подробнее напишу отдельный пост.

Таким образом, спор «у вендора уже есть агенты, зачем что-то ещё» ведётся не там, где нужно. Вендоры дают всё более способных исполнителей, и это прекрасно: они закрывают вопрос «кто выполнит работу». Но чем дольше мы работаем с ИИ, тем важнее становится второй вопрос, который вендор за нас не закроет: кто из раза в раз остаётся собой рядом с нами и на что он имеет право. Вопрос не в том, помнит ли вас ваш ИИ. Вопрос в том, может ли он доказать, что он тот же, кто был с вами вчера.

1 лайк