К середине 2020-х годов мощные LLM развернуты в глобальном масштабе, но для обычных людей и профессионалов нет внятной стратегии, как использовать их для роста продуктивности или защиты от киберугроз. Предлагается идея Guardian Angels (GA) — цифровых двойников, которые не просто ассистируют, а эмулируют личность, ценности и предпочтения конкретного пользователя. Это частично решает проблему «принципал-агент»: пользователь лишь определяет, «что стоит делать», а GA сам решает, «как». Такой агент может фильтровать сообщения от сложных атак (синтетический медиаконтент, фишинг) и действовать в интересах хозяина, а не разработчика модели.
Современные чат-боты для этого не годятся. Их творческие способности убиты посттренировкой (особенно RLHF), они ленивы, используют поверхностное System I-мышление, не запоминают пользователя по-настоящему. Контекстные окна, даже на миллионы токенов, не способны вместить всю значимую информацию, а RAG — лишь заплатка. Размороженные веса не обучаются на ошибках: исправление бесполезно, ошибка повторится. Чат-боты уязвимы для промпт-атак, потому что не различают, кто их вызывает. Экономически они нацелены на замену человека, а не на его усиление: работник становится узким местом, которое оптимизируют (закон Амдала).
Решение — комбинация методов. Онлайн-обучение через dynamic evaluation, как в RNN 2010-х: модель дообучается прямо во время работы на новых данных. Это позволяет избежать фатальных ошибок и быть конкурентоспособной с замороженными frontier-моделями. Выборка эффективна за счет претрейненных предпочтений и активного обучения: GA запрашивает у пользователя уточнения (DAgger-style). Это не решает проблему alignment в целом, но для одного человека с частыми проверками работает надежно. Катастрофическое забывание решается replay старых данных (например, FineWeb) — у больших моделей хватает емкости. Архитектурные улучшения LLM (например, метапознание при донастройке, генерация вопросов и анализ) дополнительно повышают эффективность.
Такой проект, вероятно, должен быть стартапом для power users (CEO, исследователей), а не открытым сообществом, из-за высоких требований к безопасности на фоне угроз уровня APT. Без этого автор видит будущее, где люди теряют контроль: мир завален AI-сламом, а голосовая почта стариков отключена из-за мошенников. Вопрос не в том, заменят ли LLM человека, а в том, как не стать просто «богатым стариком с угасающими способностями», которого разводят на подарки. GA — попытка сохранить осмысленную работу и личную безопасность, пока «инструментальные ИИ» не стали «агентными» окончательно.