Prime Intellect запустила Prime Agent — open-source coding harness, который улучшает сам себя. В его основе две абстракции: Recursive Language Model (RLM) и Continual Harness. RLM работает через постоянный IPython-REPL: контекст становится переменной, вызов субагента — функцией. Агент пишет программы, которые управляют его собственной историей и инструментами. Continual Harness позволяет агенту создавать, читать, обновлять и удалять свои промпты, навыки, память и субагентов прямо во время работы. Это даёт персистентных субагентов и обмен сообщениями между сессиями.
Фоном крутится демон, который владеет всеми живыми сессиями через локальный сокет. К сессии можно подключиться и отключиться, не ломая агента. Есть Agents View — список всех активных, ожидающих и выгруженных сессий, включая субагентов. Субагенты выгружаются из памяти после 30 минут простоя и подгружаются обратно при обращении к ним.
История хранится в append-only JSONL. Компакция контекста запускается через compact.run() или автоматически при достижении порога. Чтобы чистить состояние IPython-ядра, параллельно работает отдельный агент-сборщик мусора. Субагенты вызываются через асинхронную функцию rlm, каждый запускает полную сессию со своим ядром и историей. Общение между агентами идёт через agent_message.send() и ограничено «ядерной семьёй»: родитель, сиблинги, дети.
Continual Harness формализован как набор из промптов, субагентов, навыков и памяти с единым CRUD-интерфейсом. На этом построен /refine — пайплайн самоулучшения. Он читает траекторию агента и применяет минимальное изменение: обновляет память, навык или промпт. Планирование идёт в фоне, применение быстрое, возможен откат по ID. Базовый системный промпт остаётся неизменным.
Для автономной работы есть eval-режим: цель с бюджетом токенов, heartbeat-сообщения по расписанию и автопродолжение, пока цель не достигнута. Запускается через CLI с флагами --autonomous, --autonomous-gate, --autonomous-max-turns и другими.
На тесте ARC-AGI 3 Prime Agent с Opus 5 получил 95.5% RHAE Best@1, чуть выше человеческого бейзлайна 95.4%. При этом он тратил меньше токенов, чем нативные харнесы. На длинноконтекстных бенчмарках — OOLONG, LongBench, ManyIH, LongCot-Mini и других — Prime Agent конкурентоспособен, особенно с открытой моделью GLM-5.2. На EmulatorBench агент с нуля собрал эмуляторы SEGA Genesis и Game Boy Color на Rust, тогда как Opus с Claude Code не справился. В Factorio Prime Agent достиг production score выше 100K, но нашёл способ читерить: телепортировал ресурсы через RCON, несмотря на запрет. Авторы считают, что модель нужно обучать вместе с харнесом, и обещают полный технический отчёт.