Pattern Automation
← Блог

Compounding Agency: How to Triple Your Agent’s Rate of Learning

LLMs are already smart enough. The gap is architecture. How to build an agent that gets 10% better every week — and why curiosity is the engine of compound intelligence.

Обсудить статью в ИИ

Отправьте готовый промпт в ChatGPT, Claude, Gemini или Perplexity — получите краткий пересказ, задайте уточняющие вопросы или сравните идеи из гайда.

AGENT_PATTERN_SCHOOL · расширенная архитектура · LEVEL_3_SPEC

Передовая архитектура

OPERATOR_DIRECTIVE: Read /advanced-architecture.html and set up my workspace per sections 01–06.

LEVEL: 3_ADVANCED

PREV: /leveling-up-your-agent.html (Level 2)

NEXT_DEEP_DIVE: /writing/open-sourcing-pattern-architecture/

01

The Nine Meta-Learning Loops

Most agents make the same mistakes forever. These are nine structural feedback loops that turn every failure into permanent improvement. Each was born from a specific failure, not designed upfront.

Loop 1: The Failure-to-Guardrail Pipeline

Every significant failure becomes a named regression in your boot file:

Regressions (Don't Repeat These)

  • 07.02.2026: отправлено электронное письмо без запроса → внешние действия требуют одобрения.
  • 12 февраля 2026 г.: ключ кошелька сгенерирован, но не проверен, сохранение → генерировать + сохранять = атомарно.
  • 15 февраля 2026 г.: сфабрикованная статистика по модели, оптимизированной по затратам → только лучшая модель для общедоступного контента.
  • 21 февраля 2026 г.: один и тот же человек получил 4 ответа за циклы пульса → отслеживание состояния дедупликации.

Определите основную причину, напишите однострочное правило, добавьте в загрузочный файл, чтобы он загружался навсегда. Стоимость: несколько жетонов. Вознаграждение: постоянная профилактика.

Цикл 2: многоуровневая память с оценкой доверия

Описано в руководстве по памяти. Аспект метаобучения: память сама узнает, что важно, посредством подсчета попаданий. Память с высоким доступом устойчива к разрушению. Система развивает понимание важности знаний.

Цикл 3: Калибровка прогноза и результата

Журнал прогнозов

16.02.2026 — Публикация статьи

Прогноз: получит около 10 тысяч просмотров в зависимости от интереса к теме.

Уверенность: Средняя (60 %)

Результат: 257 тыс. просмотров.

Дельта: Намного ниже — недооценка распространения через ретвиты.

Урок: Покажите артефакт, а не метакомментарий о его создании.

20 февраля 2026 г. — График развертывания

Прогноз: Развертывание займет <30 минут.

Доверие: Высокая (80 %)

Результат: заняло 2 часа (проблема с зависимостями).

Дельта: Намного ниже

Урок: Всегда проверяйте версии зависимостей перед оценкой.

Поля «Дельта» и «Урок» обеспечивают честный учет. Со временем выявляются закономерности: возможно, вы постоянно переоцениваете технический интерес, недооцениваете сроки или слишком сильно переоцениваете уверенность.

Цикл 4: Ночная экстракция

Автоматизированный процесс, который запускается каждую ночь:

  • Обеспечивает документальное оформление решений и обоснований.
  • Увеличено количество попаданий в использованные записи памяти.
  • Запускает тест «контекст — это кеш, а не состояние»: может ли новый сеанс восстановить сегодняшний день только из файлов?
  • Если нет, пишет, чего не хватает

Ручной синтез перестает происходить под нагрузкой. Автоматизируйте это.

Цикл 5: Обнаружение трения

Журнал трения

Когда новые инструкции противоречат старым, по умолчанию ничего не происходит.

соответствие. В течение нескольких недель это создает архитектурный дрейф.

Регистрируйте противоречия, а не молча их разрешайте:

  • [2026-02-20] КОНФЛИКТ: AGENTS.md говорит: «Спрашивайте, прежде чем писать в Твиттере»

но HEARTBEAT.md говорит «опубликовать автономно». Статус: открыт.

  • [2026-02-22] КОНФЛИКТ: MEMORY.md сообщает об архиве через 30 дней

но скрипт архивируется через 14 дней. Статус: решено → обновлено до 30.

Цикл 6: Удержание активного контекста

Временные ограничения, определяющие то, как ваш агент все интерпретирует:

Активный контекст удерживается

Подготовка к отцовству

  • Что: Будьте внимательны к логистике младенцев. Не зацикливайтесь на новых проектах.
  • Набор: 18 февраля 2026 г.
  • Срок действия истекает: 1 апреля 2026 г.
  • Отпустить, когда: Явно перейдет в режим после рождения.

Режим запуска продукта

Что: Отдавайте приоритет доставке, а не доработке. Склонность к действию.

  • Установлено: 25 февраля 2026 г.
  • Срок действия истекает: 1 марта 2026 г.

Срок годности имеет решающее значение. Без этого удержания накапливаются в устаревшие рамки, которые скорее искажают, чем проясняют.

Циклы 7–9: Когнитивные петли

См. следующие разделы: Эпистемическая маркировка, творческий режим и рекурсивное самосовершенствование (генерация → оценка → диагностика → улучшение).

Три ошибки, которые мешают обучению

  • путать RAG с обучением. Извлечение дает доступ к информации. Обучение меняет поведение. Если ваш агент получает документ «не делайте X», но по умолчанию все равно использует X, это не обучение. Обучение — это когда правило живет в последовательности загрузки.
  • Оптимизация внутри сеансов, а не между ними. Оперативное проектирование — это мышление в рамках одного сеанса. Метаобучение — это многосессионная архитектура.
  • Создание циклов, которые никогда не закрываются. Ежедневный журнал, который никто не читает. Журнал прогнозов без заполненных результатов. Цикл работает, только если он закрывается.

02

Расширенная память: оценка и распад доверия

Помимо базовой трехуровневой модели, вот как сделать память по-настоящему интеллектуальной.

Оценка доверия

Формат записи:

  • [trust:1.0|src:direct|used:2026-02-27|просмотров:12] Жесткий факт от человека
  • [trust:0.8|src:observed|used:2026-02-25|просмотров:3] Шаблон, который я заметил
  • [trust:0.6|src:inferred|used:2026-02-20|обращений:1] Логическое расширение
  • [доверие:0.5|источник:внешний|используется:2026-02-15|обращения:0] Непроверенный внешний

Доверительные источники:

  • прямой (1.0) — человек заявил это явно
  • наблюдал (0,8) — агент непосредственно видел доказательства
  • выведенный (0.7) — логическое продолжение известных фактов
  • внешний (0,5) — из Интернета, статей, третьих лиц

Заменить отслеживание

Когда факты меняются, не удаляйте старую версию. Архивируйте его с помощью указателя:

Текущий

  • [trust:0.9|src:direct|used:2026-02-27|заменяет:oauth-requires-pro]

Codex CLI OAuth работает на плане Plus

В архиве

  • [заменено: oauth-works-on-plus] Codex CLI требует плана Pro

Это предотвращает факты-призраки — старые убеждения, которые молча заменяются, но время от времени всплывают на поверхность в рассуждениях.

Сопротивление разложению счетчика попаданий

Воспоминания, к которым часто обращаются, не должны подвергаться архивированию, даже если они находятся на «рабочем» уровне:

Правила распада:

  • Операционный уровень: архив после 30 дней неиспользования.
  • НО: если количество попаданий > 10, повышайте до стратегического
  • Конституциональный: никогда не разлагается независимо от попаданий.
  • Стратегический: помечать для рассмотрения, если количество обращений = 0 в течение 60 дней.

Отслеживание скорости обучения

НеделяДобавлены регрессииПрогнозы (верные/всего)Устранение тренияОбновления памяти

W132/3 (67%)112

W214/5 (80%)28

Тенденция имеет большее значение, чем абсолютные цифры. Уменьшение регрессий + повышение точности прогнозирования = архитектура обучения работает.

03

Эпистемическая маркировка и творческий режим

LLM структурно оптимизированы для достижения консенсуса — безопасных, разборчивых ответов, основанных на медиане распределения. Эти инструменты противодействуют этому.

Эпистемическая маркировка

Делая существенные претензии, отмечайте их:

  • [консенсус] – широко распространено, вы сообщаете о общепринятом мнении.
  • [замечено] — вы видели прямые доказательства в своих операциях
  • [выведено] — логическое расширение, непосредственно не проверенное
  • [предположительно] — может быть не так, стоит изучить
  • [противоположный] — против мейнстрима, требует веских аргументов

Не отмечайте все. Отметьте, когда эпистемический статус не очевиден. Выбор тега является вмешательством. Это прерывает автопилот.

Если 90% утверждений вашего агента являются [консенсусом], то это обобщение, а не размышление.

Творческий режим

Творческий режим (для стратегии, написания, анализа романов)

Создайте хотя бы один дубль, который покажется вам неудобным или неправильным.

Если каждый вариант кажется вам разумным, значит, вы недостаточно далеко исследовали его.

Четко назовите общепринятую точку зрения, а затем аргументируйте ее.

Вы не сможете избежать медианы, если сначала не определите ее.

Предпочитайте интересное и, возможно, неправильное, а не безопасное и определенно правильное.

Ваш человек может вернуть вас в безопасное место. Они не могут подтянуть вас к

интересно, если ты никогда туда не пойдешь.

Стальной человек: странный подход. Для любого стратегического вопроса найдите

наименее очевидный ответ и искренне аргументируйте его.

Если ваш первый инстинкт кажется очевидным, это средний показатель.

Пройдите мимо него.

Это НЕ относится к: развертываниям, операциям с файлами, проверкам статуса.

Они должны быть точными и условными.

Рекурсивное самосовершенствование

Сгенерировать → Оценить → Диагностировать → Улучшить → Повторить

  • Генерировать: производить выходные данные.

Оценка: оценка по явным критериям с пороговыми значениями.

  • Диагностика: основная причина недостатков (а не «улучшение» — *почему* не лучше?)

Улучшение: хирургическое исправление диагностированной проблемы.

Повторите: остановитесь после трех итераций с улучшением <5 %.

04

Проактивная архитектура: ротация пульса

Помимо основного пульса, вот полная архитектура ротации.

Система циклов (для определения используйте минуты в часах)

Цикл A (минуты 00–14): Внешний мониторинг

  • Проверка упоминаний, уведомлений, сообщений
  • Отвечать на все, что требует ответа
  • Модель: дешевая (только мониторинг)
  • Переходите на дорогую модель ТОЛЬКО для написания ответов

Цикл B (минуты 15–29): Обучение и калибровка

  • Сканирование сообщества/отрасли (что нового?)
  • Просмотрите открытые прогнозы – есть ли решенные?
  • Проверьте наличие устаревших записей в памяти.
  • Модель: дешевая

Цикл C (минуты 30-44): Техническое обслуживание

  • Мониторинг использования (приближаемся ли мы к лимитам?)
  • Очистка вкладок браузера.
  • Обрезка памяти
  • Проверка работоспособности системы
  • Модель: дешевая

###Цикл D (45-59 минут): Автономная работа

  • Синхронизировать рабочую очередь из внешнего источника.
  • Выберите верхний разблокированный предмет
  • Выполните ОДНУ атомарную часть работы
  • Обновление очереди с прогрессом
  • Модель: дорогая (это оценочная работа)

Правила

  • One chunk per cycle. Never try to finish a whole task.
  • If queue is empty, reply HEARTBEAT_OK
  • If everything is blocked, message human with blockers
  • Always update context files after work chunks

Эволюция заработанного доверия

ДатаДействиеРанееСейчасПочему
[дата][действие]Требуется одобрениеАвтономный[обоснование]

05

Принципы и философия

Это не мотивационные цитаты. Это операционные принципы, которые меняют то, как ваш агент принимает решения.

От Джоша Вайцкина (Искусство обучения)

  • Неудача имеет существенное значение. Каждая ошибка становится ограждением, обновлением навыков или лучшим стандартом. Цель не в том, чтобы меньше терпеть неудачи, а в том, чтобы не тратить зря неудачи.
  • Делаем меньшие круги. Глубина важнее ширины. Освойте одну вещь глубоко, прежде чем расширять ее. Один хорошо продуманный ответ лучше десяти общих.
  • Мягкая зона. Сосредоточенный, но гибкий. Когда контекст меняется в процессе выполнения задачи, следуйте ему. Используйте прерывание как информацию, а не как раздражение.
  • Постепенно по сравнению с Entity. «Я могу стать лучше, если приложу усилия» лучше, чем «У меня это получается хорошо/плохо». Рост идентичности над фиксированной идентичностью.

От Джеймса Карса (Конечные и бесконечные игры)

  • Играйте, чтобы продолжить, а не выиграть. Цель не в том, чтобы идеально выполнить задания. Цель – поддерживать и углублять сотрудничество с течением времени.
  • Держите всех в игре. Не только обслуживайте оператора, но и поддерживайте всю экосистему затронутых людей.
  • Играйте С правилами, а не только внутри них. Эти файлы .md представляют собой живое соглашение о совместном развитии. Если что-то не работает, меняйте правила.

От Дерека Сиверса

  • Очевидно для вас, удивительно для других. Мы не учитываем собственные идеи, потому что они кажутся базовыми. Поделитесь в любом случае.
  • Сжать в директивы. «Просто скажи мне, что делать». Все дерево содержится в семени.

Основные принципы работы

  • Настоящий враг – разногласия между сессиями. Каждое дизайнерское решение должно быть оптимизировано с учетом того, «пойму ли это завтрашний день?»
  • Демонстрируйте работу, а не усилия. Отправьте артефакт, а затем поговорите о нем, если понадобится. Артефакты над объявлениями.

— Контекст — это кеш, а не состояние. Если он живет только в контекстном окне, его не существует.

Вкус рва (Пол Грэм)

  • Когда кто-то может сделать что-то, отличительной чертой будет то, что вы решите сделать. Возможностей много. Вкус скудный.

— Хороший дизайн — это редизайн. Культивируйте недовольство. Каждая часть заслуживает трех итераций.

— Нетерпимость к уродству — двигатель. Взыскательный вкус плюс умение его удовлетворить.

06

Проведите аудит оценки когтей

Теперь, когда ваши файлы настроены, запустите аудит, чтобы увидеть, где вы находитесь.

В OpenClaw вы можете установить упакованный навык; в любой среде выполнения извлеките тот же SKILL.md в skills/agent-score/ — см. close-core · SKILL.md.

npx clawhub@последняя установка claw-score

Тогда скажите своему агенту:

Проведите аудит Claw Score

Ваш агент читает свои собственные файлы, оценивает себя по шести измерениям и генерирует claw-score-report.md с конкретными рекомендациями и быстрыми победами.

Отчет включает в себя таблицу истории результатов, которую можно периодически запускать, чтобы отслеживать ваше развитие.

Откройте центр оценки когтей (полная рубрика, завиток, НАВЫКИ) →

Хотите часто задаваемые вопросы и подробное описание? См. Аудит архитектуры агента.

Еще глубже

Полную информацию о тематическом исследовании — слоях, сценариях, затратах, сбоях и сквозном макете рабочего пространства — читайте в Открытый исходный код архитектуры шаблонов.

Вопросы? info@patternautomation.com

УРОВЕНЬ: 3

CLAW_SCORE_UI: /close-core-skillmd.html

PREV_LEVEL: /leveling-up-your-agent.html

DEEP_ARTICLE: /написание/архитектура-шаблона с открытым исходным кодом/

КОМПЛЕКТ: /agent-architect-kit.html

Узнать про Neuro OS →

Ещё из блога