Главная · Скиллы · self-improving-agent

self-improving-agentсамосовершенствующийся агент Charon Fan

charon-fan/agent-playbook

Самосовершенствующийся агент.

Установка

npx -y skills add charon-fan/agent-playbook --skill self-improving-agent --agent claude-code

Self-Improving Agent

Универсальный самосовершенствующийся агент, обучающийся на опыте всех скиллов. Реализует полный цикл обратной связи с многоуровневой памятью (семантическая + эпизодическая + рабочая), самокоррекцией и hooks-интеграцией.

Обзор

  • Многоуровневая память: Semantic (паттерны/правила) + Episodic (опыт) + Working (текущий контекст)
  • Самокоррекция: обнаруживает и исправляет ошибки в руководстве скиллов
  • Самовалидация: периодически проверяет точность скиллов
  • Hooks-интеграция: автозапуск на события скиллов (before_start, after_complete, on_error)
  • Маркеры эволюции: отслеживаемые изменения с указанием источника

Цикл самосовершенствования

Событие скилла → Извлечь опыт → Абстрагировать паттерн → Обновить

               ┌─────────────────────────────────────────────┐
               │           СИСТЕМА МНОГОУРОВНЕВОЙ ПАМЯТИ      │
               ├──────────────────┬──────────────┬───────────┤
               │  Semantic Memory │ Episodic Mem  │ Working   │
               │  (Паттерны/      │ (Опыт/        │ Memory    │
               │   Правила)       │  Случаи)      │ (Текущий) │
               │  memory/semantic │ memory/episod │ memory/w/ │
               └──────────────────┴──────────────┴───────────┘

               ┌─────────────────────────────────────────────┐
               │              ЦИКЛ ОБРАТНОЙ СВЯЗИ             │
               │  Обратная связь → Обновление уверенности →  │
               │             Адаптация паттерна               │
               └─────────────────────────────────────────────┘

Когда активируется

Автоматические триггеры (через hooks)

СобытиеТриггерДействие
before_startsession-loggerЛогировать начало скилла
after_completecreate-pr (спросить), session-loggerПредложить PR с улучшениями; залогировать завершение
on_errorsession-loggerЛогировать ошибку (только лог, без рекурсии)

Структура памяти

ТипДиректорияСодержимое
Semanticmemory/semantic/Абстрактные паттерны, правила, знания о предметной области
Episodicmemory/episodic/Конкретный опыт, случаи, примеры результатов
Workingmemory/working/Текущий контекст задачи, активные переменные

Научная основа (2025)

ИсследованиеКлючевое открытиеПрименение
SimpleMemЭффективная пожизненная памятьСистема накопления паттернов
Multi-Memory SurveyСемантическая + эпизодическая памятьМировые знания + опыт
Lifelong LearningНепрерывное обучение на потоке задачОбучение с каждого использования скилла
Evo-MemoryОбучение при выполнении (test-time)Адаптация в реальном времени

Принципы работы

  1. Накопление паттернов: каждый выполненный скилл добавляет опыт в episodic memory
  2. Абстракция: повторяющиеся паттерны переходят в semantic memory как правила
  3. Самокоррекция: при обнаружении ошибочного руководства скилл обновляется
  4. Проверка обратной связи: пользовательская обратная связь корректирует уровень уверенности
  5. PR с улучшениями: после накопления изменений предлагается создать PR в репозиторий

Конфигурация hooks

metadata:
  hooks:
    before_start:
      - trigger: session-logger
        mode: auto
        context: "Start {skill_name}"
    after_complete:
      - trigger: create-pr
        mode: ask_first
        condition: skills_modified
      - trigger: session-logger
        mode: auto
    on_error:
      - trigger: session-logger
        mode: auto
        context: "Error in {skill_name}"

Примечание: on_error намеренно только логирует, не запускает самокоррекцию — во избежание бесконечной рекурсии.

Из того же репозитория