Edgelab — многослойная память агента

Статья: blog.edgelab.space/guides/memory-architecture (2026, про Claude Code).

Идея: 5-слойная память вместо одного файла, чтобы агент помнил контекст между сессиями, но не раздувал активное окно (~1.2% от 1M токенов на старте сессии).

Слои:

  • IDENTITYCLAUDE.md, USER.md, rules.md — автозагрузка, живёт вечно
  • WARMdecisions.md — автозагрузка, хранится 14 дней
  • HOThandoff.md (последние 10 записей) — автозагрузка, 24 часа
  • COLDMEMORY.md, LEARNINGS.md — по запросу через Read, архив
  • L4 SEMANTIC — внешний vector-search слой (pgvector), запрос через API, без ограничения хранения

Реализация:

  • Структура .claude/{core,hooks,scripts,tools,skills}/
  • Cron-скрипты на ротацию (rotate-warm.sh, trim-hot.sh, semantic-sync.sh), компрессия на Sonnet (дешевле Opus)
  • Хуки вместо инструкций в CLAUDE.md — 100% надёжность против “~80% соблюдения” у чистого CLAUDE.md; хуки на опасные команды, защиту секретов, логирование, session bootstrap, semantic recall, детект коррекций от пользователя
  • “Terse Mode” — промпт-инструкция резать служебные слова в выводе (output-токены в 5 раз дороже input) — экономия ~75%
  • Модель: Opus для code/review/planning, Sonnet для сабагентов
  • Есть открытый репо: install-скрипт, 800 тестов, Telegram-гейтвей

Why relevant: прямое пересечение с трёхсистемной памятью Сергея (vault / auto-memory / claude-mem, см. rules) — в статье формализованный вариант той же идеи “разные слои по времени жизни + хуки вместо доверия к соблюдению инструкций”. Полезный референс, если решится ещё раз переосмыслить архитектуру памяти agent-second-brain или ccbot.

How to apply: при обсуждении реорганизации памяти (vault/MEMORY.md/claude-mem) — держать этот слоистый паттерн (identity/warm/hot/cold/semantic + hooks-enforcement) как готовый референс архитектуры, не изобретать заново.