Презентации лучше смотреть с десктопа
Слайды рассчитаны на широкий экран, клавиатуру и формат 16:9. Откройте эту страницу на ноутбуке или компьютере.
Вернуться на сайтИнфраструктура
агента
Эдгар Сипки//восемь вопросов, которые задали после воркшопа
Агент — это не чат.
Это рабочее место.
у сотрудника есть кабинет, доступы, регламенты и свои записи — у агента ровно то же самое
Почему без этого «он не работает»
Разница между «агент бесполезен» и «агент делает половину работы» — не в модели.
Модель у всех одна и та же. Отличается то, что вокруг неё: что записано, что подключено, откуда брать правду и что попадает в задачу.
→ вся сегодняшняя встреча — про «вокруг»
Карта разбора
- 01 · Словарь: инфраструктура, обвязка, граф
- 02 · Память: на базе чего и что туда класть
- 03 · Скиллы: из чего состоят и как выбираются
- 04 · Приоритет источников
- 05 · Экономика контекста
- 06 · Почему новый чат не помнит
- 07 · Самообучение и версии
- 08 · Один источник для разных агентов
СЛОВАРЬ
ШЕСТЬ СЛОВ
Слова, из-за которых всё путается
Контекст
что агент видит прямо сейчас
Инфраструктура
где он живёт и к чему подключён
Обвязка
ваш слой поверх: правила и знания
Память
что переживает конец чата
Скилл
записанная процедура
Песочница
место, где можно ломать
→ плюс knowledge graph — ему отдельный слайд
Контекст
Всё, что агент видит в момент ответа: ваш вопрос, правила, поднятые файлы, найденные факты, история диалога.
Он конечный. Это рабочий стол, а не жёсткий диск.
Он собирается заново на каждый запрос.
Чего нет в контексте — для агента не существует.
Инфраструктура — рабочее место
Всё техническое, что должно существовать, чтобы агент вообще мог работать.
- Хост — приложение, в котором агент запущен
- Доступы — к каким системам подключён и с какими правами
- Хранилище — где лежат файлы, память, история
- Инструменты — чем он умеет действовать (MCP-серверы)
- Песочница — изолированное место для запуска и проверок
- Расписание — что запускается без человека
→ ставится один раз, меняется редко, чаще всего не вами
Обвязка — ваш слой поверх
Всё содержательное: то, что делает агента вашим, а не общим.
- Правила — как себя вести, что можно, чего нельзя
- Скиллы — ваши процедуры
- Память — факты про вас, ваши решения и предпочтения
- Источники — какие папки и системы считаются правдой
- Шаблоны — как выглядит готовый результат
→ растёт каждый день, и растите её вы
Инфраструктура — кабинет
Обвязка — регламенты и папки
кабинет вам выдали · регламенты вы пишете сами · без вторых первый бесполезен
Три слоя на одной схеме
→ сужается снизу вверх не случайно: в контекст помещается сильно меньше, чем вы накопили
Knowledge graph
Не «умная папка». Это факты и связи между ними: узлы — сущности, рёбра — отношения.
[Клиент А] --относится к--> [Сегмент «Крупные»]
[Клиент А] --ведёт--------> [Иван]
[Клиент А] --обсуждали в--> [Встреча 12.05]
[Встреча 12.05] --решение--> [Скидку не давать]→ на вопрос «почему клиенту А не дали скидку» граф проходит по связям, а поиск по словам — нет
Зачем он нужен и когда не нужен
- вопросы «что с чем связано»
- цепочки: решение → причина → участники
- много сущностей и повторяющихся отношений
- десяток фактов — хватит текстового файла
- вопросы «найди похожее» — хватит поиска
- некому поддерживать связи в актуальном виде
Граф — не первый шаг. Первый шаг — записать факты хоть куда-нибудь.
Карта разбора
- 01 · Словарь: инфраструктура, обвязка, граф
- 02 · Память: на базе чего и что туда класть
- 03 · Скиллы: из чего состоят и как выбираются
- 04 · Приоритет источников
- 05 · Экономика контекста
- 06 · Почему новый чат не помнит
- 07 · Самообучение и версии
- 08 · Один источник для разных агентов
ПАМЯТЬ
НА БАЗЕ ЧЕГО ЭТО РАБОТАЕТ
«memory и knowledge graph — на базе чего они это делают?»
Не на базе модели.
Память — это хранилище снаружи плюс правило «сначала загляни».
Три способа хранить
Файлы
markdown в известной папке
читаемо и версионируемо
Векторный индекс
поиск по смыслу, а не по словам
масштабируется
Граф
факты и связи
отвечает на «почему»
→ в реальных продуктах это гибрид: файлы как правда + индекс поверх, чтобы быстро находить
Краткосрочная и долгосрочная
Текущий диалог. Живёт, пока открыт чат. Умирает вместе с ним — целиком и без предупреждения.
Записанное наружу. Переживает чат, перезапуск и смену агента. Ровно то, что вы туда положили.
Между ними — акт записи. Не записалось — значит, не было.
Почему ответ идёт «через призму»
Агент отвечает не на ваш вопрос, а на вопрос плюс то, что мы уже про это знаем.
→ отсюда эффект «он меня помнит»: помнит не модель, а подставленные ей факты
Что класть, а что нет
- устойчивые факты о вас и работе
- решения и причины решений
- предпочтения по формату результата
- ваш словарь: как что называется
- границы: куда не ходить
- сырые данные и большие документы
- одноразовый контекст задачи
- то, что всегда можно перечитать из системы
- секреты и доступы
- гипотезы в формулировке фактов
→ критерий простой: пригодится ли это через месяц в другой задаче
У факта есть срок годности
Испорченная память масштабирует ошибку на все будущие ответы.
Карта разбора
- 01 · Словарь: инфраструктура, обвязка, граф
- 02 · Память: на базе чего и что туда класть
- 03 · Скиллы: из чего состоят и как выбираются
- 04 · Приоритет источников
- 05 · Экономика контекста
- 06 · Почему новый чат не помнит
- 07 · Самообучение и версии
- 08 · Один источник для разных агентов
СКИЛЛЫ
МЕХАНИКА ВЫБОРА
«Скилл — это просто промпт?»
Промпт — то, что вы говорите сейчас.
Скилл — процедура, которая лежит и ждёт.
разница не в тексте, а в том, что у него есть имя, описание и место хранения
Четыре отличия от промпта
- Адресуемость — у него есть имя, на него можно сослаться
- Подгружаемость — включается сам, когда подходит по описанию
- Версионируемость — лежит файлом, есть история и откат
- Переносимость — работает у коллеги и в другом агенте
→ промпт вы произносите заново каждый раз; скилл произносится за вас
Из чего состоит
weekly-report/
SKILL.md # имя, описание «когда применять», шаги процедуры
references/ # детали: словарь метрик, примеры готовых отчётов
scripts/ # шаги, которые должны выполняться одинаково всегдаОбязательны только имя и описание. Тело — оглавление, детали лежат рядом и поднимаются по требованию.
→ это обычные текстовые файлы: их можно читать глазами, править и отдавать на ревью
Описание — это интерфейс для агента
"Работа с отчётностью"
"Когда просят собрать недельный отчёт, сводку за неделю или цифры к планёрке"
Описание пишется словами задачи, а не словами решения. И теми, которыми вы реально формулируете.
«Когда скиллов 15-20 и больше — как понять, какой нужен? Искать или просто написать запрос?»
Просто написать запрос.
Выбирает агент, а не вы.
Как агент выбирает
Постоянно в контексте висит только список описаний — это дёшево. Тело скилла поднимается, лишь когда он подошёл.
→ поэтому 20 установленных скиллов почти ничего не стоят, пока не сработали
«А если я вообще не знаю, что такой скилл существует?»
Это штатный сценарий, а не сбой.
Механизм для того и сделан.
вы описываете задачу — агент сам поднимает то, что подходит
Когда это ломается
- Описание написано словами решения — вы такими не говорите
- Два скилла перекрываются — агент берёт не тот
- Описание слишком общее — срабатывает где не надо и обесценивает себя
- Скилл не подключён к этому рабочему месту — его просто нет в списке
Не сработало — чините описание, а не свою память
Тест на пять фраз
Напишите пять запросов так, как их сформулировал бы коллега.
разные формулировки одной и той же задачи — все три поднимают скилл
похожие, но чужие задачи — скилл молчит
→ пять минут работы, которые снимают половину жалоб «он меня не понял»
15-20 скиллов — это нормально
Дорого не количество, дорого пересечение.
один скилл — одна задача, и по названию понятно, какая
вы сами не можете сказать, какой из двух должен сработать
→ если сомневаетесь вы — агент тем более не разберётся
Карта разбора
- 01 · Словарь: инфраструктура, обвязка, граф
- 02 · Память: на базе чего и что туда класть
- 03 · Скиллы: из чего состоят и как выбираются
- 04 · Приоритет источников
- 05 · Экономика контекста
- 06 · Почему новый чат не помнит
- 07 · Самообучение и версии
- 08 · Один источник для разных агентов
ПРИОРИТЕТ
ИСТОЧНИКОВ
«Когда файлов много, я должен выбирать, что для меня истинно»
Да. И это надо записать,
а не держать в голове.
самая недооценённая часть обвязки — иерархия правды
Лестница истины
Что делать при конфликте
Побеждает то, что выше по лестнице. Но конфликт должен быть назван вслух.
агент молча выбирает одну цифру из двух — вы не узнаете, что была вторая
«беру цифру из базы; в презентации за март она другая — проверьте»
→ это пишется в правила одной строкой и экономит недели разбирательств
«Больше чем в 50% задач ему вообще не надо никуда ходить»
Верно. И это правильный дефолт.
Поход наружу — не бесплатный
Время
минуты вместо секунд
Контекст
притащенное вытесняет нужное
Качество
мусор из источника — мусор в ответе
Формат, структура, черновик, разбор ваших же данных — ходить некуда.
Не «запрещаем ходить».
А «ходим по явной инструкции».
разрешено всё, кроме запрещённого → непредсказуемо · разрешено названное → предсказуемо
Область задачи = область источников
Вопрос по инвестициям — не повод открывать соседнюю папку.
Инвестиции -> /invest (и больше никуда)
Отчётность -> /finance, база продаж
Найм -> /hr
Всё остальное -> спросить, а не угадыватьЭто не только приватность. Чужой контекст даёт чужие выводы — уверенным тоном.
Карта разбора
- 01 · Словарь: инфраструктура, обвязка, граф
- 02 · Память: на базе чего и что туда класть
- 03 · Скиллы: из чего состоят и как выбираются
- 04 · Приоритет источников
- 05 · Экономика контекста
- 06 · Почему новый чат не помнит
- 07 · Самообучение и версии
- 08 · Один источник для разных агентов
ЭКОНОМИКА
КОНТЕКСТА
«Какие файлы переносить? Все?»
Нет. Контекст — это бюджет, а не диск.
Почему работа с файлами дорогая
- Агент не «видит» папку целиком — он открывает файлы по одному
- Каждое открытие занимает место на рабочем столе и уже не освобождает его
- Чтобы найти нужное, он читает лишнее — и лишнее остаётся в контексте
- Чем больше набито, тем хуже качество: важное тонет среди притащенного
«Загрузи все файлы» — самый быстрый способ получить дорогой и плохой ответ.
Хранить не файлы, а смысл
Документы заранее превращаются в числовые «отпечатки». По вопросу поднимается несколько кусков вместо сотни файлов.
→ ищет по смыслу, а не по совпадению слов: «отток» найдёт и «churn»
Чем за это платите
- в контекст попадает мало и по делу
- работает на объёмах, где файлы уже не тянут
- поиск по смыслу, а не по формулировке
- нарезка ломает структуру документа
- ответ собирается из фрагментов, а не из целого
- индекс надо пересобирать при изменениях
- точные цифры лучше брать из системы-источника
→ индекс хорош для «где про это написано», плох для «сколько именно»
Мастер-хранилище и рабочие слепки
Полный. Один. Источник правды. Целиком в контекст не заезжает никогда.
Выжимка под задачу: словарь, правила, ключевые факты и ссылки в мастер.
В контекст едет слепок. За деталями агент идёт в мастер — только если понадобилось.
→ у слепка одна работа: чтобы агент знал, что существует и куда за этим идти
В контексте — карта,
а не территория
постоянно: правила, словарь, границы · по требованию: документы, данные, детали
Карта разбора
- 01 · Словарь: инфраструктура, обвязка, граф
- 02 · Память: на базе чего и что туда класть
- 03 · Скиллы: из чего состоят и как выбираются
- 04 · Приоритет источников
- 05 · Экономика контекста
- 06 · Почему новый чат не помнит
- 07 · Самообучение и версии
- 08 · Один источник для разных агентов
ПОЧЕМУ НОВЫЙ ЧАТ
НИЧЕГО НЕ ПОМНИТ
«Открываешь новый чат — надо обвязку подтянуть»
Каждый чат стартует с чистого контекста.
Модель та же — стол пустой.
Что переживает новый чат
- файлы в известном месте
- записи в долгосрочной памяти
- скиллы, сохранённые по стандарту
- правила проекта
- всё, чему вы «научили» его в переписке
- уточнения, которые вы давали по ходу
- удачный промпт, который вы не сохранили
- договорённости внутри диалога
«Научил в чате» = не сохранил.
Почему «по стандарту» — не формальность
Агент подхватывает скилл, только если тот лежит там, где он его ищет, и в том виде, который он умеет читать.
.agents/skills/weekly-report/SKILL.md -> подхватится сам
Заметки.docx на рабочем столе -> не подхватится
Удачный промпт в истории чата -> не подхватится→ .agents/ — открытый стандарт (agentskills.io), его читают Claude, Codex, Cursor, Gemini CLI, VS Code · Copilot
Диагностика «он не работает»
Хоть один «нет» — новый чат будет чистым. И это не поломка модели.
Объяснили второй раз —
значит, надо было записать
факт — в память · процедуру — в скилл · границу — в правила
Карта разбора
- 01 · Словарь: инфраструктура, обвязка, граф
- 02 · Память: на базе чего и что туда класть
- 03 · Скиллы: из чего состоят и как выбираются
- 04 · Приоритет источников
- 05 · Экономика контекста
- 06 · Почему новый чат не помнит
- 07 · Самообучение и версии
- 08 · Один источник для разных агентов
САМООБУЧЕНИЕ
И ВЕРСИИ
«Со временем он понимает, от чего ты удовлетворяешься, и подстраивается»
Эффект настоящий.
Но учится не модель — растёт обвязка.
Как выглядит это «обучение»
Никакой магии: каждый ваш откат превращается в строчку, которая теперь есть всегда.
→ если правки не записываются, агент будет ошибаться одинаково хоть год
Превратить недовольство в правило
«мне не понравилось»
«сделай нормально»
«слишком длинно»
«вывод — первым абзацем»
«каждая цифра со ссылкой на источник»
«не больше одной страницы»
→ правило проверяемо: по нему можно сказать «выполнено» или «нет»
Новая версия лучше — по чему видно
- Доля прогонов без ручной правки — главная метрика
- Число кругов уточнений до приемлемого результата
- Точность срабатывания: включается на своих запросах, молчит на чужих
- Повторяемость: два прогона дают одинаковую структуру
- Цена: сколько контекста и времени ушло
Без набора из 5-10 типовых задач «стало лучше» — это вкусовщина.
Песочница под каждый скилл
Копия рабочего места с тестовыми данными и фиксированным набором задач.
- Правки скилла нельзя проверять на боевых данных — цена ошибки не ваша
- Изменили описание — могли сломать срабатывание соседних скиллов
- Нужны безопасные права: пусть пишет и удаляет, но не у вас в продакшене
Держите предыдущую версию. Меняйте по одной вещи за раз. Умейте откатиться.
Карта разбора
- 01 · Словарь: инфраструктура, обвязка, граф
- 02 · Память: на базе чего и что туда класть
- 03 · Скиллы: из чего состоят и как выбираются
- 04 · Приоритет источников
- 05 · Экономика контекста
- 06 · Почему новый чат не помнит
- 07 · Самообучение и версии
- 08 · Один источник для разных агентов
ОДИН ИСТОЧНИК
РАЗНЫЕ АГЕНТЫ
«Кто-то собрал Claude Code, кто-то ChatGPT, я использую Grok — мне важно, чтобы все три собрали из одного источника»
Это решается. Но переносимо содержание, а не подключение.
Что переносится, а что нет
- правила и границы
- словарь и определения
- процедуры (скиллы)
- факты и решения
- способ подключения источников
- формат памяти конкретного продукта
- набор доступных инструментов
- интерфейс и горячие клавиши
Содержание — это просто текстовые файлы. Именно поэтому оно и переносится.
Один мастер, три рабочих места
→ правки идут только в мастер; то, что у агентов, — производное от него
Четыре правила
.agents/ поддержан — подключаем напрямую, без копий→ копия, которую правят напрямую, перестаёт быть копией в тот же день
Тест на расхождение
Задайте один и тот же рабочий вопрос всем трём агентам.
источник действительно один
где-то живёт вторая версия правды — искать и убивать
→ гонять раз в месяц, а не когда уже поругались из-за разных цифр
ЧТО ЗАБРАТЬ
С СОБОЙ
Восемь строк
- Инфраструктура — кабинет, обвязка — регламенты. Работает вторая
- Память — хранилище снаружи плюс правило «сначала загляни»
- Скилл — не промпт: у него есть имя, описание и место хранения
- Выбирает скилл агент — по описанию. Ваше дело — описание
- Приоритет источников важнее любого промпт-трюка
- Контекст — бюджет. В него едет карта, а не территория
- Новый чат чист: не записано по стандарту — не существует
- Учится не модель, а ваша обвязка
Три якоря на неделю
→ ни один из трёх не требует ни разработчика, ни бюджета
Модель у всех одна.
Разная — обвязка.
agentskills.io//modelcontextprotocol.io//github.com/anthropics/skills
Эдгар Сипки//sipki.online//Founder EasyP