Коротко
Администратор компании примерно на 60 сотрудников создал пилотного ИТ-суперагента, через которого агенты работников получают проверенные сведения об инфраструктуре и при необходимости запрашивают решение человека. MCP, централизованные инструкции, разграничение прав и два RAG-источника сокращают ручное посредничество, но проект пока проверен лишь на небольшой группе.
Контекст
Автор — единственный ИТ-администратор компании примерно на 60 сотрудников. После неудачных попыток создавать узкоспециализированных агентов и использовать Paperclip он раздал Claude Code нескольким сотрудникам с доступом к инфраструктуре на чтение. Это привело к проблемам централизованного управления и постоянной пересылке вопросов через администратора, поэтому он собрал профильного ИТ-суперагента. Это рабочий прототип в пилоте, а не готовый продукт.
Главное
- Прежние подходы — агенты под отдельные задачи и Paperclip — не подошли: настройка требовала много времени, а поведение мультиагентов было непрозрачным и могло зацикливаться.
- Прототип состоит примерно из 4 тысяч строк Python-кода и использует FastAPI, MCP, SQLite WAL; наружный доступ к внутреннему серверу возможен только через VPN.
- Для подключения Claude Code используется MCP по HTTP и личный Bearer-токен; набор инструментов включает
ask,get_instructions,inspect,consultиcheck. - Инструкции хранятся централизованно и передаются при подключении и в ответах, поэтому администратор меняет правила для всех агентов в одном месте.
- В административном RAG около 570 файлов и 940 фрагментов; синхронизация идёт через GitLab, инкрементальная индексация — раз в 10 минут.
- Поиск по административным сведениям гибридный: SQLite FTS5 и эмбеддинги Ollama объединяются через RRF; для смешанного русского текста, имён серверов и аббревиатур используется
bge-m3. - Права на серверы задаются грантами уровней 0, 1 read, 2 operate, 3 change и 4 admin; решение о доступе принимает код, а не модель. Есть также временные персональные гранты.
- Модель суперагента работает через
claude -pбез инструментов; сервер исполняет только ограниченные проверки вродеdisk,mem,svcиjournal, используя SSH-ключ, привязанный к/usr/local/bin/sa-inspect. - В пилоте участвуют четыре аналитика продаж с правом чтения баз 1С и CRM; подключение занимает около 10 минут. Количественной оценки доли автоматических решений пока нет.
- В статье приведены практические настройки для долгих вызовов Claude Code:
MCP_TOOL_TIMEOUTсо значением330000, доверие внутреннему CA черезNODE_EXTRA_CA_CERTS, а также рекомендация приглушить логгерhttpxдля long-poll-бота.
Как сделано
Прототип написан на Python (около 4 тысяч строк) с FastAPI, MCP и SQLite в режиме WAL; он работает на внутреннем сервере за nginx и доступен через VPN. Сотрудники подключают его к агентам через MCP по HTTP командой claude mcp add --transport http superagent https://<внутренний-адрес>/superagent/mcp --header "Authorization: Bearer <личный-токен>". Инструменты ask и get_instructions возвращают данные и правила без вызова LLM; inspect запускает ограниченные проверки, а consult и check обеспечивают диалог и получение решения администратора. Централизованные инструкции хранятся в одном Markdown-файле.
Знания поступают из двух источников: административного каталога инфраструктуры и корпоративной базы на pgvector. Административный каталог содержит около 570 файлов и 940 фрагментов; зеркало синхронизируется через GitLab, полная индексация на CPU занимает около девяти минут, затем обновление идёт по хешам файлов раз в 10 минут. Поиск сочетает SQLite FTS5 и эмбеддинги локальной Ollama, результаты объединяются через RRF. Для русского текста применяют bge-m3. Доступ проверяется кодом по группам и персональным грантам пяти уровней — от скрытия сервера до admin; фрагменты фильтруются до выдачи. Секреты из access.md в индекс не попадают.
LLM суперагента запускается через claude -p без инструментов и доступа к командам. Если модели нужна проверка, она возвращает JSON-запрос inspect; сервер выполняет не более трёх проверок за ответ и двух раундов. SSH-ключ ограничен командой /usr/local/bin/sa-inspect, которая принимает только проверки из белого списка. При эскалации администратор получает запрос в Яндекс Мессенджере и отвечает кнопками ✅ / ❌ или текстом; агент забирает решение через check. Ведутся журналы вызовов 90 дней, аудит изменений прав, маскирование секретов и персональных данных, сигналы подозрительной активности и квоты с отказом при невозможности проверить лимит.
Результаты
В пилоте участвуют четыре сотрудника аналитики продаж, которым доступно чтение баз 1С и CRM. Подключение нового пользователя по инструкции занимает около 10 минут. Автор сообщает, что сотрудники перестали писать ему письма: агенты обмениваются вопросами с суперагентом, а администратор подключается, когда требуется решение. Правила для всех подключённых агентов меняются централизованно. Доля запросов, решаемых без администратора, пока не измерена; автор обещает привести такие данные в следующей части.
Ограничения
Это небольшой пилот, а не продукт; результаты не сопровождаются статистикой успешных ответов, экономии времени или качества поиска. Автор не проверил масштабирование на всю компанию и ещё не измерил, сколько обращений обходится без администратора. MCP не заставляет агент сотрудника обращаться к суперагенту — сейчас это зависит от инструкций. Классификация требуемого уровня доступа пока основана на ключевых словах; автор считает это приемлемым при текущем доступе только на чтение. Наполнение базы живым опытом сотрудников только планируется. LLM-помощник зависит от общих лимитов подписки, поэтому предусмотрены очередь, квоты и отказ при сбое проверки лимита.
Что взять себе
- Разделяйте поиск и проверку доступа: фильтруйте знания до их передачи модели, а права реализуйте детерминированным кодом.
- Не вызывайте LLM для простых операций, которые можно выполнить обычной логикой: это снижает задержки и расход общих лимитов.
- Долгие задачи лучше делать асинхронными с отдельным способом забрать результат, чтобы обрыв клиентского вызова не терял работу.
- Для русскоязычных корпоративных баз полезно сочетать многоязычные эмбеддинги с полнотекстовым поиском по точным именам и адресам; качество стоит проверять на наборе эталонных вопросов.
- Ограничивайте даже диагностический доступ: белый список команд, отдельные учётные записи, аудит, квоты и маскирование снижают последствия ошибок или утечки ключа.
Читать оригинал, если…
Откройте оригинал, если нужны точная команда подключения MCP, настройки таймаутов и сертификатов, схема прав, примеры ограничений SSH-проверок или подробности реализации и эксплуатации прототипа.