Справочник3 сентября 2026 г.·обновлено 3 сентября 2026 г.

Готовые ИИ-агенты: когда брать коробку, а когда собирать своё

Четыре уровня готовности, таблица критериев выбора до пилота и процедура дешёвой проверки: теневой режим, корзина реальных примеров, стоимость закрытой задачи.

Что это решает

Готовые ИИ-агенты убирают месяцы сборки: цикл, интерфейс, коннекторы, логи и тарификация уже сделаны, остаётся включить и настроить тон. Сложность начинается на границе применимости — часть задач коробка закрывает целиком, часть упирается в отсутствие доступа к внутренним системам на третьей неделе пилота. Ошибка выбора дорога в обе стороны: своя сборка там, где хватило бы подписки, съедает инженерные месяцы; коробка там, где нужен доступ к учёту и складу, даёт красивое демо и нулевой результат. Ниже — критерии, по которым решение принимается до пилота, и процедура пилота, которая проверяет решение дёшево.

Как устроено

За словом «готовый» скрываются четыре разных уровня, и цена ошибки на каждом своя.

УровеньЧто уже сделаноЧто настраиваетсяКто чинит отказ
Агент-функция внутри продукта (хелпдеск, CRM, почта, таблицы)всётон, база знаний, шаблонывендор
Платформа-конструктор сценариевцикл, интерфейс, готовые коннекторысценарий, промпты, свои HTTP-вызовывы в границах платформы
Каркас с открытым кодомцикл, память, обвязка инструментоввсё, что в кодевы
Сборка на API моделиничеговсёвы

Костяк у всех одинаковый: модель, набор инструментов, инструкции, память, ограничители, наблюдаемость. Уровень готовности определяет только то, какие части закрыты крышкой и к кому идти, когда агент начал врать.

Выбор делается по признакам задачи, а не по впечатлению от демонстрации.

Признак задачиГотовоеСвоё
Задача типовая для отрасли, у вендора она в описании продуктада
Данные уже лежат в том же продуктеда
Нужен доступ к нескольким внутренним системам разомда
Одна ошибка стоит денег или документада
Процесс меняется часто и по вашей инициативеда
Данные обязаны оставаться в своём периметреда
Нет инженера, который будет это сопровождатьда
Нужны трассы вызовов для разбора инцидентовпроверить у вендорада

Промежуточный вариант — гибрид: коробка как оболочка плюс свои инструменты, подключённые по HTTP, вебхуком или через MCP. Так закрывается самый частый случай: интерфейс, история переписки и распределение по операторам устраивают, не хватает доступа к своим данным.

Как подключить

1. Записать задачу как вход, выход и признак успеха. Без этого сравнивать нечего, и пилот превращается в обмен впечатлениями.

2. Собрать корзину реальных примеров. Обращения, письма, тикеты за прошлый период — как есть, с опечатками, неполными вопросами и путаницей. Выдуманные примеры дают завышенную оценку любому решению, включая заведомо непригодное.

3. Задать три вопроса до пилота. Как агент получит доступ к данным, которых нет внутри продукта — коннектор, вебхук, MCP, никак. Можно ли выгрузить трассы вызовов, переписку и базу знаний. Что именно уезжает на сторону вендора, если требования по данным жёсткие.

4. Прогнать теневой режим. Агент отвечает, но ответ уходит человеку на проверку, а не клиенту. Считается доля попаданий на той самой корзине примеров.

5. Включить режим с подтверждением. Ответ уходит после нажатия человеком. Появляется вторая метрика: сколько человек правит в черновике перед отправкой.

6. Померить стоимость закрытой задачи. Подписка за место, оплата за разговор, оплата за токены — всё сводится к одной цифре на закрытую задачу и сравнивается со временем сотрудника на той же задаче, включая проверку.

7. Решить и сразу записать план выхода. Что забирается при уходе: база знаний, промпты, история разговоров, логи, настройки маршрутизации. Отсутствие экспорта — самостоятельный аргумент против, независимо от качества ответов.

8. Оставить точку пересмотра. Объём вырос, процесс поменялся, вендор поднял тариф — решение пересматривается по тем же критериям, а не по инерции.

Полезные сценарии

  • Ответы клиентам по опубликованной документации: коробка в хелпдеске закрывает задачу без единой строки кода.
  • Первая линия в мессенджере с эскалацией на человека: готовое решение плюс один свой инструмент для проверки статуса заказа.
  • Разбор входящей почты, раскладка по папкам и черновики ответов: агент внутри почтового продукта.
  • Черновики текстов и работа с таблицами: агент внутри офисного пакета, где данные уже лежат рядом.
  • Утренняя сводка по учёту, банку и трекеру задач: собирается своё, коробка сюда не дотягивается по определению.
  • Операции, меняющие деньги и документы: своё, с именованными операциями, подтверждением человеком и журналом.

Ограничения

Готовое видит только свои данные. Агент внутри хелпдеска знает переписку и статьи базы знаний. Про остаток на складе он не знает и узнать не может, пока не появится коннектор — сколько его ни настраивай.

Трассы часто закрыты. Без доступа к тому, какие инструменты вызывались и что вернули, отладка сводится к переписыванию промпта наугад и вере в поддержку вендора.

Цена растёт с объёмом. Тариф за место дёшев на маленькой команде и дорог на потоке обращений. Считать нужно на прогнозируемом объёме следующего года, а не на текущем.

Лок-ин копится тихо. База знаний, сценарии, история и разметка накапливаются внутри платформы. Экспорт проверяется до внедрения, а не в момент ухода, когда переговорной позиции уже нет.

Своё требует дежурства. Обновления моделей, регресс после каждого обновления, безопасность, разбор инцидентов — постоянная нагрузка на инженера, а не разовая сборка на выходных.

Своё легко переоценить на демо. Прототип на десяти примерах собирается за вечер. Дистанция от прототипа до работающего процесса измеряется месяцами и состоит целиком из краевых случаев.

Общее ограничение обоих путей. Ни коробка, ни своя сборка не чинят кривой процесс. Агент, посаженный на противоречивую базу знаний и неописанные правила, воспроизводит эту противоречивость быстрее и в большем объёме.

Как проверить результат

Сравнивать на одной корзине. Те же самые примеры прогоняются через готовое и через свой прототип. Сравнение по памяти, по отзывам или по демонстрации вендора не считается результатом.

Смотреть долю эскалаций, а не долю ответов. Агент, отвечающий на всё и отправляющий половину человеку на переделку, хуже того, который честно передаёт треть сразу и не создаёт лишней работы.

Считать правки. Объём того, что человек меняет в черновике перед отправкой, — прямой показатель пригодности и переводится в минуты.

Проверять край, а не середину. Вопрос вне базы знаний, конфликтующие данные в источниках, агрессивный клиент, запрос скидки, попытка выпросить внутренние подробности. Готовые решения ломаются именно здесь, а в пилотах это обычно не проверяют.

Померить стоимость закрытой задачи в обоих вариантах и добавить к своей сборке время инженера на сопровождение — иначе сравнение выходит в пользу своего просто потому, что поддержка не посчитана.

Перегнать корзину после обновления платформы или модели. Тихая деградация после апдейта — обычное дело, и ловится она только регрессом на сохранённых примерах.

Правило одной строкой: готовое берут, когда данные уже внутри того же продукта и ошибка обратима; своё собирают, когда агенту надо ходить в несколько внутренних систем и цена ошибки высокая.

  • ИИ-агенты
  • выбор инструментов
  • внедрение
  • экономика