Пилот ИИ-агента за неделю на своих заявках: как понять до покупки, стоит ли он 150 000 ₽
Агент на один процесс у нас стоит 150 000 ₽ и делается три недели, но понять, справится ли он с вашими заявками, можно до заказа и без разработчика: за неделю прогнать 50 старых заявок через нейросеть вручную и посчитать, сколько ответов вы отправили бы клиенту без правок. Нужны выгрузка заявок с реальными ответами менеджера, промпт с ролью менеджера и таблица на пять колонок. Порог «сколько без правок — достаточно» ставите вы сами, исходя из того, что стоит одна ошибка в вашем бизнесе. Ниже — пилот по дням недели.

Что проверяет пилот: не нейросеть, а ваши заявки
Агент отличается от чат-бота тем, что не ждёт диалога
Получает заявку, находит данные, решает и отдаёт результат — подробнее в статье что такое AI-агент. Пилот проверяет только одно звено — качество решения на ваших данных. Остальное — интеграции, скорость, ночные смены — руками не проверить, и об этом в конце.
Вопрос пилота формулируется так
«Из 50 старых заявок сколько ответов нейросети я отправил бы клиенту без правок?» Не «умная ли она» и не «понравилось ли мне» — только доля. Пятьдесят — потому что на двадцати результат случаен, а сто вы за неделю руками не разберёте.
Выберите один процесс, а не «все заявки»
Ответ на входящую заявку с сайта, первичная квалификация («наш клиент или нет»), расчёт по прайсу, ответ на типовой вопрос в почте. Один процесс — один пилот. Так же устроен и наш пакет: агент на один процесс — 150 000 ₽ и три недели.
Понедельник: 50 заявок и что на них ответил менеджер
Состав: 30 типовых, 10 сложных (нестандартный запрос, торг, претензия) и 10 мусорных (спам, не по адресу, пустые). Мусорные важны: агент должен их распознавать, а не отвечать всем подряд.
Перед тем как что-то вставлять в нейросеть, уберите персональные данные — имена, телефоны, почту, названия компаний клиентов. Это и требование закона о персональных данных, и здравый смысл: вы отправляете текст во внешний сервис. Замените на «Клиент» и «+7 ХХХ».
Выгрузите из CRM или почты 50 закрытых заявок за последние месяцы
Текст обращения, ответ менеджера, чем закончилось — сделка, отказ, тишина. Ответ менеджера нужен как эталон: без него вы будете оценивать «нравится или нет», а не «так ли, как надо».
Таблица на пять колонок
Заявка — ответ менеджера — ответ нейросети — оценка — комментарий. Звучит просто, но выгрузка и чистка обычно занимают полдня, и на понедельник этого достаточно.
Хотите попробовать по ходу чтения? Инструменты из статьи — в один клик.
Вторник: промпт с ролью менеджера
Промпт — это должностная инструкция для человека, который вышел на работу первый день и ничего не знает о компании. Роль: «Ты менеджер компании X, отвечаешь на входящие заявки». Материалы: прайс, условия работы, сроки, что входит в услугу, режим работы. Правила: если данных для ответа нет — задай уточняющий вопрос, а не придумывай; цены только из прайса; не обещай сроки, которых нет в условиях; ответ до пяти предложений; обращение на «вы». Формат: сначала ответ клиенту, потом строка «Уверенность: высокая, средняя или низкая» и почему.
Где прогонять: SYNTX — сотня с лишком моделей в Telegram и на сайте, инструкции на русском. Возьмите одну сильную текстовую модель и не меняйте её до пятницы.
Проверьте промпт на пяти заявках, поправьте формулировки, затем зафиксируйте и не трогайте до конца недели. Если править промпт после каждой заявки, к пятнице у вас будет пятьдесят разных агентов и ни одного результата.
Среда и четверг: 50 прогонов и три оценки
Каждую заявку вставляете в один и тот же промпт, но в новый диалог, чтобы предыдущая не влияла. Ответ копируете в таблицу и ставите одну из трёх оценок: «отправил бы без правок», «отправил бы, поправив одну фразу», «нельзя отправлять». В комментарии — почему: неверная цена, обещание, которого нет, не тот тон, не понял вопрос, не заметил, что это спам.
Оценивает тот, кто реально отвечает на заявки, а не владелец
Менеджер видит ошибку в формулировке сроков, которую руководитель пропустит. Если оценщиков двое, спорные случаи обсуждайте: расхождения покажут, где у вас самих нет правила.
Отдельно отметьте, где нейросеть задала уточняющий вопрос вместо ответа
Это не провал, а правильное поведение, если данных не хватало. И десять заявок прогоните дважды: если ответы заметно разные, модель нестабильна на вашей задаче, и это тоже результат пилота.
Пятьдесят прогонов с оценкой — четыре-пять часов, разбитые на два дня.
Пятница: считаем и ставим свой порог
Посчитайте три доли
Без правок, с правкой, нельзя. Порог «достаточно» я не назову — он ваш и зависит от цены ошибки. Если неверная цена в ответе — это потерянная маржа или скандал, доля «нельзя» должна быть около нуля, а без правок — почти всё. Если агент только готовит черновик, а отправляет человек, планка ниже: достаточно экономить время на большинстве заявок.
Запишите порог до того, как посмотрите цифры
Карточка на стене: «Свой порог: без правок не меньше N, нельзя — не больше M. Ниже — рано».
Затем смотрите не на среднее, а на типы
Часто оказывается, что почти все «нельзя» — один вид заявок: торг, претензии, нестандартные запросы. Тогда решение не «агент не годится», а «агент на типовые, этот тип — сразу человеку». Это правило передачи человеку и есть половина технического задания на настоящего агента: на разборе процесса мы фиксируем, что агент делает сам и что отдаёт оператору с контекстом.
Если порог не взят и типы не выделяются — рано
Вы потратили неделю и сберегли 150 000 ₽.
Что пилот не покажет и что входит в 150 000 ₽
В пакете «Один процесс» за 150 000 ₽ это и делается за три недели: разбор процесса и границ ответственности агента, подключение до двух источников или систем, логика решений с проверками, логи и мониторинг, обучение команды. Два-три связанных процесса с 1С и передачей спорных случаев человеку — 300 000 ₽ за четыре-шесть недель. Гарантия та же, что на автоматизации: до старта замеряем время процесса, и если агент не сокращает его на согласованную величину — доводим или возвращаем деньги за этап.
Ручной пилот не проверяет интеграции
Агент в работе читает заявку из CRM и пишет ответ туда же, а не в чат. Не проверяет скорость и стоимость модели на реальном потоке. Не показывает, что будет ночью, когда некому перепроверить. Не даёт логов, по которым через месяц можно понять, где ошибка. И не проверяет главное — порог уверенности в работе: ниже него случай уходит оператору автоматически.
Агент в работе выглядит так
Парсер-агрегатор ТехМаркета собирает 5 630+ лотов с внешних площадок и обновляет их каждые 30 минут без человека. Ваша таблица пилота заметно сократит первый этап — разбор процесса: вы принесёте не «хотим агента», а пятьдесят размеченных случаев и правило передачи человеку.
Частые вопросы
Что спрашивают до заказа — с ответами, которые мы даём на брифе.
Как проверить ИИ-агента до внедрения?
Возьмите 50 закрытых заявок с ответами менеджера, уберите персональные данные, напишите промпт с ролью менеджера и материалами компании, прогоните каждую заявку в новом диалоге и оцените: без правок, с правкой, нельзя. Посчитайте доли и посмотрите, какие типы заявок проваливаются. На это уходит неделя по часу-два в день.
Сколько заявок нужно для теста нейросети?
Пятьдесят — рабочий минимум: на двадцати результат случаен, сто за неделю руками не оценить. Состав важнее числа: 30 типовых, 10 сложных, 10 мусорных, чтобы увидеть, как агент ведёт себя на краях.
Какой процент правильных ответов считать достаточным?
Единого порога нет — он зависит от цены одной ошибки в вашем бизнесе. Если агент отвечает клиенту сам, доля «нельзя отправлять» должна быть около нуля; если готовит черновик для менеджера, планка ниже. Запишите свой порог до подсчёта, иначе цифры вас уговорят.
Сколько стоит ИИ-агент для бизнеса?
У нас агент на один процесс — 150 000 ₽ и три недели: до двух интеграций, логи, мониторинг, обучение команды. Два-три связанных процесса — 300 000 ₽ за четыре-шесть недель. Работа модели оплачивается отдельно по факту потребления и в цену разработки не входит.
Как это выглядит на практике
Где это сделать самому
Инструменты, в которых собирается то, о чём статья: что делает хорошо, чего от него не ждать — и кнопка, чтобы попробовать на своей задаче.
SYNTX
Тексты, картинки, видео и музыка в одном Telegram-боте и веб-приложении: ChatGPT, Gemini, Kling, Veo, Sora, Suno и ещё сотня моделей по одной подписке. База знаний с инструкциями на русском.
- Одна подписка вместо десятка сервисов — тексты, картинки, видео, музыка
- Работает прямо в Telegram, ничего устанавливать не нужно
- Библиотека трендов: повторить популярный эффект в несколько кликов
- База знаний на русском — инструкции по каждой модели
Это подписка, а не оплата за использование: если генераций мало, посчитайте, окупится ли месяц.
Попробовать SYNTXПохожая задача? План и расчёт за 24 часа
Расскажите, что нужно сделать. Подскажем, хватит ли пакета с фиксированной ценой или это проект от 600 000 ₽, и вернёмся с планом.
