Где оседают расходы на поддержку
Классическая поддержка тратит деньги не на сложные случаи, а на массу: одни и те же вопросы о статусе, тарифах, регламентах, по пять минут на разговор, десятки раз в день. Вторая статья — маршрутизация: обращение ходит по отделам, пока не найдёт адресата. Третья — скорость: пока клиент ждёт ответа, копится недовольство и повторные обращения. ИИ бьёт ровно по этим трём статьям — не заменяя людей, а меняя структуру их занятости.
Четыре механизма экономии
- Ответы на типовое: ассистент с RAG-базой знаний отвечает на частые вопросы мгновенно и круглосуточно — без очереди и без выходных. База знаний — ваши же регламенты и инструкции, ответ сопровождается ссылкой на источник.
- Сортировка и маршрутизация: модель классифицирует обращение по теме и срочности и сразу направляет адресату — вместо двух-трёх пересылок «не к нам».
- Черновики для операторов: на сложные обращения ассистент готовит проект ответа с выдержками из документов; оператор проверяет и отправляет. Сокращается время обработки, а не штат знаний.
- Первая линия без найма: растущий поток закрывается масштабированием ассистента, а не пропорциональным наймом; люди остаются на второй линии, где нужна экспертиза.
Как честно считать экономию
Экономика считается по вашему потоку, а не по среднему по рынку. Методика простая: (1) возьмите месяц обращений и разметьте, какие из них закрываются типовым ответом по базе знаний — обычно это заметная доля потока; (2) умножьте на среднее время обработки и стоимость часа оператора; (3) вычтите стоимость владения ассистентом. Рыночные ставки ИТ-специалистов — 2 800–3 800 ₽/час; даже по консервативной оценке разгрузка половины первой линии обычно окупает промышленный контур за считаные месяцы. Но важно считать на своих цифрах: если обращений в месяц десятки, экономить не на чем — ассистент будет дорогой игрушкой.
Цены входа
| Ступень | Цена | Срок |
|---|---|---|
| Разбор процесса поддержки | бесплатно | 1 рабочий день |
| Прототип ассистента на вашей базе | от 90 000 ₽ | 3–5 дней |
| MVP-ассистент для команды | от 690 000 ₽ | 2–3 недели |
| Пилот на реальном потоке | от 480 000 ₽ | 4–6 недель |
| Сопровождение качества | от 50 000 ₽/мес | постоянно |
Состав работ по сопровождению — в ответе что входит в сопровождение ИИ-системы; тарифы — в ответе сколько стоит сопровождение ИИ-системы. Классическая ИТ-поддержка на аутсорсинге — отдельная услуга техподдержка и аутсорсинг ИТ; ассистенты — раздел ИИ-ассистенты.
Когда экономии нет
Честный список случаев, когда ИИ в поддержке не окупается: обращений мало, и они все уникальные; база знаний не существует или рассыпана; процессы меняются быстрее, чем база успевает обновляться; требуется юридически значимый ответ без права на ошибку — здесь ассистент может только готовить черновик под контролем человека. В таких случаях дешевле и правильнее начать с наведения порядка в базе знаний — и уже потом решать про ассистента.
Практика: с чего начать
Рабочая последовательность: разбор потока за 1 день → прототип на самых частых вопросах за неделю → пилот 4–6 недель на одном канале (например, только чат на сайте) с метриками «доля закрытых без оператора» и «оценка клиента» → решение о промышленном контуре по цифрам. Организация ИИ-обработки обращений на потоке — в гайде как организовать ИИ-обработку обращений.
Метрики, по которым это видно
«Стало лучше» — не аргумент для бюджета; аргумент — четыре цифры, которые снимаются и до, и после внедрения, желательно одним и тем же способом подсчёта. Доля обращений, закрытых без оператора: сколько процентов потока ассистент закрыл сам, со ссылкой на документ. Время первого ответа: у ассистента оно измеряется секундами — очередь исчезает как класс. Доля эскалаций: сколько диалогов потребовало человека, и как меняется эта цифра по мере обновления базы. Оценка клиента: простая шкала после диалога показывает, что скорость не куплена ценой качества. Эти же четыре метрики становятся критериями успеха пилота в договоре — и предметом сопровождения от 50 000 ₽/мес: база знаний обновляется, фильтры дорабатываются, метрики удерживаются.
Первый месяц: что происходит на самом деле
Неделя первая: ассистент отвечает только там, где уверен; всё неуверенное уходит оператору — метрики скромные, это нормально. Неделя вторая: разбор первых диалогов, правки базы знаний и промптов — доля закрытых растёт. Недели третья-четвёртая: стабилизация, снятие первых честных метрик, решение о расширении на второй канал или процесс. В этот месяц важно сопротивляться соблазну «выпустить на все каналы сразу»: качество ассистента растёт итерациями на ограниченном потоке, а не волевым решением. Дальше — плановый цикл сопровождения: обновление базы, разбор неудач, отчёт метрик владельцу процесса.
Чем это отличается от бота на кнопках
Классический кнопочный бот отвечает на то, что предусмотрел его автор: клиенту дают меню, и если вопроса нет в меню — «переадресую на оператора». Поэтому старые боты разгружали лишь малую часть потока и разочаровывали клиентов. Ассистент на LLM понимает вопрос в свободной форме, ищет ответ в базе знаний и формулирует его словами, а не пунктом меню. Практическая разница для бюджета: кнопочный бот требует постоянной доработки сценариев (каждый новый вопрос — работа разработчика), ассистент — обновления базы знаний (загрузил документ — ответы обновились). Именно поэтому экономика LLM-ассистента в поддержке считается по доле потока, которую он реально закрывает, а не по количеству написанных сценариев.
Итог
ИИ сокращает расходы на поддержку тремя способами: закрывает типовой поток без очереди, маршрутизирует обращения с первого касания и готовит черновики для операторов. Экономия проверяется арифметикой вашего потока: доля типовых обращений × время обработки × стоимость часа против цены контура и сопровождения от 50 000 ₽/мес. Начать стоит с бесплатного разбора и прототипа за 90 000 ₽ — это самый дешёвый способ узнать свою цифру экономии. Только не забудьте посчитать её «до» внедрения: без базовых замеров потока экономию нечем будет доказать ни совету директоров, ни себе.