Задача: поиск, который понимает запросы людей
Типовой публичный сайт: каталог в сотни и тысячи позиций, статьи, инструкции, новости. Аналитика показывает одно и то же: половина запросов заканчивается «ничего не найдено» — люди пишут своими словами, с опечатками и описанием задачи вместо названия. Внутренний поиск стал точкой входа номер один, а работает как фильтр по точному вхождению. Задача контура — превратить поиск в консультанта: понять смысл, показать подходящие позиции и объяснить, чем они подходят.
Чем сайт отличается от портала
У публичного сайта нет личных кабинетов и ролевой видимости — и это упрощает контур: индексируется публичный контент целиком, персональные данные в поиске не участвуют. Зато выше требования к скорости и честности: выдача обязана отвечать за доли секунды, поэтому тяжёлая работа распределяется по индексу и кэшу, а не по времени запроса. Ещё одно следствие простоты — быстрый старт: без ролевой модели и стыковок с ведомственными системами слой поиска подключается за недели, а не кварталы.
Отдельная задача — каталог: смысловой поиск соединяется с атрибутными фильтрами (категория, цена, характеристики), иначе посетители получают «похожее» вместо «подходящего». Краткий ответ при этом собирается только из опубликованных страниц и всегда несёт ссылку на источник.
Архитектура: три слоя поверх сайта
Действующий сайт (любая платформа) ── контент и каталог │ переиндексация по расписанию/по событию публикации ▼ Семантический индекс: страницы, карточки, статьи, FAQ ▼ Запрос посетителя ──► гибридный поиск: смысл + атрибуты фильтров │ реранкинг: релевантное выше «похожего» ▼ Краткий ответ (LLM): что нашлось и чем подходит + ссылка ├──► в контенте ответа нет ──► честное «не найдено» + связь с каталогом ▼ Аналитика: запросы без результата → план контента и ассортимента
Практически важное свойство — переиндексация без релизов: редактор опубликовал страницу — через паузу она в поиске; убрал — исчезла. Платформа сайта не меняется, ИИ-слой подключается к ней как отдельный сервис.
Этапы внедрения
| Этап | Что получается | Цена | Срок |
|---|---|---|---|
| Аудит контента и запросов | статистика поиска, карта дыр контента, план вычистки | 90 000 ₽ | 3–5 рабочих дней |
| ИИ-слой поиска | семантический индекс, гибридная выдача, краткий ответ со ссылкой | от 480 000 ₽ | 4–6 недель |
| MVP нового сайта с поиском | если сайта нет или он под замену: сайт + поиск одним проектом | от 690 000 ₽ | 3–6 недель |
| Контур с интеграциями | стыковка с 1С/CRM по остаткам и ценам, мониторинг качества | 0,9–1,2 млн ₽ | по ТЗ |
Ориентир рынка: медиана НМЦК в выборке из 236 закрытых лотов сентября — 2,43 млн ₽; ИИ-слой на действующем сайте стоит заметно ниже медианы. Цены «от», НДС не облагается в связи с применением УСН (п. 2 ст. 346.11 НК РФ).
Три ошибки внедрения
Первая — индексировать всё подряд. Семантический поиск честно находит и мусор: устаревшие страницы, черновики, дубли — и краткий ответ по такому «источнику» вредит доверию сильнее, чем старый поиск. Аудит контента на старте — не формальность: что попало в индекс, то и станет истиной выдачи.
Вторая — чистая семантика без атрибутов. Смысловое сходство не знает про цену, наличие и категорию; посетитель получает «похожее по духу» вместо «подходящего по параметрам». Гибрид с фильтрами и реранкингом — обязательная часть, а не улучшение второй очереди. Третья — генерация без ссылки. Краткий ответ, который не сверяется со страницей источника, превращает поиск в машину слухов. Конструкция «только по найденному + ссылка + честное „не найдено“» должна сохраняться во всех сценариях, включая голосовые и виджеты.
Типовые метрики «до/после»
Ниже — типовые вилки результата для этого класса систем, а не отчёт конкретного сайта. Базовая линия — статистика действующего поиска за период до внедрения.
- Доля запросов с результатом: с 40–60% у поиска по вхождению до 80–95% у семантического.
- Путь до карточки: с 3–5 кликов до одного — поиск отдаёт релевантную позицию, а не список разделов.
- Отказы после поиска: типовое снижение на 15–35% — посетитель находит и остаётся.
- Контент-план: запросы без результата превращаются в план страниц; типовой бонус — список дыр ассортимента.
Безопасность и границы
Публичный контур не трогает персональные данные: индексируются только опубликованные страницы и карточки, cookie и формы в индекс не попадают. Модель для кратких ответов работает по договору обработки данных либо в собственном контуре — для сайтов с особыми требованиями к независимости. Ответ собирается строго из найденного и всегда со ссылкой; если ответа в контенте нет, система говорит об этом прямо — посетитель не должен получать выдумку вместо пустого результата. Генеративная часть — это краткая сводка выдачи, а не источник фактов.
Об этом разборе. Это обезличенный типовой проект из нашей практики проектирования: имена сайтов не раскрываются (NDA), метрики даны вилками класса, фактические значения закрепляются в КП и протоколом приёмки. Каждый краткий ответ проверяемо опирается на опубликованную страницу.