Частота ошибок на объёме
Шесть цифр — и видно, какой поток ошибок дойдёт до клиента при выбранной глубине проверки и во что обойдётся сам контроль.
Ваши данные
Считаются финальные ответы клиенту, а не все обращения к модели.
Замеряется на выборке реальных запросов, а не на придуманных примерах.
Полная стоимость сотрудника — с налогами и взносами.
Учтён только поток ошибок. Тяжесть каждой считается отдельно — ошибки в цене и в приветствии стоят разного.
Поток управляемый, и рычагов два. Глубина выборки снижает число дошедших ошибок линейно, а разбор повторяющихся случаев уменьшает саму долю неверных ответов. Обычно дешевле второе: правила и примеры из разбора работают на весь объём сразу.
- Всего неверных ответов
- 240
- Ответов на проверке
- 2 400
- Снимает проверка
- 82
- Доля неверных у клиента
- 2,6%
- Часов проверки в месяц
- 80 часов
- Ставок проверяющего
- 0,5
- Стоимость проверки
- 44 000 ₽
Расчёт даёт порядок величины на ровном потоке запросов. Реальная картина зависит от того, насколько тестовая выборка похожа на живой трафик.
Как устроен расчёт
Точка отсчёта — объём. Число ответов за месяц умножается на долю неверных, замеренную на тесте. Получается поток ошибок при текущем качестве системы.
Дальше поток делится надвое. Часть ответов попадает под проверку, остальные уходят к клиенту напрямую. В непроверенной части ошибки доходят все до единой.
Внутри выборки ловят тоже не всё. Глубина проверки задана коэффициентом: быстрый просмотр — 0,7, чек-лист — 0,85, сверка с источником — 0,95. Это ориентиры для прикидки, а не измеренные на конкретном проекте значения.
Итог — сколько неверных ответов дошло до клиента за месяц. Рядом считается цена контроля: часы проверки, число ставок и их стоимость по ставке сотрудника.
Что двигает результат сильнее всего
Первый рычаг — доля ошибок. Она действует на весь объём сразу и без людей. Снижение с 4% до 2% на потоке в шесть тысяч ответов убирает 120 ошибок из месячного потока, независимо от того, кто и как проверяет.
Второй рычаг — глубина выборки. Переход с 40% на 80% при чек-листе уменьшает число дошедших ошибок примерно вдвое. Платой идут часы: проверка удваивается тоже.
Третий рычаг — объём. Он множитель для обоих предыдущих. Доля в 2% выглядит спокойно на тысяче ответов и превращается в поток на сорока тысячах.
Порядок рычагов не случаен. Выборка стоит денег каждый месяц, а работа над качеством ответов окупается один раз и держится дальше.
При каких условиях ассистента выпускают к людям
Первое условие — обратимость. Ошибку видно и можно поправить до того, как она стала обязательством: неверный срок правит менеджер, неверную цену ловит сверка с прайсом на выходе.
Второе — узость темы. На одном сценарии с понятными источниками доля ошибок падает быстрее всего, потому что правила формулируются коротко и проверяются на выборке за день.
Третье — работающая эскалация. Ассистент должен уметь сказать, что не знает, и передать диалог человеку. Отказ от ответа дешевле уверенной выдумки.
Четвёртое — выборка на постоянной основе. Даже после выхода на низкую долю ошибок несколько процентов ответов смотрят глазами: поток запросов меняется, и вместе с ним меняется картина ошибок.
Как замерить свою долю ошибок
Берутся реальные обращения за последние две недели — 150–200 штук, без отбора удобных. Ассистент отвечает на них отдельно от клиентов. Ответы размечает специалист, который знает предметную область.
Разметка идёт в три корзины: верно, неверно, отказ от ответа. Отказы считаются отдельно и в долю ошибок не входят — они дорого обходятся по удобству, но безопасны по последствиям.
Полученную долю подставляют в калькулятор. На выборке в сто запросов погрешность порядка двух процентных пунктов, поэтому число читается как диапазон.
Что остаётся за скобками
Ошибки в расчёте равны между собой, а в жизни — нет. Перепутанный срок доставки и перепутанное условие гарантии расходятся по цене на порядки. Для оценки ущерба нужен разбор по типам.
Ошибки приходят кластерами. Одна пробелённая тема в базе знаний даёт серию похожих промахов подряд, и ровное среднее по месяцу такую серию не показывает.
Не учтена и задержка контроля. Выборочную проверку часто делают постфактум, а до клиента ответ уходит сразу — число дошедших ошибок от глубины проверки в этом случае не зависит вовсе. Чтобы расчёт был честным, проверка должна стоять до отправки хотя бы на рискованных типах запросов.
Наконец, за скобками сама работа над ошибками. Разбор случаев, правка инструкций и пополнение базы знаний занимают часы сверх проверки. Обычно это от четверти до половины времени, которое уходит на саму выборку.
Частые вопросы
Откуда взять долю неверных ответов, если ассистент ещё не запущен
Собирается выборка из 150–200 реальных обращений за последние две недели, ассистент отвечает на них офлайн, ответы размечает предметный специалист. Доля ошибок на такой выборке — рабочая отправная точка. На сотне запросов погрешность около 2 процентных пунктов, этого хватает для прикидки порядка величины.
Почему проверка ловит не все ошибки
Проверяющий видит ответ, но не всегда источник. Быстрый просмотр отсекает явную чушь и пропускает правдоподобную — в расчёте это 0,7. Чек-лист с обязательными полями даёт около 0,85, сверка с документом-источником — около 0,95, но занимает втрое больше времени.
Что даёт больше — глубже проверять или снижать саму долю ошибок
Снижение доли ошибок действует на весь объём и не требует людей каждый месяц. Проверка действует только на выбранную долю и стоит часов постоянно. Сравнить можно прямо в калькуляторе: сдвиньте долю неверных ответов на процентный пункт вниз и посмотрите на число дошедших.
Считается ли здесь ущерб от ошибок
Нет, считается только их количество. Стоимость зависит от того, что именно система перепутала: срок доставки, условие гарантии или цену. Для оценки ущерба нужен отдельный разбор по типам ошибок.
Почему час проверяющего делится на 164
164 часа — средний рабочий месяц при сорокачасовой неделе. Зарплата с налогами делится на это число и даёт стоимость часа. Число ставок в разбивке показывает, сколько людей понадобится держать на контроле при выбранной глубине выборки.
Проверить на вашей задаче?
Посмотрим ваш процесс и назовём цифры по нему, а не по средним значениям.
Смежные инструменты
Обновлено: 15 сентября 2026