Гипотеза
Автоматический разбор может расширить охват контроля качества, если система различает факты, предположения и случаи, которые нужно передать человеку.
Дизайн эксперимента
Подготовить разрешённую обезличенную выборку разговоров. Независимо разметить критерии вручную. Сравнить AI-оценки с эталоном, отдельно учитывая пропуски и ложные срабатывания.
Что измерять
Согласованность оценок, долю выводов с корректным подтверждением, время ручной проверки и стоимость обработки. Итоговый балл без анализа ошибок не доказывает полезность.
Статус
План эксперимента. Данные, результаты и дата фактического запуска пока не опубликованы.
Похожая задача?
Расскажите, как сейчас устроен процесс и что хотите изменить.
Обсудить задачу