Фокус-группа: как приписать цитату правильному человеку

Фокус-группа — восемь голосов вперебивку, а цитата в отчёте не должна достаться не тому участнику. Как помогают запись и диаризация — и где нет.

Сценарии

Фокус-группа просит модератора делать две несовместимые вещи разом: вести живую перекрёстную дискуссию восьми человек и держать точную запись, кто что сказал. И то и другое нельзя — хорошая модерация означает присутствие в разговоре, а не стенографию его. Так запись откладывается на после сессии, когда её пересобирают из памяти и записи, которая для группы из восьми — часы распутывания. А ставки этой записи необычно высоки: цитата в отчёте, приписанная не тому участнику — похвала лоялиста, отданная пользователю конкурента, — не опечатка, а ошибочная находка; а находки клиент и оплатил.

Запись плюс разделение по голосам делает бóльшую часть распутывания. Но это ещё и тот сценарий, где честные пределы этой технологии важнее всего, — поэтому статья называет их сразу.

Коротко

Почему запись нельзя вести вживую

Хорошая модерация — деятельность на всё внимание: чтение зала, ведение нити, вытягивание тихого участника, управление доминирующим. Модератор, ведущий дословный конспект с атрибуцией, — это модератор, который этого не делает, — поэтому профессиональная практика записывает сессию и анализирует после. Проблема всегда была в «после»: для восьми говорящих ручная расшифровка-с-атрибуцией — часы на сессию, и это самая нелюбимая, самая подверженная ошибкам часть качественной работы, — ровно поэтому её и торопят.

В этой спешке и входят ошибки атрибуции — а в фокус-группе атрибуция и есть данные. «Молодой пользователь конкурента похвалил упаковку» и «лояльный давний клиент похвалил упаковку» — разные инсайты с разными следствиями. Ошибитесь в говорящем — и анализ ошибочен так, что выглядит совершенно уверенно.

Что даёт разделение по голосам

Обработайте запись — и она вернётся разделённой по голосам: дискуссия разбита по голосам, каждая реплика с таймкодом, участники различимы (факты продукта). Переименуйте каждого один раз — «Участник 3» становится «мама, 34, пользователь конкурента» — и подпись едет по всей расшифровке, так что сырые голоса становятся осмысленными сегментами, нужными анализу (факт продукта). Темы всплывают в саммари; цитаты для отчёта приходят с атрибуцией и таймкодом для сверки.

Этот таймкод здесь — позвоночник процесса. Потому что цитата не просто «приписана системой» — она проверяема: один клик к точному моменту в аудио, так что до того, как реплика попадёт в отчёт, вы подтверждаете, что это нужный человек говорит нужное. Механика того, как диаризация различает голоса, и её слабые места — в статье диаризация: как ИИ различает голоса.

Честный предел — и почему всё равно стóит

Скажем прямо, ведь фокус-группа — где диаризация труднее всего: восемь человек говорят быстро, перебивают, накладываются. Наложение мутит аудио; короткие вставки несут слишком мало голоса для чистого отпечатка; похожие голоса на одном микрофоне комнаты могут слипнуться. Так что атрибуция в оживлённой группе не гарантированно идеальна, а самым коротким репликам чаще всего достаётся чужое имя. Любой инструмент, обещающий безупречную атрибуцию восьми голосов с записи вперебивку, переобещает.

Вот почему это всё равно преобразующе. Альтернатива — не идеальная ручная атрибуция, а часы ручной атрибуции, тоже подверженной ошибкам и торопливой. Запись даёт качественный первый проход за минуты, с таймкодом на каждой реплике для проверки, так что усилие смещается с «расшифровать с нуля» на «проверить и поправить». Это тот же принцип, что в журналистской работе с цитатами — расшифровка предлагает, аудио подтверждает, — применённый к исследованию (см. расшифровка интервью). Цитаты для отчёта вы всё равно сверяете с аудио. Просто не тратите выходные, чтобы сначала построить расшифровку.

По серии групп

Большинство исследований ведёт несколько групп, и архив превращает их в корпус: «в какой группе хвалили упаковку?» и «где всплывала цена?» — вопросы к архиву, отвечаемые цитатами с датами по сессиям (факты продукта) — сравнение сегментов без ручного сведения стенограмм. Дисциплина «серия-в-структуру» из статьи кастдев-интервью действует; программа фокус-групп — тот же метод, но с групповой динамикой вместо один-на-один.

Источники и метод

Факты продукта (расшифровки по голосам с таймкодами на премиум-движке, распространяющееся переименование участников, тематические саммари, полнотекстовый поиск и вопросы по архиву с ответами-цитатами) описаны по продуктовому каталогу Летучки на момент написания. Точность диаризации падает на многоголосом аудио с наложением; атрибуция в большой перекрёстной группе — черновик для сверки с записью, не гарантия — безупречная многоголосая атрибуция не заявляется, цифры точности не приводятся. Согласие участников на запись и обработку — ответственность исследователя. Статистика не приводится и не выдумывается.

Похожие материалы: Диаризация: как ИИ различает голоса · Расшифровка интервью · Кастдев-интервью: как держать серию в структуре · Полтора часа, восемь голосов, расшифровка знает кто что сказал (юзкейс)


Обработайте последнюю фокус-группу в @letuchka_robot, переименуйте участников один раз — и увидите, сколько анализа уже сделано; затем сверьте цитаты с аудио. Новым пользователям — приветственные турбо-минуты: разделение по голосам работает на премиум-движке.

Попробуйте бесплатно

Загрузите запись встречи — получите саммари и задачи. 100 бесплатных минут каждый месяц, без карты.