Содержание
Десять глубинных интервью по 40–60 минут — это 8–10 часов записи. Расшифровать их вручную — ещё столько же времени, а то и вдвое больше: перепечатать реплики, разобраться, кто говорит, расставить время. Пока текст не готов, к анализу не подступиться — а дедлайн отчёта не двигается.
Чем транскрипт для анализа отличается от обычного текста
Просто «текст записи» для качественного исследования не подходит. Нужно, чтобы транскрипт:
- надёжно разделял реплики по респондентам, а не сваливал всё в один абзац;
- позволял вернуться к нужному месту записи одним кликом — проверить интонацию, паузу, невербальную реакцию;
- давал выбор — дословно (со словами-паразитами и самоисправлениями) или в чистом виде, в зависимости от того, дискурс-анализ это или тематическое кодирование;
- оставался единообразным по терминам и именам от интервью к интервью — иначе поиск по корпусу транскриптов ничего не найдёт.
Шаг 1. Разделите реплики по респондентам
WonderScribe автоматически различает голоса и подписывает реплики — диаризация работает и на разговоре двух людей, и на групповой дискуссии, особенно хорошо — при 3–6 участниках, как в типичной фокус-группе. Дальше остаётся переименовать «Спикер 1» и «Спикер 2» в свои коды — «Модератор», «Р1», «Р2» — так удобнее цитировать в отчёте и сверять реплики между собой.
Шаг 2. Выберите: дословно или без «э-э» и повторов
По умолчанию транскрипт сохраняет всё сказанное — включая слова-паразиты, оговорки и самокоррекции. Это нужно для дискурс-анализа и конверсационного анализа, где важна каждая пауза и «ну». Если задача — тематическое кодирование, а не лингвистический разбор, лишний шум мешает читать. Для этого в WonderScribe есть отдельный шаблон отчёта «Чистый текст»: нейросеть убирает слова-паразиты, повторы и самоисправления, оставляя смысл. Можно держать обе версии одной записи — дословную для точных цитат в отчёте и чистую для быстрого чтения.
Шаг 3. Находите нужный фрагмент за секунды, а не перемоткой
В онлайн-редакторе клик по любому слову сразу перематывает плеер на этот момент записи — это работает благодаря выравниванию на уровне слов. Вместо того чтобы прокручивать часовую запись в поисках цитаты, ищите её текстом и сразу слушаете оригинал для проверки интонации. А чтобы имена информантов, названия организаций и профессиональные термины не «плыли» по написанию от интервью к интервью, добавьте их заранее в пользовательский словарь — распознавание будет учитывать эти слова во всех последующих записях исследования.
Конфиденциальность информантов
Записи глубинных интервью часто содержат чувствительные данные — от медицинских историй до внутренней информации компаний респондентов. Файлы обрабатываются на серверах в России в рамках 152-ФЗ и не используются для обучения сторонних моделей; запись и расшифровку можно удалить в любой момент после того, как выгрузили нужный текст. Хорошая практика для качественного исследования — заменить в рабочей копии транскрипта реальные имена на коды «Р1», «Р2» ещё до того, как делиться файлом с командой или заказчиком.
Если число спикеров определилось неверно
На групповых дискуссиях с перебиванием голосов нейросеть иногда насчитывает спикеров больше или меньше, чем было на самом деле. Пересъёмка для этого не нужна: число говорящих можно поправить прямо в готовой записи, и разметка речи пересчитается заново за секунды.
Первые 30 минут расшифровки в WonderScribe — бесплатно, без привязки карты: этого достаточно, чтобы проверить диаризацию и поиск по тексту на своей первой записи. Попробовать бесплатно.
А как вы сейчас готовите транскрипты для анализа — вручную или уже автоматизировали часть процесса? Поделитесь в комментариях.
Частые вопросы
Можно ли автоматически разделить реплики модератора и респондента?
Подходит ли расшифровка для фокус-групп с несколькими участниками?
Как получить дословный транскрипт со словами-паразитами для дискурс-анализа?
Как быстро найти нужную цитату в длинной записи интервью?
Безопасно ли загружать записи интервью с чувствительными данными информантов?
Попробуйте WonderScribe
30 минут бесплатно, без карты. Экспорт в Word, SRT, VTT и PDF.