Десять интервью с клиентами — это около десяти часов записи. Целиком их не переслушает никто. Поэтому в отчёт попадает то, что интервьюер успел записать в заметки. А в заметки попадает то, что совпало с его гипотезой.
Дело не в дисциплине команды. Час разговора в голове не удержать. А у аудиофайла нет оглавления, и искать в нём нечем. Расшифровка закрывает обе проблемы, если с ней правильно работать.

Где теряются выводы
Интервьюер слушает и пишет одновременно. Внимание делится. Записывается то, что кажется важным в моменте. Важным обычно кажется знакомое.
Через неделю от разговора остаётся впечатление вроде «клиентам дорого». Какими словами это прозвучало и у кого, восстановить уже нельзя. Один мог сказать «дорого» про цену. Другой про время на внедрение. Для продукта это два разных вывода.
Запись формально есть. Но чтобы найти нужные две минуты в часовом файле, придётся переслушать половину. Поэтому к записям почти не возвращаются.
Отдельная потеря — команда. Дизайнер и разработчик на встрече не были. Им достаётся пересказ пересказа.
Что даёт текст
Текст читают и ищут по нему. С аудио так не выйдет. Вот что становится возможным:
- поиск по словам клиента
- дословные цитаты в отчёте
- разметка по темам
- сравнение интервью между собой
Поиск особенно выручает на серии. Ctrl+F по слову «долго» за минуту покажет все места, где клиенты жаловались на скорость.
Цитата убеждает сильнее пересказа. Фраза клиента его же словами действует на руководителя быстрее слайда «пользователи недовольны онбордингом».
Таймкоды связывают текст с записью. Если важна интонация, нужный момент открывается за секунды. Пауза или нервный смешок иногда говорят больше самих слов.
Как записать интервью, чтобы расшифровка вышла чистой
Начните с согласия. Попросите разрешения на запись в начале разговора, пусть оно прозвучит на самой записи. В интервью звучат имена, должности и детали чужого бизнеса. Храните расшифровки так же бережно, как клиентскую базу.
Распознавание сильнее всего страдает от эха и перебиваний. Акцент и быстрая речь мешают меньше. Гарнитура у собеседника и тихая комната дадут больше любых настроек. И договоритесь не говорить одновременно.
Онлайн-встречу лучше записывать средствами самой платформы видеосвязи. Такая запись берёт звук напрямую. Диктофон рядом с динамиком ноутбука пишет ещё и комнату.
Если на встрече двое от вашей команды, разделите роли. Один задаёт вопросы. Второй молчит и следит за временем. Чем реже голоса накладываются, тем быстрее потом вычитка.
Что делать с расшифровкой
Работа с текстом укладывается в четыре шага:
- Вычитать имена и термины.
- Подписать спикеров.
- Разметить темы.
- Свести интервью в таблицу.
Вычитка нужна всегда. Распознавание ошибается там же, где ошибся бы новичок в вашей отрасли. Это названия продуктов, фамилии и аббревиатуры. Сверять их удобно по таймкодам.
Спикеров подписывайте ролью. Вместо «Спикер 2» пишите «Клиент, логистика, отдел продаж». Так расшифровку можно показать команде без лишних персональных данных.
Для разметки хватит четырёх цветов: текущее решение клиента, раздражение, неудачные попытки и то, за что он уже платил. Здесь пригодится правило из книги Роба Фитцпатрика «Спроси маму». Верить стоит рассказам о прошлом, а не обещаниям. «Мы бы попробовали» ничего не значит. «В марте мы посадили стажёра вручную сводить отчёты» — это уже факт.
Таблица собирает серию в одну картину. В строках интервью, в столбцах темы. В ячейке цитата и таймкод. После десятка интервью видно, какие боли повторяются, а какие прозвучали один раз.
Автоматическое саммари удобно как оглавление перед чтением. Выводы по нему делать рано. Саммари всегда сжимает текст. А самое ценное в интервью часто звучит один раз и вскользь — такое при сжатии теряется первым.
Чем расшифровывать
Для интервью важны пять вещей:
- русский язык как основной
- разделение по спикерам
- таймкоды
- выгрузка в документ
- понятные правила хранения файлов
Мы делаем AudioVText как раз под такие задачи. AudioVText расшифровывает аудио и видео, расставляет таймкоды и делит речь по спикерам. Основной язык — русский, под него сервис и настроен. Всего поддерживается 99 языков, так что интервью с зарубежными клиентами тоже подойдут.

Запись можно загрузить файлом или вставить ссылку на YouTube, VK Видео, Rutube или OK.ru. Готовый текст выгружается в DOCX, PDF или TXT. Для видео есть субтитры SRT и VTT. Краткое саммари AudioVText собирает сам.
С хранением так. AudioVText работает по 152-ФЗ о персональных данных. Файлы не передаются третьим лицам и не идут в обучение ИИ. Хранятся они в зашифрованном виде и удаляются автоматически.
Если интервью уже записаны, начните с последнего. Расшифруйте его, вычитайте имена, разметьте четыре темы. Через час станет ясно, стоит ли так же разобрать остальные.

Интересный кейс, особенно понравилось, что объяснили без лишней воды.
Хороший пример того, как маленькие решения влияют на итоговый результат.
Хорошо разложено по шагам, стало понятнее, где обычно теряется время.
Полезно увидеть детали, которые обычно остаются за кадром.