Разделение голосов
Модель pyannote размечает, где говорит один человек, а где другой; Whisper распознаёт речь.
Кейс · Кто что сказал
Сплошной текст разговора нескольких людей почти бесполезен: непонятно, чья реплика и кто что пообещал. Поэтому разделение по говорящим выбирали в 77 % заказов — это самая востребованная опция сервиса.
Задача
Совещание, звонок или разговор на троих без разметки спикеров приходится переслушивать, чтобы понять, кто что сказал. Смысл расшифровки теряется.
Что сделали
Модель pyannote размечает, где говорит один человек, а где другой; Whisper распознаёт речь.
Каждая реплика — с отметкой говорящего и временем: легко найти место в записи.
Из размеченного текста собирают протокол, резюме или список договорённостей.
Цифры
Только цифры из базы заказов и действующего прайса — под каждой источник.
67 из 87
заказов — с разделением по говорящим, это 77 %
Источник: обезличенная статистика базы заказов сервиса за октябрь 2025 — май 2026 (сверена с базой 28.09.2026)
45 из 87
заказов — клиент сам указал число говорящих (двое), остальным хватило автоопределения
Источник: обезличенная статистика базы заказов сервиса за октябрь 2025 — май 2026 (сверена с базой 28.09.2026)
5 ₽/мин
тариф «Кто что сказал» — час записи 300 ₽
Источник: действующий прайс на golos.smittmediagroup.ru/audio-v-tekst
60 мин
бесплатно на первую запись, один раз
Источник: действующий прайс на golos.smittmediagroup.ru/audio-v-tekst
Что получил клиентТекст, в котором видно, кто что сказал и когда, — основа для протокола, резюме встречи или разбора звонка.
Цена-ориентир«Кто что сказал» — 5 ₽/мин, час записи — 300 ₽. Первые 60 минут бесплатно.
Про ИИ и данныеРасшифровку выполняет ИИ — распознавание речи Whisper и разделение голосов pyannote на нашем оборудовании. ИИ может ошибиться в именах, терминах и цифрах: важные места сверяйте с записью. Это не юридически значимая стенограмма. Кейс собран по обезличенной статистике базы заказов: только число заказов, форматы файлов, объём и выбранные опции. Имён, компаний, контактов и содержимого записей здесь нет и не будет — записи клиентов мы не публикуем. Если в ваших записях есть персональные данные других людей (голоса клиентов, сотрудников), основание для их обработки — на вашей стороне; для компаний условия обработки обсуждаем при заявке.
Вопросы
Не обязательно: число говорящих определяется автоматически, но подсказка повышает точность.
Нет, голоса размечаются как «Говорящий 1», «Говорящий 2» — имена вы подставляете сами.
5 ₽ за минуту записи, час — 300 ₽. Первые 60 минут бесплатно, один раз на клиента.
Обработка одного файла начинается от 40 секунд; при обычной загрузке результат приходит в течение дня. Точный срок подтверждаем в ответе на заявку, до оплаты.
Заявка
Напишите, что за записи и сколько их. Файлы в форму не прикладывайте — пришлём ссылку для загрузки.