Возможности 2026

Не сырой ASR. Не ChatGPT. WonderScribe.

Собственная нейросеть, дообученная на русском. Диаризация, саммари и экспорт — без сторонних сервисов.

5–10 мин на час записи до 99% точность 99 языков
Функции

Шесть вещей, которые делают разницу

Каждая — часть единого пайплайна. Не нужно собирать сервис из трёх разных.

Wonder Speech
Собственная нейросеть WonderScribe с fine-tune на русском. До 99% на чистом звуке, устойчивость к шуму и переключению языков.
WonderScribe ASR · 99 языков
Диаризация спикеров
WonderScribe автоматически определяет, кто говорит: до 6 голосов без настройки, до 30 — если указать число при загрузке. Переименование спикеров в редакторе.
нейро-диаризация
Субтитры и экспорт
SRT/VTT для YouTube и монтажа, Word и TXT для отчётов, burn-in прямо в MP4 для Reels и TikTok.
SRT · VTT · Word · TXT · PDF · JSON
AI‑саммари
Протокол встречи, конспект лекции, action items и ключевые термины. 92 шаблона в 15 категориях, автоматический выбор по содержимому.
WonderScribe LLM · 92 шаблона
Очистка звука
Шумоподавление + loudnorm под шумные записи. Три режима: Выкл / Авто / Всегда — для улицы, кафе и эха в комнате.
шумоподавление · loudnorm EBU
Приватность
Серверы в России, шифрование AES-256 / TLS 1.3, файлы удаляются по кнопке. Данные не уходят на обучение моделей.
152-ФЗ совместимо
Сравнение8 параметров

Модель распознаёт речь. Продукт решает задачу

Голая ASR-модель отдаёт поток слов. Всё остальное — спикеры, пунктуация, редактор, форматы — приходится собирать самому. Ниже — что именно мы берём на себя.

Что нужно на практике
Сырая ASR-моделькак есть
WonderScribeэто мы
Точность на русскомразговорная речь, термины
85–92%без очистки звука и пост-обработки
до 99%на чистой записи; шумные — через авто-очистку
Кто говоритразделение по голосам
Нетсплошной текст без реплик
Автоматически до 6 голосоввручную — до 30; имена подставляются из текста
Пунктуация и абзацычитаемость без ручной правки
Как получитсяпоток текста, абзацы вручную
Нейропунктуацияабзацы по смыслу, чистка оговорок
Выжимка по встречерешения, задачи, итоги
Неттолько текст, выводы — сами
92 шаблона отчётов15 категорий: встречи, лекции, интервью, суд
Правка результатаисправить слово, переименовать спикера
Нетправка в стороннем редакторе, таймкоды теряются
Редактор с таймкодамиклик по слову — переход к этой секунде аудио
Форматы на выходеотдать заказчику, залить на видео
TXT / JSONсубтитры и документы — своим кодом
Word, PDF, SRT, VTT, JSON+ пословные субтитры и burn-in в MP4
Длинная записьлекция, созвон на три часа
Резать вручнуюна длинных растут пропуски и повторы
До 4 часов одним файломавто-разбиение по паузам, фильтр галлюцинаций
Что нужно, чтобы начатьпорог входа
GPU и настройкасвоё железо, окружение, обновление моделей
Открыть в браузере30 минут бесплатно каждый месяц, без карты
Точность на русском#1 / 8
WonderScribe
до 99%
Сырая модель
85–92%
Кто говорит#2 / 8
WonderScribe
до 6 авто, вручную 30
Сырая модель
Нет
Пунктуация и абзацы#3 / 8
WonderScribe
Нейропунктуация
Сырая модель
Как получится
Выжимка по встрече#4 / 8
WonderScribe
92 шаблона
Сырая модель
Нет
Правка результата#5 / 8
WonderScribe
Редактор с таймкодами
Сырая модель
Нет
Форматы на выходе#6 / 8
WonderScribe
Word, PDF, SRT, VTT, MP4
Сырая модель
TXT / JSON
Длинная запись#7 / 8
WonderScribe
до 4 часов одним файлом
Сырая модель
Резать вручную
Что нужно, чтобы начать#8 / 8
WonderScribe
Браузер, 30 мин бесплатно
Сырая модель
GPU и настройка

Оценки точности — по нашим наблюдениям на русскоязычных записях: результат зависит от качества звука, числа спикеров и терминологии. Проверить проще всего на своём файле.

Как это работает

Единый пайплайн, без склеек

Каждый шаг виден статусами и прогрессом в кабинете.

01 · Подготовка
Анализ и очистка
 SNR-профиль · loudnorm · шумоподавление
Измеряем SNR, подбираем профиль обработки, для шумных файлов применяем шумоподавление и нормализацию громкости.
02 · Распознавание
Речь → текст + спикеры
 WonderScribe ASR + диаризация + NLP
Word-level таймкоды, разделение по спикерам, восстановление пунктуации и исправление типичных ошибок ASR.
03 · Результат
Редактор и экспорт
 Word · SRT · VTT · JSON · PDF
Правка слов по клику, переименование спикеров, AI‑саммари с решениями и задачами, burn-in субтитров в MP4.
Попробовать на своих записях

Загрузите файл и увидите пайплайн

30 минут бесплатно. Карта не требуется. Полный редактор, диаризация и экспорт доступны на бесплатном тарифе.

Безопасность ·  Политика конфиденциальности ·  Условия использования

FAQ — возможности

Вопросы про модели, диаризацию и качество распознавания.

Какая модель распознавания используется?
Две специализированные ASR-модели, движок выбирается автоматически по языку аудио:
  • Wonder Speech — для русского. Нативная пунктуация, акцент на разговорной речи, RTF 0.15–0.25 (в 4–6 раз быстрее реального времени)
  • Wonder Multilingual — для 98 других языков. Турбо-версия в 3× быстрее обычных облачных моделей при той же точности
Поверх ASR — собственный word-level пайплайн с нейросетью-выравнивателем для точных пословных таймкодов, фильтрами галлюцинаций и нейропунктуация для восстановления пунктуации. Сравнение с конкурентами — на странице сравнения.
Поддерживаются ли диалоги и несколько спикеров?
Да — наша диаризация автоматически разделяет голоса. Без настройки определяем до 6 голосов — этого хватает большинству встреч. Если участников больше, укажите их число при загрузке: поддерживается до 30.

Дополнительные защиты:
  • Автоподстановка имён из текста («Меня зовут Иван…» или обращения по имени)
  • Защита от топонимов: «Уфа», «Москва» не станут «именами» спикеров (217-словарь)
  • Merge двойников: один голос не разобьётся на «Спикера 1 + Спикера 2» (cosine similarity по эмбеддингам)
  • Multi-channel для Zoom/Meet/Telemost — отдельные дорожки участников
В редакторе любого «Спикера N» можно переименовать в один клик — изменения отразятся во всех экспортах. Подробнее — на странице диаризации.
Есть ли очистка звука?
Да — автоматическая многоуровневая очистка с AI-фильтрами. Включается при загрузке: «Очистка звука → Авто» (рекомендуется) или «Всегда».

Что применяется автоматически по профилю записи (по SNR — отношению сигнал/шум):
  • gentle (SNR≥18 дБ — чистая запись): только ресемплинг 16 kHz mono, без агрессивной обработки
  • normal (15–18 дБ — обычная запись): нормализация громкости для выравнивания громкости
  • aggressive (3–12 дБ — улица, кафе): сегментированный loudnorm + soft-режим, демпфирует шум
  • narrowband (телефон/voIP): принудительный нормализатор + расширение полосы
Для совсем плохих записей — AI-разделение источников подключается для recovery в местах пропусков. Большинство файлов улучшаются на 8–15% точности после очистки.
Можно ли экспортировать субтитры?
Да — SRT и VTT одним кликом из редактора, оба готовы для YouTube Studio.

Доступные форматы субтитров:
  • SRT/VTT segment-level — стандартные субтитры с разбивкой по фразам и таймкодами
  • SRT/VTT word-level — пословные субтитры (как в Reels/TikTok): подсветка каждого слова в момент произнесения
  • Burn-in MP4 — субтитры вшиваются прямо в видео (для TikTok, Reels, Shorts, ВКонтакте Клипы — они не поддерживают отдельные SRT-файлы)
Все экспорты сохраняют имена спикеров и таймкоды. Кириллица в UTF-8, переводы строк CRLF (совместимо с любыми плеерами). Для пакетной обработки видеосерий — через REST API.
Где посмотреть тарифы?
Тарифы — на странице /pricing. Кратко: бесплатно 30 мин/мес («Старт»), Базовый — 649 ₽/мес (30 часов), Профи — 1449 ₽/мес (безлимит). При оплате за год скидка 50% (3890 / 8690 ₽).

Дополнительно:
  • Поминутная оплата (PAYG) — 2 ₽/мин без подписки, 1,5 ₽/мин — со скидкой если активен тариф
  • Заморозка плана до 90 дней (отпуск, командировка) без потери минут
  • Возврат pro-rata — в первые 24ч 100%, далее пропорционально неиспользованным часам (ст. 32 ЗоЗПП)
Все ML-функции (диаризация, AI-саммари, очистка, перевод) доступны даже на «Старт» — никаких premium-tier'ов на функционал.