DeepScribe

Расшифровка встреч · интервью · звонков

Текст ваших встреч —
за 3 минуты, а не за вечер.

Загрузите встречу, интервью или звонок — получите текст по спикерам, краткое содержание и список задач. Час записи — примерно 3 минуты.

Демо 30 минут · без регистрации текст через 10–90 с
или
396 пользователей
сервиса
178 часов
расшифровано
1 941 файлов
расшифровано
Серверы в РФ · 152-ФЗ Не обучаем ИИ на файлах Авто-удаление аудио через 24 часа Чек 54-ФЗ · Тинькофф
interview_05_15.mp3 · 17 мин 23 сек Пример результата
[00:03] Олег Добрый день! Сегодня обсуждаем запуск нового продукта на третий квартал.
[00:12] Анна Хорошо. Я подготовила оценки по бюджету — пришлю в чат после встречи.
[00:34] Олег Идея в том, чтобы выйти на рынок к сентябрю. Что нужно для этого?
[01:18] Сергей Со стороны технической команды нужно минимум 6 недель на разработку MVP.

Бот в Telegram и MAX — секретарь для ваших чатов

Не просто текст голосового, а смысл чата: что решили, что срочно, кто что обещал. В группе бот пишет в чат только текст длинных голосовых, сводку получают в личку те, кто попросит.

Открыть бота Что умеет бот

Голосовые в текст

За 1–2 секунды, с пунктуацией. Бесплатно до 30 минут в день.

Догнать пачку

Перешлите 50 сообщений — получите одну сводку: решили, срочно, обещали, звали вас.

Сказано — записано

Обещания из голосовых и переписки — с напоминанием за 30 минут до срока.

Память чата

Поиск по сказанному, вечерняя сводка, бриф админу в 8:00, срочное сразу.

Что вы получите

Загрузите запись — и получите готовый к работе текст, а не сырую расшифровку.

Кто что сказал

Текст разбит по спикерам, у каждой реплики — таймкод. Во встречах, которые записал наш бот, — сразу настоящие имена.

Итоги встречи

Краткое содержание, принятые решения и задачи — кто, что и к какому сроку. Прямо в чат, рядом с текстом.

Правка в браузере

Исправьте слово, переименуйте спикера, послушайте любой фрагмент — в редакторе личного кабинета.

Нужный формат

DOCX для документов, SRT и VTT для субтитров, TXT, PDF и JSON для систем. Видео — тоже: звук извлечём сами.

Бот для встреч и голосовые

Пришлите запись встречи — верну протокол: решения и задачи. Встречу в Jitsi, Толке или Zoom бот запишет сам по ссылке (бета). Голосовые в Telegram и MAX — в текст за пару секунд.

Записи остаются в России

Собственные модели на наших серверах, без внешних ИИ-сервисов. Исходный файл удаляется через 24 часа.

Работает в Telegram-боте (файлы до 20 МБ), веб-кабинете (до 5 ГБ), боте в MAX и через REST API.

Тарифы

Прозрачное ценообразование без скрытых ограничений. Платите за минуты обработки, а не за «версию приложения». Чем больше период — тем выгоднее.

Lite

390 ₽/мес
  • 10 часов обработки
  • Файлы до 4 часов
  • Форматы: TXT, DOCX, SRT
  • Пунктуация и заглавные буквы
  • Краткое саммари встречи
  • Редактор транскрипта в ЛК

Business

2 490 ₽/мес
  • 120 часов обработки
  • Приоритет в очереди
  • Форматы: TXT, DOCX, SRT, VTT, JSON, PDF
  • Пунктуация и заглавные буквы
  • Расширенное саммари с деталями
  • Голосовые профили команды — DeepScribe запоминает голоса и подписывает их именами автоматически
  • Свой словарь терминов — загружайте имена сотрудников, продуктов и терминологию для точного распознавания
  • API-доступ (для разработчиков — 0,40 ₽/мин)

На 3 / 6 / 12 месяцах действует скидка 10% / 15% / 25%. Овердрафт оплачивается из остатка кошелька — не блокирует работу.

Сравнить тарифы построчно

Что входит в каждый тариф

Сравните возможности построчно — выберите тариф под свой объём и сценарий. Все цены за месяц.

Возможность
Lite
390 ₽
Business
2 490 ₽
Минуты обработки / мес
10 ч
120 ч
Цена за минуту
0,65 ₽
0,35 ₽
Длина одного файла
4 ч
без ограничений
Форматы экспорта
TXT, DOCX, SRT
+ PDF, JSON
Разделение спикеров
✓
✓
Пунктуация и заглавные буквы
✓
✓
Саммари встречи
краткое
детальное
Список задач и решений
—
✓
Чат с транскриптом (Q&A)
—
✓
Перевод на 6 языков
—
✓
Редактор транскрипта в ЛК
✓
✓
Приоритет в очереди
—
✓
Голосовые профили команды
—
✓
Свой словарь терминов
—
✓
Калькулятор: сколько вы сэкономите на расшифровке
Калькулятор: сколько вы сэкономите
Двигайте ползунок · покажу тариф и выгоду
У меня
10 часов / мес
Подходящий тариф
Pro
790 ₽/мес
Ручная расшифровка
при 1 500 ₽/час
15 000 ₽
в месяц
Ваша экономия
14 010 ₽
−93%

Сравнение со средней ставкой на фрилансе по расшифровке встреч/интервью на русском (1 200 – 1 800 ₽/час, источник: Profi.ru / Kwork). DeepScribe обрабатывает 60 минут аудио примерно за 15 минут.

Что где можно

Распознаём только русскую речь — во всех каналах. Перевод на другие языки — это перевод готового текста, а не распознавание речи на другом языке.

Демо на сайтеЛичный кабинетTelegram-ботMAX-ботAPI
Регистрацияне нужнапочтааккаунт Telegramаккаунт MAXключ API
Бесплатнопервые 30 мин файла, до 4 демо в сутки — проверить качество180 мин в месяц, первые 30 мин каждого файлате же 180 мин; голосовые до 15 мин — 30 мин в денькак в Telegram—
Длина файладо 4 ч, расшифруем 30 миндо 4 чдо 4 чдо 4 чдо 4 ч
Размер файладо 500 МБFree — до 500 МБ, тарифы — до 5 ГБдо 20 МБ (ограничение Telegram)до 250 МБдо 5 ГБ
ФорматыTXT, SRTFree — TXT, SRT; Lite — + DOCX; Pro — + VTT; Business — + PDF, JSONкак по тарифу + JSON
Спикерыразделение голосов во всех каналах; имена — переименованием в редакторе личного кабинета
Саммари и задачинеткраткое — Lite, подробное с задачами — Pro и Businessпо тарифу
Перевод текстанетPro и выше: английский, немецкий, испанский, французский, итальянский, китайский

Принимаем аудио и видео: MP3, M4A, WAV, OGG, OPUS, FLAC, AAC, WMA, MP4, MOV, MKV, WEBM, AVI. Файл другого типа не примем и скажем почему. Аудио удаляем через 24 часа после обработки, текст храним 30 дней.

Частые вопросы

Если ответа нет — напишите в бот, команда «/support».

Можно попробовать бесплатно?

Да. Загрузите файл на главной — получите демо-фрагмент 2-3 минуты с разделением спикеров, без регистрации и привязки карты. Этого достаточно чтобы оценить качество распознавания и диаризации на вашем типе записи.

Дальше выбор:

  • Разовая обработка одного файла — от 49 ₽ за весь файл (цена зависит от длительности).
  • Подписка: Lite 390 ₽/мес — 10 часов + краткое саммари, Pro 790 ₽/мес — 30 часов + детальное саммари с задачами, Business 2 490 ₽/мес — 120 часов + всё включено. Бесплатно — 180 минут в месяц.
Сколько занимает обработка?

Час аудио — около 2 минут до готового текста с разделением голосов, с кратким содержанием — около 3–4 минут (замер 28.09 на часовой записи: 1 мин 45 с и 3 мин 14 с). Двухминутный фрагмент — 7–10 секунд. При высокой нагрузке или сложных файлах может потребоваться больше времени.

На тарифе Business — приоритетная очередь (ваш файл идёт вне общей очереди). Можно закрыть чат: бот напишет, когда транскрипт готов. Если указали email — придёт ещё и письмо.

Какие форматы файлов принимаются?

Аудио: MP3, WAV, M4A, OGG, OPUS, FLAC, AAC, WMA, AMR.
Видео: MP4, MOV, MKV, WEBM, AVI, FLV (аудио извлечём сами).
Голосовые сообщения Telegram — да, поддерживаем (OPUS под капотом).

Если ваш формат не в списке — попробуйте загрузить, обычно работает: внутри стоит ffmpeg, он понимает почти всё.

Какие языки поддерживаются?

Распознавание: только русский язык. Речь на других языках модель не распознаёт — присылайте записи на русском.

Перевод (Pro и выше): готовый транскрипт можно перевести на английский, немецкий, испанский, французский, итальянский, китайский. Перевод делает локальная LLM — точность хорошая для деловой переписки и заметок.

Какую точность ожидать на моих записях?

Честно — зависит от качества записи: микрофона, эха и количества одновременно говорящих. Ниже — наши замеры 28.09.2026 на открытых наборах записей с ручной расшифровкой (методика).

Распознавание текста — ошибок на 100 слов (WER, меньше — лучше):

  • Дальний микрофон в комнате — 5,8
  • Аудиокниги, чистая речь — 7,0
  • Короткие фразы разных людей — 9,6
  • Живая речь на бытовые микрофоны — 12,8
  • Телефонные звонки — 19,8

WER считает заменённые, пропущенные и лишние слова, поэтому «100 − WER» — не вероятность того, что конкретное слово верно. Наборы и нормализация — на странице методики; на вашем материале результат может быть другим — проверьте на демо.

Разделение голосов (диаризация), замер 30.09.2026:

  • Слов не у того спикера (WDER) — 6,8%: 5 интервью и подкастов по 9–97 минут, разметка людьми
  • Ошибка разметки по времени (DER) — 10,7%: учитывает и пропущенную речь, и путаницу спикеров; на спокойном интервью ниже, на перебивках и нескольких голосах одновременно — выше

Разметку голосов можно поправить в редакторе личного кабинета на любом тарифе: переименовать «Голос 1» → «Иван», поменять голоса местами, объединить две реплики или разделить одну.

Как определяются разные голоса (диаризация)?

Используем нейросеть для разделения голосов. Под капотом аудио делится на короткие сегменты, из каждого извлекается «отпечаток голоса», похожие отпечатки кластеризуются — это и есть «спикеры».

Точность хорошая, когда: запись приемлемого качества, голоса достаточно разные (мужчина + женщина — почти 100%), минимум одновременной речи. Возможные ошибки: один человек с разной интонацией = два «спикера», эхо может «размножить» голос. На любом платном тарифе можно объединить лишних спикеров в редакторе ЛК одним кликом.

Какое качество записи нужно?

Минимум: семплинг 8 кГц+, битрейт 16 kbps+ (для речи), соотношение сигнал/шум выше 10 дБ.

Хорошо: семплинг 16 кГц+ (мы сами ресэмплим), MP3 64 kbps+ или OPUS 24 kbps+. Записывайте близко к источнику — петличка / гарнитура. Тихая комната без эха. Чёткая дикция (но мы умеем и с акцентами, и с быстрой речью).

Что такое «краткое содержание»?

На всех платных тарифах автоматически генерируется саммари встречи через локальную LLM. На Lite — краткое содержание (3–5 предложений с ключевыми мыслями). На Pro и Business — детальное саммари: общее резюме, ключевые темы, принятые решения, action items с ответственными, открытые вопросы.

Сохраняется как summary.md рядом с транскриптом и показывается отдельным блоком в ЛК. На Business — расширенный анализ (тональность, потенциальные риски, цитаты). В бесплатном демо саммари не генерируется.

Что умеет редактор в личном кабинете?

На любом платном тарифе (Lite/Pro/Business) доступен полнофункциональный редактор:

  • Редактирование текста любого сегмента
  • Переименование спикеров («Голос 1» → «Иван»)
  • Bulk-merge — объединить лишних спикеров одним кликом
  • Воспроизведение оригинала с подсветкой текущего сегмента
  • Поиск по тексту с подсветкой
  • Чат с транскриптом — задайте вопрос «о чём договорились?» и ИИ ответит на основе содержания
  • Регенерация форматов после правок
Подписка продлится автоматически?

Да, если вы оплатили картой и не отключили авто-продление (включено по умолчанию). За 3 дня до окончания напомним письмом и в боте. В день списания спишем сумму такого же тарифа на тот же период.

Отключить — в личном кабинете → Настройки или через /support. Данные карты у нас не хранятся, только токен (через рекуррентные платежи Тинькофф).

Скидки на 3/6/12 месяцев — как работают?

При оплате любого тарифа (Lite/Pro/Business) можно выбрать период подписки:

  • 1 месяц — обычная цена
  • 3 месяца — −10%
  • 6 месяцев — −15%
  • 12 месяцев — −25%

Минуты начисляются помесячно (Pro на 12 мес = 30 часов каждый месяц, а не 360 часов сразу). Расчёт скидки виден прямо в окне оплаты.

Как считаются минуты. Списываем только за успешно обработанные файлы, по фактической длительности; если обработка не удалась, минуты не списываются. Минуты тарифа не переносятся: каждые 30 дней счётчик обнуляется. Минуты из пакетов по 1 ₽/мин не сгорают и тратятся, когда минуты тарифа закончились.

Есть ли промокоды?

Иногда выпускаем в рамках акций. Применяются в окне оплаты — есть отдельное поле «Промокод». Дают либо процентную скидку, либо бонусные минуты. Подписаться на анонсы — TG-канал @deepscribe_news.

Что делать, если файл больше 20 МБ?

Telegram-боты не могут скачивать файлы больше 20 МБ — это лимит Telegram. Варианты:

  • Откройте веб-кабинет — там лимит до 5 ГБ: deepscribe.ru/webapp/
  • Сожмите файл: MP3 128 kbps (~1 МБ/мин) или OPUS 24 kbps (~0,3 МБ/мин). Качество распознавания почти не страдает.
  • Разбейте на части по 15–20 минут.
  • MAX-бот — там лимит выше (250 МБ).
Качество распознавания плохое — что делать?

Чек-лист:

  1. Послушайте запись сами — если шумно/глухо, моделям тоже сложно. Особенно плохо: телефонные записи через плохую сеть, эхо в большой комнате, далеко поставленный микрофон.
  2. Битрейт MP3 ниже 64 kbps — качество страдает. OPUS лучше MP3 на низких битрейтах.
  3. На платных тарифах есть редактор для ручного исправления текста.
  4. Если речь сильно специфичная (юр. термины, медицина) — напишите /support, подключим словари.

Не помогло — пришлите ID задания через /support, разберём конкретный случай.

Оплатил, но минуты не зачислились

Чаще всего:

  • Задержка обработки — Тинькофф иногда уведомляет нас с задержкой до 5 минут. Подождите.
  • Не пришёл webhook — редко, но бывает. Напишите /support, приложите чек или номер транзакции — проверим вручную и начислим за час.
  • Возврат банком — иногда банк блокирует платёж после успешного списания (антифрод). Деньги вернутся на карту через 1–3 дня.

Никакая оплата у нас не «пропадает» — разберёмся.

Как подключить API?

REST API доступен на Business и API-Developer тарифах. Шаги:

  1. Купите Business (2 490 ₽/мес) или API-Developer тариф
  2. В боте: /api → «Создать ключ» → сохраните dsk_live_...
  3. Документация — deepscribe.ru/api/docs

Основные endpoints: POST /v1/jobs (загрузить файл), GET /v1/jobs/{id} (статус), GET /v1/jobs/{id}/download/{format} (скачать), GET /v1/balance. Rate limit — 60 req/min (можно увеличить — пишите /support).

Как обеспечивается конфиденциальность?

Исходное аудио удаляется через 24 часа после обработки. Распознавание идёт на нашем GPU-сервере в России собственными моделями: файл не уходит во внешние API, не индексируется, не передаётся третьим лицам и не используется для обучения моделей. Текстовый транскрипт (TXT/DOCX/SRT...) хранится в кабинете 30 дней, удалить раньше можно кнопкой «Удалить файлы». Голосовые сообщения удаляются сразу после распознавания. Подробнее о приватности.

Можно ли использовать стенограмму в суде?

DeepScribe выдаёт информационную стенограмму — она подходит для подготовки к делу, согласования формулировок с клиентом, работы с цитатами. Для приобщения к материалам дела требуется заключение лицензированного эксперта по фоноскопической экспертизе. Такие заключения мы не делаем.

Какие способы оплаты?

Российские карты, СБП, Mir — через Тинькофф Эквайринг. Электронный чек по 54-ФЗ автоматически приходит на email. Для юр. лиц — счёт и закрывающие документы через /support.

Возможен ли возврат денег?

Да. Не подойдёт результат — вернём полностью в течение 7 дней с момента оплаты. За неиспользованные минуты — в любой момент (ст. 32 закона о защите прав потребителей). Напишите в /support; деньги вернутся на ту же карту в срок до 10 банковских дней.

Есть ли API для разработчиков?

Да. OpenAPI-документация, multipart upload, polling статуса, rate limit от 60 req/min. Цена для разработчиков — 0,40 ₽/мин. Создание API-ключа — через команду «/api» в Telegram-боте.

Кто стоит за DeepScribe?

За DeepScribe — команда с многолетним опытом в речевых технологиях и судебной фоноскопии. Те же инженеры разработали:

  • юрзвук.рф — сервис подготовки фоноскопических материалов для адвокатов и юристов
  • deepverify.io — forensic-grade платформа для верификации аудио и видео доказательств

Тот же ASR-движок, что используется в наших экспертных продуктах, мы переупаковали в массовый сервис DeepScribe — для подкастеров, журналистов, психологов, HR и команд, которым нужна быстрая и точная транскрипция без юридической бюрократии.

Юридическое лицо: ИП Степин Иван Геннадьевич, ИНН 772172955804, Москва. Заявка на товарный знак DeepScribe подана в Роспатент. Серверы в РФ, чеки 54-ФЗ, соответствие ФЗ-152.

Транскрибация аудио и видео в текст онлайн

DeepScribe — сервис автоматической расшифровки аудио- и видеозаписей в текст с разделением голосов, таймкодами, краткое содержание и экспортом в DOCX, SRT, VTT, TXT, JSON. Работает на русском и ещё нескольких языках. Серверы в РФ, соответствие ФЗ-152. Подходит для расшифровки интервью, встреч, подкастов, лекций, звонков и юридических аудиозаписей.

Аудио в текст
MP3, WAV, M4A, OGG → текст с таймкодами
Видео в текст
MP4, MOV, MKV → расшифровка и SRT
Разделение голосов
До 8 спикеров, переименование, точные границы
Субтитры SRT/VTT
Для YouTube, Rutube, видеомонтажа
Telegram-бот
Голосовые и аудио прямо в @DeepScribe_bot
API для разработчиков
REST + webhooks для CRM и аналитики
Для бизнеса и команд
Совещания, созвоны, CustDev — расшифровка и протоколы
Юридические аудиозаписи
Стенограммы для суда, дословно, с таймкодами