Расшифровка встреч · интервью · звонков
Текст ваших встреч —
за 3 минуты, а не за вечер.
Загрузите встречу, интервью или звонок — получите текст по спикерам, краткое содержание и список задач. Час записи — примерно 3 минуты.
Демо — первые 30 минут записи, до 4 файлов в сутки: чтобы проверить качество на своём
материале. Весь файл и 180 минут в месяц — после регистрации.
Запись с микрофона — до 2 минут. Распознаём только русскую речь. Все ограничения.
Загружая файл, вы соглашаетесь с
офертой и
политикой ПДн.
Файл удаляется через 24 часа.
сервиса
расшифровано
расшифровано
Краткое содержание
Встреча посвящена запуску нового продукта в третьем квартале. Команда обсуждала бюджет, сроки и распределение задач. Главный итог — целевая дата запуска 1 сентября.
Ключевые темы
- Согласование бюджета на Q3
- Сроки разработки MVP — 6 недель
- Маркетинговый план и каналы привлечения
- Распределение зон ответственности
Что нужно сделать
- Анна: прислать оценки по бюджету в чат (сегодня)
- Сергей: подготовить план разработки MVP (до 20.05)
- Олег: согласовать дату запуска с маркетингом (на следующей встрече)
- Анна: запросить смету от подрядчика (до конца недели)
Бот в Telegram и MAX — секретарь для ваших чатов
Не просто текст голосового, а смысл чата: что решили, что срочно, кто что обещал. В группе бот пишет в чат только текст длинных голосовых, сводку получают в личку те, кто попросит.
Голосовые в текст
За 1–2 секунды, с пунктуацией. Бесплатно до 30 минут в день.
Догнать пачку
Перешлите 50 сообщений — получите одну сводку: решили, срочно, обещали, звали вас.
Сказано — записано
Обещания из голосовых и переписки — с напоминанием за 30 минут до срока.
Память чата
Поиск по сказанному, вечерняя сводка, бриф админу в 8:00, срочное сразу.
Что вы получите
Загрузите запись — и получите готовый к работе текст, а не сырую расшифровку.
Кто что сказал
Текст разбит по спикерам, у каждой реплики — таймкод. Во встречах, которые записал наш бот, — сразу настоящие имена.
Итоги встречи
Краткое содержание, принятые решения и задачи — кто, что и к какому сроку. Прямо в чат, рядом с текстом.
Правка в браузере
Исправьте слово, переименуйте спикера, послушайте любой фрагмент — в редакторе личного кабинета.
Нужный формат
DOCX для документов, SRT и VTT для субтитров, TXT, PDF и JSON для систем. Видео — тоже: звук извлечём сами.
Бот для встреч и голосовые
Пришлите запись встречи — верну протокол: решения и задачи. Встречу в Jitsi, Толке или Zoom бот запишет сам по ссылке (бета). Голосовые в Telegram и MAX — в текст за пару секунд.
Записи остаются в России
Собственные модели на наших серверах, без внешних ИИ-сервисов. Исходный файл удаляется через 24 часа.
Работает в Telegram-боте (файлы до 20 МБ), веб-кабинете (до 5 ГБ), боте в MAX и через REST API.
Для кого мы — выберите свой сценарий:
Тарифы
Прозрачное ценообразование без скрытых ограничений. Платите за минуты обработки, а не за «версию приложения». Чем больше период — тем выгоднее.
Lite
- 10 часов обработки
- Файлы до 4 часов
- Форматы: TXT, DOCX, SRT
- Пунктуация и заглавные буквы
- Краткое саммари встречи
- Редактор транскрипта в ЛК
Business
- 120 часов обработки
- Приоритет в очереди
- Форматы: TXT, DOCX, SRT, VTT, JSON, PDF
- Пунктуация и заглавные буквы
- Расширенное саммари с деталями
- Голосовые профили команды — DeepScribe запоминает голоса и подписывает их именами автоматически
- Свой словарь терминов — загружайте имена сотрудников, продуктов и терминологию для точного распознавания
- API-доступ (для разработчиков — 0,40 ₽/мин)
На 3 / 6 / 12 месяцах действует скидка 10% / 15% / 25%. Овердрафт оплачивается из остатка кошелька — не блокирует работу.
Сравнить тарифы построчно
Что входит в каждый тариф
Сравните возможности построчно — выберите тариф под свой объём и сценарий. Все цены за месяц.
390 ₽
790 ₽
2 490 ₽
Калькулятор: сколько вы сэкономите на расшифровке
при 1 500 ₽/час
Сравнение со средней ставкой на фрилансе по расшифровке встреч/интервью на русском (1 200 – 1 800 ₽/час, источник: Profi.ru / Kwork). DeepScribe обрабатывает 60 минут аудио примерно за 15 минут.
Что где можно
Распознаём только русскую речь — во всех каналах. Перевод на другие языки — это перевод готового текста, а не распознавание речи на другом языке.
| Демо на сайте | Личный кабинет | Telegram-бот | MAX-бот | API | |
|---|---|---|---|---|---|
| Регистрация | не нужна | почта | аккаунт Telegram | аккаунт MAX | ключ API |
| Бесплатно | первые 30 мин файла, до 4 демо в сутки — проверить качество | 180 мин в месяц, первые 30 мин каждого файла | те же 180 мин; голосовые до 15 мин — 30 мин в день | как в Telegram | — |
| Длина файла | до 4 ч, расшифруем 30 мин | до 4 ч | до 4 ч | до 4 ч | до 4 ч |
| Размер файла | до 500 МБ | Free — до 500 МБ, тарифы — до 5 ГБ | до 20 МБ (ограничение Telegram) | до 250 МБ | до 5 ГБ |
| Форматы | TXT, SRT | Free — TXT, SRT; Lite — + DOCX; Pro — + VTT; Business — + PDF, JSON | как по тарифу + JSON | ||
| Спикеры | разделение голосов во всех каналах; имена — переименованием в редакторе личного кабинета | ||||
| Саммари и задачи | нет | краткое — Lite, подробное с задачами — Pro и Business | по тарифу | ||
| Перевод текста | нет | Pro и выше: английский, немецкий, испанский, французский, итальянский, китайский | |||
Принимаем аудио и видео: MP3, M4A, WAV, OGG, OPUS, FLAC, AAC, WMA, MP4, MOV, MKV, WEBM, AVI. Файл другого типа не примем и скажем почему. Аудио удаляем через 24 часа после обработки, текст храним 30 дней.
Частые вопросы
Если ответа нет — напишите в бот, команда «/support».
Можно попробовать бесплатно?
Да. Загрузите файл на главной — получите демо-фрагмент 2-3 минуты с разделением спикеров, без регистрации и привязки карты. Этого достаточно чтобы оценить качество распознавания и диаризации на вашем типе записи.
Дальше выбор:
- Разовая обработка одного файла — от 49 ₽ за весь файл (цена зависит от длительности).
- Подписка: Lite 390 ₽/мес — 10 часов + краткое саммари, Pro 790 ₽/мес — 30 часов + детальное саммари с задачами, Business 2 490 ₽/мес — 120 часов + всё включено. Бесплатно — 180 минут в месяц.
Сколько занимает обработка?
Час аудио — около 2 минут до готового текста с разделением голосов, с кратким содержанием — около 3–4 минут (замер 28.09 на часовой записи: 1 мин 45 с и 3 мин 14 с). Двухминутный фрагмент — 7–10 секунд. При высокой нагрузке или сложных файлах может потребоваться больше времени.
На тарифе Business — приоритетная очередь (ваш файл идёт вне общей очереди). Можно закрыть чат: бот напишет, когда транскрипт готов. Если указали email — придёт ещё и письмо.
Какие форматы файлов принимаются?
Аудио: MP3, WAV, M4A, OGG, OPUS, FLAC, AAC, WMA, AMR.
Видео: MP4, MOV, MKV, WEBM, AVI, FLV (аудио извлечём сами).
Голосовые сообщения Telegram — да, поддерживаем (OPUS под капотом).
Если ваш формат не в списке — попробуйте загрузить, обычно работает: внутри стоит ffmpeg, он понимает почти всё.
Какие языки поддерживаются?
Распознавание: только русский язык. Речь на других языках модель не распознаёт — присылайте записи на русском.
Перевод (Pro и выше): готовый транскрипт можно перевести на английский, немецкий, испанский, французский, итальянский, китайский. Перевод делает локальная LLM — точность хорошая для деловой переписки и заметок.
Какую точность ожидать на моих записях?
Честно — зависит от качества записи: микрофона, эха и количества одновременно говорящих. Ниже — наши замеры 28.09.2026 на открытых наборах записей с ручной расшифровкой (методика).
Распознавание текста — ошибок на 100 слов (WER, меньше — лучше):
- Дальний микрофон в комнате — 5,8
- Аудиокниги, чистая речь — 7,0
- Короткие фразы разных людей — 9,6
- Живая речь на бытовые микрофоны — 12,8
- Телефонные звонки — 19,8
WER считает заменённые, пропущенные и лишние слова, поэтому «100 − WER» — не вероятность того, что конкретное слово верно. Наборы и нормализация — на странице методики; на вашем материале результат может быть другим — проверьте на демо.
Разделение голосов (диаризация), замер 30.09.2026:
- Слов не у того спикера (WDER) — 6,8%: 5 интервью и подкастов по 9–97 минут, разметка людьми
- Ошибка разметки по времени (DER) — 10,7%: учитывает и пропущенную речь, и путаницу спикеров; на спокойном интервью ниже, на перебивках и нескольких голосах одновременно — выше
Разметку голосов можно поправить в редакторе личного кабинета на любом тарифе: переименовать «Голос 1» → «Иван», поменять голоса местами, объединить две реплики или разделить одну.
Как определяются разные голоса (диаризация)?
Используем нейросеть для разделения голосов. Под капотом аудио делится на короткие сегменты, из каждого извлекается «отпечаток голоса», похожие отпечатки кластеризуются — это и есть «спикеры».
Точность хорошая, когда: запись приемлемого качества, голоса достаточно разные (мужчина + женщина — почти 100%), минимум одновременной речи. Возможные ошибки: один человек с разной интонацией = два «спикера», эхо может «размножить» голос. На любом платном тарифе можно объединить лишних спикеров в редакторе ЛК одним кликом.
Какое качество записи нужно?
Минимум: семплинг 8 кГц+, битрейт 16 kbps+ (для речи), соотношение сигнал/шум выше 10 дБ.
Хорошо: семплинг 16 кГц+ (мы сами ресэмплим), MP3 64 kbps+ или OPUS 24 kbps+. Записывайте близко к источнику — петличка / гарнитура. Тихая комната без эха. Чёткая дикция (но мы умеем и с акцентами, и с быстрой речью).
Что такое «краткое содержание»?
На всех платных тарифах автоматически генерируется саммари встречи через локальную LLM. На Lite — краткое содержание (3–5 предложений с ключевыми мыслями). На Pro и Business — детальное саммари: общее резюме, ключевые темы, принятые решения, action items с ответственными, открытые вопросы.
Сохраняется как summary.md рядом с транскриптом и показывается отдельным блоком в ЛК. На Business — расширенный анализ (тональность, потенциальные риски, цитаты). В бесплатном демо саммари не генерируется.
Что умеет редактор в личном кабинете?
На любом платном тарифе (Lite/Pro/Business) доступен полнофункциональный редактор:
- Редактирование текста любого сегмента
- Переименование спикеров («Голос 1» → «Иван»)
- Bulk-merge — объединить лишних спикеров одним кликом
- Воспроизведение оригинала с подсветкой текущего сегмента
- Поиск по тексту с подсветкой
- Чат с транскриптом — задайте вопрос «о чём договорились?» и ИИ ответит на основе содержания
- Регенерация форматов после правок
Подписка продлится автоматически?
Да, если вы оплатили картой и не отключили авто-продление (включено по умолчанию). За 3 дня до окончания напомним письмом и в боте. В день списания спишем сумму такого же тарифа на тот же период.
Отключить — в личном кабинете → Настройки или через /support. Данные карты у нас не хранятся, только токен (через рекуррентные платежи Тинькофф).
Скидки на 3/6/12 месяцев — как работают?
При оплате любого тарифа (Lite/Pro/Business) можно выбрать период подписки:
- 1 месяц — обычная цена
- 3 месяца — −10%
- 6 месяцев — −15%
- 12 месяцев — −25%
Минуты начисляются помесячно (Pro на 12 мес = 30 часов каждый месяц, а не 360 часов сразу). Расчёт скидки виден прямо в окне оплаты.
Как считаются минуты. Списываем только за успешно обработанные файлы, по фактической длительности; если обработка не удалась, минуты не списываются. Минуты тарифа не переносятся: каждые 30 дней счётчик обнуляется. Минуты из пакетов по 1 ₽/мин не сгорают и тратятся, когда минуты тарифа закончились.
Есть ли промокоды?
Иногда выпускаем в рамках акций. Применяются в окне оплаты — есть отдельное поле «Промокод». Дают либо процентную скидку, либо бонусные минуты. Подписаться на анонсы — TG-канал @deepscribe_news.
Что делать, если файл больше 20 МБ?
Telegram-боты не могут скачивать файлы больше 20 МБ — это лимит Telegram. Варианты:
- Откройте веб-кабинет — там лимит до 5 ГБ: deepscribe.ru/webapp/
- Сожмите файл: MP3 128 kbps (~1 МБ/мин) или OPUS 24 kbps (~0,3 МБ/мин). Качество распознавания почти не страдает.
- Разбейте на части по 15–20 минут.
- MAX-бот — там лимит выше (250 МБ).
Качество распознавания плохое — что делать?
Чек-лист:
- Послушайте запись сами — если шумно/глухо, моделям тоже сложно. Особенно плохо: телефонные записи через плохую сеть, эхо в большой комнате, далеко поставленный микрофон.
- Битрейт MP3 ниже 64 kbps — качество страдает. OPUS лучше MP3 на низких битрейтах.
- На платных тарифах есть редактор для ручного исправления текста.
- Если речь сильно специфичная (юр. термины, медицина) — напишите /support, подключим словари.
Не помогло — пришлите ID задания через /support, разберём конкретный случай.
Оплатил, но минуты не зачислились
Чаще всего:
- Задержка обработки — Тинькофф иногда уведомляет нас с задержкой до 5 минут. Подождите.
- Не пришёл webhook — редко, но бывает. Напишите /support, приложите чек или номер транзакции — проверим вручную и начислим за час.
- Возврат банком — иногда банк блокирует платёж после успешного списания (антифрод). Деньги вернутся на карту через 1–3 дня.
Никакая оплата у нас не «пропадает» — разберёмся.
Как подключить API?
REST API доступен на Business и API-Developer тарифах. Шаги:
- Купите Business (2 490 ₽/мес) или API-Developer тариф
- В боте:
/api→ «Создать ключ» → сохранитеdsk_live_... - Документация — deepscribe.ru/api/docs
Основные endpoints: POST /v1/jobs (загрузить файл), GET /v1/jobs/{id} (статус), GET /v1/jobs/{id}/download/{format} (скачать), GET /v1/balance. Rate limit — 60 req/min (можно увеличить — пишите /support).
Как обеспечивается конфиденциальность?
Исходное аудио удаляется через 24 часа после обработки. Распознавание идёт на нашем GPU-сервере в России собственными моделями: файл не уходит во внешние API, не индексируется, не передаётся третьим лицам и не используется для обучения моделей. Текстовый транскрипт (TXT/DOCX/SRT...) хранится в кабинете 30 дней, удалить раньше можно кнопкой «Удалить файлы». Голосовые сообщения удаляются сразу после распознавания. Подробнее о приватности.
Можно ли использовать стенограмму в суде?
DeepScribe выдаёт информационную стенограмму — она подходит для подготовки к делу, согласования формулировок с клиентом, работы с цитатами. Для приобщения к материалам дела требуется заключение лицензированного эксперта по фоноскопической экспертизе. Такие заключения мы не делаем.
Какие способы оплаты?
Российские карты, СБП, Mir — через Тинькофф Эквайринг. Электронный чек по 54-ФЗ автоматически приходит на email. Для юр. лиц — счёт и закрывающие документы через /support.
Возможен ли возврат денег?
Да. Не подойдёт результат — вернём полностью в течение 7 дней с момента оплаты. За неиспользованные минуты — в любой момент (ст. 32 закона о защите прав потребителей). Напишите в /support; деньги вернутся на ту же карту в срок до 10 банковских дней.
Есть ли API для разработчиков?
Да. OpenAPI-документация, multipart upload, polling статуса, rate limit от 60 req/min. Цена для разработчиков — 0,40 ₽/мин. Создание API-ключа — через команду «/api» в Telegram-боте.
Кто стоит за DeepScribe?
За DeepScribe — команда с многолетним опытом в речевых технологиях и судебной фоноскопии. Те же инженеры разработали:
- юрзвук.рф — сервис подготовки фоноскопических материалов для адвокатов и юристов
- deepverify.io — forensic-grade платформа для верификации аудио и видео доказательств
Тот же ASR-движок, что используется в наших экспертных продуктах, мы переупаковали в массовый сервис DeepScribe — для подкастеров, журналистов, психологов, HR и команд, которым нужна быстрая и точная транскрипция без юридической бюрократии.
Юридическое лицо: ИП Степин Иван Геннадьевич, ИНН 772172955804, Москва. Заявка на товарный знак DeepScribe подана в Роспатент. Серверы в РФ, чеки 54-ФЗ, соответствие ФЗ-152.
Транскрибация аудио и видео в текст онлайн
DeepScribe — сервис автоматической расшифровки аудио- и видеозаписей в текст с разделением голосов, таймкодами, краткое содержание и экспортом в DOCX, SRT, VTT, TXT, JSON. Работает на русском и ещё нескольких языках. Серверы в РФ, соответствие ФЗ-152. Подходит для расшифровки интервью, встреч, подкастов, лекций, звонков и юридических аудиозаписей.
Попробуйте без регистрации
DeepScribe превращает в текст разговорную речь — интервью, лекции, встречи, подкасты, голосовые сообщения. В демо расшифруем первые 30 минут записи. Ссылка на результат живёт 24 часа.
⚠ Музыкальные треки, караоке и записи без речи мы расшифровать не сможем — в них нет того, что нужно распознать.
Говорите естественно. Тишина и музыкальный фон ухудшают точность.
Загружая, вы соглашаетесь с офертой и политикой ПДн. Файл удаляется через 24 часа.
Обрабатываем ваш файл
Распознаём речь, разделяем голоса, готовим саммари.
- Загрузка
- Распознавание речи
- Разделение голосов
- Саммари
- Готовим результат
Работает. Вот расшифровка вашей записи
Бесплатно — первые 30 минут любой записи. Посмотрите качество текста и разделение голосов.
В редакторе на платных тарифах: правка одной кнопкой, объединение/разделение спикеров, переименование «Голос 1» → «Иван Петров», поиск по тексту с переходом к аудио-моменту.
Редактор открывается прямо в браузере — не нужно выгружать в Word и обратно. Всё сохраняется автоматически, можно поделиться ссылкой.
Список спикеров с количеством реплик. Загрузите файл — и здесь появится список голосов из вашей записи.
На Lite — краткое содержание встречи. На Pro и Business — детальное саммари: ключевые темы, принятые решения и список задач с указанием ответственных — автоматически в каждой расшифровке.
Идеально для совещаний, CustDev-интервью, лекций и звонков продаж — не нужно пересматривать запись, всё главное уже выписано.
AI вытаскивает action items из обсуждения: «Иван — подготовить отчёт к пятнице», «Маша — связаться с подрядчиком до среды». Можно сразу разнести по календарю или Trello.
Action items доступны на Pro и Business — на Lite только краткое саммари, без списка задач.
Вы видите первые 30 минут. Ещё мин речи, разделение голосов до конца, саммари и список задач — в полной версии файла.
Нажимая кнопку, вы соглашаетесь с офертой и политикой конфиденциальности. build 2026-05-27-v33 paid-poll-404-fix
Файл готов!
Полная транскрипция с разделением голосов готова. Скачайте в нужном формате ниже.
Переименуйте спикеров, объедините реплики, исправьте текст, скачайте обновлённую версию.
Нужна проверка подлинности самой записи — на признаки монтажа, подмены голоса или дипфейка? Это другая задача, её решает DeepVerify — отдельный экспертный сервис с заключением специалиста по ст. 188 ГПК / 58 УПК / 55.1 АПК.
Узнать про проверку подлинности →Не получилось
—
- Интервью / разговор — два человека говорят по очереди
- Лекция или подкаст — один человек рассказывает
- Встреча / Zoom-запись — несколько спикеров
- Голосовое сообщение — диктофонная запись
Мы расшифровываем именно разговорную речь. Песни, музыка, вокал из MDX-сепаратора, тишина — не подходят. Примеры подходящих сценариев →