Блог

Как сделать стенограмму аудио или видео: пошаговый гайд

Как сделать стенограмму аудио или видео — практический вопрос для журналистов, юристов, исследователей, HR и студентов: есть запись интервью, лекции, совещания или Zoom-звонка, нужен текст с репликами, таймкодами и возможностью цитировать. Способов несколько — от ручного набора до нейросети с вычиткой. В этом гиде — все основные методы, пошаговый алгоритм, образец оформления и требования к качеству записи: как сделать стенограмму аудиозаписи или видео так, чтобы текст не стыдно отдать редакции, заказчику или суду, и когда выбирать AI-расшифровку, а когда — ручную расшифровку.

Что такое стенограмма и чем она отличается от «просто текста»

Стенограмма — дословная или близкая к дословной фиксация устной речи с указанием говорящих и, как правило, временных меток. Это не конспект (сжатое изложение) и не саммари (краткое содержание).

Элементы полноценной стенограммы:

  • разметка спикеров (Спикер 1, ведущий, свидетель);
  • абзацы по репликам;
  • таймкоды для навигации по записи;
  • пометки о неразборчивых фрагментах;
  • сохранение смысловых маркеров (отрицания, числа, цитаты).

Расшифровка аудио в текст без спикеров и таймкодов — черновик; для протоколов, статей и судебных материалов её нужно доработать.

Способы сделать стенограмму: обзор

Способ Время Точность Стоимость
Ручной набор 4–6× длины записи Максимальная Дорого (время человека)
Стенографист / фриланс 1–3 дня Высокая От сотен ₽/мин
Автоматическая транскрибация Минуты 85–92% на сложном аудио От 2 ₽/мин (SlovoMol)
Автоматика + ручная расшифровка Часы–дни 98%+ Автоматика + 75 ₽/мин вычитки
Встроенные субтитры YouTube Минуты Нестабильно Бесплатно, но без контроля ПДн

Шаг 0: подготовьте запись

Качество стенограммы начинается не в редакторе, а при записи:

  1. Микрофон ближе к источнику — петличка лучше встроенного ноутбука.
  2. Меньше фонового шума — кондиционер, кафе, улица ухудшают распознавание.
  3. Один файл на событие — не теряйте куски при нарезке.
  4. Формат — WAV/FLAC для архива; MP3/M4A допустимы для распознавания.
  5. Метаданные — запишите дату, участников, тему (для шапки стенограммы).

Пошаговый гид: стенограмма через онлайн-сервис

Шаг 1. Загрузите файл

Откройте личный кабинет SlovoMol, выберите аудио или видео. Поддерживаются распространённые форматы; видео обрабатывается по звуковой дорожке.

Шаг 2. Выберите режим

  • AI-расшифровка — быстрый черновик от 2 ₽/мин; новым пользователям 10 бесплатных минут;
  • Ручная расшифровка — если текст пойдёт клиенту, в суд, в СМИ или в диссертацию — 75 ₽/мин.

Шаг 3. Укажите язык и опции

Русский — основной сценарий; при смешении русского и английского проверьте результат на англицизмы и термины. Включите диаризацию (разделение спикеров), если доступно.

Шаг 4. Получите черновик

Автоматика обрабатывает запись на локальной инфраструктуре с учётом 152-ФЗ — важно для корпоративных и клиентских записей.

Шаг 5. Проверьте критичные места

Прослушайте фрагменты с:

  • именами и названиями;
  • цифрами, датами, суммами;
  • отрицаниями («не согласен»);
  • перебиваниями — там часто путаются спикеры.

Шаг 6. Доработайте или закажите ручную расшифровку

Мелкие правки — в Word. Системные ошибки — передайте на вычитку редактора.

Шаг 7. Экспортируйте

Выберите формат:

  • DOCX — редактирование и печать;
  • PDF — финальная версия для отправки;
  • TXT — простой текст для CMS;
  • SRT — субтитры к видео в монтажных программах.

Пошаговый гид: ручная стенограмма

Если нет бюджета на сервис и запись короткая (до 15 минут):

  1. Откройте аудио в плеере с горячими клавишами паузы и воспроизведения (например, пробел).
  2. Используйте USB-педаль (опционально) — руки свободны для набора.
  3. Ставьте таймкод каждые 1–2 минуты: [00:05:30].
  4. Не исправляйте грамматику устной речи, если нужна дословность.
  5. Помечайте [неразборчиво] вместо догадок.
  6. После черновика — один проход только на сверку имён и цифр.

Ориентировочное правило: опытный человек набирает 1 минуту аудио за 4–6 минут работы; час записи — пол рабочего дня.

Стенограмма из видео

Для YouTube, Zoom, телемоста, съёмки интервью:

  • извлеките аудиодорожку (ffmpeg, HandBrake) или загрузите видео целиком;
  • для субтитров экспортируйте SRT и импортируйте в Premiere, DaVinci, CapCut;
  • если в кадре видны имена — используйте их для подписей спикеров в DOCX.

Оформление готового документа

Шапка

Дата, место, участники, источник записи, автор расшифровки, оговорка при необходимости («не является официальным протоколом»).

Тело

Пример оформления реплик: абзац с таймкодом и жирным именем спикера — «[00:00:12] Ведущий: Добрый день, начинаем интервью.»; следующий абзац — «[00:00:18] Гость: Спасибо, готов ответить на вопросы.»

Примечания

Шум, обрыв связи, пауза, смех — по необходимости в квадратных скобках.

Образец стенограммы: как выглядит готовый документ

Рабочий образец стенограммы аудиозаписи читается так: сначала шапка (дата, событие, участники, источник записи), затем реплики — таймкод, имя спикера и текст: «[00:07:41] Руководитель проекта: Бюджет согласован в размере 1,2 миллиона». Ниже — ответная реплика в том же формате, с собственным таймкодом. Любой абзац такого примера стенограммы сверяется с записью за секунды.

Перед сдачей работы сверьте оформление с внутренним шаблоном компании: единые сокращения, разметка спикеров и пометки о шуме важнее красивого слога — стенограмма должна фиксировать историю записи, а не пересказывать её.

Когда достаточно автоматики, когда нужна ручная расшифровка

AI-расшифровки хватит:

  • личный конспект лекции;
  • черновик для монтажа подкаста;
  • поиск цитаты в длинном интервью;
  • внутренний протокол «для команды» с низкими рисками.

Нужна ручная расшифровка:

  • судебные и досудебные материалы;
  • публикации в СМИ с прямыми цитатами;
  • медицинские и финансовые разборы;
  • защита диссертации, протоколы с юридическими формулировками;
  • любой текст, где одна ошибка в слове меняет смысл.

Типичные ошибки новичков

  1. Гнаться за «красивым» текстом — стенограмма не литературная обработка.
  2. Не подписывать спикеров — через неделю не вспомните, кто говорил.
  3. Доверять автоматике в числах — всегда сверяйте с аудио.
  4. Загружать конфиденциальное аудио в первый попавшийся облачный сервис — 152-ФЗ и утечки.
  5. Обрезать аудио перед расшифровкой — теряется контекст для экспертизы.

Инструменты помимо распознавания

  • ffmpeg — извлечь аудио из видео, нормализовать громкость.
  • Audacity — шумоподавление (осторожно, не «замылить» голос).
  • Word / Google Docs — финальная вёрстка DOCX.
  • Notion / Obsidian — хранение стенограмм с тегами проектов.

Стенограмма для разных задач

Журналистика

AI-расшифровка для первого прохода, автор выверяет цитаты; ручная расшифровка — для расследований и публикаций с дословными цитатами.

Наука и образование

Лекции — автоматика; защиты и семинары с терминами — автоматика + вычитка. Как оформляется стенограмма диссертационного совета — в статье «Стенограмма защиты диссертации».

Бизнес

Протокол совещания: AI-расшифровка, решения и поручения проверяет секретарь. Требования к таким документам — в материале «Протокол и стенограмма совещания».

Юриспруденция

Ручная расшифровка по умолчанию; автоматика — для первичной ориентировки по длинной записи. Отдельные требования к судебным документам разобраны в статье «Стенограмма судебного заседания».

Стоимость: пример расчёта

Запись 60 минут интервью:

  • только автоматика: 60 × 2 ₽ = 120 ₽ (минус 10 бесплатных минут на первом заказе);
  • автоматика + полная ручная расшифровка: 60 × 75 ₽ = 4500 ₽ (расшифровку часто включают в стоимость);
  • ручной фриланс: рыночно от 3000–8000 ₽ и выше в зависимости от срока.

Стратегия «эконом»: автоматика целиком + ручная расшифровка только 10 минут с ключевыми цитатами. Актуальные ставки обоих режимов — на странице тарифов, полный разбор цен по типам записей — в статье «Сколько стоит расшифровка аудио в 2026».

Безопасность и 152-ФЗ

В записи — голоса, ФИО, иногда медицинские и банковские сведения. При выборе сервиса проверьте:

  • договор поручения обработки ПДн;
  • локализацию в РФ;
  • срок удаления файла после обработки.

SlovoMol обрабатывает аудио локально, без передачи в публичные зарубежные сервисы распознавания.

Часто задаваемые вопросы

Сколько времени занимает стенограмма 1 часа аудио?

Автоматика — несколько минут; ручная расшифровка — обычно от нескольких часов до 1–2 рабочих дней; ручной набор — 4–6 часов.

Можно ли сделать стенограмму бесплатно?

10 бесплатных минут автоматики в SlovoMol; для полного часа — платный тариф от 2 ₽/мин или ручной труд.

Видео без звука — можно?

Нет; нужна аудиодорожка. Без звука остаётся только описание картинки (другая задача).

Как различить спикеров, если их пять?

Диаризация + ручная подпись по голосам; при хаосе — ручная расшифровка.

Какой формат лучше для суда?

DOCX или PDF с таймкодами; согласуйте с адвокатом представление вместе с аудио.

Чем SlovoMol лучше бесплатных сервисов расшифровки?

Локальная обработка, 152-ФЗ, профессиональные форматы, связка автоматики и ручной расшифровки, русская специализация.

Итог

Сделать стенограмму аудио или видео в 2026 проще всего через связку качественной записи → AI-расшифровка от 2 ₽/мин → выборочная или полная ручная расшифровка. Не пропускайте проверку имён, цифр и спикеров. SlovoMol: 2 ₽/мин автоматика, 75 ₽/мин вычитка, 10 бесплатных минут для старта, экспорт TXT, SRT, DOCX, PDF. Загрузите файл на slovomol.com или в кабинет и получите первый черновик за минуты.

← К блогу