УРОВЕНЬ 1 · ОСНОВА

Транскрибация и диаризация

Аудио и видео любой длины превращается в точный текст с разделением по спикерам. Обработка идёт на вашем сервере — запись не покидает контур.

Работает сейчас

Как записи попадают в систему

Пять способов — выбирайте тот, который встроится в текущие привычки команды, а не наоборот.

  • Загрузка файла в веб-кабинете — перетащили и забыли
  • Telegram-бот: переслали голосовое или файл прямо из чата
  • Прямая ссылка на YouTube, Яндекс.Диск или Google Drive
  • REST API — для встраивания в свои сервисы
  • WebSocket streaming — расшифровка по ходу разговора

Что получается на выходе

  • Текст с таймкодами и разделением по спикерам — до 10 голосов на записи
  • Имена участников подставляются автоматически, если они звучат в разговоре
  • Проверка орфографии и расстановка пунктуации
  • Свой словарь терминов, фамилий и аббревиатур — под лексику вашей отрасли
  • Экспорт в DOCX, SRT, VTT, TXT и JSON

Форматы и языки

Принимаем MP3, WAV, FLAC, Opus, M4A, MP4, MKV, WEBM и ещё несколько десятков форматов — конвертировать вручную не нужно. Распознавание работает на 60+ языках, включая переключение языка внутри одного предложения.