Услышать. Распознать.
Сохранить смысл.
Аудио и видео в текст на русском языке. Таймкоды, разметка по спикерам и готовые форматы для дальнейшей работы.
Посмотреть результатТранскрибация аудио и видео, разделение спикеров
и синтез речи. Подключите к своему продукту по API.
Бесплатно каждый месяц. Все функции. Без привязки карты.
Записи звонков, встречи и голосовые интерфейсы.
Вы строите решение. Spice Voice Engine работает с речью.
Аудио и видео в текст на русском языке. Таймкоды, разметка по спикерам и готовые форматы для дальнейшей работы.
Посмотреть результатПотоковое распознавание речи для приложений и внутренних систем. Отдельный сценарий работы с микрофоном и гарнитурой.
Сценарий realtimeПревращайте текст в аудио для уведомлений, приложений и голосовых сценариев. Выбирайте доступный голос и скорость.
Сценарий синтезаДобавьте транскрибацию в CRM, телефонию или собственное решение. Вы управляете продуктом, SVE обрабатывает речь.
Посмотреть интеграциюПереводите встречи и звонки в текст. Передавайте расшифровки во внутренние системы или работайте с файлами в браузере.
Попробовать записьЛекции, интервью, подкасты и голосовые заметки. Получите текст с таймкодами без кода и создания приложения.
Загрузить свой файлБез регистрации: до 5 минут записи,
1 минуты realtime или 10 слов для озвучивания.
Интервью, лекция, встреча или звонок
MP3 · WAV · M4A · MP4 · WebM · FLAC · OGGФайл отправится только после нажатия «Транскрибировать».
Метки эмоций и тона — вероятностная оценка звучания речи.
Распознаём речь
Это иллюстрация формата. После обработки здесь появится текст вашей записи.
Используйте микрофон или гарнитуру. Промежуточный текст уточняется по мере речи.
Микрофон выключен.
Нажмите «Включить микрофон» и начните говорить. Текст появится здесь.
Введите фразу и создайте аудио. Здесь появится запись для прослушивания.
Выберите режим под свою задачу.
Наценки за выбор модели нет.
Транскрибация готовых аудио и видео. Для записей разговоров, интервью, лекций и встреч.
Дополнительная модель для обработки записей. Сравните результат на своей речи и выберите подходящий вариант.
Потоковое распознавание. Текст появляется во время разговора и уточняется по мере поступления речи.
Пакеты минут действуют для всех доступных моделей. Диаризация включена в цену. Набор параметров зависит от режима обработки.
Сохраните структуру речи, чтобы было удобнее читать, искать нужный фрагмент и работать с результатом.
Предложения и знаки препинания превращают поток речи в удобный для чтения текст.
Реплики разных участников отделены друг от друга. Для монолога разделение можно выключить.
Дополнительные метки помогают заметить эмоциональную окраску фрагментов записи.
Разметка тона дополняет расшифровку и помогает быстрее найти фрагменты для прослушивания.
Эмоции и тон оцениваются по аудио и не устанавливают намерения человека. Для выводов важен контекст всей записи.
Загрузите аудио или видео в браузере либо отправьте файл через API.
Моно или стерео, разделение спикеров и подходящий режим обработки.
Скачайте расшифровку или передайте структурированный результат в свою систему.
Встраивайте транскрибацию в CRM, внутренние системы и решения для заказчиков. Получайте текст и разметку, а дальше решайте сами, что с ними делать.
{
"language": "ru",
"channels": 2,
"segments": [
{
"start": 0.0,
"end": 4.8,
"speaker": "speaker_1",
"text": "Добрый день."
}
]
}Начните со 100 бесплатных минут.
Выберите пакет, когда будете готовы
к регулярной работе.
1 000 минут
2 000 ₽ за пакетДля первой интеграции
и небольших объёмов.
5 000 минут
8 500 ₽ за пакетДля рабочих процессов
и растущего продукта.
20 000 минут
28 000 ₽ за пакетДля команд с регулярным
потоком записей.
100 000 минут
110 000 ₽ за пакетДля интеграторов
с несколькими проектами.
Диаризация включена. Считаем длительность записи, а не число каналов.
Все условия и калькуляторПостоплата доступна после заключения договора. Объём и условия согласуем индивидуально.
Обсудим локальное развёртывание под ваши требования к данным, нагрузке и эксплуатации. Лицензия, внедрение и сопровождение — в одном предложении.
Исходники хранятся 30 дней. После их удаления расшифровки остаются доступны по правилам аккаунта.
Увеличим срок по запросу. Постоянное хранение рассчитаем отдельно и закрепим в условиях.
Режим без постоянного сохранения записи и расшифровки после выдачи результата.
После регистрации вы получаете 100 минут каждый месяц для проверки всех функций SVE. Бесплатный доступ помогает оценить качество на ваших задачах до покупки пакета.
Нет. Учитывается длительность исходной записи. Количество каналов не увеличивает число оплачиваемых минут, а разделение спикеров включено в цену.
Сейчас основной поддерживаемый язык — русский. Другие языки будут добавляться после проверки качества.
Да, с указанием Spice Voice Engine. White label, перепродажа самостоятельного доступа и поставка On-Premise обсуждаются отдельно.
Да. Загружайте аудио и видео прямо в тестовую форму на сайте. Для личных задач не нужны API или собственное приложение. В кабинете будет доступна работа с историей расшифровок.
Оплату по счёту можно согласовать для компании. Постоплата подключается только после подписания договора с согласованным лимитом и условиями расчётов.
Право использования программного обеспечения Spice Voice Engine. Объём использования измеряется по правилам тарифа. Для On-Premise и white label действуют индивидуальные условия.
Моно, стерео и диаризация — чем они отличаются и что выбрать для своей записи.
ЧитатьРАЗМЕТКА РЕЧИ · 3 МИНКак читать дополнительные метки и использовать их вместе с исходным аудио.
ЧитатьЛИЧНЫЕ ЗАДАЧИ · 2 МИНЗагрузка в браузере, пунктуация, таймкоды и выбор формата для скачивания.
ЧитатьРасскажите, что хотите построить.
Обсудим API, объёмы или локальное развёртывание.