• 16 ноября, 2023

Речевые технологии платформы SaluteSpeech стали ещё доступнее для пользователей

Сбер сообщил о запуске отдельного приложения для работы с речевыми технологиями — SaluteSpeech App. Это новый удобный инструмент для распознавания аудио и озвучивания текста. Приложение доступно для популярных операционных систем, отличается простотой использования и включает в себя возможности GigaChat API, программного интерфейса доступа к сервису GigaChat.

В SaluteSpeech App два раздела, каждый из которых соответствует своей технологии. Раздел «Распознавание» предназначен для текстовой расшифровки встреч, звонков, интервью и любых других голосовых файлов. Раздел «Синтез», наоборот, позволяет озвучить текст, настраивая паузы и ударения, и даёт возможность скачать готовый аудиофайл на своё устройство. Синтезировать текст можно разными голосами из семи общедоступных вариантов на русском и английском языках.

Использование GigaChat API дополнительно упрощает процесс подготовки аудиоконтента. Пользователь может загрузить короткие тезисы и попросить нейросетевую модель на их базе подготовить необходимый текст для последующего синтеза. Например, написать сказку по заданной теме, затем озвучить ее, чтобы полученный аудиофайл включать ребенку в машине или перед сном. Также с помощью GigaChat API в приложении SaluteSpeech App можно сделать короткую выжимку протокола встречи, аналитического отчёта или любого другого текста, а затем озвучить полученный материал. Есть множество и других кейсов, всё зависит от задач и фантазии пользователя.

Новое приложение будет доступно всем без оплаты и подойдёт для решения самых разных задач. Например, журналисты могут быстро расшифровать интервью, авторы книг — озвучить свои произведения, разработчики приложений с голосовыми командами — создавать для них голосовые дорожки, студенты —расшифровывать лекции и многое другое.

Для начала работы с SaluteSpeech App необходимо скачать приложение. Внутри приложения перейти по ссылке для создания проекта SaluteSpeech и GigaChat, далее перенести свои авторизационные данные из соответствующего проекта в приложение SaluteSpeech App. После чего можно приступить к решению задач с использованием передовых технологий Сбера.

Похожие статьи

Туристы потратили рекордные 80,7 млрд рублей на путешествия по…

В праздничные дни — с 31 декабря 2025-го по 11 января 2026 года — россияне совершили 11,8 млн поездок по стране.…

ДОМ.РФ и Naumen вышли в финал «Хрустальной Гарнитуры» с…

Консультационный центр ДОМ.РФ и российский вендор ПО и облачных сервисов Naumen стали финалистами международной программы «Хрустальная Гарнитура» в номинациях «Лучший проект внедрения, интеграции технологий» (кейс «Внедрение экосистемы…
Исследование Домклик: на какие нишевые ипотечные кредиты был спрос в 2025 году

Исследование Домклик: на какие нишевые ипотечные кредиты был спрос…

В 2025 году в абсолютном большинстве случаев спрос заёмщиков был сконцентрирован на классических и наиболее востребованных объектах жилой недвижимости: квартирах в…