Технический директор ВКонтакте Александр Тоболь на открытии конференции Saint HighLoad++, сообщил что теперь у разработчиков есть возможность бесплатно использовать технологию ВКонтакте, которая считывает голос и переводит его в текст.

ASR (Automatic Speech Recognition) или технологию распознавания речи, можно внедрить в несколько кликов.

Реклама. Erid 2VtzquyAJcf. ООО «Клик.ру». Клик.ру
Реклама. Erid 2VtzqvfByDy. ООО «Клик.ру». Клик.ру

На выбор доступно две модели для распознавания можно:

  • нейтральная — для разборчивой речи, как в телешоу или интервью;
  • спонтанная — для обыденной речи со сленгом и ненормативной лексикой.

Нейросети ВК быстро обрабатывают аудиофайлы, удаляют из расшифровки шумы и паузы, понимают неразборчивую речь и даже отдельный звук «ъ».

Обработку аудио до 100 минут в сутки можно применять для любых целей, а для безлимитного доступа нужно отправить заявку на электронную почту. Начать использовать технологию можно через веб-интерфейс на специальной странице или настроить интеграцию через публичный API ВКонтакте. Решение должно быть востребовано в стартапах, небольших инди-проектах, а также в личных проектах.

В самой соцсети ASR используется для расшифровки голосовых сообщений, генерации субтитров в видео, персональных рекомендаций и многого другого. Решение включает в себя три нейросети: для распознавания речи, поиска подходящих слов и расстановки знаков препинания.

Ранее ВКонтакте показал новый дизайн профиля в приложении.

⭐ Наш Telegram-канал, где мы показываем, как применять ИИ в работе: промты, кейсы, гайды и рабочие схемы. Подписывайтесь → «Промты — и точка».

⭐ Наш Telegram-канал, где мы показываем, как применять ИИ в работе: промты, кейсы, гайды и рабочие схемы. Подписывайтесь → «Промты — и точка».

Комментарии: ВКонтакте откроет доступ к собственной технологии распознавания речи сторонним разработчикам
⚡ В тренде
Twitch — это не просто стримы и чат. Это возможность превратить своё увлечение играми в настоящую профессию. Представь: ты не просто играешь в любимые игры, а зарабатываешь на этом, строишь собственное комьюнити и становишься узнаваемым стримером. Звучит как мечта? На Twitch она вполне реальна. В этой статье расскажем, как быстро раскрутить канал, выйти на первую […]
Сайты с прокси – это сервисы, предоставляющие услуги прокси: использование специальных серверов, выступающих посредниками между пользователем и интернетом. Прокси-серверы позволяют сохранять анонимность в сети, увеличивают скорость доступа к некоторым ресурсам, повышают уровень защиты данных от возможных угроз. В этой статье мы разберем, какие прокси бывают и для чего используются. Рассмотрим 10 популярных сайтов с прокси. […]
История Pixar — это не просто рассказ о создании мультфильмов. Это история о том, как маленькая команда энтузиастов смогла изменить индустрию развлечений, ввести новые стандарты и доказать: даже самые амбициозные мечты достижимы. Успех Pixar — это синтез технологий, креатива и бизнес-рисков. Эта история может вдохновить не только тех, кто связан с кино или анимацией, но […]
Ищете промты для открыток ко Дню России? Нейросети могут сделать семейное поздравление по фото, портрет в праздничном образе, открытку для детей или вариант в советском стиле с достопримечательностями нужного города. В этой статье собрали готовые промты для разных форматов, а также покажем, как ими пользоваться и где лучше генерировать такие открытки. Читайте также: 25 нейросетей […]
Google добавила в Gemini Live создание и редактирование изображений во время разговора. Можно показать комнату через камеру и попросить Gemini изменить интерьер, разобрать задачу по математике или сделать мем. Функция работает в приложении Gemini через Live. Google не уточнила, у всех ли уже появился новый режим и есть ли ограничения по странам, устройствам или типам […]
Блоги компаний
Новости
Свежие статьи