Microsoft выпустила ИИ-модель для генерации текста из аудио
Microsoft представила VibeVoice — новую модель для мгновенной озвучки текста. ИИ умеет создавать аудио длительностью до 90 минут по текстовым запросам, сценариям или определенным прописанным репликам.
Microsoft позиционирует эту модель как помощника в записи и проведении подкастов. В одну аудиозапись можно добавить до четырёх персонажей. Пока инструмент поддерживает только английский и китайский языки.
Подписывайтесь на Telegram Пащенко Илья | IT технологии и цифровизация.