Сегодня 21 ноября 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → аудиокниги

Audible протестирует поиск аудиокниг при помощи ИИ

Компания по производству аудиокниг Audible, принадлежащая Amazon, объявила о старте тестирования функции поиска на основе искусственного интеллекта, которая должна помочь пользователям существенно упростить поиск аудиокниг. Некоторым клиентам в США уже сейчас стало доступно взаимодействие с Maven, новым ИИ-экспертом по персональным рекомендациям Audible, который предлагает аудиокниги на основе запросов пользователей.

 Источник изображений: Audible

Источник изображений: Audible

При поиске пользователь может использовать естественный язык для ввода запросов, а Maven предоставит индивидуальные рекомендации, основываясь на каталоге Audible, насчитывающем почти миллион наименований книжной продукции.

ИИ-поиск Maven станет доступен на устройствах iOS и Android. Почти половина клиентов Audible в США получат доступ к этой функции, независимо от тарифного плана. В настоящее время, по словам компании, область поиска ограничена «подмножеством» её библиотеки аудиокниг. В дальнейшем Audible планирует развивать и совершенствовать новый инструмент поиска.

Audible не конкретизировала, какие модели ИИ были использованы при разработке системы поиска Maven. Представитель компании отметил, что Maven использует «сильные стороны нескольких моделей» и будет «постоянно оценивать» их по мере совершенствования.

Наряду с объявлением о запуске Maven, Audible сообщила, что также экспериментирует с «Коллекциями», курируемыми ИИ, и обзорами, созданными ИИ. «Коллекции» Audible примечательны тем, что могут стать ответом Audible на плейлисты Spotify, созданные при помощи ИИ.

Ранее негативную реакцию со стороны актёров и других творческих личностей вызвало сообщение, что по состоянию на май 2024 года более 40 000 книг в библиотеке Audible были озвучены ИИ. На сегодняшний день их количество, вероятно, заметно увеличилось.

В России набирает популярность озвучивание аудиокниг с помощью ИИ

По сообщениям сетевых источников, российские книжные сервисы и издательства активно используют алгоритмы на базе искусственного интеллекта для озвучивания аудиокниг. Предполагается, что такие алгоритмы позволят существенно ускорить и удешевить производство контента в этом сегменте. Однако на данном этапе эта технология не может полностью заменить человека и подходит не для всех типов литературы.

 Источник изображения: 4system / Pixabay

Источник изображения: 4system / Pixabay

По данным источника, принадлежащий МТС книжный сервис «Строки» в этом году планирует озвучить свыше 10 тыс. произведений с помощью алгоритма, созданного специалистами подразделения MTS AI. В настоящее время в работе находятся 600 произведений. Запись книг будет осуществляться с помощью платформы Audiogram, которая построена на основе нейросетей, машинного обучения и технологии обработки естественного языка. С её помощью можно синтезировать речь, расставляя ударения и паузы, а также воспроизводить вопросительные побудительные и другие интонации.

Лидер отечественного рынка аудиокниг в лице ГК «ЛитРес» (сервисы «ЛитРес», MyBook, LiveLib и др.) также развивает направление, связанное с озвучиванием книг с помощью нейросетей. «Такую озвучку мы запустили ещё осенью 2020 года, но активно использовать начали осенью 2022 года. Она основана на технологии распознавания и синтеза речи SpeechKit, на которой работает голосовой помощник «Алиса», — рассказал директор департамента по развитию контента ГК «ЛитРес» Евгений Селиванов.

По данным «Яндекса», в 2022 году с помощью технологии SpeechKit было озвучено свыше 100 тыс. часов аудиокниг. «ЛитРес» в прошлом году записал и выпустил около 6 тыс. книг, озвученных «живыми» голосами, тогда как использование ИИ-алгоритма позволило озвучить 3 тыс. произведений всего за два месяца. Отмечается, что себестоимость озвучивания одной книги с помощью ИИ составляет всего 400-700 рублей.

В МТС отметили, что в настоящее время более 90 % книг на российском рынке не имеют аудиоверсий, а их трансформация в аудиоформат традиционным способом заняла бы годы. В то же время для создания первоначальной версии аудиокниги с помощью ИИ-алгоритма требуется 30-60 минут. Для сравнения, запись живым голосом занимает до нескольких дней с учётом технической обработки и монтажа. При этом расходы на озвучивание одной единицы контента снижаются примерно в десять раз.

Apple начала продавать аудиокниги, озвученные нейросетью

Стало известно, что в сервисе Apple Books появились аудиокниги, которые были озвучены с помощью специального алгоритма на базе искусственного интеллекта. Очевидно, за счёт этого компания планирует не только сократить расходы на оплату работы дикторов и рассказчиков, но и существенно ускорить процесс создания аудиокниг.

 Источник изображений: Samuel Axon / ArsTechnica

Источник изображений: Samuel Axon / ArsTechnica

На данный момент в библиотеке Apple присутствует всего несколько книг, озвученных нейросетью, но в будущем их может стать больше. Каждая такая книга в описании имеет соответствующую пометку, в которой сказано, что произведение озвучено «цифровым голосом». Отмечается, что озвученные нейросетью аудиокниги мало чем уступают более привычным, в которых озвучкой занимались люди. Однако в некоторых местах повествования можно заметить отрывки со странным произношением или отсутствием эмоций в голосе.

По данным источника, за последние несколько месяцев Apple контактировала с разными независимыми книжными издателями, предлагая взять на себя расходы по созданию аудиокниг и обещая платить авторам отчисления с продаж. Не все издатели согласились сотрудничать с Apple, но, вероятно, в дальнейшем IT-гигант продолжит расширять библиотеку аудиокниг на своей платформе, поскольку они пользуются большой популярностью. Отметим также, что Apple, скорее всего, будет не единственной компанией, использующей нейросеть для создания аудиокниг. В прошлом Google и Amazon, являющиеся крупными поставщиками электронных и аудиокниг, также не исключали такую возможность.


window-new
Soft
Hard
Тренды 🔥
Новый трейлер раскрыл дату выхода Mandragora — метроидвании с элементами Dark Souls и нелинейной историей от соавтора Vampire: The Masquerade — Bloodlines 20 мин.
В Японии порекомендовали добавить в завещания свои логины и пароли 2 ч.
Обновления Windows 11 больше не будут перезагружать ПК, но обычных пользователей это не касается 3 ч.
VK похвасталась успехами «VK Видео» на фоне замедления YouTube 4 ч.
GTA наоборот: полицейская песочница The Precinct с «дозой нуара 80-х» не выйдет в 2024 году 6 ч.
D-Link предложила устранить уязвимость маршрутизаторов покупкой новых 7 ч.
Valve ужесточила правила продажи сезонных абонементов в Steam и начнёт следить за выполнением обещаний разработчиков 7 ч.
Австралия представила беспрецедентный законопроект о полном запрете соцсетей для детей до 16 лет 8 ч.
Биткоин приближается к $100 000 — курс первой криптовалюты установил новый рекорд 8 ч.
В открытых лобби Warhammer 40,000: Space Marine 2 запретят играть с модами, но есть и хорошие новости 9 ч.
Астрономы впервые сфотографировали умирающую звезду за пределами нашей галактики — она выглядит не так, как ожидалось 35 мин.
Представлена технология охлаждения чипов светом — секретная и только по предварительной записи 58 мин.
Японская Hokkaido Electric Power намерена перезапустить ядерный реактор для удовлетворения потребности ЦОД в энергии 2 ч.
Meta планирует построить за $5 млрд кампус ЦОД в Луизиане 3 ч.
Arm задаёт новый стандарт для ПК, чтобы навязать конкуренцию x86 3 ч.
HPE готова ответить на любые вопросы Минюста США по расследованию покупки Juniper за $14 млрд 3 ч.
Thermaltake представила компактный, но вместительный корпус The Tower 250 для игровых систем на Mini-ITX 4 ч.
Флагманы Oppo Find X8 и X8 Pro на Dimensity 9400 стали доступны не только в Китае — старший оценили в €1149 5 ч.
«ВКонтакте» выросла до 88,1 млн пользователей — выручка VK взлетела на 21,4 % на рекламе 5 ч.
В Китае выпустили жидкостный кулер с 6,8-дюймовым изогнутым OLED-экраном за $137 5 ч.