Сегодня 27 декабря 2024
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → аудиокниги

Audible протестирует поиск аудиокниг при помощи ИИ

Компания по производству аудиокниг Audible, принадлежащая Amazon, объявила о старте тестирования функции поиска на основе искусственного интеллекта, которая должна помочь пользователям существенно упростить поиск аудиокниг. Некоторым клиентам в США уже сейчас стало доступно взаимодействие с Maven, новым ИИ-экспертом по персональным рекомендациям Audible, который предлагает аудиокниги на основе запросов пользователей.

 Источник изображений: Audible

Источник изображений: Audible

При поиске пользователь может использовать естественный язык для ввода запросов, а Maven предоставит индивидуальные рекомендации, основываясь на каталоге Audible, насчитывающем почти миллион наименований книжной продукции.

ИИ-поиск Maven станет доступен на устройствах iOS и Android. Почти половина клиентов Audible в США получат доступ к этой функции, независимо от тарифного плана. В настоящее время, по словам компании, область поиска ограничена «подмножеством» её библиотеки аудиокниг. В дальнейшем Audible планирует развивать и совершенствовать новый инструмент поиска.

Audible не конкретизировала, какие модели ИИ были использованы при разработке системы поиска Maven. Представитель компании отметил, что Maven использует «сильные стороны нескольких моделей» и будет «постоянно оценивать» их по мере совершенствования.

Наряду с объявлением о запуске Maven, Audible сообщила, что также экспериментирует с «Коллекциями», курируемыми ИИ, и обзорами, созданными ИИ. «Коллекции» Audible примечательны тем, что могут стать ответом Audible на плейлисты Spotify, созданные при помощи ИИ.

Ранее негативную реакцию со стороны актёров и других творческих личностей вызвало сообщение, что по состоянию на май 2024 года более 40 000 книг в библиотеке Audible были озвучены ИИ. На сегодняшний день их количество, вероятно, заметно увеличилось.

В России набирает популярность озвучивание аудиокниг с помощью ИИ

По сообщениям сетевых источников, российские книжные сервисы и издательства активно используют алгоритмы на базе искусственного интеллекта для озвучивания аудиокниг. Предполагается, что такие алгоритмы позволят существенно ускорить и удешевить производство контента в этом сегменте. Однако на данном этапе эта технология не может полностью заменить человека и подходит не для всех типов литературы.

 Источник изображения: 4system / Pixabay

Источник изображения: 4system / Pixabay

По данным источника, принадлежащий МТС книжный сервис «Строки» в этом году планирует озвучить свыше 10 тыс. произведений с помощью алгоритма, созданного специалистами подразделения MTS AI. В настоящее время в работе находятся 600 произведений. Запись книг будет осуществляться с помощью платформы Audiogram, которая построена на основе нейросетей, машинного обучения и технологии обработки естественного языка. С её помощью можно синтезировать речь, расставляя ударения и паузы, а также воспроизводить вопросительные побудительные и другие интонации.

Лидер отечественного рынка аудиокниг в лице ГК «ЛитРес» (сервисы «ЛитРес», MyBook, LiveLib и др.) также развивает направление, связанное с озвучиванием книг с помощью нейросетей. «Такую озвучку мы запустили ещё осенью 2020 года, но активно использовать начали осенью 2022 года. Она основана на технологии распознавания и синтеза речи SpeechKit, на которой работает голосовой помощник «Алиса», — рассказал директор департамента по развитию контента ГК «ЛитРес» Евгений Селиванов.

По данным «Яндекса», в 2022 году с помощью технологии SpeechKit было озвучено свыше 100 тыс. часов аудиокниг. «ЛитРес» в прошлом году записал и выпустил около 6 тыс. книг, озвученных «живыми» голосами, тогда как использование ИИ-алгоритма позволило озвучить 3 тыс. произведений всего за два месяца. Отмечается, что себестоимость озвучивания одной книги с помощью ИИ составляет всего 400-700 рублей.

В МТС отметили, что в настоящее время более 90 % книг на российском рынке не имеют аудиоверсий, а их трансформация в аудиоформат традиционным способом заняла бы годы. В то же время для создания первоначальной версии аудиокниги с помощью ИИ-алгоритма требуется 30-60 минут. Для сравнения, запись живым голосом занимает до нескольких дней с учётом технической обработки и монтажа. При этом расходы на озвучивание одной единицы контента снижаются примерно в десять раз.

Apple начала продавать аудиокниги, озвученные нейросетью

Стало известно, что в сервисе Apple Books появились аудиокниги, которые были озвучены с помощью специального алгоритма на базе искусственного интеллекта. Очевидно, за счёт этого компания планирует не только сократить расходы на оплату работы дикторов и рассказчиков, но и существенно ускорить процесс создания аудиокниг.

 Источник изображений: Samuel Axon / ArsTechnica

Источник изображений: Samuel Axon / ArsTechnica

На данный момент в библиотеке Apple присутствует всего несколько книг, озвученных нейросетью, но в будущем их может стать больше. Каждая такая книга в описании имеет соответствующую пометку, в которой сказано, что произведение озвучено «цифровым голосом». Отмечается, что озвученные нейросетью аудиокниги мало чем уступают более привычным, в которых озвучкой занимались люди. Однако в некоторых местах повествования можно заметить отрывки со странным произношением или отсутствием эмоций в голосе.

По данным источника, за последние несколько месяцев Apple контактировала с разными независимыми книжными издателями, предлагая взять на себя расходы по созданию аудиокниг и обещая платить авторам отчисления с продаж. Не все издатели согласились сотрудничать с Apple, но, вероятно, в дальнейшем IT-гигант продолжит расширять библиотеку аудиокниг на своей платформе, поскольку они пользуются большой популярностью. Отметим также, что Apple, скорее всего, будет не единственной компанией, использующей нейросеть для создания аудиокниг. В прошлом Google и Amazon, являющиеся крупными поставщиками электронных и аудиокниг, также не исключали такую возможность.


window-new
Soft
Hard
Тренды 🔥
В Windows 11 обнаружена ошибка, которая мешает установке обновления безопасности 5 ч.
Разработчики Assetto Corsa Evo подтвердили, с каким контентом игра выйдет на старт раннего доступа и чего ждать от полноценного релиза 11 ч.
Российский аниме-хоррор MiSide внезапно оказался хитом Steam — восторженные отзывы игроков, сотни тысяч проданных копий 12 ч.
Киберпанковый слешер Ghostrunner 2 стал новой бесплатной игрой в Epic Games Store — раздача доступна в России и продлится всего 24 часа 14 ч.
Activision сыграет в кальмара: новый трейлер раскрыл, когда в Call of Duty: Black Ops 6 стартует кроссовер со Squid Game 2 15 ч.
«К чёрту Embracer Group»: неизвестный устроил утечку исходного кода Saints Row IV 16 ч.
Отечественная платформа Tantor повысит производительность и удобство работы с СУБД на базе PostgreSQL 19 ч.
В Steam вышла новая демоверсия голливудской стратегии Hollywood Animal от авторов This is the Police 19 ч.
IT-холдинг Т1 подал иск к «Марвел-Дистрибуции» в связи с уходом Fortinet из России 20 ч.
Рождественское чудо: в открытый доступ выложили документы Rockstar начала 2000-х, включая планы на GTA Online от 2001 года 20 ч.
AWS будет меньше полагаться на ZT Systems, которую купила AMD 2 ч.
Новая статья: Обзор смартфона HUAWEI nova Y72s: у меня тоже есть новая кнопка! 8 ч.
Япония пустила «антиковидные» фонды на создание производства 2-нм чипов, и не всем это понравилось 9 ч.
Новая статья: Обзор игрового QD-Mini-LED 4K-монитора Acer Predator X32Q FS: вся сила в подсветке! 10 ч.
NASA поручило частным компания обеспечить связь в радиусе 2 млн км от Земли 13 ч.
Китайский автопроизводитель GAC представил гуманоидного робота GoMate с 38 степенями свободы 14 ч.
Главный конкурент Tesla запустил разработку человекоподобных роботов 14 ч.
Omdia: быстрый рост спроса на TPU Google ставит под вопрос доминирование NVIDIA на рынке ИИ-ускорителей 16 ч.
Российскую игровую приставку собрались построить на процессоре «Эльбрус», для которого не существует игр 16 ч.
Equinix предложил ИИ-фабрики на базе систем Dell с ускорителями NVIDIA 17 ч.