Сегодня 25 апреля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Xiaomi представила ИИ-модели MiMo V2.5 для преобразования текста в речь и обратно

Xiaomi представила две модели искусственного интеллекта, предназначенные для работы с голосом. MiMo-V2.5-TTS позволяет преобразовывать текст в речь, предлагая широкие возможности настройки с минимальными усилиями; MiMo-V2.5-ASR — напротив, создаёт текстовые расшифровки по звуку речи и пения.

 Источник изображения: Xiaomi

Источник изображения: Xiaomi

Семейство Xiaomi MiMo-V2.5-TTS включает три модели, которые какое-то время будут доступны бесплатно на платформе Xiaomi MiMo Studio. Базовая MiMo-V2.5-TTS позволяет преобразовывать текст в речь с минимальными возможностями: есть набор предустановленных голосов, а также функции настройки скорости речи, тона и эмоционального окраса. MiMo-V2.5-TTS-VoiceDesign позволяет создавать новые тембры голоса, используя короткую фразу. MiMo-V2.5-TTS-VoiceClone, как можно догадаться по названию, предназначена для воспроизведения определённого голоса по небольшому набору образцов, сохраняя согласованность по стилям и инструкциям.

Чтобы добиться нужного результата, пользователь может разметить текст заданными тегами или поступить проще — простым естественным языком описать, как должен звучать голос. Можно даже составить сценарий для виртуальных постановок с несколькими голосами сразу. Поддерживаются инструкции на китайском и английском языках.

Открытая модель Xiaomi MiMo-V2.5-ASR предназначена для распознавания устной речи даже в сложных условиях. Она поддерживает несколько китайских диалектов и английский язык, может создавать расшифровки двуязычных диалогов, даже записывать тексты песен, разбирая вокал, который звучит вместе с музыкой, а также распознавать речь в условиях сильного постороннего шума. Важным достоинством Xiaomi MiMo-V2.5-ASR является поддержка пунктуации — знаки препинания расставляются на основе интонаций. Это значит, что для готовой расшифровки достаточно минимальных усилий по редактированию.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Google инвестирует в Anthropic $40 млрд и предоставит 5 ГВт вычислительных мощностей на фоне обострившейся ИИ-гонки 6 ч.
Новая статья: Mouse: P.I. For Hire — чёрно-белый Doom с мышами. Рецензия 12 ч.
ОАЭ намерены перевести половину госсектора под управление агентного ИИ за два года 14 ч.
«Открыла новую главу для корейских игр»: Crimson Desert заслужила уважение премьер-министра Южной Кореи 15 ч.
Режиссёр Resident Evil Requiem засветил продажи игры на фотографии с корпоратива Capcom 16 ч.
Вопреки опасениям фанатов, в Assassin’s Creed Black Flag Resynced всё-таки будет кровь и «даже не в виде платного DLC» 17 ч.
«Готическая версия Returnal»: трейлер хоррор-шутера Luna Abyss с датой релиза вызвал у игроков конкретные ассоциации 18 ч.
«Очень рады и до сих пор ошеломлены»: продажи Clair Obscur: Expedition 33 к первой годовщине превысили 8 миллионов копий 19 ч.
«Яндекс» стал сообщать пользователям, когда их близким звонят мошенники 19 ч.
Три главных коллекционера Steam собрали на аккаунте более 40 000 игр каждый 19 ч.
Электрощит с ИИ-сервером: SPAN анонсировала «распределённый ЦОД» XFRA 45 мин.
ИИ поставил человекоподобных роботов на коньки — такого хоккея мы от них не ждали 2 ч.
США призвали всех активнее бороться с дистилляцией американских ИИ-моделей китайцами 4 ч.
Акции Intel взлетели в цене почти на четверть и потянули за собой конкурентов — Nvidia теперь стоит $5 трлн 5 ч.
Илон Маск в очередной раз сообщил о запуске производства беспилотного такси Tesla Cybercab 6 ч.
А король-то голый: VDURA уверена, что SSD не вытеснят HDD из ЦОД 12 ч.
Digma Pro представил офисные IPS-мониторы Motion — 23,8 и 27 дюймов, до QHD и 144 Гц 13 ч.
Физики создали принципиально новую камеру для охоты на нейтрино и тёмную материю 14 ч.
«Они заржавели»: модули лунной орбитальной станции NASA Lunar Gateway пришли в негодность ещё на Земле 14 ч.
CPU нужны всем, особенно ИИ: Intel шестой квартал подряд бьёт прогнозы по выручке 15 ч.