Сегодня 24 апреля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Xiaomi представила ИИ-модели MiMo V2.5 для преобразования текста в речь и обратно

Xiaomi представила две модели искусственного интеллекта, предназначенные для работы с голосом. MiMo-V2.5-TTS позволяет преобразовывать текст в речь, предлагая широкие возможности настройки с минимальными усилиями; MiMo-V2.5-ASR — напротив, создаёт текстовые расшифровки по звуку речи и пения.

 Источник изображения: Xiaomi

Источник изображения: Xiaomi

Семейство Xiaomi MiMo-V2.5-TTS включает три модели, которые какое-то время будут доступны бесплатно на платформе Xiaomi MiMo Studio. Базовая MiMo-V2.5-TTS позволяет преобразовывать текст в речь с минимальными возможностями: есть набор предустановленных голосов, а также функции настройки скорости речи, тона и эмоционального окраса. MiMo-V2.5-TTS-VoiceDesign позволяет создавать новые тембры голоса, используя короткую фразу. MiMo-V2.5-TTS-VoiceClone, как можно догадаться по названию, предназначена для воспроизведения определённого голоса по небольшому набору образцов, сохраняя согласованность по стилям и инструкциям.

Чтобы добиться нужного результата, пользователь может разметить текст заданными тегами или поступить проще — простым естественным языком описать, как должен звучать голос. Можно даже составить сценарий для виртуальных постановок с несколькими голосами сразу. Поддерживаются инструкции на китайском и английском языках.

Открытая модель Xiaomi MiMo-V2.5-ASR предназначена для распознавания устной речи даже в сложных условиях. Она поддерживает несколько китайских диалектов и английский язык, может создавать расшифровки двуязычных диалогов, даже записывать тексты песен, разбирая вокал, который звучит вместе с музыкой, а также распознавать речь в условиях сильного постороннего шума. Важным достоинством Xiaomi MiMo-V2.5-ASR является поддержка пунктуации — знаки препинания расставляются на основе интонаций. Это значит, что для готовой расшифровки достаточно минимальных усилий по редактированию.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Китаец разработал универсальный ключ для взлома электромобильных зарядок и не только 23 мин.
Люди боятся ИИ, но разработчикам это безразлично — гражданам всё равно придётся осваивать технологии 41 мин.
ИИ-модель Qwen массово встроят в китайские автомобили — водители смогут голосом заказывать еду и бронировать отели 44 мин.
Босс Google Cloud: генеративный ИИ уже в ответе за ваши любимые игры, просто вы об этом не знаете 46 мин.
США обвинили Китай в краже ИИ-технологий в «промышленных масштабах» — тот назвал это клеветой 2 ч.
«Ещё один шаг к мировому господству Housemarque»: критики вынесли вердикт амбициозному боевику Saros от создателей Returnal 3 ч.
Microsoft запускает «мягкие» сокращения: 7 % сотрудников досрочно отправят на пенсию 3 ч.
Представлена DeepSeek V4 — открытая ИИ-модель, которая потягается с лучшими решениями OpenAI и Google 3 ч.
Xiaomi представила ИИ-модели MiMo V2.5 для преобразования текста в речь и обратно 4 ч.
Пламенный двухмерный боевик Nocturnal стал временно бесплатным в Steam — раздача доступна и в России 5 ч.
Intel похвалилась снижением брака по техпроцессам Intel 4, 3 и 18A 35 мин.
Камеры Canon подорожают из-за бума ИИ — до производителя дотянулся кризис памяти, затраты подскочили 37 мин.
Geely выпустит на дороги несколько тысяч роботакси Caocao Eva Cab в следующем году 41 мин.
На Солнце зафиксирована вспышка экстремального класса — вторая по мощности с начала года 2 ч.
Tesla готовит новую версию бортового компьютера для автопилота — с удвоенным объёмом памяти 2 ч.
Зарубежный трафик в российских сетях вырос на 15–20 %, вопреки прогнозам о спаде 2 ч.
В следующем десятилетии люди начнут жить и работать на Луне, пообещал глава стартапа Voyager Technologies 3 ч.
Intel заявила, что без оптимизаций игры теряют до 30 % производительности 3 ч.
Tesla развернула ИИ-кластер Cortex 2 на территории Gigafactory в Техасе 3 ч.
Гибридная СХД TrueNAS V160 обеспечивает пропускную способность до 60 Гбайт/с 4 ч.