Сегодня 18 августа 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Meta✴ научила ИИ-модель SeamlessM4T переводить текст и речь быстрее и естественнее

Meta обновила свою ИИ-модель SeamlessM4T, предназначенную для перевода речи и текста. Теперь платформа поддерживает переводы почти на 100 языках, включая русский, в текстовом формате и на 36 — в устной речи. С новой архитектурой решения технологический гигант стремится сделать перевод более естественным и выразительным, что обещает стать прорывом в коммуникациях между людьми и производстве контента.

 Источник изображения: ***

Источник изображения: Meta

Meta построила SeamlessM4T на основе своей архитектуры многофункциональной модели UnitY на базе PyTorch, которая выполняет различные модальные переводы, а также автоматическое распознавание речи. Она использует систему BERT 2.0 для аудиокодирования, разбивая входные данные на составляющие токены для анализа, и HiFi-GAN unit vocoder для генерации голосовых ответов.

Первая из двух новых функций SeamlessM4T называется SeamlessExpressive. Как можно понять из названия, она переносит эмоциональные интонации голоса в переведённую речь. Система учитывает такие составляющие, как тон речи, её громкость, эмоциональный окрас (возбуждение, печаль или шёпот), темп речи и паузы. Всё это делает переводы менее механическими и более живыми. Поддерживаются английский, испанский, немецкий, французский, итальянский и китайский языки.

Вторая функция, SeamlessStreaming, начинает переводить речь, пока говорящий ещё не закончил предложение, что позволяет другим слушателям быстрее услышать перевод. Задержка составляет чуть менее двух секунд. По словам Meta, основной трудностью здесь было различие в структуре предложений разных языков, поэтому был разработан специальный алгоритм, который анализирует неполные аудиофрагменты и решает, достаточно ли контекста для начала генерации перевода или стоит ещё послушать говорящего.

Как и большинство предыдущих разработок Meta в области машинного перевода, будь то Llama 2, Massively Multilingual Speech (MMS), Universal Speech Translator (UST) или амбициозный проект No Language Left Behind (NLLB), SeamlessM4T находится в открытом доступе на GitHub. «Мы считаем, что SeamlessM4T является важным прорывом в стремлении сообщества ИИ к созданию универсальных многофункциональных систем», — написала команда исследователей.

Развитие компанией Meta ИИ-технологий перевода с различных языков открывает новые перспективы в области межъязыкового общения. Эти инновации могут значительно превзойти существующие решения, такие как инструменты перевода, разработанные компаниями Google и Samsung. Пока нет точной информации о сроках внедрения Meta этих функций, но их потенциальное применение, например, в умных очках Meta, обещает сделать их незаменимыми в повседневной жизни и профессиональной сфере.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Assassin’s Creed Shadows стала самой продаваемой новой игрой 2025 года в Европе, опередив Monster Hunter Wilds и Kingdom Come: Deliverance 2 22 мин.
Курс биткоина упал до $115 000 после нового рекорда на прошлой неделе 27 мин.
Чат-бот Claude AI станет прекращать «вредоносные или оскорбительные диалоги с пользователями» 3 ч.
Таиланд разрешит иностранным туристам обменивать криптовалюту на баты уже к концу года 3 ч.
Полностью отключить обновление приложений в Microsoft Store больше не получится 3 ч.
«Более яркая, отзывчивая и доступная, чем когда-либо»: культовое приключение Shenmue 3 выйдет на новых платформах в улучшенном виде 3 ч.
Microsoft наконец улучшила тёмный режим в Windows 11, но до идеала ещё далеко 3 ч.
Научно-фантастическое выживание StarRupture от создателей Green Hell отправит игроков на планету кошмарных катастроф — ранний доступ откладывается 4 ч.
Олдскульный хоррор Caput Mortum покажет, каково 30 лет назад было играть в King's Field — геймплейный трейлер раскрыл дату выхода 9 ч.
Rutube — главный бенефициар замедления YouTube: аудитория российского сервиса выросла более чем вдвое в этом году 11 ч.
Представлен смартфон Honor X7c 5G с чипом Snapdragon 4 Gen 2 и 50-Мп камерой за $170 4 мин.
Steam Deck и подобные портативные ПК набирают популярность — продажи вырастут на 32 % в этом году 7 мин.
Apple теряет американский рынок смартфонов два квартала подряд — её долю захватывает Samsung 16 мин.
Умные очки Meta Hypernova с экраном будут стоить гораздо дешевле, чем предполагалось 3 ч.
Samsung представила беспроводные наушники Galaxy Buds3 FE с активным шумоподавлением, классическим дизайном и Galaxy AI за $149 6 ч.
Китайская HKC выпустила первый в мире игровой монитор с частотой обновления 750 Гц 6 ч.
В Apple готовятся к волне увольнений топ-менеджеров, но Тим Кук останется гендиром 7 ч.
OpenAI намерена потратить триллионы долларов на ИИ-инфраструктуру, но для начала их надо где-то найти 8 ч.
BYD построила «Автомобильный Диснейленд» — за $280 можно поплавать на внедорожнике и погонять на гиперкаре 8 ч.
AAEON представила вычислительные модули на IoT-платформе MediaTek Genio 9 ч.