Сегодня 24 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → распознавание речи

«Т-Банк» выпустил ИИ-модель распознавания речи с открытым исходным кодом — T-one

Российская группа компаний «Т-Технологии», владеющая «Т-Банком», опубликовала собственную ИИ-модель распознавания речи с открытым исходным кодом. Речевая модель под названием T-one обещает новый уровень качества распознавания, по словам её разработчиков. Также обещаются прорывные решения, такие как распознавание речи в реальном времени, передаёт Forbes.

 Источник изображения: «Т-Технологии»

Источник изображения: «Т-Технологии»

Более подробно о T-one представители «Т-Технологий» рассказали 19 июля в Москве на Второй конференции по машинному обучению Turbo ML. А на официальном ресурсе компании на платформе GitHub объясняется, что T-one — это высокопроизводительная система автоматического распознавания речи (ASR) с акцентом на распознавание русского языка в телефонии. Кстати, на GitHub она уже доступна для скачивания. Также её можно загрузить с Hugging Face. Для разработчиков приведены инструкции по развёртыванию системы.

T-one — модель относительно небольшая, около 70 млн параметров. Для сравнения, речевая модель компании GigaAM от «Сбера» состоит из 240 млн параметров, а модель Whisper large-v3 от OpenAI — из 1,55 млрд. Однако, по утверждениям разработчиков T-One, это не мешает последней обгонять именитых конкурентов именно в распознавании русской речи в телефонных разговорах, под что она «заточена».

«Т-Технологии» позиционируют свою разработку как для бизнеса, так и для научного сообщества. Второму она будет интересна низкой стоимостью: эксплуатация на собственном сервере должна быть в десятки раз дешевле конкурирующих решений от облачных провайдеров. T-one хорошо адаптируется под нужды конкретной компании и разработку собственных решений.

«Это могут быть компании, разрабатывающие голосовых роботов и ассистентов, занимающиеся автоматизацией кол-центров, — пояснили представители «Т-Технологий» на конференции Turbo ML. — Они могут взять за основу эту модель и адаптировать её под свои решения. Это позволит сократить ресурсы на разработку с нуля».

Meta✴ в партнёрстве с ЮНЕСКО запускает новую программу сбора данных для улучшения речи и перевода ИИ

LTPP (Language Technology Partner Program — партнёрская программа по языковым технологиям) — совместная инициатива ЮНЕСКО и Meta✴ по поиску авторов, которые могут предоставить более 10 часов записей речи с транскрипциями, большие объёмы письменного текста и наборы переведённых текстов на разных языках. В дальнейшем эти данные будут интегрированы в ИИ-модели с открытым исходным кодом для распознавания речи и перевода.

 Источник изображения: dailysabah.com

Источник изображения: UNESCO

Усилия LTPP будут сосредоточены на недостаточно обслуживаемых языках для поддержки работы, уже проводимой в этом направлении ЮНЕСКО. «В конечном итоге наша цель — создать интеллектуальные системы, которые могут понимать и реагировать на сложные потребности человека, независимо от языка или культурного происхождения», — заявил представитель Meta✴.

В дополнение к новой инициативе Meta✴ опубликовала открытый исходный код программы для оценки производительности моделей языкового перевода. Тест, состоящий из предложений, созданных лингвистами, поддерживает семь языков, и доступен на платформе разработки ИИ Hugging Face.

Meta✴ продолжает расширять количество языков, поддерживаемых её ИИ-моделями и развивать функции автоматического перевода для создателей контента. В сентябре прошлого года компания начала тестирование инструмента для перевода голосов в Instagram✴ Reels, который дублирует речь создателя на другом языке с автоматическим липсинком.

На сегодняшний день обработка на платформах Meta✴ контента на языках, отличных от английского, далека от совершенства. По некоторым данным, в соцсети Facebook✴ 79 % дезинформации о COVID на итальянском и испанском языках не были распознаны и отмечены системой, по сравнению с 29 % на английском языке. А сообщения на арабском языке, наоборот, часто ошибочно помечаются как разжигающие ненависть.

Meta✴ заявила, что принимает меры по улучшению своих технологий перевода и модерации. И, хотя компания позиционирует обе свои языковые инициативы как филантропические, нет никаких сомнений, что главным бенефициаром этих программ станет именно Meta✴, которая сможет существенно улучшить качество распознавания речи и перевода.


window-new
Soft
Hard
Тренды 🔥
Установка российских приложений на Android может усложниться из-за обязательной верификации Google 8 мин.
ИИ уже участвует в каждом шестом взломе в мире — и тенденция усиливается 59 мин.
«Яндекс» представил ИИ-ассистента «Алиса AI Про» для бизнеса 2 ч.
Yandex B2B Tech расширила экосистему сервисов для бизнеса 3 ч.
В Африке создали компактную LLM, которая обошла более крупные модели Google и Meta — Morena знает 12 местных языков 3 ч.
Bethesda не убьёт «творческую идентичность» Obsidian после присоединения — разработчики Fallout: New Vegas не станут командой поддержки 4 ч.
Microsoft помогла нейтрализовать популярный фишинговый сервис EvilTokens 5 ч.
Canonical ускорила выпуск обновлений Ubuntu — ИИ выявляет слишком много уязвимостей 5 ч.
«Больше похож на новую игру, чем на ремейк»: обзорный геймплейный трейлер Rayman Legends Retold впечатлил фанатов классического платформера 5 ч.
Альтман и другие лидеры ИИ-индустрии предупредили Совбез ООН: ИИ может стать угрозой для человечества 5 ч.
Дорогая память пока не помешала Raspberry Pi — выручка взлетела на 90 %, прибыль более чем удвоилась 22 мин.
Maibenben выпустила в России игровые ноутбуки X-Treme X17F Typhoon и Tornado с чипами AMD Zen 4 по цене от 122 тыс. рублей 52 мин.
Как в «Семейке Аддамс»: швейцарские инженеры разработали кисть руки, которая сама передвигается и нажимает кнопки 2 ч.
ASM решила проблему герметизации и обработки 3D-чипов — теперь это будет быстрее и дешевле 3 ч.
Крупнейшая компания Европы не продаёт ничего в Европе — зато Китай и Индия зовут ASML строить у них заводы 3 ч.
Четыре ядра, DDR5 и PCIe 4.0: дебютировали китайские чипы Hygon 1000 для встраиваемых систем 4 ч.
Немцы научились «по фотографии» измерять характеристики солнечных панелей — экспресс-диагностика выйдет на новый уровень 4 ч.
ДНК вместо традиционной памяти: AtlasBase представила платформу для хранения и вычислений 4 ч.
Alibaba Cloud расширяет присутствие в Европе — на очереди открытие ЦОД в Финляндии, Нидерландах и Турции 5 ч.
Атомные часы побили рекорд точности — на сцену вышел тяжёлый лютеций 5 ч.