Сегодня 28 мая 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ИИ показал прогресс в изучении редких и малоизвестных языков

Большие языковые модели искусственного интеллекта стали активно сокращать языковой разрыв по всему миру — самые передовые добились существенных успехов в работе с редкими языками, которые представляли сложности для предшествующих систем. Об этом сообщил TechRadar со ссылкой на исследование компании RWS.

 Источник изображения: bennett tobias / unsplash.com

Источник изображения: bennett tobias / unsplash.com

Модель Google Gemini Pro получила высокие оценки качества (выше 4,5 из 5 баллов) в знании языка киньяруанда, на котором говорят 12 млн человек в Руанде, Уганде и Демократической Республике Конго. Прогресс авторы исследования объяснили тем, что ИИ часто обращается к общим статистическим закономерностям разных языков. Передовым моделям уже не требуются огромные наборы информации для каждого языка — ограниченные объёмы обучающих данных компенсируются за счёт механизмов межъязыкового переноса. Ещё один положительный фактор — улучшения в работе токенизатора, то есть средства, которое разбивает слова из запросов на фрагменты, называемые токенами. Всё это помогает моделям ИИ качественнее работать с редкими и малоизвестными языками.

В ходе исследования эксперты обнаружили эффект «дрейфа бенчмарка», при котором возможности моделей неожиданно меняются при переходе от одной версии к другой. Так, последняя версия OpenAI GPT отстаёт от более мелких в нескольких задачах на генерацию контента, хотя её предшественница оказывалась более эффективной в тех же задачах. Эффективность токенизатора также может сильно отличаться между поколениями моделей — при работе с определёнными языками одна оказывается в 3,5 раза экономичнее другой. То есть при выборе модели для развёртывания в многоязычных приложениях полагаться на результаты тестов предыдущих систем не следует.

До недавнего времени многие лаборатории ИИ отдавали приоритет показателям производительности на английском и нескольких других основных языках мира; современные модели в значительной мере преуспели в этих областях, разработчики начинают отдавать приоритет охвату широкой аудитории, и, как ожидают эксперты, этому примеру будут следовать многие. При этом оценка в 4,5 балла из 5 не гарантирует реального уровня владения языком, и многоязычная поддержка до сих пор не стала предметом первой необходимости. Разработчики обращаются к материалам на редких языках отчасти и потому, что англоязычные источники уже исчерпаны. Но всё-таки ИИ продолжает разрушать языковые барьеры.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Первое за 11 лет дополнение к The Witcher 3: Wild Hunt будет не меньше, чем «Кровь и вино» — подробности «Баллад прошлого» 31 мин.
Миллион героев: продажи Heroes of Might & Magic: Olden Era за месяц в раннем доступе достигли впечатляющей величины 2 ч.
Пиратская градостроительная стратегия Corsair Cove получила новый трейлер, дату выхода и демоверсию в Steam 3 ч.
Activision наконец анонсировала Call of Duty: Modern Warfare 4 — первый трейлер, дата выхода и релиз на Switch 2 4 ч.
Кооператив, гильдия воров и многое другое: разработчики Heroes of Might & Magic: Olden Era раскрыли план улучшения игры в раннем доступе 6 ч.
Собственный мир дикой природы: разработчики Elite: Dangerous анонсировали амбициозный симулятор зоопарков Planet Zoo 2 6 ч.
Хакеры теперь требуют с российских компаний по 50 млн рублей за данные и молчание — а потом охотно торгуются 7 ч.
«Это просто нечто»: геймплейный трейлер метроидвании Silent Planet: Elegy of a Dying World заворожил фанатов Castlevania: Symphony of the Night 10 ч.
«Яндекс» представил Alice AI LLM Flash — быструю ИИ-модель для бизнеса 11 ч.
Инсайдеры показали обложку Call of Duty: Modern Warfare 4 и подтвердили релиз игры на Nintendo Switch 2 12 ч.
Zalman выпустила термопасту ZM-STC11 с высокой теплопроводностью и долгим сроком службы 7 мин.
Waymo начала перевозить пассажиров на новейших роботакси Ojai — пока бесплатно 32 мин.
Silicon Motion представила контроллер для SSD с PCIe 5.0, но без DRAM — он заточен под ИИ 43 мин.
Хороший понт дороже денег: вышел складной смартфон Vertu AlphaFold за $13 800 с кожей аллигатора и не новым чипом 3 ч.
В России начались продажи робота-пылесоса Roborock Saros 20 с ИИ для эффективной уборки 3 ч.
Лавры MacBook Neo не дают покоя: Acer представила первый ноутбук на Snapdragon C по «начальной цене» 4 ч.
Chuwi выпустила ноутбук CoreBook Air класса Copilot+ PC — с Intel Core Ultra и безоблачным ИИ 5 ч.
Представлено умное кольцо Oura Ring 5 за $399 — оно на 40 % компактнее и умеет следить за артериальным давлением 5 ч.
Acer представила портативную консоль Predator Atlas 8 на новых Intel Arc G3 5 ч.
Sandisk выпустит антикризисные SATA SSD объёмом до 4 Тбайт — Sandisk 320 и 520 5 ч.