Сегодня 23 июня 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Яндекс» ищет тренеров для обучения YandexGPT переводу текста с изображений, аудио- и видеофайлов

Нейросеть YandexGPT научат распознавать и переводить текст с изображений, аудио- и видеофайлов, пишут «Ведомости» со ссылкой на описание вакансии AI-тренера, опубликованной на сайте компании «Яндекс». По словам источника ресурса, близкого к «Яндексу», предполагается нанять около десятка специалистов такого профиля.

 Источник изображения: geralt/Pixabay

Источник изображения: geralt/Pixabay

Как указано в описании вакансии, в обязанности тренера входит обучение генеративной модели, создавая собственные эталонные примеры, а также оценка качества перевода и обучение нейросети распознаванию и переводу текста с изображений и видео.

В начале 2023 года «Яндекс» объявляла набор AI-тренеров для обучения моделей семейства YandexGPT, напомнил представитель компании. Но если тогда принимали на работу специалистов гуманитарного направления, умеющих работать с русскоязычными текстами, то сейчас речь идёт о специалистах, ориентирующихся в узкоспециализированных тематиках, чтобы точечно углубить знания ИИ-модели. Например, они должны разбираться в терминологии самых разных направлений — от физики до юриспруденции, сообщил представитель «Яндекса».

Гендиректор Dbrain, автор Telegram-канала AI Happens Алексей Хахунов отметил, что в машинном обучении самыми важными критерии являются чистота и качество данных. По словам Хахунова, для обучения современных моделей нужны два типа специалистов: нейролингвисты, которые знают, как работают нейросети и могут создавать современные алгоритмы — в первую очередь машинных переводов, и специалисты, в совершенстве владеющие несколькими языками, что позволяет создавать пары между различными языками.

При этом нужно делать не дословный перевод, а собирать семантически близкие виды переводов. «Одни и те же фразы по смыслу могут звучать по-разному на разных языках, и важно, чтобы переводчик опирался на глубокое понимание языка, а не на дословный перевод», — пояснил эксперт.

С ним согласился эксперт Альянса искусственного интеллекта Андрей Комиссаров, по словам которого, проблема в том, что на большом количестве языков нейросети делают дословный перевод, поскольку не ощущают тонкостей языка и не могут работать с фразеологизмами. «В данном случае речь идёт о дообучении модели. Для этого необходимо чутье языка», — отметил он.

Сейчас с переводом у нейросетей дела идут по-разному. «Если с английским языком машина более-менее справляется, то в случае с китайским, если перевести текст туда и обратно, он фактически превратится в бессвязный набор слов», — сообщил Комиссаров.

Источники:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Звезда God of War Laufey знала об игре с 2018 года — Santa Monica запланировала приключения жены Кратоса почти десять лет назад 20 мин.
Во втором трейлере GTA VI спустя больше года нашли отсылку к Томми Версетти из GTA: Vice City 2 ч.
Cloudflare и крупнейшие разработчики браузеров научат сайты отличать людей от ботов 2 ч.
Анонсирован Give Us A Sign — кооперативный хоррор про поиск призраков на чересчур «живых» локациях 3 ч.
OpenAI запустила инициативу Patch the Planet, чтобы помочь разработчикам открытого ПО в поиске ошибок 3 ч.
Блогер показал 25 минут геймплея мультиплеерного мода для The Last of Us Part II — игроки в восторге 5 ч.
«Такого никто никогда не видел»: загадочный хоррор OD будет «максимально страшным», но Кодзима придумал особую систему для пугливых игроков 5 ч.
Китайские ИИ-модели скоро станут закрытыми, предупредили эксперты 5 ч.
«Фора измеряется месяцами»: разведка Five Eyes предупредила о стремительном росте ИИ-угроз для Запада 9 ч.
AMD выпустила драйвер с поддержкой масштабирования FSR 4.1 на видеокартах Radeon RX 7000 16 ч.
Samsung уже выручила на поставках HBM4 более $1 млрд, а SK hynix начала сдерживать расширение поставок 39 мин.
Samsung показала первую смартфонную память UFS 5.0 — как не самые быстрые SSD с PCIe 5.0 42 мин.
Автономный грузовик «Яндекса» впервые совершил поездку на 700 км — не без подстраховки 47 мин.
От секретного китайского многоразового космоплана на орбите отделился загадочный объект 48 мин.
Роботы рано или поздно заменят до 700 000 курьеров китайской JD.com, заявил глава компании 51 мин.
Акции Alphabet пережили худший день более чем за год — компания разом подешевела на 5 % 54 мин.
Трамп распорядился к 2028 году построить в США мощный квантовый компьютер 2 ч.
Китайский суперкомпьютер LineShine стал самым производительным в мире и возглавил TOP500 2 ч.
Groq привлекла $650 млн на развитие своей облачной инференс-платформы 2 ч.
Micron и Anthropic анонсировали стратегическое партнёрство для масштабирования ИИ-инфраструктуры нового поколения 2 ч.