Сегодня 10 января 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Гарри Поттер оказался излюбленным персонажем для экспериментов в области ИИ

Спустя более двадцати лет после того, как Джоан Роулинг (Joanne Rowling) открыла миру волшебную вселенную, главный персонаж её книг, Гарри Поттер (Harry Potter) обрёл новую актуальность в совершенно иной области — области исследований искусственного интеллекта. На это обращает внимание Bloomberg.

 Источник изображений: wizardingworld.com

Источник изображений: wizardingworld.com

Бестселлеры о Гарри Поттере всё чаще используются для экспериментов с технологиями ИИ из-за непреходящего влияния серии на массовую культуру, широкого спектра языковых данных и сложной игры слов на страницах книг. Список исследований и научных статей, ссылающихся на Гарри Поттера, даёт представление о передовых проектах в области ИИ и некоторых сложнейших вопросах, стоящих перед этой областью.

В научной статье «Кто такой Гарри Поттер?» описывается методика, помогающая большим языковым моделям выборочно забывать информацию. Это важная задача для области ИИ: большие языковые модели обучаются на огромных массивах онлайн-данных, включая защищённые авторским правом материалы и прочий проблемный контент — в результате на разработчиков этих систем всё чаще подают в суд, а их работы привлекают всё более пристальное внимание общественности. Авторы статьи, сотрудники Microsoft Марк Руссинович (Mark Russinovich) и Ронен Элдан (Ronen Eldan), продемонстрировали, что ИИ-модели можно изменять, удаляя любую информацию о существовании книг о Гарри Поттере, включая персонажей и сюжеты, не жертвуя при этом творческими и аналитическими способностями системы. Учёные говорят, что выбрали книги о юном волшебнике из-за их известности — об элементах сюжета и персонажах знают даже те, кто их не читал.

Схожие вопросы поднимают в своём исследовании (PDF) учёные Вашингтонского университета в Сиэтле, Калифорнийского университета в Беркли и Института искусственного интеллекта Аллена. Они разработали языковую модель Silo, в которой поддерживается удаление данных для снижения юридических рисков. Исследователи обращают внимание, что если исключить из обучающего массива защищённые авторским правом материалы и правительственные документы, и оставить только тексты с низким уровнем риска, то производительность модели снижается. Удаляя книги о Гарри Поттере из обучающих массивов, они обнаружили повышение перплексии — коэффициента неопределённости, на основе которой оценивается качество языковой модели: чем он ниже, тем более качественный результат выдаёт ИИ.

Исследователи ИИ цитируют Гарри Поттера не менее десяти лет, и сегодня книги о нём упоминаются в работах всё чаще, поскольку и учёные, и технологии всё больше сосредоточены на инструментах ИИ, помогающих в обработке естественного языка и механизмов реакции на него. Присутствующее в книгах о Гарри Поттере «обилие сцен, диалогов, эмоциональных моментов делает его очень актуальным для конкретной области обработки естественного языка», отметила исследователь университета Карнеги Меллона Лейла Вебе (Leila Wehbe), которая в 2014 году провела серию экспериментов, собирая данные МРТ у читающих книги о юном волшебнике людей, чтобы глубже изучить языковые механизмы.

Поиск на открытом портале arXiv.org среди недавних публикаций показывает такие наименования статей как «Машинное обучение при создании зелий в Хогвартсе», «Гарри Поттер и большие языковые модели», а также «Обнаружение заклинаний в фентезийной литературе с помощью искусственного интеллекта на основе [архитектуры] трансформера». В некоторых проектах Гарри Поттер хотя и не оказывается центральным объектом исследования, но остаётся любимым литературным персонажем учёных. В одном из исследований книги Роулинг используются для оценки уровня интеллекта ИИ-систем. А, по мнению Терренса Сейновски (Terrence Sejnowski), руководителя лаборатории вычислительной нейробиологии при Институте биологических исследований Солка, чат-боты просто отражают интеллект и предубеждения своих пользователей, как «Зеркало Еиналеж» из первой книги о Гарри Поттере, которое показывало самые сокровенные желания каждому, кто в него смотрел. «Гарри Поттер популярен среди молодых исследователей. Они читали их [эти книги] в детстве или в юности, вот и выбирают их в качестве письменных или устных массивов текста», — заключила доцент Вебе.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Telegram передал властям США данные тысяч пользователей после задержания Дурова во Франции 25 мин.
Новая студия ветерана Halo и Destiny осталась без китайского финансирования — первая игра на паузе, будущее под вопросом 2 ч.
Assassin’s Creed Shadows скрылась от февральских конкурентов — Ubisoft опять перенесла релиз игры 3 ч.
На Пхукете туристам разрешили платить криптовалютой за товары и услуги 5 ч.
Square Enix показала трейлер ПК-версии Final Fantasy VII Rebirth и объявила системные требования для игры в 4K и 60 FPS 6 ч.
xAI выпустил самостоятельное приложение для фривольного ИИ-бота Grok — пока в тестовом режиме и только на iOS 6 ч.
«В этом была бы трагедия Дженсена»: бывший сценарист Eidos Montreal рассказал, каким могло стать продолжение Deus Ex: Mankind Divided 7 ч.
Microsoft подтвердила презентацию Developer_Direct — Doom: The Dark Ages, игра-сюрприз и не только 7 ч.
Медиаплеер VLC получил ИИ-генератор субтитров с переводом на более чем 100 языков — он работает оффлайн 7 ч.
Meta освободила от стандартной модерации рекламодателей, которые приносят больше всех денег 9 ч.
Новая статья: Итоги 2024 года: смартфоны 9 мин.
DJI представила сверхлёгкие экшен-камеры O4 Air для дронов — трансляция видео в 4K на расстояние до 15 км с задержкой 15 мс 4 ч.
Astrohaus представила клавиатуру Freewrite Wordrunner со счётчиком слов и механическим таймером 5 ч.
PowerColor показала свои Radeon RX 9070 XT и RX 9070 в версиях Red Devil, Hellhound и Reaper 5 ч.
Xpeng Aero HT представила на CES 2025 модульный летающий автомобиль Land Aircraft Carrier, который стоит меньше $300 000 5 ч.
Мощнейший в истории гамма-всплеск может пролить свет на новую физику — аксионы и тайну тёмной материи 5 ч.
Lenovo обновила профессиональные мониторы ThinkVision: от 27 до 34 дюймов, QHD или WQHD и 120 Гц 6 ч.
Zotac показала прототип портативной игровой консоли Zone Gaming на чипе AMD Ryzen AI 9 HX 370 7 ч.
SoftBank и Arm заинтересовались покупкой Ampere, но о переговорах говорить рано 7 ч.
Palit представила компактный ИИ-компьютер Pandora на базе Nvidia Jetson Orin NX Super 7 ч.