Сегодня 27 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Meta✴ показала ИИ для метавселенной и создала альтернативу традиционным большим языковым моделям

Meta доложила о результатах последних исследований в области искусственного интеллекта в рамках проектов FAIR (Fundamental AI Research). Специалисты компании разработали модель ИИ, которая отвечает за правдоподобные движения у виртуальных персонажей; модель, которая оперирует не токенами — языковыми единицами, — а понятиями; и многое другое.

 Источник изображения: Google DeepMind / unsplash.com

Источник изображения: Google DeepMind / unsplash.com

Модель Meta Motivo управляет движениями виртуальных человекоподобных персонажей при выполнении сложных задач. Она была обучена с подкреплением на неразмеченном массиве с данными о движениях человеческого тела — эта система сможет использоваться в качестве вспомогательной при проектировании движений и положений тела персонажей. «Meta Motivo способна решать широкий спектр задач управления всем телом, в том числе отслеживание движения, принятие целевой позы <..> без какой-либо дополнительной подготовки или планирования», — рассказали в компании.

Важным достижением стало создание большой понятийной модели (Large Concept Model или LCM) — альтернативы традиционным большим языковым моделям. Исследователи Meta обратили внимание, что современные передовые системы ИИ работают на уровне токенов — языковых единиц, обычно представляющих фрагмент слова, но не демонстрируют явных иерархических рассуждений. В LCM механизм рассуждения отделён от языкового представления — схожим образом человек сначала формирует последовательность понятий, после чего облекает её в словесную форму. Так, при проведении серии презентаций на одну тему у докладчика уже есть сформированная серия понятий, но формулировки в речи могут меняться от одного мероприятия к другому.

При формировании ответа за запрос LCM предсказывает последовательность не токенов, а представленных полными предложениями понятий в мультимодальном и многоязычном пространстве. По мере увеличения контекста на вводе архитектура LCM, по мнению разработчиков, представляется более эффективной на вычислительном уровне. На практике эта работа поможет повысить качество работы языковых моделей с любой модальностью, то есть форматом данных, или при выводе ответов на любом языке.

 Источник изображения: ***

Источник изображения: Meta

Механизм Meta Dynamic Byte Latent Transformer также предлагает альтернативу языковым токенам, но не посредством их расширения до понятий, а, напротив, путём формирования иерархической модели на уровне байтов. Это, по словам разработчиков, повышает эффективность при работе с длинными последовательностями при обучении и запуске моделей. Вспомогательный инструмент Meta Explore Theory-of-Mind предназначается для привития навыков социального интеллекта моделям ИИ при их обучении, для оценки эффективности моделей в этих задачах и для тонкой настройки уже обученных систем ИИ. Meta Explore Theory-of-Mind не ограничивается заданным диапазоном взаимодействий, а генерирует собственные сценарии.

Технология Meta Memory Layers at Scale направлена на оптимизацию механизмов фактической памяти у больших языковых моделей. По мере увеличения числа параметров у моделей работа с фактической памятью требует всё больших ресурсов, и новый механизм направлен на их экономию. Проект Meta Image Diversity Modeling, который реализуется с привлечением сторонних экспертов, направлен на повышение приоритета генерируемых ИИ изображений, которые более точно соответствуют объектам реального мира; он также способствует повышению безопасности и ответственности разработчиков при создании картинок с помощью ИИ.

Модель Meta CLIP 1.2 — новый вариант системы, предназначенной для установки связи между текстовыми и визуальными данными. Она используется в том числе и для обучения других моделей ИИ. Инструмент Meta Video Seal предназначен для создания водяных знаков на видеороликах, генерируемых при помощи ИИ — эта маркировка незаметна при просмотре видео невооружённым глазом, но может обнаруживаться, чтобы определить происхождение видео. Водяной знак сохраняется при редактировании, включая наложение эффекта размытия, и при кодировании с использованием различных алгоритмов сжатия. Наконец, в Meta напомнили о парадигме Flow Matching, которая может использоваться при генерации изображений, видео, звука и даже трёхмерных структуры, в том числе белковых молекул — это решение помогает использовать информацию о движении между различным частями изображения и выступает альтернативой механизму диффузии.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Разработчики Fable «не бегут в страхе от других крупных игр», если только это не GTA VI 28 мин.
Metal Gear Solid 4: Guns of the Patriots наконец сбросила оковы PS3 — в продажу поступил сборник Metal Gear Solid: Master Collection Vol. 2 2 ч.
ИИ разоряет видеопродакшн уже сейчас — за 2025 год суммарные обороты сегмента упали на 17 % 2 ч.
«HDRP больше не понадобится»: создатель самого популярного мода для «Ведьмака 3» подтвердил работу над The Witcher 3: Wild Hunt — Remastered 2 ч.
Кашу маслом не испортишь: Adobe добавила ещё больше искусственного интеллекта в Photoshop 3 ч.
Meta согласилась защищать подростков от соцсетей строже — но лишь там, где её заставили власти 3 ч.
Любую открытую ИИ-модель можно сделать вредоносной без потери способностей, убедились учёные 3 ч.
Разработчики симулятора смотрителя средневекового кладбища Graveyard Keeper 2 анонсировали дату выхода и пообещали сауну в подарок за предзаказ 3 ч.
Британские хирурги провели первую в мире операцию на мозге человека с использованием ИИ в процессе 5 ч.
Заброшенный разработчиками ролевой боевик Wolcen: Lords of Mayhem спустя семь лет получит продолжение — первый трейлер и детали Wolcen 2 6 ч.
Plaud выпустила наушники, которые запоминают разговоры за владельца — ИИ сам сделает расшифровку и заметки 13 мин.
Гигантских тараканов-киборгов вооружили шприцами и научили делать инъекции 22 мин.
Hugging Face выпустила обучаемую робоутку за $400 — она умеет петь, кататься на роликах и носить вещи в клюве 25 мин.
NVIDIA более чем удвоила выручку, но акции выросли всего на 13 % на фоне опасений ИИ-пузыря 2 ч.
Anthropic заплатит Nscale $45 млрд за аренду облачных ИИ-мощностей 2 ч.
Nvidia предала геймеров забвению — в финансовом отчёте нет ни одного упоминания GeForce RTX 2 ч.
Samsung представила новые игровые мониторы Odyssey  — размер до 49”, разрешение до 5K, частота до 1100 Гц 3 ч.
Amazon купит ещё 2 млн чипов NVIDIA и укрепит сотрудничество по другим направлениям 3 ч.
Xiaomi представила глобальные версии Redmi Note 17 и Redmi Note 17 5G c 7-дюймовыми экранами и батареями на 7700 мА·ч 3 ч.
Xiaomi представила глобальные версии смартфонов Redmi Note 17 Pro и 17 Pro Max 4 ч.