Сегодня 14 февраля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

В Meta✴ отрицают, что искусственно завысили результаты тестов ИИ-модели Llama 4

Представитель Meta опроверг слухи о том, что компания намеренно улучшала показатели своих новых ИИ-моделей Llama 4 в бенчмарках. Вице-президент по генеративному искусственному интеллекту Ахмад Аль-Дахле (Ahmad Al-Dahle) заявил в посте на страницах X, что утверждения о подгонке результатов с целью сокрытия слабых сторон моделей Maverick и Scout — «просто неправда».

 Источник изображения: Mariia Shalabaieva / Unsplash

Источник изображения: Mariia Shalabaieva / Unsplash

Слухи о манипуляциях появились в соцсетях после публикации бывшего сотрудника Meta. Пользователь китайской платформы утверждал, что уволился из компании в знак протеста против «нечестных методов тестирования». Позже эти обвинения распространились в X (бывший Twitter) и Reddit, пишет издание TechCrunch.

Однако Аль-Дахле подчеркнул, что Meta не обучала модели Llama 4 Maverick и Llama 4 Scout на «тестовых наборах данных», то есть специальных выборках, используемых для оценки ИИ. Такая практика могла бы искусственно завысить результаты, создав ложное впечатление о возможностях моделей.

Подозрения изначально появились из-за различий в работе Llama 4 Maverick на разных платформах. Исследователи заметили, что версия модели в бенчмарке LM Arena ведёт себя иначе, чем публично доступная и не справляется с определёнными задачами. Кроме того, Meta использовала экспериментальную сборку Maverick для улучшения результатов тестов, что также вызвало вопросы.

Одновременно Аль-Дахле отмечает, что причина, по которой пользователи пока сталкиваются с нестабильным качеством моделей, может быть связана с настройками облачных провайдеров, на серверах которых размещаются скрипты. «Мы выпустили модели сразу после их готовности, и потребуется несколько дней, чтобы все публичные реализации были настроены в соответствии с нашими требованиями», — пояснил он. В Meta пообещали в любом случае продолжить работу над исправлениями багов Llama 4 для быстрой интеграции разработчиками в свои проекты.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Новая статья: Cult of the Lamb: Woolhaven — культ на пике. Рецензия 8 мин.
Warhorse прокачала Kingdom Come: Deliverance для PS5, Xbox Series X и S, а на ПК исправила старые баги 4 ч.
Хоррор Reanimal от авторов Little Nightmares стартовал в Steam с рейтингом 33 % из-за отсутствия обещанной функции — разработчики уже отреагировали 4 ч.
Свежее обновление снова сломало Windows 11 — KB5077181 вызывает бесконечную перезагрузку 5 ч.
Владелец TikTok продаст разработчика Mobile Legends: Bang Bang за $6 миллиардов и окончательно уйдёт из игровой индустрии 6 ч.
ИИ-модель Claude допустила шантаж и даже убийство, когда ей пригрозили отключением 6 ч.
Как в старые времена: Microsoft вернёт в Windows 11 возможность перемещать панель задач 7 ч.
Глава ИИ в Microsoft: через два года нейросети заменят большинство офисных работников 7 ч.
Главный китайский поисковик интегрирует трендового ИИ-агента OpenClaw в мобильное приложение 7 ч.
Россияне массово пожаловались на сбои в работе Discord, Valorant и других сервисов 7 ч.
«ЭР-Телеком Холдинг» инвестирует более 100 млрд рублей в строительство дата-центров и не только 48 мин.
В Китае создали «глаз мухи» для дронов с панорамным зрением и встроенным «обонянием» 3 ч.
В Японии вышла цифровая камера-брелок OPT100 Neo Film в виде катушки 35-мм пленки 5 ч.
Шпионам и не снилось: умные очки Meta смогут распознавать людей и показывать информацию о них 6 ч.
Учёные доказали, что тепло может течь как вода — это новые горизонты в охлаждении чипов и не только 6 ч.
Waymo запустила роботакси шестого поколения — сначала для своих, затем для всех в десятках тысяч авто 6 ч.
Logitech G Pro X2 Superstrike установила рекорд Гиннесса по скорости кликов — но некоторые игры сочли эту мышь читом 7 ч.
Nvidia похвалилась, что Blackwell удешевили инференс нейросетей до 10 раз — и это заслуга не только «железа» 8 ч.
Житель Германии отправился в Африку за 5000 км, чтобы вернуть украденный iPhone 8 ч.
Lenovo нарастила выручку от СЖО на 300 % — здесь снова замешан ИИ 9 ч.