Сегодня 11 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Исследователи нашли способ масштабирования ИИ без дополнительного обучения, но это не точно

Группа исследователей предложила новый метод масштабирования искусственного интеллекта (ИИ). Речь идёт о так называемом «поиске во время вывода», который позволяет модели генерировать множество ответов на запрос и выбирать лучший из них. Этот подход может повысить производительность моделей без дополнительного обучения. Однако сторонние эксперты усомнились в правильности идеи.

 Источник изображения: сгенерировано AI

Источник изображения: сгенерировано AI

Ранее основным способом улучшения ИИ было обучение больших языковых моделей (LLM) на всё большем объёме данных и увеличение вычислительных мощностей при запуске (тестировании) модели. Это стало нормой, а точнее сказать, законом для большинства ведущих ИИ-лабораторий. Новый метод, предложенный исследователями, заключается в том, что модель генерирует множество возможных ответов на запрос пользователя и затем выбирает лучший. Как отмечает TechCrunch, это позволит значительно повысить точность ответов даже у не очень крупных и устаревших моделей.

В качестве примера учёные привели модель Gemini 1.5 Pro, выпущенную компанией Google в начале 2024 года. Утверждается, что, используя технику «поиска во время вывода» (inference-time search), эта модель обошла мощную o1-preview от OpenAI по математическим и научным тестам. Один из авторов работы, Эрик Чжао (Eric Zhao), подчеркнул: «Просто случайно выбирая 200 ответов и проверяя их, Gemini 1.5 однозначно обходит o1-preview и даже приближается к o1».

Тем не менее, эксперты посчитали эти результаты предсказуемыми и не увидели в методе революционного прорыва. Мэтью Гуздиал (Matthew Guzdial), исследователь ИИ из Университета Альберты, отметил, что метод работает только в тех случаях, когда можно чётко определить правильный ответ, а в большинстве задач это невозможно.

С ним согласен и Майк Кук (Mike Cook), исследователь из Королевского колледжа Лондона. По его словам, новый метод не улучшает способность ИИ к рассуждениям, а лишь помогает обходить существующие ограничения. Он пояснил: «Если модель ошибается в 5 % случаев, то, проверяя 200 вариантов, эти ошибки просто станут более заметны». Основная проблема состоит в том, что метод не делает модели умнее, а просто увеличивает количество вычислений для поиска наилучшего ответа. В реальных условиях такой подход может оказаться слишком затратным и малоэффективным.

Несмотря на это, поиск новых способов масштабирования ИИ продолжается, поскольку современные модели требуют огромных вычислительных ресурсов, а исследователи стремятся найти методы, которые позволят повысить уровень рассуждений ИИ без чрезмерных затрат.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
YouTube усложнит подключение новых авторов к программе монетизации с 1 февраля 2027 года 2 ч.
OpenAI выпустила GPT 5.6 Cyber для поиска уязвимостей, но доступ к модели получат только проверенные партнёры 2 ч.
Мрачный боевик 1666: Amsterdam от создателя Assassin’s Creed отправит охотиться на монстров среди людей — раскрыта дата выхода в раннем доступе Steam 8 ч.
Контрабанда на рыбалке: секретная версия отменённого боевика Contraband от авторов Just Cause четыре года скрывалась в файлах другой игры 12 ч.
Meta выпустила открытую ИИ-модель Muse Glimmer для запуска прямо на ПК 13 ч.
Китайский фермер уничтожил 10 гектаров кунжута, послушав вредный совет ИИ 14 ч.
Второй раз за шесть лет в открытый доступ попал исходный код CS:GO — на этот раз куда более свежий 14 ч.
Valve заявила о возможной утечке данных пользователей в результате кибератаки на её европейского партнёра по логистике 15 ч.
Цукерберг раскритиковал закрытые ИИ-модели и поддержал принцип открытости исходного кода 15 ч.
Российский рынок ИИ превысил 316 млрд рублей 15 ч.
Microsoft представит следующее поколение ИИ-чипов Maia 300 уже в сентябре 16 мин.
Intel продаст акции на сумму $15 млрд для финансирования разработок в сфере ИИ 2 ч.
Boeing продаст свой стартап по разработке аэротакси компании Archer Aviation 2 ч.
Новая статья: Обзор Gigabyte B850 Aorus Elite X3D: материнская плата для Ryzen X3D 7 ч.
NVIDIA заплатит до $3 млрд за долю в Lancium, предоставляющей землю и энергию ИИ ЦОД Stargate 7 ч.
Nokia купила у NXP завод в США, чтобы перепрофилировать его на производство оптических компонентов для ЦОД 7 ч.
Себестоимость iPhone 18 Pro взлетит почти на 40 % — Apple может пожертвовать прибылью ради объёмов продаж 8 ч.
LG разработала пятислойный OLED для будущих iMac — ярче, долговечнее и с меньшим риском выгорания 9 ч.
«Мегафон» протестировал первую Private 5G — пока в стенах сетевой лаборатории 10 ч.
Cooler Master начала продажи GPU Guard — адаптера против плавления разъёмов GeForce RTX 15 ч.