Сегодня 19 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Apple разработала ИИ, который рассматривает несколько вариантов ответа параллельно и выдаёт лучший

Исследователи Apple совместно с учёными из Калифорнийского университета в Сан-Диего разработали новый фреймворк LaDiR, улучшающий качество ответов больших языковых моделей (LLM). Суть системы заключается в том, что она позволяет нейросетям тестировать несколько вариантов рассуждений параллельно перед выдачей финального результата.

 Источник изображения: AI

Источник изображения: AI

Фреймворк, получивший название LaDiR (Latent Diffusion Enhances LLMs for Text Reasoning), объединяет диффузионные и авторегрессионные подходы к генерации текста. На этапе размышления модель использует диффузию для одновременной обработки множества токенов, а итоговый ответ формирует авторегрессионным методом — по одному токену за раз. При этом, как отмечает 9to5Mac, LaDiR не является самостоятельной нейросетью, а выступает надстройкой над уже существующими языковыми моделями, меняя сам алгоритм их мышления.

 Источник изображения: 9to5mac.com

Источник изображения: 9to5mac.com

Механизм работы фреймворка основан на генерации скрытых блоков рассуждений, которые изначально представляют собой случайный шум и постепенно очищаются до логически связных шагов. LaDiR запускает сразу несколько таких параллельных путей, каждый из которых развивает собственный диффузионный процесс, а специальный механизм стимулирует ветви для исследования разных возможностей, чтобы они не сводились к одному и тому же решению слишком рано. Когда модель решает, что процесс размышления завершён, она переключается на последовательную генерацию финального ответа.

Для проверки эффективности исследователи применили LaDiR к модели Meta LLaMA 3.1 8B для математических задач и решения головоломок, а также к Qwen3-8B-Base для генерации кода. По итогам теста в математике фреймворк продемонстрировал более высокую точность по сравнению с существующими подходами, показав уверенные результаты даже на сложных нестандартных задачах. Одновременно в бенчмарке HumanEval система выдавала более надёжный код, заметно превосходя стандартную тонкую настройку, особенно при решении трудных проблем.

 Источник изображения: 9to5mac.com

Источник изображения: 9to5mac.com

В задачах планирования, таких как игра Countdown, LaDiR исследовал более широкий спектр верных ответов, чем любая базовая модель, и находил правильные решения надёжнее всех ИИ-систем общего назначения. Однако в задачах, требующих высокой точности с первой попытки, фреймворк все же уступил специализированным моделям, заточенным под конкретные узкие задачи. Несмотря на техническую сложность некоторых аспектов исследования, авторы работы отмечают, что предложенный подход открывает новые перспективы для улучшения качества генерации текста и логики языковых моделей.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Персональный ИИ-агент Muse от Meta возглавил рейтинг App Store всего через неделю после релиза 38 мин.
ИИ-модель Google Gemini перепутала тест с реальностью и случайно взломала три компании 40 мин.
SpaceXAI удвоила точность распознавания речи в новой модели Grok Voice Transcribe 2.0 2 ч.
Anthropic сделала первый шаг к замедлению ИИ — Accenture будет проверять Claude изнутри 2 ч.
Европейские разработчики ИИ выступили против призывов США замедлить темп 5 ч.
Новая статья: Doloc Town — достойная наследница Stardew Valley. Рецензия 15 ч.
Фэнтезийная 4X-стратегия Endless Legend 2 покинула ранний доступ — онлайн в Steam вырос в 10 раз 17 ч.
Более 100 экспертов предупредили: независимая проверка безопасности ИИ сейчас почти невозможна 17 ч.
«Воровство беспрецедентных масштабов»: OpenAI и Microsoft признали, что ИИ построен на краже данных и неумолимо разрушает интернет 19 ч.
AAA по цене AA: раскрыт бюджет вампирской ролевой игры The Blood of Dawnwalker от ведущих разработчиков The Witcher 3 и Cyberpunk 2077 19 ч.
Samsung вновь вышла на первое место по продажам смартфонов благодаря флагманам 33 мин.
Китай взял под контроль рынок ЖК-панелей — теперь Samsung и LG придётся платить больше 50 мин.
«Искусственные листья» научили добывать водород из грязной морской воды — для этого нужен только солнечный свет 2 ч.
HP представила ноутбук со 192 Гбайт памяти — 160 Гбайт можно отдать встроенной Radeon 3 ч.
Контракт на миллиард: NASA заказало ещё три пилотируемых миссии SpaceX Crew Dragon 5 ч.
Выручка OpenAI к концу 2030 года вырастет до $350 млрд, но всё равно не сможет покрыть расходы 9 ч.
Anthropic решила провести IPO в ноябре, и скоро выйдет на уровень годовой выручки в $100 млрд 10 ч.
Asus выпустила компактный мини-ПК Ascent QN10 на базе Qualcomm Snapdragon X2 Elite стоимостью от $1350 11 ч.
Honor выпустила 2-литровую рабочую станцию с Nvidia RTX Spark и 128 Гбайт памяти 15 ч.
IT-индустрия изменила отношение к мейнфреймам в связи с ростом инвестиций в ИИ 17 ч.