Сегодня 18 апреля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Новая ИИ-модель от DeepMind смогла бы получить «золото» на Международной математической олимпиаде

DeepMind, дочернее предприятие Google, специализирующееся на исследованиях в сфере искусственного интеллекта (ИИ), сообщило о новых достижениях ИИ-модели AlphaGeometry2 в решении геометрических задач. В недавно опубликованном исследовании DeepMind сообщается, что AlphaGeometry2 успешно решила 84 % задач (42 из 50) Международной математической олимпиады (IMO) с 2000 по 2024 год, набрав средний балл золотого медалиста (40,9).

 Источник изображения: Google

Источник изображения: Google

AlphaGeometry2 является улучшенной версией ИИ-системы AlphaGeometry, вышедшей в январе прошлого года. В июле прошлого года DeepMind продемонстрировала возможности системы, объединившей ИИ-модели AlphaProof и AlphaGeometry2, которой удалось решить 4 из 6 задач IMO.

AlphaGeometry2, используя лингвистическую модель на основе архитектуры Gemini и усовершенствованный механизм символической дедукции способна определять стратегии решения задач с точностью, превосходящей возможности большинства экспертов-людей.

Принятый подход объединяет два основных компонента: лингвистическую модель, способную генерировать предложения на основе подробного геометрического описания, и символический механизм DDAR (Deductive Database Arithmetic Reasoning), который проверяет логическую связность предлагаемых решений, создавая дедуктивное замыкание на основе доступной информации.

Проще говоря, модель Gemini AlphaGeometry2 предлагает символическому механизму шаги и конструкции на формальном математическом языке, и механизм, следуя определённым правилам, проверяет эти шаги на логическую согласованность.

Ключевым элементом, который позволил AlphaGeometry2 превзойти по скорости предшественника AlphaGeometry, является алгоритм SKEST (Shared Knowledge Ensemble of Search Trees), который реализует итеративную стратегию поиска, основанную на обмене знаниями между несколькими параллельными деревьями поиска. Это позволяет одновременно исследовать несколько путей решения, увеличивая скорость обработки и улучшая качество сгенерированных доказательств.

Эффективность системы удалось значительно повысить с новой реализацией DDAR на C++, что в 300 раз увеличило её скорость по сравнению с версией, написанной на Python.

Вместе с тем из-за технических особенностей AlphaGeometry2 пока ограничена в возможности решать задачи с переменным числом точек, нелинейными уравнениями или неравенствами. Поэтому DeepMind изучает новые стратегии, такие как разбиение сложных задач на подзадачи и применение обучения с подкреплением для выхода ИИ на новый уровень в решении сложных математических задач.

Как сообщается, AlphaGeometry2 технически не является первой ИИ-системой, достигшей уровня золотого медалиста по геометрии, но она первая, достигшая этого с набором задач такого размера.

При этом AlphaGeometry2 использует гибридный подход, поскольку модель Gemini имеет архитектуру нейронной сети, в то время как её символический механизм основан на правилах.

Сторонники использования нейронных сетей утверждают, что интеллектуальных действий, от распознавания речи до генерации изображений, можно добиться только благодаря использованию огромных объёмов данных и вычислений. В отличие от символических систем ИИ, которые решают задачи, определяя наборы правил манипуляции символами, предназначенных для определённых задач, нейронные сети пытаются решать задачи посредством статистической аппроксимации (замены одних результатов другими, близкими к исходным) и обучения на примерах. В свою очередь, сторонники символического ИИ считают, что он более подходит для эффективного кодирования глобальных знаний.

В DeepMind считают, что поиск новых способов решения сложных геометрических задач, особенно в евклидовой геометрии, может стать ключом к расширению возможностей ИИ. Решение задач требует логического рассуждения и способности выбирать правильный шаг из нескольких возможных. По мнению DeepMind, эти способности будут иметь решающее значение для будущего универсальных моделей ИИ.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Microsoft добавила режим Xbox в Windows 11 на ПК, ноутбуках и планшетах 2 ч.
Специалисты нашли фундаментальную брешь в безопасности большинства смартфонов Samsung, Xiaomi, Nokia и Honor 3 ч.
На этой неделе OpenAI потеряла ещё троих руководителей 7 ч.
Китайскую DeepSeek оценили в $10 млрд — компания хочет привлечь $300 млн на развитие 7 ч.
Новая статья: Darwin’s Paradox! — платформер с душой и щупальцами. Рецензия 13 ч.
Тизер нового компаньона в дополнении «Неисчислимый музеон» разочаровал фанатов Warhammer 40,000: Rogue Trader 17 ч.
Anthropic выпустила Claude Design — дизайнерский ИИ для тех, кто в дизайне ничего не понимает 17 ч.
Инсайдер: в Game Pass может появиться тариф с доступом только к эксклюзивам Xbox, а будущее Call of Duty в сервисе под вопросом 18 ч.
Глава Nvidia: у Китая уже есть всё, что нужно для обучения ИИ уровня Claude Mythos 18 ч.
Google рассказала, как правильно разрабатывать приложения для Android с помощью ИИ 19 ч.
Apple одержала очередную победу в тяжбе с Masimo по измерению кислорода в крови 56 мин.
Meta уволит почти 10 % штата ради перестройки вокруг ИИ и роста эффективности 57 мин.
Калифорнийский стартап предложил шапочку для чтения мыслей без «дырок в черепе» 2 ч.
Утечка показала, в каких цветах выйдет iPhone 18 Pro: тёмно-красный Dark Cherry заменит Cosmic Orange 2 ч.
ASRock вместе с TeamGroup придумали новый тип модулей памяти DDR5 — HUDIMM для дешёвых ПК 2 ч.
Samsung полностью сняла с продажи трёхстворчатый смартфон Galaxy Z TriFold — с анонса прошло меньше года 3 ч.
Китай на месяц отложил ротацию экипажа станции «Тяньгун» из-за старого инцидента с трещиной в иллюминаторе 3 ч.
Apple не успевает за ИИ-бумом: компьютеры Mac стали дефицитным товаром, а некоторые версии и вовсе пропали с прилавков 3 ч.
Инженеры разработали устройство для печати электроники на живых тканях и хирургических имплантах без их повреждения 5 ч.
SpaceX обвинила Blue Origin в том, что антенны спутниковой сети TeraWave создадут помехи для 10 млн абонентов Starlink 6 ч.