Сегодня 17 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ИИ-модель DeepseekMath-V2 достигла уровня золотой медали на Международной математической олимпиаде

Китайский стартап DeepSeek представил новую ИИ-модель DeepseekMath-V2, которая показывает впечатляющие результаты при решении сложных математических задач. Алгоритм справился с многими заданиями Международной математической олимпиады (IMO 2025) и Китайской математической олимпиады (CMO 2024), показав при этом результат на уровене золотой медали.

 Источник изображений: the-decoder.com

Источник изображений: the-decoder.com

В сообщении сказано, что DeepseekMath-V2 набрала 118 из 120 баллов в задачах Putnam, что существенно выше лучшего результата человека в 90 баллов. DeepSeek отмечает, что ранее ИИ-модели часто выдавали верные ответы в сложных математических задачах, но при этом не показывали правильного хода решения. Для исправления ситуации ИИ-модель задействует многоэтапный процесс с отдельным верификатором для оценки корректности шагов решения задачи и необходимости их перепроверки. Такая структура позволяет алгоритму проверять и совершенствовать свои решения в режиме реального времени.

С технической стороны DeepseekMath-V2 построена на основе базовой модели Deepseek-V3.2-Exp-Base. В описании DeepSeek ни разу не упоминается использование внешних инструментов, таких как калькуляторы или интерпретаторы кода. В ключевых экспериментах одна и та же модель DeepseekMath-V2 используется как для генерации доказательств, так и для их проверки. Высокая производительность алгоритма обусловлена способностью подвергать критике и улучшать собственные выводы вместо того, чтобы задействовать внешнее программное обеспечение. Для решения более сложных задач модель наращивает вычислительные мощности на этапе тестирования, параллельно создавая и проверяя множество возможных доказательств, чтобы повысить уровень уверенности в правильности конечного ответа.

Релиз DeepSeek последовал за анонсом ещё не выпущенных ИИ-моделей OpenAI и Google Deepmind, которые достигли схожих результатов в решении сложных математических задач. Примечательно, что эти алгоритмы достигли такого результата за счёт способности к рассуждению, а не целевой оптимизации для математических олимпиад. Если на деле успехи этих алгоритмов действительно окажутся столь впечатляющими, то это будет означать, что языковые модели приблизились к моменту, когда они смогут решать сложные, абстрактные задачи, что традиционно считалось исключительно человеческим навыком.

Отметим, что решение DeepSeek раскрыть технические детали модели DeepseekMath-V2 резко контрастирует с секретностью, которую соблюдают Google и OpenAI. Американские компании держат в тайне подробности об архитектуре собственных ИИ-моделей, тогда как китайский стартап буквально раскрывает все карты, наглядно показывая, что компания идёт вровень с ведущими отраслевыми представителями.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Лучше поздно, чем никогда: спустя три года после релиза у Lords of the Fallen появился официальный перевод на русский язык 58 мин.
В открытый доступ попал геймплей Star Wars: Magellan — отменённого мультиплеерного боевика от ветеранов Diablo 3 ч.
У GitHub произошёл глобальный сбой — половина запросов оборачивается ошибкой 3 ч.
Проверенный инсайдер рассекретил дату выхода и наполнение Diablo IV для Nintendo Switch 2 4 ч.
В Firefox для iPhone появился встроенный блокировщик рекламы, но блокирует он не всё 4 ч.
Geekom случайно раздавала вредоносное ПО вместе с драйвером для мини-ПК — компания извинилась перед пользователями 4 ч.
«Ещё одна причина жить дальше»: культовое психоделическое приключение Sally Face спустя 10 лет получит продолжение 5 ч.
В «Яндексе» придумали тесты для ИИ на традиционные ценности — часть вопросов от разработчиков скроют 9 ч.
Создатель «Симпсонов» проговорился о возвращении культового экшена The Simpsons: Hit & Run в духе GTA 10 ч.
«Это кризис доверия»: глава Anthropic объяснил негативное отношение людей к ИИ 11 ч.
Unitree показала робота-супермена: он умеет прыгать на 2 метра вверх и разгоняться до 45 км/ч 35 мин.
Концепция европейского ИИ-суверенитета Mistral AI включает создание 1 ГВт мощностей и… китайские LLM 5 ч.
AOC перевыпустила 27-дюймовый игровой монитор Agon Pro AG276UZ с круговой поляризацией и режимами 4K@240 Гц и 1080@480 Гц 6 ч.
В России внедрена поддержка полностью кириллических адресов электронной почты в доменах .RU и .РФ 7 ч.
Бигтехи потратят на ИИ на $3 трлн больше, чем говорят — большая часть расходов скрыта за балансом 7 ч.
Lenovo сообщила о рекордных результатах первого финансового квартала 8 ч.
Intel неожиданно привлекла до $23 млрд — аналитики увидели признаки успеха её контрактного бизнеса 9 ч.
CoreWeave продлила использование NVIDIA A100 до 2029 года 10 ч.
СЖО на пальмовом масле: Малайзия готовит экологичную жидкость Sawit EcoTherm для погружного охлаждения 13 ч.
Macronix создала двухуровневые SSD со слоями SLC и TLC 14 ч.