Сегодня 09 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Искусственный интеллект, машинное обучение, нейросети

Математический прорыв OpenAI оказался под вопросом — учёные нашли расхождение в доказательстве

Математический прорыв OpenAI начал вызывать вопросы. Учёные сравнили опубликованное доказательство по уравнениям Навье — Стокса с его алгоритмической Lean-версией и нашли расхождения: в нескольких ключевых местах машинный вариант, проверяемый на компьютере, содержит более слабые утверждения. Это ещё не опровержение, но почва для сомнений уже вполне плодородная

 Источник изображения: Thomas T /unsplash.com

Источник изображения: Thomas T /unsplash.com

По словам математиков, расхождение вовсе не означает, что доказательства неверны или что OpenAI неправильно решила задачу, но это ставит под сомнение, всегда ли можно полагаться на математические результаты, генерируемые моделями искусственного интеллекта.

«Что нужно сделать со всеми этими большими доказательствами, созданными на основе языковой модели, так это то, что они должны быть прочитаны людьми, и это создает огромную дополнительную нагрузку на математиков», — сообщил руководитель команды Андерс Хансен (Anders Hansen).

Процесс поиска расхождений занял у команды около двух недель. При этом математики использовали подсказки ChatGPT. Напомним, что у OpenAI на решение задачи ушло 88 часов.

Математики указали на расхождение в части доказательств, называемой леммой 8.6. В доказательстве на естественном языке уравнение в этой части требует, чтобы определённое значение было меньше m + 4, где m - целое число, а в Lean‑версии — меньше m + 5, что математически слабее, поскольку допускает больше возможных решений и не эквивалентно первому.

Представим, что вас попросили решить уравнение x + 3 = 6, ответом на которое является x = 3. Можно написать доказательство того, что x должно быть меньше 4, а также того, что x должно быть меньше 5. Оба эти математических утверждения абсолютно верны, но последнее допускает больше возможных ответов для x, что делает его математически более слабым.

По словам Хансена, неправильный перевод мог возникнуть из-за того, что ИИ стремится к тому, чтобы компьютерный код был полностью самосогласован и не выдавал ошибок. Если в процессе автоматической формализации ИИ обнаружит часть доказательства, которая не компилируется, он попытается найти обходной путь, даже если это означает отклонение от доказательства, написанного на естественном языке.

Кевин Баззард (Kevin Buzzard) из Имперского колледжа Лондона сообщил, что можно надёжно формализовать в Lean саму формулировку теоремы и затем проверить, компилируется ли доказательство. Но это не гарантирует, что текстовое доказательство в PDF корректно передаёт логику. То есть Lean‑код может быть внутренне согласован, но не соответствовать тому, что написано в статье. «Я уверен, что проблема Навье — Стокса была решена правильно, — говорит Баззард. — Я гораздо менее уверен в том, что доказательство, описанное текстом, является правильным».

OpenAI сообщила ресурсу New Scientist, что ей известно о несоответствии между доказательством на естественном языке и в виде кода, и что это не означает, что ни одно из них недействительно.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме
Прежде чем оставить комментарий, пожалуйста, ознакомьтесь с правилами комментирования. Оставляя комментарий, вы подтверждаете ваше согласие с данными правилами и осознаете возможную ответственность за их нарушение.
Все комментарии премодерируются.
Комментарии загружаются...

window-new
Soft
Hard
Тренды 🔥
+Anthropic обогатила Claude панелью мониторинга данных и анимацией 2 мин.
Суровая средневековая стратегия Stronghold 4 получила дату выхода в раннем доступе Steam и новую демоверсию 52 мин.
Продажи EA Sports FC 27 превысили $714 млн — футбольный симулятор возглавил топ игровых бестселлеров 2026 года 60 мин.
Беспилотник повредил второй дата-центр «Яндекса» подряд — на этот раз в Калуге 2 ч.
«От меня не скроешься»: в Steam вышла демоверсия кафкианского immersive sim о побеге от милиционера-великана Militsioner 3 ч.
Хакеры придумали «вредоносную поэзию» — стихи на GitHub помогают управлять вирусом и заражать новые компьютеры 3 ч.
По мотивам Cyberpunk 2077 выйдет полнометражный фильм от Paramount — первые подробности 3 ч.
Первым делом самолёты: авиационный боевик Ace Combat 8: Wings of Theve удивил Bandai Namco скоростью продаж 5 ч.
Anthropic запустила бесплатный сервис для поиска дыр в ПО с открытым исходным кодом 9 ч.
Anthropic запретила пользователям жестоко обращаться с ИИ-ботом Claude — иначе он объявит бойкот 14 ч.
«Железное сердце Яндекса»: ЦОД компании в Калуге пострадал от атаки беспилотника 10 мин.
Чёрные дыры, пульсары и сверхновая: «Роскосмос» показал космос глазами рентгеновского телескопа ART-XC 15 мин.
Apple переоценила спрос на новые iPhone — выпуск iPhone 18 Pro и Pro Max урезали на 20 % 45 мин.
Трамп вручил медали Маску, Хуангу и другим техноиммигрантам — за вклад в науку и технологии 2 ч.
Три астронавта и космонавт миссии SpaceX Crew-12 вернулись на Землю после восьми месяцев на МКС 3 ч.
Samsung решила свернуть разработку чипов Exynos для автомобильной электроники 6 ч.
Приведённая годовая выручка OpenAI оказалась на $20 млрд меньше, чем рассчитывали инвесторы 7 ч.
SpaceX бросила вызов крупнейшим мобильным операторам США — Starlink Mobile объединит спутники и наземные сети 9 ч.
Мировые поставки ПК в третьем квартале рухнули на 20 % — у Apple и Asus намного меньше, чем у остальных 13 ч.
Bloomberg: Apple представит 27 октября сенсорный MacBook Pro, iPad mini с OLED и другие новинки 13 ч.