Сегодня 10 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Математический прорыв OpenAI оказался под вопросом — учёные нашли расхождение в доказательстве

Математический прорыв OpenAI начал вызывать вопросы. Учёные сравнили опубликованное доказательство по уравнениям Навье — Стокса с его алгоритмической Lean-версией и нашли расхождения: в нескольких ключевых местах машинный вариант, проверяемый на компьютере, содержит более слабые утверждения. Это ещё не опровержение, но почва для сомнений уже вполне плодородная

 Источник изображения: Thomas T /unsplash.com

Источник изображения: Thomas T /unsplash.com

По словам математиков, расхождение вовсе не означает, что доказательства неверны или что OpenAI неправильно решила задачу, но это ставит под сомнение, всегда ли можно полагаться на математические результаты, генерируемые моделями искусственного интеллекта.

«Что нужно сделать со всеми этими большими доказательствами, созданными на основе языковой модели, так это то, что они должны быть прочитаны людьми, и это создает огромную дополнительную нагрузку на математиков», — сообщил руководитель команды Андерс Хансен (Anders Hansen).

Процесс поиска расхождений занял у команды около двух недель. При этом математики использовали подсказки ChatGPT. Напомним, что у OpenAI на решение задачи ушло 88 часов.

Математики указали на расхождение в части доказательств, называемой леммой 8.6. В доказательстве на естественном языке уравнение в этой части требует, чтобы определённое значение было меньше m + 4, где m - целое число, а в Lean‑версии — меньше m + 5, что математически слабее, поскольку допускает больше возможных решений и не эквивалентно первому.

Представим, что вас попросили решить уравнение x + 3 = 6, ответом на которое является x = 3. Можно написать доказательство того, что x должно быть меньше 4, а также того, что x должно быть меньше 5. Оба эти математических утверждения абсолютно верны, но последнее допускает больше возможных ответов для x, что делает его математически более слабым.

По словам Хансена, неправильный перевод мог возникнуть из-за того, что ИИ стремится к тому, чтобы компьютерный код был полностью самосогласован и не выдавал ошибок. Если в процессе автоматической формализации ИИ обнаружит часть доказательства, которая не компилируется, он попытается найти обходной путь, даже если это означает отклонение от доказательства, написанного на естественном языке.

Кевин Баззард (Kevin Buzzard) из Имперского колледжа Лондона сообщил, что можно надёжно формализовать в Lean саму формулировку теоремы и затем проверить, компилируется ли доказательство. Но это не гарантирует, что текстовое доказательство в PDF корректно передаёт логику. То есть Lean‑код может быть внутренне согласован, но не соответствовать тому, что написано в статье. «Я уверен, что проблема Навье — Стокса была решена правильно, — говорит Баззард. — Я гораздо менее уверен в том, что доказательство, описанное текстом, является правильным».

OpenAI сообщила ресурсу New Scientist, что ей известно о несоответствии между доказательством на естественном языке и в виде кода, и что это не означает, что ни одно из них недействительно.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
В ИИ-лабораториях обыгрываются сценарии масштабной катастрофы — она может произойти в течение года 23 мин.
Белый дом отныне будет требовать от разработчиков ИИ обязательного предоставления отчётов об инцидентах с моделями 2 ч.
Новая статья: RetroSpace — осторожно, уборщик галактику спасает. Рецензия 10 ч.
Девять из десяти клиентов VMware задумались об уходе из-за высоких цен 10 ч.
Apple Hills Digital: предобученные модели и интеграция с данными для заказчиков важнее стоимости ИИ-нагрузки 12 ч.
OpenAI уволила трёх исследователей безопасности ИИ — они опасаются, что компания заставит сотрудников молчать о рисках 13 ч.
Пошаговая ролевая игра Shadow of the Road не выйдет за неделю до GTA VI — Owlcat объявила новую дату релиза 13 ч.
Китайские ИИ-компании скрывают, насколько опасны их модели — публичных тестов почти нет 14 ч.
Продюсер Konami рассказал о планах на продолжение Silent Hill 18 ч.
ИИ-агенты ошибаются опаснее чат-ботов — они сливают личные данные и совершают покупки без разрешения 18 ч.
Несмотря на задержки, Amazon обещает запустить спутниковый интернет-сервис в ближайшее время 31 мин.
Президент Трамп объявил врагами всех, кто не готов использовать термин «сверхинтеллект» 3 ч.
Тим Кук заявил, что не вмешивается в работу нового генерального директора Apple 4 ч.
Frore Systems анонсировала СЖО LiquidJet Diamond с алмазными пластинами 11 ч.
Google «выжмет» из АЭС Constellation ещё 890 МВт для своих ИИ ЦОД 13 ч.
Понаехали: власти США обвинили Microsoft в замене американцев мигрантами и отстранили её от программы грин-карт 14 ч.
Volkswagen закончила эпоху ID.4 — представлен электрический кроссовер ID. Tiguan с запасом хода до 600 км 14 ч.
NVIDIA Vera показал превосходство над чипами AMD и Intel в HPC-бенчмарках 15 ч.
«В 50 раз больше Пентагона»: Broadcom намерена привлечь $50 млрд на ИИ-чипы, а SpaceX — $40 млрд 17 ч.
E1.L вместимостью до 122,88 Тбайт: Kioxia представила QLC SSD серии LD4 17 ч.