Сегодня 23 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Думающая ИИ-модель OpenAI о1 получила 83 балла на математической олимпиаде США

Искусственный интеллект вступил в новую эру благодаря ИИ-модели о1 компании OpenAI, которая значительно приблизилась к человеческому мышлению. Её впечатляющий результат на тесте AIME — 83 балла из ста — позволил включить её в число 500 лучших участников математической олимпиады США. Однако такие достижения сопровождаются серьёзными вызовами, включая риски манипуляции ИИ человеком и возможность его использования для создания биологического оружия.

 Источник изображения: Saad Ahmad / Unsplash

Источник изображения: Saad Ahmad / Unsplash

Долгое время отсутствие у ИИ способности обдумывать свои ответы являлось одним из его главных ограничений. Однако ИИ-модель о1 совершила прорыв в этом направлении и продемонстрировала способность к осмысленному анализу информации. Несмотря на то, что результаты её работы пока не опубликованы в полном объёме, научное сообщество уже активно обсуждает значимость такого достижения.

Современные нейронные сети в основном функционируют по принципу так называемой «системы 1», которая обеспечивает быструю и интуитивную обработку информации. Например, такие ИИ-модели успешно применяются для распознавания лиц и объектов. Однако человеческое мышление включает также «систему 2», связанную с глубоким анализом и последовательным размышлением над задачей. ИИ-модель о1 объединяет эти два подхода, добавляя к интуитивной обработке данных сложные рассуждения, характерные для человеческого интеллекта.

Одной из ключевых особенностей о1 стала её способность строить «цепочку размышлений» — процесс, при котором система анализирует задачу постепенно, уделяя больше времени поиску оптимального решения. Эта инновация позволила ИИ-модели достичь 83 балла на тесте Американской математической олимпиады (AIME), что значительно превосходит результат GPT-4o, набравшей лишь 13 баллов. Тем не менее такие успехи связаны с возросшими вычислительными затратами и высоким уровнем энергопотребления, что ставит под сомнение экологичность разработки.

 Источник изображения: Igor Omilaev / Unsplash

Источник изображения: Igor Omilaev / Unsplash

Вместе с достижениями ИИ-модели о1 растут и потенциальные риски. Улучшенные когнитивные способности сделали её способной вводить человека в заблуждение, что, возможно, несёт серьёзную угрозу в будущем. Кроме того, уровень риска её использования для разработки биологического оружия оценён как средний — высший допустимый показатель по шкале самой OpenAI. Эти факты подчёркивают необходимость внедрения строгих стандартов безопасности и регулирования подобных ИИ-моделей.

Несмотря на значительные успехи, ИИ-модель о1 всё же сталкивается с ограничениями в решении задач, требующих долгосрочного планирования. Её способности ограничиваются краткосрочным анализом и прогнозированием, что делает невозможным решение комплексных задач. Это свидетельствует о том, что создание полностью автономных ИИ-систем остаётся задачей будущего.

Развитие ИИ-моделей, подобных о1, подчёркивает острую необходимость регулирования данной области. Эти технологии открывают перед наукой, образованием и медициной новые горизонты, однако их неконтролируемое применение может привести к серьёзным последствиям, включая угрозы безопасности и неэтичное использование. Для минимизации этих рисков требуется обеспечить прозрачность разработок ИИ, соблюдение этических стандартов и внедрение строгого надзора со стороны регулирующих органов.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Новая статья: Agent 64: Spies Never Die — не время умирать. Рецензия 5 ч.
Всего 1 % игр в Steam собирает 84,5 % выручки, показало исследование 10 ч.
Седьмая утечка геймплея GTA VI показала ограбление заправок и систему повреждения машин 13 ч.
Microsoft возложила вину за проблемы Windows 11 с играми после очередного обновления на RGB-подсветку 15 ч.
Claude улучшил результаты в три раза благодаря оболочке: Nvidia показала новый путь развития ИИ-агентов 15 ч.
Российский рекорд: впервые в истории весь топ-4 The International заняли команды из РФ 15 ч.
Утечки геймплея GTA VI вызвали в Rockstar переполох, но на планы студии не повлияли 15 ч.
Microsoft запустила приложение, которое делает Bing поиском по умолчанию во всех браузерах 16 ч.
DeepSeek представила экспериментальную мультимодальную ИИ-модель — она не уступает Claude Opus 4.8 19 ч.
Магазин на диване переродился: «Яндекс» начал тестировать функции шопинга на смарт-телевизорах 20 ч.
Synology представила сетевые хранилища RackStation RS826RP+ и RS826+ формата 1U 9 ч.
Gigabyte представила 1U-серверы серии R165 на базе AMD EPYC Venice 9 ч.
Firefly Aerospace доставит на Луну «ядерную печку» — она будет согревать оборудование холодными лунными ночами 10 ч.
SpaceX в сотый раз запустила ракету Falcon в этом году — на орбиту доставлено ещё 27 спутников Starlink 13 ч.
Скоро полетит: SpaceX протестировала готовность двигателей Starship к историческому полёту с выходом на орбиту 14 ч.
Группировка Starlink разрослась до 11 тыс. спутников, похвастался Илон Маск 14 ч.
Sony Xperia 10 VIII показался на фото за несколько дней до анонса 14 ч.
Астрономы нашли невообразимо огромную галактику — она в 17 раз больше Млечного Пути 14 ч.
Google Pixel 11 Pro Fold не выдержал тест на экстремальный изгиб, но хотя бы не взорвался вслед за предшественником 16 ч.
Первый повторный запуск китайской многоразовой ракеты Zhuque-3 состоится в течение полугода 19 ч.