Сегодня 30 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Думающая ИИ-модель OpenAI о1 получила 83 балла на математической олимпиаде США

Искусственный интеллект вступил в новую эру благодаря ИИ-модели о1 компании OpenAI, которая значительно приблизилась к человеческому мышлению. Её впечатляющий результат на тесте AIME — 83 балла из ста — позволил включить её в число 500 лучших участников математической олимпиады США. Однако такие достижения сопровождаются серьёзными вызовами, включая риски манипуляции ИИ человеком и возможность его использования для создания биологического оружия.

 Источник изображения: Saad Ahmad / Unsplash

Источник изображения: Saad Ahmad / Unsplash

Долгое время отсутствие у ИИ способности обдумывать свои ответы являлось одним из его главных ограничений. Однако ИИ-модель о1 совершила прорыв в этом направлении и продемонстрировала способность к осмысленному анализу информации. Несмотря на то, что результаты её работы пока не опубликованы в полном объёме, научное сообщество уже активно обсуждает значимость такого достижения.

Современные нейронные сети в основном функционируют по принципу так называемой «системы 1», которая обеспечивает быструю и интуитивную обработку информации. Например, такие ИИ-модели успешно применяются для распознавания лиц и объектов. Однако человеческое мышление включает также «систему 2», связанную с глубоким анализом и последовательным размышлением над задачей. ИИ-модель о1 объединяет эти два подхода, добавляя к интуитивной обработке данных сложные рассуждения, характерные для человеческого интеллекта.

Одной из ключевых особенностей о1 стала её способность строить «цепочку размышлений» — процесс, при котором система анализирует задачу постепенно, уделяя больше времени поиску оптимального решения. Эта инновация позволила ИИ-модели достичь 83 балла на тесте Американской математической олимпиады (AIME), что значительно превосходит результат GPT-4o, набравшей лишь 13 баллов. Тем не менее такие успехи связаны с возросшими вычислительными затратами и высоким уровнем энергопотребления, что ставит под сомнение экологичность разработки.

 Источник изображения: Igor Omilaev / Unsplash

Источник изображения: Igor Omilaev / Unsplash

Вместе с достижениями ИИ-модели о1 растут и потенциальные риски. Улучшенные когнитивные способности сделали её способной вводить человека в заблуждение, что, возможно, несёт серьёзную угрозу в будущем. Кроме того, уровень риска её использования для разработки биологического оружия оценён как средний — высший допустимый показатель по шкале самой OpenAI. Эти факты подчёркивают необходимость внедрения строгих стандартов безопасности и регулирования подобных ИИ-моделей.

Несмотря на значительные успехи, ИИ-модель о1 всё же сталкивается с ограничениями в решении задач, требующих долгосрочного планирования. Её способности ограничиваются краткосрочным анализом и прогнозированием, что делает невозможным решение комплексных задач. Это свидетельствует о том, что создание полностью автономных ИИ-систем остаётся задачей будущего.

Развитие ИИ-моделей, подобных о1, подчёркивает острую необходимость регулирования данной области. Эти технологии открывают перед наукой, образованием и медициной новые горизонты, однако их неконтролируемое применение может привести к серьёзным последствиям, включая угрозы безопасности и неэтичное использование. Для минимизации этих рисков требуется обеспечить прозрачность разработок ИИ, соблюдение этических стандартов и внедрение строгого надзора со стороны регулирующих органов.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Платформа NVIDIA Open Agent Safety Platform обеспечит безопасное использование ИИ-агентов — от тестирования до развёртывания 8 мин.
На OpenAI подали в суд за взлом Hugging Face и игнорирование рисков автономного ИИ 48 мин.
OpenAI бросила вызов Microsoft — ChatGPT получил свой пакет офисных приложений 2 ч.
OpenAI представила GPT‑6.1 Sol — почти как флагманская GPT‑6 Astra в сложных задачах, но в пять раз дешевле 2 ч.
AMD выпустила драйвер с поддержкой кампании Call of Duty: Modern Warfare 4, ремастера The Witcher 3: Wild Hunt, Gears of War: E-Day и других новых игр 4 ч.
The Witcher 3: Wild Hunt спустя 11 лет установила новый рекорд популярности в Steam — всё благодаря ремастеру 5 ч.
Учёные нашли способ подделывать RSA-подписи без взлома закрытого ключа 6 ч.
«Требуем фильм или сериал по Ace Combat»: финал короткометражки Hour Zero по Ace Combat 8: Wings of Theve привёл фанатов в восторг 6 ч.
Firefox получил обновлённый дизайн — более округлый и плавный 7 ч.
Ностальгическое дорожное приключение Keep Driving докатило до консолей и получило поддержку модов в Steam — трейлер с живыми актёрами 8 ч.
Новая статья: Обзор UWQHD VA-монитора DIGMA Overdrive 34A712Q: для ценителей 2 ч.
Снова без изменений: утечка раскрыла дизайн Google Pixel 11a 2 ч.
SteelSeries представила беспроводные игровые мыши Sensei Pro и Rival Pro с широкополосным беспроводным подключением 3 ч.
Honor представила крошечный букридер с 3,68-дюймовым экраном E-Ink — он крепится магнитами на тыл смартфона 4 ч.
Китайский рой из 116 подводных дронов попал в Книгу рекордов Гиннесса 4 ч.
Больше продуктов и меньше менеджеров среднего звена: Тернус собрался перестроить Apple с «упором на инженерию» 6 ч.
Современные автомобили постоянно собирают и куда-то передают данные — больше половины сливают данные рекламщикам 6 ч.
Polaroid представила моментальную ретро-камеру с уникальными аналоговыми эффектами 8 ч.
Учёные создали крошечных роботов-прыгунов на ИК-питании — но пока не придумали, зачем 8 ч.
Чтобы купить PlayStation 5 Pro, японцам придётся выиграть в лотерею — так Sony отбивается от перекупщиков и туристов 8 ч.