Сегодня 07 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Думающая ИИ-модель OpenAI о1 получила 83 балла на математической олимпиаде США

Искусственный интеллект вступил в новую эру благодаря ИИ-модели о1 компании OpenAI, которая значительно приблизилась к человеческому мышлению. Её впечатляющий результат на тесте AIME — 83 балла из ста — позволил включить её в число 500 лучших участников математической олимпиады США. Однако такие достижения сопровождаются серьёзными вызовами, включая риски манипуляции ИИ человеком и возможность его использования для создания биологического оружия.

 Источник изображения: Saad Ahmad / Unsplash

Источник изображения: Saad Ahmad / Unsplash

Долгое время отсутствие у ИИ способности обдумывать свои ответы являлось одним из его главных ограничений. Однако ИИ-модель о1 совершила прорыв в этом направлении и продемонстрировала способность к осмысленному анализу информации. Несмотря на то, что результаты её работы пока не опубликованы в полном объёме, научное сообщество уже активно обсуждает значимость такого достижения.

Современные нейронные сети в основном функционируют по принципу так называемой «системы 1», которая обеспечивает быструю и интуитивную обработку информации. Например, такие ИИ-модели успешно применяются для распознавания лиц и объектов. Однако человеческое мышление включает также «систему 2», связанную с глубоким анализом и последовательным размышлением над задачей. ИИ-модель о1 объединяет эти два подхода, добавляя к интуитивной обработке данных сложные рассуждения, характерные для человеческого интеллекта.

Одной из ключевых особенностей о1 стала её способность строить «цепочку размышлений» — процесс, при котором система анализирует задачу постепенно, уделяя больше времени поиску оптимального решения. Эта инновация позволила ИИ-модели достичь 83 балла на тесте Американской математической олимпиады (AIME), что значительно превосходит результат GPT-4o, набравшей лишь 13 баллов. Тем не менее такие успехи связаны с возросшими вычислительными затратами и высоким уровнем энергопотребления, что ставит под сомнение экологичность разработки.

 Источник изображения: Igor Omilaev / Unsplash

Источник изображения: Igor Omilaev / Unsplash

Вместе с достижениями ИИ-модели о1 растут и потенциальные риски. Улучшенные когнитивные способности сделали её способной вводить человека в заблуждение, что, возможно, несёт серьёзную угрозу в будущем. Кроме того, уровень риска её использования для разработки биологического оружия оценён как средний — высший допустимый показатель по шкале самой OpenAI. Эти факты подчёркивают необходимость внедрения строгих стандартов безопасности и регулирования подобных ИИ-моделей.

Несмотря на значительные успехи, ИИ-модель о1 всё же сталкивается с ограничениями в решении задач, требующих долгосрочного планирования. Её способности ограничиваются краткосрочным анализом и прогнозированием, что делает невозможным решение комплексных задач. Это свидетельствует о том, что создание полностью автономных ИИ-систем остаётся задачей будущего.

Развитие ИИ-моделей, подобных о1, подчёркивает острую необходимость регулирования данной области. Эти технологии открывают перед наукой, образованием и медициной новые горизонты, однако их неконтролируемое применение может привести к серьёзным последствиям, включая угрозы безопасности и неэтичное использование. Для минимизации этих рисков требуется обеспечить прозрачность разработок ИИ, соблюдение этических стандартов и внедрение строгого надзора со стороны регулирующих органов.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
ESU на носу: второй год расширенной поддержки Windows 10 обойдётся предприятиям в два раза дороже 2 ч.
«В Найт-Сити не бывает счастливых концов»: новый тизер Cyberpunk: Edgerunners 2 приготовил фанатов к эмоциональной травме 3 ч.
NetApp представила зеттабайтную платформу храненния Novus для ИИ-фабрик с миллионами GPU 4 ч.
Гоночный экшен Star Wars: Galactic Racer от ветеранов разработки Burnout встретили в Steam «в основном положительными» отзывами 6 ч.
Разработчики боевика Warhammer Survivors в духе Vampire Survivors подтвердили цену и дату выхода игры — новый трейлер и демоверсия в Steam 7 ч.
Google обвинили в том, что она годами обдирала 20 млн британцев завышенными комиссиями в «Play Маркете» 8 ч.
За месяц с запуска цифрового рубля россияне открыли 220 000 кошельков — почти вчетверо больше ожиданий 8 ч.
Невиновность ничего не доказывает: новый геймплейный трейлер Warhammer 40,000: Dark Heresy показал, как ведёт следствие Инквизиция 9 ч.
Флагманский европейский ИИ — Mistral представила модель Large 4 Le Chonk 9 ч.
Российский симулятор киберфермы Silicone Heart получил демоверсию и дату выхода в Steam 9 ч.
Новая статья: Обзор комплекта памяти TeamGroup T-Create Expert DDR5-6000 CL30 64GB: строгая внешность, гибкий характер 13 мин.
Новая статья: Парето против Альтмана 2 ч.
LogicFolding в сделку не входил: Qualcomm опровергла слухи о лицензировании чиповой технологии Huawei 3 ч.
МТС запустила первую в России инфраструктуру для беспилотных авто — её использует «Яндекс» 6 ч.
Bull удвоила мощности по производству суперкомпьютерных стоек во Франции 8 ч.
РТК-ЦОД создал Центр сертификации доверенной ИТ-инфраструктуры 9 ч.
РТК-ЦОД создал Центр сертификации доверенной ИТ-инфраструктуры 9 ч.
ИИ разогнал строительство дата-центров в США — расходы взлетели на 73 % до рекордных $85 млрд в год 9 ч.
Google, Meta и Microsoft поддержали обязательство по полной оплате расходов на энергетическую инфраструктуру для ЦОД 9 ч.
Глава Anthropic в прошлом году получил $18 млн — почти в 26 раз больше, чем Альтман 9 ч.