Сегодня 25 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

OpenAI выпустила две модели с открытыми весами — они почти догоняют o3-mini и o4-mini и могут запускаться на одном GPU

OpenAI выпустила две рассуждающие модели искусственного интеллекта с открытыми весами — они, утверждает разработчик, обладают возможностям, аналогичным тому, на что способны его модели серии «o». Обе новые открытые модели ИИ доступны на платформе Hugging Face.

 Источник изображения: Mariia Shalabaieva / unsplash.com

Источник изображения: Mariia Shalabaieva / unsplash.com

Компания предложила две разработки: более мощная модель gpt-oss-120b требует для работы видеокарту Nvidia, а более лёгкой gpt-oss-20b достаточно потребительского ноутбука с 16 Гбайт оперативной памяти. В последний раз OpenAI выпускала открытый проект более пяти лет назад — это была GPT-2. Новые модели, сообщили в компании, могут направлять слишком сложные запросы работающим в облаке системам, если не справляются с какими-либо запросами самостоятельно.

Будучи признанным мировым лидером в отрасли ИИ, OpenAI стремилась сделать свои открытые модели наиболее мощными в сравнении с существующими аналогами, и это ей, по её утверждению, удалось. В тестах платформы Codeforces на написание программного кода модели gpt-oss-120b и gpt-oss-20b набрали 2622 и 2516 баллов соответственно, обойдя DeepSeek R1, но уступив o3 и o4-mini. В бенчмарке Humanity’s Last Exam (HLE) gpt-oss-120b и gpt-oss-20b показали результаты соответственно 19 % и 17,3 % — ниже, чем o3, но выше ведущих открытых моделей DeepSeek и Alibaba Qwen.

 Источник изображения: openai.com

Источник изображения: openai.com

Отмечается, что у новых открытых моделей OpenAI галлюцинации, то есть выдаваемые с уверенностью не соответствующие действительности ответы, встречаются чаще, чем у закрытых o3 и o4-mini. Такой результат разработчик назвал «ожидаемым, поскольку модели меньшего размера обладают меньшим знанием мира, чем передовые модели большего размера, и склонны к более выраженным галлюцинациям». В тесте PersonQA модели gpt-oss-120b и gpt-oss-20b галлюцинировали в ответах в 49 % и 53 % случаев соответственно; для сравнения, у o3 и o4-mini эти показатели составляют соответственно 16 % и 36 %.

OpenAI обучала открытые модели, используя те же процессы, что применяются при обучении закрытых — в обеих используется метод MoE (Mixture-of-Experts), позволяющий при ответах на вопросы использовать меньше параметров. Так, у модели gpt-oss-120b всего 177 млрд параметров, но активируются лишь 5,1 млрд на токен, что способствует росту эффективности. При разработке использовалось высокоинтенсивное обучение с подкреплением (high-compute reinforcement learning) — процедура, помогающая отличать правильное от неправильного в моделируемых средах; этот метод применяется при обучении моделей серии «o». Открытые модели также используют схожий процесс обработки ответов, предполагающий выделение дополнительного времени и дополнительных ресурсов.

 Источник изображения: openai.com

Источник изображения: openai.com

Открытые модели, утверждают в OpenAI, подходят для работы в составе ИИ-агентов, они способны обращаться к веб-поиску и средствам выполнения кода Python. Подчёркивается, что они не являются мультимодальными, то есть предназначаются только работы с текстом и не могут обрабатывать или генерировать изображения и звук. Модели доступны под лицензией Apache 2.0, которая считается одной из наиболее демократичных. При этом компания отказалась раскрывать, какие данные использовались при их обучении.

OpenAI провела отдельное исследование на предмет того, смогут ли гипотетические злоумышленники использовать их в кибератаках или разработке биологического или химического оружия — при участии сторонних экспертов было установлено, что незначительную помощь в области биологической науки они оказать всё-таки смогут, но доказательств потенциального превышения установленного «порога возможностей» даже после процедуры тонкой настройки обнаружено не было.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Календарь релизов 24–30 августа: Resonance: A Plague Tale Legacy и Star Wars Zero Company 5 ч.
NVIDIA выплатит Poolside за лицензию $6 млрд и получит более ста его специалистов, но поглощением эту сделку называть отказывается 8 ч.
Hugging Face отказалась от денег Nvidia и теперь рассматривает продажу за $13 млрд 9 ч.
The Witcher 4 выйдет в 2028 году — это «самая большая, смелая и амбициозная игра» в истории CD Projekt Red 9 ч.
«Это пустяки»: ветеран Rockstar сравнил утечки GTA VI с секс-скандалом вокруг GTA: San Andreas 11 ч.
После критики фанатов вампирская ролевая игра The Blood of Dawnwalker от ветеранов CD Projekt Red всё-таки получит поддержку 60 кадров/с на консолях 12 ч.
Alibaba выпустила Wan3.0 — новую версию генератора 30-секундных видео 12 ч.
Авторитетный инсайдер подтвердил продолжение Ori and the Will of the Wisps, а создатель серии назвал слухи об Ori 3 «полной чушью» 15 ч.
В Steam завирусился гибрид шутера и симулятора рыбалки на четверых How to Fish — миллион проданных копий за два дня 16 ч.
Зоркий фанат нашёл в Cyberpunk 2077 лужу из нового трейлера Cyberpunk: Edgerunners 2 и впечатлил даже CD Projekt Red 16 ч.
LG оценила 24,5-дюймовый игровой IPS-монитор UltraGear 25G590B с Full HD и 1000 Гц в $1000 3 ч.
Intel раскрыла устройство Crescent Island — ИИ-ускорителя с огромным объёмом дешёвой памяти 4 ч.
Новая статья: Обзор и тест процессорного кулера MSI MAG CoreFrozr AA13: просто, недорого, симпатично 4 ч.
В контрабанде ИИ-ускорителей в Китай оказался замешан топ-менеджер Nvidia — теперь ему грозит 5 лет тюрьмы 9 ч.
Xiaomi представила мини-ПК AI Cube на собственных CPU, GPU и NPU и с LPDDR6-памятью 10 ч.
Xiaomi начала повышать цены на смартфоны — некоторые модели подорожают на 25 % 10 ч.
Фото дня: доставка суперускорителя NVIDIA Vera Rubin NVL72 в дата-центр Microsoft 12 ч.
YMTC готовит IPO на $4,9 млрд — китайский производитель флеш-памяти хочет нарастить выпуск 3D NAND 15 ч.
Xiaomi бросила вызов Qualcomm и MediaTek: новый 3-нм чип Xring O3 первым получил поддержку LPDDR6 15 ч.
Alibaba Cloud намерена всё больше полагаться на ИИ-чипы собственной разработки 16 ч.