Сегодня 13 ноября 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Новая модель OpenAI CriticGPT обучена «критиковать» результаты GPT-4

Компания OpenAI представила CriticGPT — новую модель искусственного интеллекта, предназначенную для выявления ошибок в коде, сгенерированном непосредственно ChatGPT. CriticGPT будет использоваться в качестве алгоритмического помощника для тестировщиков, которые проверяют программный код, выданный ChatGPT.

 Источник изображения: Copilot

Источник изображения: Copilot

Согласно новому исследованию «LLM Critics Help Catch LLM Bugs», опубликованному OpenAI, новая модель CriticGPT создана как ИИ-ассистент для экспертов-тестировщиков, проверяющих программный код, сгенерированный ChatGPT. CriticGPT, основанный на семействе большой языковой модели (LLM) GPT-4, анализирует код и указывает на потенциальные ошибки, облегчая специалистам обнаружение недочётов, которые в противном случае могли бы остаться незамеченными из-за человеческого фактора. Исследователи обучили CriticGPT на наборе данных с образцами кода, содержащими намеренно внесённые ошибки, научив его распознавать и отмечать различные погрешности.

Учёные обнаружили, что в 63-% случаев, связанных с естественно возникающими ошибками LLM, аннотаторы предпочитали критику CriticGPT человеческой. Кроме того, команды, использующие CriticGPT, писали более полные отзывы, чем люди, не использующие этого ИИ-помощника, при этом снижался уровень конфабуляций (ложных фактов и галлюцинаций).

Разработка автоматизированного «критика» включала обучение модели на большом количестве входных данных с намеренно внесёнными ошибками. Экспертов просили модифицировать код, написанный ChatGPT, внося ошибки, а затем предоставлять результат с якобы обнаруженными багами. Этот процесс позволил модели научиться выявлять и критиковать различные типы ошибок в коде.

В экспериментах CriticGPT продемонстрировал способность улавливать как внесённые баги, так и естественно возникающие ошибки в результатах ответов ChatGPT. Исследователи также создали новый метод «Force Sampling Beam Search» (FSBS), который помогает CriticGPT писать более детальные обзоры кода, позволяя регулировать тщательность поиска проблем и одновременно контролируя частоту ложных срабатываний.

Интересно, что возможности CriticGPT выходят за рамки простой проверки кода. В экспериментах модель применили к множеству тренировочных данных ChatGPT, ранее оцененных людьми как безупречные. Удивительно, но CriticGPT выявил ошибки в 24-% случаев, которые впоследствии были подтверждены экспертами. OpenAI считает, что это демонстрирует потенциал модели не только для работы с техническими задачами, но и подчёркивает её способность улавливать тонкие ошибки, которые могут ускользнуть даже от тщательной проверки человеком.

Несмотря на многообещающие результаты, CriticGPT, как и все ИИ-модели, имеет ограничения. Модель обучалась на относительно коротких ответах ChatGPT, что может не полностью подготовить её к оценке более длинных и сложных задач, с которыми могут столкнуться будущие ИИ-системы. Команда исследователей признаёт, что модель наиболее эффективна в обнаружении ошибок, которые могут быть определены в одном конкретном, узком месте кода. Однако реальные ошибки в выводе AI могут часто быть разбросаны по нескольким частям ответа, что представляет собой вызов для будущих итераций модели.

Кроме того, хотя CriticGPT снижает уровень конфабуляций, он не устраняет их полностью, и люди-эксперты по-прежнему могут совершать ошибки на основе этих ложных данных.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Ростелеком» приобретает долю в одном из старейших разработчиков российского Linux — «Базальт СПО» 2 ч.
Google передумала блокировать установку приложений в Android из сторонних источников, но только для опытных пользователей 4 ч.
Нестареющая классика: суперкомпьютеры продолжат исправлять ошибки квантовых вычислений на QPU IBM 4 ч.
Ирландия запустила расследование деятельности X из-за проблем с модерацией контента 4 ч.
В «Google Сообщениях» появятся упоминания в групповых RCS-чатах 4 ч.
«Перешли черту»: GSC Game World обвинила в плагиате разработчиков кооперативного шутера Misery, вдохновлённого S.T.A.L.K.E.R. 4 ч.
OpenAI не сможет устранить нарушения авторских прав в Sora — ИИ-генератор обучался на украденном контенте 5 ч.
Российский рынок ИИ показал мощный рост, но до США и Китая ему очень далеко 5 ч.
Самая узнаваемая песня в Fallout 4 пропала из игры с выходом юбилейного издания 5 ч.
Sony анонсировала первую за четыре года новую Ratchet & Clank, но есть нюанс — это мобильный мультиплеерный шутер 7 ч.
1024 ядра, 6 ГГц и 48 Тбайт DDR5-17600: Tachyum обновила характеристики несуществующего процессора Prodigy 41 мин.
ФАС обязал МТС вернуть тарифы к уровню весны 2024 года и выплатить 3 млрд рублей 41 мин.
Samsung выпустила портативные смарт-мониторы Movingstyle диагональю 27 и 32 дюйма 42 мин.
Утечка раскрыла характеристики первого трёхстворчатого смартфона Samsung 2 ч.
Астрономы впервые засекли корональный выброс массы далёкой звезды — фатальный для потенциальной инопланетной жизни 2 ч.
Anthropic собралась потратить $50 млрд на строительство ЦОД в США в ближайшие годы 4 ч.
Asus предупредила, что поднимет цены на ПК, если дефицит DRAM и NAND сохранится 4 ч.
Baidu представила фирменные чипы M100 и M300 для обучения и запуска ИИ-моделей 4 ч.
Valve уже знает, какой будет Steam Deck 2 — и специально тянет с её выпуском 4 ч.
Смартфоны Poco F7 Pro, Poco F7 и Redmi Note 14 сочетают высокую производительность со стильным дизайном 4 ч.