Сегодня 12 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Thinking Machines Lab намерена добиться, чтобы ИИ не отвечал по-разному на одинаковые вопросы

Бывшая технический директор OpenAI Мира Мурати (Mira Murati) учредила Thinking Machines Lab — собственный стартап в области искусственного интеллекта, который уже привлёк от инвесторов $2 млрд, не анонсировав ни одного продукта. В минувшую среду компания всё-таки рассказала об одном из своих проектов — она намеревается разработать модель ИИ, способную воспроизводить собственные ответы. Это оказалось не так просто.

 Источник изображения: Steve Johnson / unsplash.com

Источник изображения: Steve Johnson / unsplash.com

В корпоративном блоге Thinking Machines Lab появилась публикация под заголовком «Преодоление нестабильности в ответах больших языковых моделей». Работающий в компании исследователь Хорас Хэ (Horace He) пытается раскрыть первопричину фактора случайности в ответах моделей ИИ: если задать, например, ChatGPT один и тот же вопрос несколько раз, чат-бот будет всегда отвечать по-разному. Сообщество ИИ приняло эту особенность как данность, современные модели считаются недетерминированными системами, но в Thinking Machines Lab считают проблему решаемой.

Хорас Хэ указывает, что первопричина случайного фактора в работе моделей ИИ кроется в механизме взаимодействия между графическими ядрами — запущенными на чипах Nvidia алгоритмами — в процессе инференса, то есть вывода системы ИИ. Если обеспечить тщательный контроль над этим механизмом, можно повысить уровень определённости в работе моделей. В результате увеличится и надёжность ответов ИИ для потребителей, предприятий и учёных. Добившись воспроизводимости, можно повысить также качество обучения с подкреплением — процесса, при котором ИИ получает вознаграждение за правильные ответы: если все они имеют небольшие отличия, то в данных на выходе возникает информационный шум. Когда же ответы моделей ИИ оказываются более согласованными, то и процесс обучения с подкреплением становится более «гладким», рассуждает учёный.

 Источник изображения: thinkingmachines.ai

Источник изображения: thinkingmachines.ai

Ранее Thinking Machines Lab сообщила инвесторам, что намеревается предлагать бизнесу модели ИИ, прошедшие настройку с помощью обучения с подкреплением. Первый продукт Мира Мурати пообещала представить в ближайшие месяцы, отметив, что он будет «полезен для исследователей и стартапов, разрабатывающих собственные модели». Что это за продукт, и будут ли применяться при его разработке указанные в новом материале методы повышения воспроизводимости результатов, ясности пока нет. Компания также заявила о планах часто публиковать в блоге записи с программным кодом и другой информацией о своих исследованиях, чтобы «приносить пользу обществу, а также повышать нашу собственную культуру научных разработок».

На момент создания Thinking Machines Lab брала на себя обязательство проводить открытую политику в отношении собственных исследований, но по мере роста компания становилась всё более закрытой. Публикация даёт редкую возможность заглянуть за кулисы одного из самых засекреченных стартапов отрасли — точного направления развития технологии пока не даётся, но есть повод утверждать, что Thinking Machines Lab занялась решением одной из важнейших задач в области ИИ. Настоящей проверкой для неё будет ответ на вопрос, способна ли она решать такие задачи и создавать на основе этих исследований продукты, оправдывающие оценку компании в $12 млрд.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
За два месяца до скандального взлома Hugging Face ИИ-агенты OpenAI атаковали RubyGems 35 мин.
25 лауреатов Филдсовской премии забили тревогу из-за успехов ИИ в математике 3 ч.
«Яндекс» сделал открытой ИИ-модель, на которой основаны быстрые ответы в её поисковике 3 ч.
Новая статья: Star Wars Zero Company — XCOM в далёкой Галактике. Рецензия 13 ч.
Broadcom закрыла публичный доступ к VDDK, усложнив миграцию с VMware 15 ч.
Культовый скролл-шутер Gley Lancer с Sega Mega Drive спустя 35 лет получит переосмысление для современных платформ 16 ч.
Сорванные сроки, дороговизна разработки и эксклюзивность: авторитетный инсайдер раскрыл подробности разрыва PlayStation с Кодзимой 17 ч.
«Не люблю, когда мне лезут в душу»: Meta изменила алгоритм своего чат-бота после жалоб на бестактные личные вопросы 18 ч.
Обширная метроидвания Aeterna Lucis отправит игроков предотвращать конец света и низвергать бога Хаоса — новый трейлер и дата выхода 19 ч.
OpenAI ускорит научные исследования с помощью ИИ — первый «исследователь-стажёр» появится уже в сентябре 19 ч.
Утекли характеристики Lenovo Googlebook 15 — он не сможет быть дешёвым 31 мин.
ИИ-гигастройка обходится Oracle слишком дорого — компания потратит ещё $700 млн на увольнения сотрудников 33 мин.
Anthropic спрогнозировала три сценария развития ИИ — от умеренного роста экономики до массовой безработицы 2 ч.
AMD ворвалась в тройку крупнейших бесфабричных чипмейкеров — но до Nvidia ещё очень далеко 5 ч.
Nvidia рассматривает возможность вложения в Anthropic до $10 млрд в ходе IPO 6 ч.
Google TV сможет превращать смартфон с виртуальный геймпад для управления играми 13 ч.
В Москве запустили производство серверных блоков питания CRPS мощностью до 5 кВт 14 ч.
Altera готовится к IPO в этом году, планируя привлечь $2 млрд 14 ч.
Китайскую СХД выписали из лидеров IO500 — возможно, её и вовсе не существует 15 ч.
Утечка раскрыла дизайн компактной AR-гарнитуры Meta с кодовым названием Project Phoenix 17 ч.