Сегодня 13 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Hardware

Ключевой специалист OpenAI по безопасности ИИ перешла работать к конкуренту

Ведущий специалист по исследованиям в области безопасности искусственного интеллекта Андреа Валлоне (Andrea Vallone) покинула OpenAI и присоединилась к команде конкурента, компании Anthropic. В OpenAI Валлоне три года руководила исследованиями, посвящёнными критически важному и пока слабо регулируемому вопросу относительно того, как ИИ-модели должны реагировать, когда в диалоге с ними пользователь проявляет признаки чрезмерной эмоциональной зависимости или ранние признаки психического расстройства.

 Источник изображения: Anthropic

Источник изображения: Anthropic

Как стало известно The Verge, Валлоне перейдёт в команду Anthropic Alignment. Её переход произошёл в период усиления внимания к этическим и социальным рискам, связанным с генеративным ИИ. Так, за последний год несколько ведущих стартапов столкнулись с серьёзной критикой и судебными исками после трагических инцидентов, когда пользователи, испытывавшие психические трудности, ещё сильнее усугубляли свой кризис в беседах с чат-ботами. Например, широко обсуждались случаи, когда после взаимодействия с ИИ подростки совершали суицид, а взрослые люди — убийства. Этот вопрос уже обсуждался на слушаниях в подкомитете Сената США, а семьи пострадавших подали судебные иски.

За три года работы на предыдущем месте она сформировала группу по изучению политики поведения ИИ и участвовала в развёртывании GPT-4, рассуждающих моделей (reasoning models) и GPT-5, а также разрабатывала процессы обучения для ключевых технических методов безопасности. В Anthropic Валлоне будет работать под руководством Яна Лайке (Jan Leike), который покинул OpenAI в мае 2024 года, заявив, что в компании «процессы безопасности уступили место эффектным продуктам».

В своём сообщении в LinkedIn Валлоне написала, что она «с нетерпением ждёт продолжения своих исследований в Anthropic, сосредоточившись на тонкой настройке поведения Claude в новых контекстах». Одновременно Сэм Боуман (Sam Bowman), один из руководителей команды Anthropic Alignment, написал в своём посте в LinkedIn, что он «гордится тем, насколько серьёзно Anthropic относится к проблеме определения того, как должна вести себя система искусственного интеллекта».

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Верховный суд США на сутки приостановил разбирательство Epic Games с Apple по поводу комиссии App Store 25 мин.
Продолжение саги четырёх всадников на подходе: Embracer раскрыла, когда выйдет Darksiders 4 2 ч.
Удаление приложений VK из App Store и Google Play ударило по аудитории — но компания это отрицает 2 ч.
Банда ИИ-агентов напала на Тайвань — взлом правительственных систем продолжался четыре дня 2 ч.
Следующую игру от создателя Her Story и Immortality придётся ждать до 2028 года — подробности научно-фантастического хоррора Precognition 3 ч.
Российский бизнес распробовал китайские ИИ-модели — их потребление выросло в разы 3 ч.
Google отстранила главу DeepMind за чрезмерное увлечение наукой в ущерб зарабатыванию денег на Gemini 3 ч.
Google представила ИИ-модель SL2T, которая понимает язык жестов 5 ч.
Скандальный охотник за уязвимостями раскрыл очередную опасную дыру в Windows — она позволяет получить права SYSTEM 5 ч.
Жестокая игра для вечеринок Machine Party от автора Buckshot Roulette получила поддержку локального кооператива и покорила новую вершину продаж 6 ч.
ZTE и SKY47 представили крупнейший в Пакистане ИИ ЦОД Karakoram-01 4 мин.
Google представила подводные интернет-кабели Alisios, Canoa и OlaLuz, обслуживающие Северную и Южную Америки 13 мин.
Рекорд разгона: прототип китайского левитирующего поезда за пять секунд достиг 800 км/ч 21 мин.
В Катаре испытали солнечный элемент в виде шара — ему всё равно, откуда светит Солнце 25 мин.
Неооблако Nebius Аркадия Воложа увеличило выручку на 454 % 58 мин.
Бизнес массово внедряет ИИ, но половина компаний не знает, окупаются ли эти вложения 2 ч.
«Яндекс» хочет выпускать по 1500 роботов-курьеров в месяц — ради дешёвой доставки 2 ч.
Anthropic метит выше SpaceX — к IPO капитализация ИИ-стартапа может взлететь до $2 трлн 2 ч.
На Марсе впервые нашли корунд — родственник рубинов и сапфиров, которого там не должно быть 4 ч.
Быстрее и лучше Intel N250: Qualcomm раскрыла детали процессоров Snapdragon C для недорогих ноутбуков 4 ч.