Сегодня 05 мая 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Развитие ИИ замедляется из-за переизбытка бесполезных данных — их слишком много

Дальнейшее совершенствование ИИ-систем, которое обеспечит переход от ChatGPT к использованию человекоподобных роботов, зависит от качества данных, которые предоставляются этим системам для обучения, пишет ресурс Fortune.

 Источник изображения: Igor Omilaev/unsplash.com

Источник изображения: Igor Omilaev/unsplash.com

Ресурс отметил, что отрасль находится на пороге следующего рубежа ИИ — физического ИИ и моделей окружающего мира — систем, которые будут учиться и в конечном итоге работать в физическом мире. Для того чтобы они получили когнитивные способности, необходимые для навигации по дорогам, складывания белья или оказания помощи при сложных медицинских операциях, им требуются не просто данные, которые можно загрузить. Их обучение требует богатых и многогранных данных. И если исследователи не смогут остановить избыток ненужных данных — данных, которые не способствуют развитию модели, — весь потенциал физического ИИ и моделей окружающего мира может никогда не раскрыться в полной мере.

Проблема заключается в том, что для создания новых, более совершенных ИИ-моделей требуется всё больше данных. На волне ажиотажа вокруг ИИ возникло множество ИИ-стартапов, таких, как Scale AI, Surge AI и Mercor, испытывающих ненасытную потребность в данных. Однако удовлетворение этой потребности привело к появлению огромного количества ненужных данных, которые на самом деле никак не способствуют развитию моделей ИИ, отметил Fortune.

Обучение моделей пониманию сложного многомерного мира требует значительно больше данных — данных, которые также очень трудно получить. Инженеры по машинному обучению прибегают к моделированию данных, используя виртуальные реконструкции реальных сценариев для создания данных, которые будут использоваться для обучения роботов и беспилотных автомобилей.

Использование некачественных данных при обучении ИИ-моделей может привести к непредсказуемым результатам. Как утверждает ресурс Fortune, OpenAI прекратила поддержку видеоприложения Sora из-за проблемы некачественных данных, поскольку её модель мира не обладала достаточным пониманием физики, что затрудняло реалистичные прогнозы.

Для дальнейшего продвижения ИИ-специалистам, занимающимся машинным обучением, необходимы инструменты и технологии для удаления ненужных данных, которые анализируют, очищают, нормализуют и корректируют обучающие данные. Для достижения успеха в обучении потребуется извлечение ценных выводов и их отделение от ненужных данных.

Теперь ограничивающим фактором стала нехватка качественных данных. Компании, которые первыми поймут это, создадут ИИ-системы, которые действительно будут работать, пишет Fortune.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Маск потребовал от президента OpenAI вернуть $29 млрд — суд вскрыл старый дневник 60 мин.
Новая Call of Duty впервые за 13 лет не выйдет на PS4 — консоли прошлого поколения остались в прошлом 2 ч.
Selectel создал новую компанию для реализации ИИ-проектов 2 ч.
Глава Take-Two объяснил, почему GTA VI обойдёт ПК на запуске 2 ч.
Календарь релизов 4–10 мая: Dead as Disco, Mixtape, Motorslice и Beyond Enemy Lines — Vietnam 11 ч.
Forza Horizon 6 не опоздает на старт — игра «укатила» на золото 15 ч.
Инсайдер назвал слухи о DLC для Resident Evil Requiem «полной чушью» и уточнил, когда Capcom анонсирует ремейк Resident Evil Code: Veronica 16 ч.
Инсайдеры: мультиплеерная Assassin's Creed Invictus в духе Fall Guys «просто ужасна», но Ubisoft не теряет надежды 17 ч.
Meta тестирует для Instagram метку для контента, созданного с помощью ИИ 17 ч.
«Станете самыми ненавистными людьми в Америке»: Маск угрожал руководству OpenAI перед началом судебных разбирательств 17 ч.
Valve распродала Steam Controller менее чем за полчаса — спекулянты взвинтили цену на eBay в семь раз 23 мин.
Steam Machine не за горами: Valve ввезла в США 50 тонн «игровых приставок» за два дня 57 мин.
iPhone 17 стал самым продаваемым смартфоном в мире в первом квартале — на втором и третьем месте «айфоны» подороже 58 мин.
Samsung представила сверхъяркий мобильный экран и дисплей с датчиками здоровья 2 ч.
Немецкий разработчик энергохранилищ для ИИ ЦОД CMBlu Energy привлёк €50 млн инвестиций при капитализации €1 млрд 2 ч.
Будущие iPhone и Mac могут получить процессоры производства Intel и Samsung 2 ч.
Илон Маск отделается выплатой штрафа в размере $1,5 млн по делу о покупке Twitter 4 ч.
Создатель Roomba представил Familiar — робота-питомца с локальным ИИ и «собственным характером» 5 ч.
Глава Nvidia заявил, что доля компании на китайском рынке ИИ-ускорителей упала до нуля 6 ч.
Хакер вывел из кошелька Grok токены на сумму $204 000, но потом добровольно вернул их 7 ч.