Сегодня 13 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Развитие ИИ замедляется из-за переизбытка бесполезных данных — их слишком много

Дальнейшее совершенствование ИИ-систем, которое обеспечит переход от ChatGPT к использованию человекоподобных роботов, зависит от качества данных, которые предоставляются этим системам для обучения, пишет ресурс Fortune.

 Источник изображения: Igor Omilaev/unsplash.com

Источник изображения: Igor Omilaev/unsplash.com

Ресурс отметил, что отрасль находится на пороге следующего рубежа ИИ — физического ИИ и моделей окружающего мира — систем, которые будут учиться и в конечном итоге работать в физическом мире. Для того чтобы они получили когнитивные способности, необходимые для навигации по дорогам, складывания белья или оказания помощи при сложных медицинских операциях, им требуются не просто данные, которые можно загрузить. Их обучение требует богатых и многогранных данных. И если исследователи не смогут остановить избыток ненужных данных — данных, которые не способствуют развитию модели, — весь потенциал физического ИИ и моделей окружающего мира может никогда не раскрыться в полной мере.

Проблема заключается в том, что для создания новых, более совершенных ИИ-моделей требуется всё больше данных. На волне ажиотажа вокруг ИИ возникло множество ИИ-стартапов, таких, как Scale AI, Surge AI и Mercor, испытывающих ненасытную потребность в данных. Однако удовлетворение этой потребности привело к появлению огромного количества ненужных данных, которые на самом деле никак не способствуют развитию моделей ИИ, отметил Fortune.

Обучение моделей пониманию сложного многомерного мира требует значительно больше данных — данных, которые также очень трудно получить. Инженеры по машинному обучению прибегают к моделированию данных, используя виртуальные реконструкции реальных сценариев для создания данных, которые будут использоваться для обучения роботов и беспилотных автомобилей.

Использование некачественных данных при обучении ИИ-моделей может привести к непредсказуемым результатам. Как утверждает ресурс Fortune, OpenAI прекратила поддержку видеоприложения Sora из-за проблемы некачественных данных, поскольку её модель мира не обладала достаточным пониманием физики, что затрудняло реалистичные прогнозы.

Для дальнейшего продвижения ИИ-специалистам, занимающимся машинным обучением, необходимы инструменты и технологии для удаления ненужных данных, которые анализируют, очищают, нормализуют и корректируют обучающие данные. Для достижения успеха в обучении потребуется извлечение ценных выводов и их отделение от ненужных данных.

Теперь ограничивающим фактором стала нехватка качественных данных. Компании, которые первыми поймут это, создадут ИИ-системы, которые действительно будут работать, пишет Fortune.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Ролевая игра про магию музыки Songs of Glimmerwick не заставит себя долго ждать — новый трейлер и дата выхода в Steam 60 мин.
«Был у нас под носом больше трёх лет»: фанаты нашли тизер подзаголовка The Elder Scrolls VI в Starfield 2 ч.
Поисковик Google по ошибке «похоронил» Сэма Альтмана — виноватой сделали «Википедию» 3 ч.
DeepSeek больше не хочет быть дешёвой — тарифы на флагманские ИИ-модели взлетят до 4,5 раза 3 ч.
Нативное приложение GeForce Now для Linux вышло из беты, а у генератора кадров понизились задержки 4 ч.
Mafia: Definitive Edition взяла курс на новые платформы — ремейк Mafia: The City of Lost Heaven прокачают для PS5, Xbox Series X и S 4 ч.
Российский ИИ отправят на экзамен по духовности — модели проверят на традиционные ценности 4 ч.
«Будь это добровольно, никто бы не согласился»: Twitch начал тренировать ИИ на контенте пользователей, никого не спросив 5 ч.
Mewgenics получила русскую локализацию, но пока только для тех, кому не терпится «почухать котиков с именами на своём языке» 6 ч.
Верховный суд США на сутки приостановил разбирательство Epic Games с Apple по поводу комиссии App Store 8 ч.
«Ужасный хруст»: шарнир Galaxy Z Fold8 не выдержал испытания пылью и песком 2 ч.
Google объяснила перемещение NFC-антенны в верхнюю часть Pixel 11 3 ч.
Учёные создали «лживое зеркало» без электроники — в нём никогда не увидеть настоящего отражения 3 ч.
Xiaomi решила не отставать от Apple и Samsung, и тоже готовит широкоэкранный складной смартфон 3 ч.
Zotac представила видеокарту GeForce RTX 5080 Solid Core OC 20th Anniversary Edition к своему 20-летию 4 ч.
KTC представила игровой монитор M27P6S с 2304-зонной подсветкой Mini-LED и режимами 4K@160 Гц и 1080p@320 Гц 4 ч.
Китайские фабрики чипов разбогатели на ИИ-буме — прибыль SMIC выросла на 262 %, Hua Hong на 386 % 5 ч.
VK вышла из многолетней полосы убытков — впервые с 2022 года квартал завершён с прибылью 5 ч.
Meta бесплатно раздаст 15 000 умных очков ирландским слабовидящим 5 ч.
Тонкий 13-дюймовый Honor Pad X9b Max с батареей на 10 100 мА·ч поступил в продажу в России 5 ч.