Сегодня 04 мая 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Развитие ИИ замедляется из-за переизбытка бесполезных данных — их слишком много

Дальнейшее совершенствование ИИ-систем, которое обеспечит переход от ChatGPT к использованию человекоподобных роботов, зависит от качества данных, которые предоставляются этим системам для обучения, пишет ресурс Fortune.

 Источник изображения: Igor Omilaev/unsplash.com

Источник изображения: Igor Omilaev/unsplash.com

Ресурс отметил, что отрасль находится на пороге следующего рубежа ИИ — физического ИИ и моделей окружающего мира — систем, которые будут учиться и в конечном итоге работать в физическом мире. Для того чтобы они получили когнитивные способности, необходимые для навигации по дорогам, складывания белья или оказания помощи при сложных медицинских операциях, им требуются не просто данные, которые можно загрузить. Их обучение требует богатых и многогранных данных. И если исследователи не смогут остановить избыток ненужных данных — данных, которые не способствуют развитию модели, — весь потенциал физического ИИ и моделей окружающего мира может никогда не раскрыться в полной мере.

Проблема заключается в том, что для создания новых, более совершенных ИИ-моделей требуется всё больше данных. На волне ажиотажа вокруг ИИ возникло множество ИИ-стартапов, таких, как Scale AI, Surge AI и Mercor, испытывающих ненасытную потребность в данных. Однако удовлетворение этой потребности привело к появлению огромного количества ненужных данных, которые на самом деле никак не способствуют развитию моделей ИИ, отметил Fortune.

Обучение моделей пониманию сложного многомерного мира требует значительно больше данных — данных, которые также очень трудно получить. Инженеры по машинному обучению прибегают к моделированию данных, используя виртуальные реконструкции реальных сценариев для создания данных, которые будут использоваться для обучения роботов и беспилотных автомобилей.

Использование некачественных данных при обучении ИИ-моделей может привести к непредсказуемым результатам. Как утверждает ресурс Fortune, OpenAI прекратила поддержку видеоприложения Sora из-за проблемы некачественных данных, поскольку её модель мира не обладала достаточным пониманием физики, что затрудняло реалистичные прогнозы.

Для дальнейшего продвижения ИИ-специалистам, занимающимся машинным обучением, необходимы инструменты и технологии для удаления ненужных данных, которые анализируют, очищают, нормализуют и корректируют обучающие данные. Для достижения успеха в обучении потребуется извлечение ценных выводов и их отделение от ненужных данных.

Теперь ограничивающим фактором стала нехватка качественных данных. Компании, которые первыми поймут это, создадут ИИ-системы, которые действительно будут работать, пишет Fortune.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Biohub Марка Цукерберга взялся ускорить лечение всех болезней с помощью ИИ-моделей клеток 2 ч.
Развитие ИИ замедляется из-за переизбытка бесполезных данных — их слишком много 2 ч.
Кооперативный шутер о приключениях роботов-ковбоев на Диком Западе стал новым хитом Steam — полмиллиона проданных копий Far Far West 2 ч.
Долгожданное воссоединение: моддер добавил в Resident Evil Requiem торговца из ремейка Resident Evil 4 3 ч.
Квартальные расходы на облачные инфраструктуры выросли на 35 % — до $129 млрд 4 ч.
Google кардинально обновила дизайн и интерфейс приложения Gemini 4 ч.
«Готовим нечто действительно умопомрачительное»: глава Mundfish подтвердил, что Atomic Heart 2 и The Cube создаются без генеративного ИИ 4 ч.
Продажи Heroes of Might & Magic: Olden Era превысили 500 тыс. копий менее чем за три дня после релиза 6 ч.
OpenAI добавила в Codex анимированных ИИ-«питомцев» для напоминаний о ходе работы — пока на Windows и macOS 20 ч.
Microsoft адаптировала Azure Local для крупномасштабных суверенных облаков 03-05 12:53
На фоне торговой войны США и Китая Huawei прогнозирует рост выручки от продажи ИИ-чипов на 60 % 40 мин.
MSI IPC выпустила 3,5″ одноплатный компьютер MS-CF27 с четырьмя портами 2.5GbE 54 мин.
Электромобили Tesla намотали 16 млрд км в автономном режиме: ранее Илон Маск обещал, что это позволит им отказаться от надзора водителя 55 мин.
GameStop предложила купить eBay за $56 млрд 2 ч.
Видеокарты GeForce RTX 5050 и Radeon RX 9070 появились в рейтинге оборудования Steam 2 ч.
Western Digital увеличила квартальную выручку в полтора раза благодаря ИИ 3 ч.
Samsung сменила главу телевизионного подразделения — китайские конкуренты давят всё сильнее 4 ч.
Японский производитель унитазов неожиданно заработал на буме ИИ и дефиците памяти 4 ч.
Трудный выбор: телеком-операторы хотят и ИИ внедрить, и сэкономить, и избежать привязки к одному поставщику 5 ч.
Fujitsu распрощается с мейнфреймами к 2035 году — на смену придут квантовые или ИИ-суперкомпьютеры 6 ч.