Сегодня 24 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Развитие ИИ замедляется из-за переизбытка бесполезных данных — их слишком много

Дальнейшее совершенствование ИИ-систем, которое обеспечит переход от ChatGPT к использованию человекоподобных роботов, зависит от качества данных, которые предоставляются этим системам для обучения, пишет ресурс Fortune.

 Источник изображения: Igor Omilaev/unsplash.com

Источник изображения: Igor Omilaev/unsplash.com

Ресурс отметил, что отрасль находится на пороге следующего рубежа ИИ — физического ИИ и моделей окружающего мира — систем, которые будут учиться и в конечном итоге работать в физическом мире. Для того чтобы они получили когнитивные способности, необходимые для навигации по дорогам, складывания белья или оказания помощи при сложных медицинских операциях, им требуются не просто данные, которые можно загрузить. Их обучение требует богатых и многогранных данных. И если исследователи не смогут остановить избыток ненужных данных — данных, которые не способствуют развитию модели, — весь потенциал физического ИИ и моделей окружающего мира может никогда не раскрыться в полной мере.

Проблема заключается в том, что для создания новых, более совершенных ИИ-моделей требуется всё больше данных. На волне ажиотажа вокруг ИИ возникло множество ИИ-стартапов, таких, как Scale AI, Surge AI и Mercor, испытывающих ненасытную потребность в данных. Однако удовлетворение этой потребности привело к появлению огромного количества ненужных данных, которые на самом деле никак не способствуют развитию моделей ИИ, отметил Fortune.

Обучение моделей пониманию сложного многомерного мира требует значительно больше данных — данных, которые также очень трудно получить. Инженеры по машинному обучению прибегают к моделированию данных, используя виртуальные реконструкции реальных сценариев для создания данных, которые будут использоваться для обучения роботов и беспилотных автомобилей.

Использование некачественных данных при обучении ИИ-моделей может привести к непредсказуемым результатам. Как утверждает ресурс Fortune, OpenAI прекратила поддержку видеоприложения Sora из-за проблемы некачественных данных, поскольку её модель мира не обладала достаточным пониманием физики, что затрудняло реалистичные прогнозы.

Для дальнейшего продвижения ИИ-специалистам, занимающимся машинным обучением, необходимы инструменты и технологии для удаления ненужных данных, которые анализируют, очищают, нормализуют и корректируют обучающие данные. Для достижения успеха в обучении потребуется извлечение ценных выводов и их отделение от ненужных данных.

Теперь ограничивающим фактором стала нехватка качественных данных. Компании, которые первыми поймут это, создадут ИИ-системы, которые действительно будут работать, пишет Fortune.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Google: ИИ ещё очень далёк от замены людей — пользователи доверяют ему лишь 21 % рабочих задач 60 мин.
Runway представила Media Router — сервис сам подберёт самый выгодный ИИ для генерации контента 2 ч.
OpenAI запустила ChatGPT Health и заявила, что её ИИ способен рассуждать лучше врачей 2 ч.
Новая статья: Хочу всё знать: обзор ИИ-приложений с функцией умной камеры для Android 3 ч.
Chrome для Android стал заметно плавнее: Google избавилась от половины рывков при прокрутке 3 ч.
Max Payne исполнилось 25 лет, но разработчики про юбилей забыли 4 ч.
Вышедший 10 лет назад ролевой экшен Grim Dawn получил масштабное дополнение Fangs of Asterkarn 4 ч.
Microsoft тестирует бесплатный облачный гейминг с рекламой на участниках программы Xbox Insider 5 ч.
Aliens: Fireteam Elite 2 не заставит себя долго ждать — новый тизер и дата выхода амбициозного кооперативного шутера во вселенной «Чужих» 6 ч.
Uber уволила 10 % сотрудников службы поддержки — их заменит ИИ 6 ч.
AMD бросила новый вызов Nvidia: представлен ускоритель Instinct MI455X с 432 Гбайт HBM4 и до четырёх раз быстрее предшественника 55 мин.
AMD представила процессоры EPYC Venice 9006: до 256 ядер и 1 Гбайт L3-кеша 2 ч.
AMD представила первые процессоры на Zen 6 — версии EPYC 9006X получат более 1 Гбайт кеша 2 ч.
Дефицит памяти добрался до автомобилей — производители уже повышают цены 3 ч.
Сооснователь Neuralink выпустил ретинальный имплант, возвращающий слепым способность читать 6 ч.
ИИ нужен аварийный рубильник: США хотят обязать разработчиков внедрить механизмы отключения опасных моделей 7 ч.
Акции Tesla и Google полетели вниз — инвесторов напугали растущие расходы на ИИ 8 ч.
КАМАЗ рассказал, когда на дороги выйдут грузовики без водителей — ждать осталось недолго 8 ч.
6U-сервер Gigabyte XLS4-SX2 оснащён восемью ускорителями RTX Pro 6000 Blackwell с СЖО 9 ч.
Квартальная выручка Google Cloud подскочила на 82 %, но доходы стали отставать от расходов на ИИ-инфраструктуру 10 ч.