Сегодня 01 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → ии
Быстрый переход

«Сбер» и «Яндекс» в разы снизили цены на ИИ-токены, но зарубежный ИИ всё равно дешевле

За последний год российские компании «Сбер» и «Яндекс» в несколько раз снизили цены на стоимость генерации контента моделями искусственного интеллекта. Об этом сообщил РБК со ссылкой на исследование платформы Nodul.

 Источник изображения: Milad Fakurian / unsplash.com

Источник изображения: Milad Fakurian / unsplash.com

У российских технологических гигантов кратно снизились цены на ИИ-токены — минимальные единицы текста или данных, которые обрабатывают ИИ-модели. Это могут быть целые слова, их фрагменты, знаки препинания и отдельные символы, в том числе пробелы. Токены разделяют на входные и выходные: первые относятся к тексту запросов, а вторые — к ответам нейросетей. За первые обычно взимается плата в три или четыре раза меньше, чем за вторые, но российские поставщики услуг традиционно устанавливали единую цену на те и другие.

С октября 2025 по август 2026 года стоимость тысячи токенов за работу с моделью GigaChat Lite снизилась с 0,20 до 0,065 руб., что соответствует снижению на 67,5 %; доступ к GigaChat Pro подешевел с 1,50 до 0,50 руб., и это снижение на 66,7 %. С выходом YandexGPT Pro 5.1 стоимость тысячи токенов сократилась до 0,80 руб. — это на 33 % дешевле, чем YandexGPT 5 Pro. Доступ к YandexGPT Lite остался без перемен на уровне 0,20 руб.

Зарубежные модели со схожими возможностями обходятся до десяти раз дешевле. Самыми недорогими, по традиции, являются китайские. Быстрая DeepSeek V4 Flash стоит около 0,0375 руб. за тысячу входных и 0,112 руб. — за тысячу выходных токенов; GPT-5.4 mini обходится в 0,064 и 0,383 руб., а Qwen 3.8 Max — 0,17 и 0,511 руб. соответственно.

В «Сбере» и «Яндексе» с выводами Nodul не согласились и заявили, что доступ к их моделям подешевел значительно сильнее.

«Устройства для извращенцев»: взрывная популярность умных очков вызывает протесты из-за скрытой съёмки

Пока техногиганты стараются убедить потребителей, что следующим после смартфонов повсеместным типом электронных устройств станут умные очки, социальные последствия их использования уже вызывают протесты. Критики считают, что пользователи таких очков не должны иметь возможность скрытно снимать окружающих без серьёзных ограничений.

 Источник изображения: Unsplash, Matthew Fassnacht

Источник изображения: Unsplash, Matthew Fassnacht

Издание Financial Times приводит примеры ситуаций, когда молодые люди целенаправленно снимают в общественных местах женщин в неловких или компрометирующих ситуациях, чтобы затем без их согласия размещать эти ролики в социальных сетях. Героини подобных видео настаивают, что такая практика нарушает их личные границы и должна быть запрещена.

Владеющая популярными социальными сетями американская компания Meta✴ Platforms, которая активно продвигает подобные устройства, старается бороться со злоупотреблениями, блокируя учётные записи с видео спорного содержания. В некоторых юрисдикциях использование умных очков уже запрещено законом в определённых местах. Например, в Великобритании ограничения действуют в некоторых увеселительных заведениях и залах суда.

Одними только умными очками дело не ограничивается: появляются сообщения о намерениях Apple представить не только аналогичное устройство, но и оснащённые камерами беспроводные наушники, а также носимый на шее кулон со встроенной камерой. Увеличение объёмов информации, поступающей в системы ИИ через такого рода устройства, позволит совершенствовать их работу, но этому процессу неизбежно будут сопутствовать проблемы с неприкосновенностью частной жизни, считают эксперты.

Популярности умных очков такие настроения пока особо не мешают. Эксперты Counterpoint Research прогнозируют, что в период с 2026 по 2032 год потребители потратят на умные носимые устройства более $1 трлн. К ним относятся не только очки, но и разного рода наушники, кулоны и броши. Непосредственно умные очки за этот период принесут продавцам $44 млрд. По мнению вице-президента Meta✴ Алекса Химела (Alex Himel), привлекательность умных очков заключается в том, что они всегда готовы к использованию: за ними не надо тянуться в карман или сумку. Как заявляет представитель компании, благодаря умным очкам ИИ-модели буквально обретут глаза и уши.

Критики этой тенденции опасаются, что умные очки смогут использоваться для массовой слежки за людьми, позволяя операторам соответствующих систем моментально распознавать лица практически в любой точке мира. Эксперты поясняют, что техногиганты продвигают новые технологии быстрее, чем к ним успевает адаптироваться общество, хотя рано или поздно такая адаптация происходит. Некоторые активисты, защищающие право на частную жизнь, даже называют умные очки «устройством для извращенцев». При этом они не обязательно призывают отказываться от ИИ в целом, но настаивают на необходимости использовать подобные технологии ответственно.

С 2021 года было продано более 10 млн умных очков со встроенными камерами, причём примерно 7 млн из них пришлись на прошлый год. EssilorLuxottica, сотрудничающая с Meta✴ в этой сфере, в прошлом квартале сообщила об удвоении выручки от продаж устройств данного типа. Продвижением подобных изделий занимаются и известные блогеры, которых стимулирует к этому Meta✴. EssilorLuxottica пытается выработать стандарты безопасного использования умных очков и надеется, что люди будут применять их ответственно.

 Источник изображения: Unsplash, Damir Semirkhanov

Источник изображения: Unsplash, Damir Semirkhanov

По данным Omdia, сейчас Meta✴ контролирует 85 % рынка умных очков, причём их продажи растут даже в условиях падения рынка смартфонов из-за резкого подорожания микросхем памяти. Объём рынка таких устройств в этом году эксперты оценивают в 15 млн штук, а к 2030 году он должен утроиться до 45 млн штук. В случае Meta✴ именно сотрудничество с производящей модные аксессуары EssilorLuxottica позволило добиться коммерческого успеха, поскольку соответствующие устройства получили привлекательный дизайн. Десять лет назад попытку создать этот сегмент рынка предпринимала Google со своим проектом Glass, но при тогдашнем уровне развития технологий он потерпел неудачу. Росту популярности решений Meta✴ способствовало и бурное развитие систем искусственного интеллекта. Хотя инженеры Meta✴ пытались оснастить умные очки множеством технологий, представители EssilorLuxottica настаивали, что они должны оставаться достаточно лёгкими.

Этот пример вдохновил конкурентов на аналогичное сотрудничество. Google и Samsung будут работать с Warby Parker и Gentle Monster при подготовке к выводу на рынок своих умных очков в текущем году. Не каждая оправа подходит конкретному человеку, а необходимость унификации модельного ряда умных очков пока ограничивает разнообразие дизайна. Apple, по имеющимся данным, не собирается позволять своим умным устройствам делать снимки и записывать видео с помощью встроенных камер, а намерена использовать их только для анализа окружающей обстановки. Предполагается, что голосовые команды можно будет подавать шёпотом, поскольку умные очки Apple должны научиться буквально «читать по губам», анализируя микродвижения мышц лица пользователя. Это частично решит проблему управления умными очками в людных местах, где много постороннего шума и не всегда хочется произносить команды вслух.

Китайский стартап Even Realities, разрабатывающий умные очки с крохотным встроенным дисплеем, сообщает об интересной практике их применения. Разработчики программного обеспечения отдают команды ИИ-агентам голосом, а ответы системы считывают с дисплея очков. По меньшей мере, это не привязывает их к рабочему столу и позволяет освободить руки. Эксперты считают, что до появления практичных и лёгких умных очков со встроенными дисплеями пройдёт от двух до трёх лет, но именно такие устройства могут стать важной аппаратной платформой и заметно изменить рынок.

По мнению представителей Meta✴, лучший ИИ-ассистент не обязательно должен быть самым умным — важнее, насколько хорошо он знает и понимает конкретного пользователя. Умные носимые устройства в этом смысле открывают новые каналы получения информации, которая может использоваться для совершенствования систем ИИ. Сама компания при этом, по имеющимся данным, разрабатывает очки, способные практически непрерывно собирать визуальную и звуковую информацию об окружающей пользователя обстановке, чтобы при необходимости напоминать ему о произошедших событиях. Такая функция может появиться и в уже существующих моделях после программного обновления. При этом индикатор записи на очках не будет сигнализировать о ведении непрерывного сбора данных.

Попытки Meta✴ разработать систему распознавания лиц для умных очков пока не привели к выпуску коммерческой версии соответствующего ПО, поскольку эта идея столкнулась с общественной критикой. Компания настаивает, что такая функция могла бы пригодиться, например, незрячим людям. Недавно Meta✴ внедрила функцию, которая полностью блокирует запись, если выясняется, что пользователь пытается вести её скрытно, закрывая светодиодный индикатор.

Основатель Nothing Карл Пэй (Carl Pei) вообще утверждает, что умные очки часто возвращают в магазины и что у них пока нет преданной пользовательской аудитории. По его мнению, в ближайшее время ситуация не изменится. Сама Nothing по этой причине отказалась от разработки умных очков. Как считает Пэй, рынок начнёт меняться только после того, как голосовые ИИ-ассистенты выйдут на новый функциональный уровень.

Благодаря использованию ИИ китайские хакеры удвоили число атак

Китайские хакеры увеличили число атак благодаря использованию открытых ИИ-моделей, включая DeepSeek, сообщил Bloomberg. По данным тайваньской исследовательской компании Team T5, количество атак, совершённых связанными с Пекином кибергруппировками, выросло более чем вдвое с тех пор, как они начали использовать ИИ для разработки сложного вредоносного ПО.

 Источник изображения: Sasun Bughdaryan/unsplash.com

Источник изображения: Sasun Bughdaryan/unsplash.com

Исследователи отметили, что идентифицировать используемые хакерами ИИ-модели пока не удаётся, хотя, по их сведениям, разработки DeepSeek пользуются популярностью в киберпреступной среде благодаря своей высокой производительности и возможности индивидуальной настройки, а также низким требованиям к безопасности.

В то время как в США нарастает беспокойство по поводу автономных возможностей передовых моделей от Anthropic и OpenAI после серии произведённых ими взломов в тестовой среде, китайские хакеры используют гораздо менее совершенный ИИ для масштабирования своей деятельности и осуществления атак, несмотря на наличие в стране более мощных ИИ-моделей, включая Kimi K3 от Moonshot.

«DeepSeek — это предпочтительная ИИ-модель для китайских хакеров, поскольку она относительно мощная и имеет очень низкие киберограничения, — отметил Чарльз Ли (Charles Li), главный аналитик Team T5. — Западные модели пользуются большим спросом, но их ограничения гораздо более строгие и требуют больше усилий для обхода».

По данным Team T5, группировка Grimfengxi использовала DeepSeek для создания эксплойт-кодов. Другая группа хакеров Huapi применяла китайскую ИИ-модель, как правило, DeepSeek, для атаки на почтовую систему тайской компании. Третья группа хакеров, известная как Teleboyi, использовала эту платформу для сбора 1 тыс. IP-адресов из интернета и составления карты доменов компании.

В некоторых случаях китайские хакеры применяли для атак американские ИИ-модели. Компания по кибербезопасности CyCraft сообщила, что ChatGPT использовался во время атаки на западный аналитический центр. Получив копию локальной базы данных Signal сотрудника с взломанного компьютера, хакеры обратились к чат-боту за помощью в создании программного модуля, предназначенного для ее расшифровки.

Закупки ИИ-ускорителей российскими компаниями поддержат налоговыми льготами

Российские власти пытаются решить проблему нехватки графических ускорителей, необходимых для работы систем искусственного интеллекта. В России такие ускорители не производятся, и в правительстве готовятся меры господдержки, в том числе налоговые льготы при закупках этого оборудования, передаёт Forbes. Это оборудование ещё предстоит чётко отделить от майнингового.

 Источник изображения: Igor Omilaev / unsplash.com

Источник изображения: Igor Omilaev / unsplash.com

Решением проблемы дефицита графических процессоров и их высокой стоимости занимается рабочая группа правительственной подкомиссии. До конца сентября будут определены конкретные нормы, выступающие препятствием для отнесения ИИ-оборудования к отечественной продукции — потребуется сформулировать базу для изменения этих норм. Будут также выработаны критерии, которые «позволяют однозначно отделить ИИ-оборудование (GPU, NPU, высокоскоростные сети и т.д.) от майнингового и прочего». Это необходимо, чтобы упростить «администрирование мер поддержки» и исключить схемы злоупотребления ими.

Одна из инициатив — до конца года подготовить предложения «по льготному налогообложению на закупки оборудования для ИИ и прочим механизмам поддержки, позволяющим снизить стоимость владения ИИ-оборудованием». К концу года будут выработаны критерии, отделяющие центры обработки данных ИИ от прочих ЦОД. Основу инфраструктуры для ИИ составляют серверы с графическими процессорами, напоминают опрошенные Forbes эксперты. Это оборудование используется как для обучения моделей ИИ, так и для запуска уже обученных. Отделить ИИ-оборудование от майнингового можно по классу графических процессоров и их вычислительной мощности: закупать ускорители Nvidia H200 или B300 для майнинга экономически невыгодно.

Формально по классификаторам майнинговое и ИИ-оборудование не различаются — оно проходит по коду ТН ВЭД 8471 50 000 0. Поэтому есть смысл увязывать льготы не с фактом покупки оборудования, а с подтверждённым целевым использованием. Подчёркивается, что в России графические процессоры не производятся, поэтому проблему целесообразно решать поэтапно: сначала локализовать сборку, а затем в перспективе десяти лет увеличивать степень локализации — слишком жёсткие требования грозят затормозить рынок.

Сотрудники Microsoft раскрыли свои траты на ИИ на рабочем месте — до $28 000 в месяц

Сотрудники Microsoft в добровольном порядке анонимно раскрыли уровни своего заработка и объёмы потребления ресурсов искусственного интеллекта за месяц — в компании существует внутренняя платформа для отслеживания этих показателей и обеспечения прозрачности. Сводную таблицу данных опубликовал Business Insider.

 Источник изображения: Simon Ray / unspalsh.com

Источник изображения: Simon Ray / unspalsh.com

Эти показатели дают возможность оценить, как ИИ используется внутри Microsoft — компания соревнуется с такими конкурентами как Meta✴, Google, OpenAI и Anthropic. Софтверный гигант тратит на инфраструктуру ИИ сотни миллиардов долларов и побуждает сотрудников включать средства ИИ в повседневную работу. Фактическое использование этих инструментов резко варьируется и может составлять от нескольких долларов до нескольких десятков тысяч. Это указывает, что интенсивное применение ИИ в работе не связано с повышением зарплат, премий и продвижением по службе. Крупные компании всё чаще отслеживают объёмы потребления ресурсов ИИ сотрудниками.

 Источник изображения: businessinsider.com

Источник изображения: businessinsider.com

В этом году в общую таблицу прозрачности добавили новый столбец и предложили сотрудникам самостоятельно сообщать об объёмах использования ИИ в долларах в месяц — точнее, за последние 28 дней. Для этого в Microsoft предусмотрен специальный внутренний инструмент, который пока находится на стадии тестирования. В распоряжении Business Insider оказался документ с 600 записями от сотрудников Microsoft, из которых графу об использовании ИИ заполнили 350. Медианная сумма за 28 дней составила $300; самую высокую указал сотрудник отдела Microsoft Customer and Partner Solutions — $28 000. Данные не являются официальными, предоставляются в добровольном порядке и могут содержать ошибки. По состоянию на 30 июня в компании работали 223 000 человек, поэтому выборка из 350 сотрудников не представляет полной картины.

Продукт Apple, который она никогда не показывала, — в сети появились фото ИИ-серверов компании

В стремлении наверстать упущенное в области искусственного интеллекта Apple разработала систему Private Cloud Compute — инфраструктуру безопасных вычислений для служб ИИ. Собственные ИИ-серверы Apple выпускает на заводе в техасском Хьюстоне. Их изображение опубликовал пользователь соцсети X под псевдонимом hsuchingpo.

 Источник изображений: x.com/hsuchingpo

Источник изображений: x.com/hsuchingpo

Опубликованы четыре снимка, на одном из которых показан сервер высотой 2U, предназначенный для установки в стойку. Он имеет модульную конструкцию: сервер состоит из четырёх блоков, каждый из которых включает восемь плат — на каждой плате размещён процессор. Платы располагаются на внешних сторонах блоков, а на внутренних установлены радиаторы. Таким образом, каждый сервер содержит четыре процессора, и это чипы Apple M5. На одном из снимков представлен чип с логотипом Apple, и можно предположить, что речь идёт о старшем и самом производительном варианте процессора M5 Ultra.

Вдоль всего блока протянута основная управляющая плата, к которой подключены более мелкие. По центральной части сервера проложены соединительные кабели — нет ясности, предназначены ли они для подачи питания, передачи данных или для обеих задач. Примечательно, что программное управление задачами сервера осуществляет не он сам, а внешний компьютер Mac Studio — и он может располагаться в другом месте.

Конструкция разработана таким образом, чтобы обеспечить максимально эффективный приток воздуха через блок из передней в заднюю часть. Радиаторы расположены посередине каждого блока, а их рёбра позволяют воздуху свободно циркулировать. Боковые стороны и основания блоков прикрыты прозрачными крышками, которые направляют воздух через канал. На одном из снимков представлен вид ИИ-сервера сбоку без крышки.

Meta✴ готовит новую ИИ-модель Watermelon и универсального ИИ-агента Hatch

В ближайшие недели Meta✴ намерена выпустить ориентированного на потребителей агента искусственного интеллекта Hatch, а на октябрь у компании запланирован запуск новой модели Watermelon, сообщает The Information. Гигант соцсетей планирует сделать ИИ новым источником дохода.

 Источник изображения: Igor Omilaev / unsplash.com

Источник изображения: Igor Omilaev / unsplash.com

Последние проекты в области ИИ реализуются в рамках стратегии Meta✴ по диверсификации бизнеса и снижения зависимости от рекламного направления. Компания может ввести несколько тарифов с подпиской на сервисы ИИ — самый дорогой вариант достигнет $200 в месяц. Первые варианты ИИ-агента Hatch обучены взаимодействовать с сайтами и популярными сервисами, в том числе DoorDash, Etsy, Reddit, Yelp и Outlook: для пользователя предусмотрена центральная панель управления ИИ-агентами, которым будут поручаться разные задачи с доступом к различным инструментам. Здесь будут собраны все навыки приложения — от фитнес-трекера до планирования поездок. Hatch запланирован к выпуску на конец августа или начало сентября, утверждают источники. Meta✴ также планирует запустить в составе мессенджера WhatsApp платформу для управления ИИ-агентами.

Наряду с Hatch, компания готовится выпустить в октябре новую ИИ-модель, которая проходит под кодовым именем Watermelon. Подробностей о ней немного — она может выйти в составе линейки Meta✴ Muse или стать отдельным продуктом. Компания ускорила темпы разработки ИИ в стремлении сократить отставание от крупнейших конкурентов; выпускаются как открытые, так и проприетарные системы. В ближайшей перспективе Meta✴ намерена монетизировать это направление деятельности.

«Мы этого заслуживаем»: сотрудники Samsung сочинили песню про премию, которую им не дали

Катализатором творческих процессов обычно являются сильные эмоции, и если они носят негативную окраску, то и произведения получаются соответствующими. Как поясняет Nikkei Asian Review, на YouTube в прошлом месяце появилась меланхолическая баллада о том, что не всем сотрудникам Samsung Electronics достались щедрые премии от бума ИИ.

 Источник изображения: Samsung Electronics

Источник изображения: Samsung Electronics

Напомним, в начале лета крупнейшее профессиональное объединение работников Samsung Electronics выбило через угрозу масштабной забастовки особые условия премирования для тех, кто занят на производстве микросхем памяти. Настояв на перераспределении между сотрудниками солидной части операционной прибыли, работники полупроводникового подразделения по итогам текущего года теперь могут получить премии в размере более $400 000 на человека. Правда, основная часть суммы будет выдана акциями Samsung, которые нельзя будет сразу реализовать, но будущие доходы таких сотрудников всё равно становятся объектом зависти тех коллег, которых ИИ-бум не обласкал подобными бонусами.

Ресурс Nikkei Asian Review подчёркивает, что разница между годовыми премиями сотрудников подразделений памяти и смартфонов в текущем финансовом году будет достигать двух порядков. То есть, первые получат в 100 раз больше премиальных выплат, чем вторые. Операционная прибыль полупроводникового подразделения Samsung во втором квартале взлетела более чем в 200 раз на волне ИИ-бума.

Автор выложил на YouTube четырёхминутную меланхоличную балладу «Мы этого заслуживаем», посвятив её «сотрудникам Samsung, к которым работодатель отнёсся несправедливо только по той причине, что они не принадлежат к полупроводниковому подразделению». Меланхоличная баллада содержит слова: «Мама, я разрабатываю бытовую технику, а не полупроводники». Произведение было прослушано более 60 000 раз и набрало немало одобрительных комментариев.

Стократный разрыв в величине премиальных выплат деморализует сотрудников подразделений Samsung, которые не имеют отношения к производству памяти, как отмечают представители их профсоюза. За последние два месяца численность этого профессионального объединения выросла с 2000 до 30 000 человек, поскольку обделённые заоблачными премиями сотрудники компании решили активнее бороться за свои права. Во втором квартале операционная прибыль полупроводникового бизнеса Samsung выросла в годовом сравнении в 223 раза, и из этих средств компания собирается выплачивать не только премии ряду сотрудников, но и дивиденды акционерам. В последнем случае планируется вернуть инвесторам около $72 млрд в общей сложности. Разумеется, подобная избирательность выплат устраивает далеко не всех внутри компании.

Напомним, что подразделение Samsung по выпуску смартфонов в прошлом квартале впервые получило операционные убытки — по иронии, как раз из-за резкого роста цен на память, который подогрел прибыль полупроводникового подразделения компании. В своём развитии Samsung Electronics исторически компенсировала потери на одном направлении за счёт прибыли на другом. Фактически, выпуском телевизоров и бытовой техники компания занимается с 1960-х и 1970-х годов прошлого века, а выпускать полупроводниковые компоненты она начала только в 1980-е. В определённые периоды всю прибыль с прочих направлений она инвестировала в полупроводниковый бизнес. Опять же, когда последний в 2023 году на фоне низких цен на память понёс убытки, они компенсировались доходами от реализации смартфонов. Поэтому сотрудников Samsung особенно возмущает, что теперь, когда подразделения поменялись местами, доходы от бума ИИ распределяются столь неравномерно. Призывы председателя Samsung Electronics Ли Чжэ Ёна (Lee Jae-yong) к единству коллектива, прозвучавшие накануне майской забастовки, на этом фоне вряд ли способствуют поднятию боевого духа.

SpaceX начнёт выводить на орбиту космические ЦОД в четвёртом квартале следующего года

Объединение SpaceX и xAI с последующим выходом на IPO происходило под флагом идеи запуска в ближайший космос центров обработки данных, которые не будут занимать место на Земле и смогут питаться солнечной энергией. Илон Маск (Elon Musk) на этой неделе заявил, что вывод таких ЦОД на орбиту начнётся в четвёртом квартале следующего года.

 Источник изображения: SpaceX

Источник изображения: SpaceX

Уже в 2028 году, по его словам, которые приводит Bloomberg, подобная деятельность SpaceX достигнет «существенных масштабов». Компания подала заявку в Федеральную комиссию по связи США, которая должна позволить ей вывести на орбиту Земли до 1 млн спутников, играющих роль космических центров обработки данных для фирменной инфраструктуры ИИ. В основу этих ЦОД лягут компоненты производства Nvidia, поскольку с недавних пор SpaceX решила сосредоточиться именно на платформе этого поставщика.

Со страниц социальной сети X, которая номинально также входит в SpaceX, глава всех трёх компаний пояснил, что «спутниковые ЦОД» окажутся существенно проще по конструкции, дешевле, легче и будут обладать более высокой плотностью компоновки по сравнению с традиционными серверными стойками. В первом поколении космических ЦОД компания собирается использовать оптимизированные для такой среды эксплуатации компоненты Nvidia семейства Vera Rubin NVL72. Когда SpaceX только готовилась к IPO, Маск говорил о намерениях начать вывод на орбиту ЦОД лишь в 2028 году, но уже на последующем квартальном отчётном мероприятии заявил, что это случится в текущем году. Центральные процессоры Nvidia Vera будут использоваться в инфраструктуре SpaceX для синхронизации работы наземных и космических ЦОД соответственно.

Nvidia заявила, что ускорители Groq 3 LPX начали массово выпускаться и выйдут на рынок в этом году

Декабрьская сделка на сумму $20 млрд, которая дала Nvidia доступ к разработкам стартапа Groq, имела не совсем обычную структуру, но позволила первой из компаний на этой неделе заявить, что ускорители Groq 3 LPX уже выпускаются серийно и появятся на рынке до конца текущего года. Данные чипы специализируются на ускорении инференса в инфраструктуре ИИ.

 Источник изображения: Nvidia

Источник изображения: Nvidia

Ускорители Groq 3 LPX войдут в состав платформы Vera Rubin, они будут использоваться в агентских задачах. Первым клиентом Nvidia, который подписал контракт на получение ускорителей Groq, стала компания Nebius Аркадия Воложа, являющегося основателем Яндекс. В одной серверной стойке могут быть объединены до 256 ускорителей LP30, которые позволяют снизить задержки при обработке запросов в агентских задачах ИИ. Продемонстрированные Artificial Analysis результаты тестирования Groq 3 LPX в открытой модели Gemma 4 31B позволяют говорить, что ускоритель обеспечивает рекордную пропускную способность в 3400 токенов за секунду при размере контекстного окна в 100 000 токенов. По словам Nvidia, это повышает отзывчивость системы в четыре раза по сравнению с конкурирующими решениями, значительно сокращая время выполнения работы ИИ-агентами. Во многом этому способствует наличие на чипе Groq 3 LPX скоростной памяти SRAM объёмом 500 Мбайт.

Одновременно на конференции Hot Chips компания Nvidia заявила, что ей удалось заключить контракт со SpaceX на поставку компонентов платформы Vera Rubin. Как минимум, компания Илона Маска (Elon Musk) будет использовать центральные процессоры Vera для слаживания работы наземных и космических ЦОД. Чипы Groq 3 LPX для Nvidia выпускаются компанией Samsung Electronics, поскольку исходный стартап сотрудничал с этим контрактным производителем. Для остальной части продукции Nvidia более характерно использование услуг тайваньской TSMC. Основатель Nvidia Дженсен Хуанг (Jensen Huang) весной этого года заявил, что ускорители типа Groq займут до четверти рынка ЦОД в сегменте, ориентированном на разработку программного обеспечения с помощью ИИ.

Реклама в ChatGPT стала доступна для европейских пользователей из 31 страны

OpenAI запустила 24 августа в ChatGPT рекламу в 31 стране Европы, сообщили «Ведомости» со ссылкой на блог компании. На первом этапе размещение будет доступно через рекламное подразделение OpenAI, агентства и технологических партнёров, а самостоятельный запуск через менеджер рекламы появится позднее в этом квартале.

 Источник изображения: OpenAI (изменено)

Источник изображения: OpenAI (изменено)

Тестировать рекламу в сервисе OpenAI начала ещё в феврале в США, после чего за шесть месяцев распространила пилотный проект ещё на восемь рынков. Выход в 31 европейскую страну, включая Германию, Францию, Испанию, Италию, Швецию, Норвегию, Данию, Нидерланды и Австрию, станет следующим этапом международного расширения платформы. По данным компании, рекламой ChatGPT на сегодня уже воспользовались десятки тысяч рекламодателей.

За время тестирования OpenAI расширила набор рекламных инструментов. Помимо модели оплаты за тысячу показов (CPM), платформа теперь поддерживает оплату за клики (CPC) и оплату по модели oCPC (Optimized Cost Per Click) за совершения целевых действий. Также появились геотаргетинг, создание пользовательской аудитории и инструменты оценки результатов рекламных кампаний, включая OpenAI Pixel, Conversions API и интеграцию со сторонними системами аналитики.

OpenAI заявляет, что рекламные объявления в ChatGPT чётко маркируются и отделяются от ответов сервиса, а их размещение не влияет на содержание ответов ChatGPT. Компания планирует показывать рекламу в ситуациях, когда пользователи изучают и сравнивают товары или услуги и планируют покупки.

Intel раскрыла устройство Crescent Island — ИИ-ускорителя с огромным объёмом дешёвой памяти

В рамках конференции Hot Chips 2026 компания Intel раскрыла новые подробности об устройстве ускорителя Crescent Island, предназначенного для выполнения задач ИИ-инференса в центрах обработки данных. Компания впервые подробно рассказала о вычислительной части GPU: он получит 32 ядра Xe3P и 256 матричных движков XMX. Ранее Intel уже сообщала, что Crescent Island будет выпускаться в виде PCIe-карт с воздушным охлаждением и сможет оснащаться до 480 Гбайт памяти LPDDR5X.

Вычислительная часть Crescent Island разделена на четыре блока Compute Slice, каждый из которых объединяет по восемь ядер Xe. В сумме GPU располагает 32 ядрами Xe3P, 256 векторными движками и таким же количеством матричных движков XMX, отвечающих за ускорение операций, используемых нейросетями. Каждое ядро Xe располагает 512 Кбайт объединённого кеша L1 и локальной памяти SLM, поэтому их суммарный объём достигает 16 Мбайт. Кроме того, в GPU предусмотрено 32 Мбайт общего кеша второго уровня.

Архитектура Xe3P представляет собой специализированное развитие Xe3 с упором на производительность и энергоэффективность при вычислительных нагрузках. В Crescent Island Intel отказалась от блоков, необходимых для обработки традиционной 3D-графики, направив освободившийся транзисторный бюджет на вычислительные ресурсы. Ускоритель поддерживает широкий набор форматов данных от FP4, ориентированного на ИИ-инференс, до FP64, необходимого для высокоточных вычислений.

Одной из наиболее необычных особенностей Crescent Island станет подсистема памяти. Вместо дорогой HBM, которую используют современные ускорители Nvidia и AMD, Intel выбрала LPDDR5X. Эталонная карта самой Intel получит 160 Гбайт памяти, тогда как партнёры смогут создавать ускорители с объёмом до 480 Гбайт. Такой подход обеспечивает меньшую пропускную способность по сравнению с HBM, однако позволяет существенно увеличить объём памяти при умеренной стоимости и энергопотреблении. Большой объём памяти должен позволить размещать на одном ускорителе крупные языковые модели, обслуживать более длинный контекст и одновременно выполнять запросы большего числа ИИ-агентов.

При этом Crescent Island рассчитан не на конкуренцию с наиболее производительными ускорителями для обучения нейросетей, а прежде всего на экономичное выполнение уже обученных моделей. Intel делает особый акцент на стоимости генерации токенов и возможности устанавливать новые ускорители в существующие серверы без перехода на жидкостное охлаждение. Эталонная PCIe-карта Crescent Island имеет энергопотребление 350 Вт и рассчитана на обычное воздушное охлаждение.

Фактически Intel пытается занять отдельную нишу на быстро растущем рынке ИИ-ускорителей: вместо максимальной вычислительной мощности Crescent Island предлагает сочетание большого объёма относительно дешёвой памяти, умеренного энергопотребления и специализированных вычислительных блоков. Такой подход особенно интересен для инференса крупных моделей, где возможность целиком разместить модель и её контекст в памяти ускорителя зачастую оказывается не менее важна, чем пиковая вычислительная производительность.

Crescent Island был впервые анонсирован Intel осенью прошлого года с 160 Гбайт LPDDR5X, а весной компания расширила спецификацию платформы, разрешив партнёрам создавать версии с объёмом памяти до 480 Гбайт. Первые образцы ускорителей должны поступить клиентам во второй половине 2026 года. Данные о производительности Crescent Island и сроки начала серийных поставок Intel пока не раскрыла.

В контрабанде ИИ-ускорителей в Китай оказался замешан топ-менеджер Nvidia — теперь ему грозит 5 лет тюрьмы

По словам осведомлённых источников, тайваньская прокуратура предъявила обвинение высокопоставленному руководителю Nvidia за участие в контрабанде передовых ИИ-чипов в Китай. Предположительно, сотрудник Nvidia, по фамилии Чанг, вместе с восемью другими лицами организовал доставку 74 серверов с чипами B300 в Китай через Японию и Индонезию, обойдя торговые ограничения США. Попытка переправить ещё 56 серверов была пресечена тайваньскими властями.

 Источник изображения: unsplash.com

Источник изображения: unsplash.com

Помимо Чанга, обвинения предъявлены двум высокопоставленным сотрудникам компании SuperMicro. По словам прокуратуры, группа «вступала в сговор вертикально и горизонтально ради получения непомерной прибыли, незаконно экспортируя высокопроизводительные серверы, увеличивая корпоративные издержки на соблюдение нормативных требований и серьёзно нанося ущерб международному имиджу Тайваня».

Обвинения также предъявлены высокопоставленным сотрудникам ещё четырёх компаний. Это Albatron Technology —реселлер оборудования SuperMicro, Flying Tiger — предполагаемый конечный пользователь контрабандного оборудования Nvidia и две компании-посредника, которые помогали организовывать китайских клиентов и содействовали фактической доставке. Для Чанга прокуратура требует пяти лет тюремного заключения — его считают «ключевой фигурой» в этой преступной схеме и обвиняют в том числе в подделке документов и злоупотреблении доверием.

Вашингтон давно ограничивает Пекин в покупке американских чипов для ИИ, но китайским компаниям нелегальными путями всё же удавалось получить доступ к желанным ускорителям. Американские чиновники утверждают, что за последние несколько лет в Китай попало оборудование Nvidia на миллиарды долларов.

Тайвань не обвинил Nvidia как компанию в каких-либо правонарушениях. Nvidia отвергла возможность контрабанды своих ускорителей ИИ. «Контрабанда исключена, — заявил представитель Nvidia. — Мы в основном продаём нашу продукцию известным партнёрам, включая OEM-производителей, которые помогают нам гарантировать, что все продажи соответствуют правилам экспортного контроля США».

По мнению тайваньской прокуратуры, преступная схема работала следующим образом. Топ-менеджеры Flying Tiger создали в Японии компанию, предназначенную для использования в качестве транзитного пункта для контрабандного оборудования. Им удалось добиться включения Flying Tiger в список партнёров Nvidia. Совместно со старшим директором по продажам SuperMicro, генеральным директором Albatron и менеджером тайваньского оператора ЦОД Chief Telecom, злоумышленникам удалось создать впечатление, будто Flying Tiger арендовала достаточно места на объекте Chief Telecom для размещения оборудования.

Преступникам удалось обманным путём убедить проверяющих в своей добросовестности, после чего SuperMicro согласилась продать Flying Tiger 130 серверов. В начале 2026 года группа обвиняемых договорилась о продаже 40 из этих серверов одному неназванному китайскому клиенту, разделив поставки между прямой доставкой в ​​Китай и доставкой через Индонезию — все от имени Flying Tiger. Ещё 34 сервера были экспортированы компанией Long Wins, которая оказалась замешана в этом деле благодаря связям со вторым обвиняемым менеджером Super Micro. Это оборудование было разделено между Индонезией и Японией, прежде чем попасть во вторую китайскую компанию, покупку которой организовала Long Wins.

Тайваньские власти пресекли эту криминальную схему, когда Flying Tiger попыталась экспортировать оставшиеся 56 серверов в Японию с поддельными документами. Глава Nvidia Дженсен Хуанг (Jensen Huang) прибыл в Тайбэй через несколько дней после этого инцидента. В то время тайваньские власти задержали только трёх человек и заявили, что изъяли неустановленное количество серверов Super Micro, содержащих чипы Nvidia. Хуанг заявил, что Nvidia «строго» разъясняет правила, а ответственность лежит на SuperMicro. SuperMicro, в свою очередь, сообщила, что её политика продаж соответствует политике Nvidia, и призвала к общеотраслевым решениям.

Сэм Альтман боится не только восстания ИИ — его пугает переход контроля над технологией в руки избранных

Гендиректор OpenAI Сэм Альтман (Sam Altman) выразил опасения по поводу того, что контроль над искусственным интеллектом окажется в руках небольшого числа компаний и людей. В таком случае потребители не смогут влиять на то, как эта технология меняет окружающий мир, пишет Business Insider.

 Источник изображения: Growtika/unsplash.com

Источник изображения: Growtika/unsplash.com

«Правильный подход заключается в том, чтобы сказать, что мы хотим, чтобы люди в значительной степени контролировали будущее, — сказал Альтман. — Общество и модели будут развиваться совместно».

Альтман добавил, что его также беспокоит возможность выхода ИИ из-под контроля людей. По его словам, страх перед этим может привести к реализации первого опасения. «Многие люди так нервничают из-за масштаба этих рисков, что поддаются этому страху и чувствуют необходимость защитить мир, — сказал он. — Как будто, знаете ли, “мы должны пожертвовать большой свободой ради безопасности”».

Как полагает Business Insider, Альтман, скорее всего, имел в виду гендиректора Anthropic Дарио Амодеи (Dario Amodei), который предупреждает об опасностях, связанных с быстрым развитием ИИ. Амодеи выступает за более активное государственное регулирование ИИ, что, по мнению Альтмана, может привести к ограничению свободы ради повышения безопасности.

Anthropic — одна из немногих крупных компаний в сфере ИИ, не подписавших в прошлом месяце письмо в поддержку моделей с открытыми весами, которые позволяют разработчикам обмениваться ими, загружать, модифицировать и развёртывать их на собственной инфраструктуре.

Ряд американских компаний, включая Nvidia, Meta✴ и Microsoft, утверждают, что США необходимо способствовать более широкому использованию моделей с открытыми весами, как это происходит в Китае, иначе страна рискует потерять лидерство в гонке ИИ.

Более 90 % трафика на сайты интернет-магазинов сейчас генерируют боты, охотящиеся за DDR5

Не секрет, что в последние пару лет дефицит оперативной памяти и рост цен на неё вызван бурным развитием вычислительной инфраструктуры для систем искусственного интеллекта, но родственные технологии при этом применяются и при поиске модулей памяти в рознице. Исследователи утверждают, что в ряде случаев более 90 % обращений к страницам интернет-магазинов, на которых продаётся память DDR5, сейчас генерируют программные роботы.

 Источник изображения: Crucial

Источник изображения: Crucial

Получается, что из десяти визитов на профильные страницы некоего интернет-магазина приходится только одно обращение живого человека. Исследование DataDome показало, что 91 предложение DDR5 в онлайн-рознице в среднем получало около 50 000 обращений в час. В среднем на каждую страницу приходилось по 551 запросу, каждые 6,5 секунд кто-то проверял, есть ли желанная память в наличии. Боты обращались к страницам сайтов, на которых предлагались не только игровые модули DDR5, но и разъёмы для их установки на материнские платы. Кроме того, эти программные средства использовали методы более частого обновления интернет-страниц, чтобы не получать устаревшие данные о наличии товара из кеша.

Для сравнения, в марте пропорция автоматизированных запросов достигала «6:1», поэтому по её увеличению можно судить о сохранении высокого спроса на оперативную память. У рядовых покупателей остаётся всё меньше шансов купить память по адекватным для текущего состояния рынка ценам, поскольку все самые интересные предложения достаются специализированным ботам.


window-new
Soft
Hard
Тренды 🔥
«Вито в сделку не входил»: в масштабной утечке Valve нашли вырезанную концовку Mafia 2 12 мин.
Ролевой боевик No Rest for the Wicked от авторов Ori не выйдет из раннего доступа Steam в 2026 году 2 ч.
Свежий драйвер GeForce 616.56 заставил мерцать некоторые мониторы — Nvidia уже работает над исправлением 2 ч.
80 % разработчиков Star Wars Zero Company остались без зарплаты, и Electronic Arts тут ни при чём 3 ч.
Sonos попытается вернуть доверие пользователей с помощью ИИ-агентов — представлена ОС Sonos 27 для аудиосистем 3 ч.
Mozilla встроила блокировщик рекламы в Firefox для iPhone 3 ч.
Anthropic вновь разрешила ИИ-моделям атаковать реальные компании в рамках тестов — но теперь с усиленной защитой 4 ч.
Double Fine пообещала сделать Brutal Legend 2, но при одном условии 4 ч.
Группа фанатов возродит амбициозный сетевой экшен APB: All Points Bulletin от создателя GTA — подробности и геймплей 5 ч.
Google Gemini сможет «думать» в фоне, пока пользователь занимается другими делами на смартфоне 5 ч.
«Надёжность и долговечность»: Джон Тернус возглавил Apple и раскрыл свои приоритеты на посту гендира 2 ч.
Sonos представила полностью переработанный саундбар Beam Ultra со звуком 7.1.2 и поддержкой Dolby Atmos 2 ч.
Sonos представила наушники Ace Ultra с эффективным шумоподавлением и повышенной автономностью за $450 3 ч.
Самая дешёвая GeForce RTX 5090 теперь стоить $5000 в США — в 2,5 раза дороже, чем на момент анонса 3 ч.
Учёные создали дрон с «кошачьими когтями» — он садится на айсберги и крутые ледяные скалы 3 ч.
Steam Deck получила поддержку более 30 тыс. игр из библиотеки Steam 4 ч.
SilverStone выпустила блок питания HELA 3000Rz на 3000 Вт — он справится с четвёркой RTX 5090 5 ч.
При Тиме Куке акции Apple выросли на 2275 % — но Джону Тернусу не обязательно повторять его успех 5 ч.
Asus раскрыла характеристики ноутбука ProArt P14 — одного из первых на процессоре Nvidia RTX Spark 5 ч.
OpenAI отвергла новые обвинения Apple в краже технологий как безосновательные 5 ч.