Сегодня 19 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → stable diffusion

Японцы научили ИИ видеть сквозь стены при помощи Wi-Fi

Подключённые к Wi-Fi устройства вокруг нас постоянно обмениваются сигналами пространственно ориентированных радиоволн. Эти радиоволны отражаются от стен, мебели и других предметов в пространстве, формируя информацию о местоположении этих объектов. Такой набор данных или информацию о состоянии канала Wi-Fi (Wi-Fi CSI) ранее научились использовать для построения грубых эскизов помещений, и точность этих эскизов можно повысить при помощи искусственного интеллекта.

 Источник изображения: Institute of Science Tokyo

Источник изображения: Institute of Science Tokyo

Исследователи Токийского университета науки предложили способ обрабатывать данные Wi-Fi CSI при помощи диффузионных моделей ИИ. Построенная на математических алгоритмах визуализация Wi-Fi CSI даёт лишь приблизительные результаты из-за недостаточных объёмов исходной информации и требует слишком больших вычислительных ресурсов — эти пробелы способна восполнить диффузионная модель ИИ, обученная создавать фотореалистичные изображения. Это достигается преобразованием Wi-Fi CSI в латентное (скрытое) пространство — общее представление объектов, которым оперируют диффузионные модели ИИ, а не в набор пикселей; поэтому метод получил название LatentCSI.

Технология LatentCSI предполагает перевод Wi-Fi CSI в латентное пространство, которое затем транслируется в предварительно обученную диффузионную модель, а она уже генерирует изображение высокого разрешения с мелкими деталями и текстурами, которые Wi-Fi сам по себе «разглядеть» не в состоянии. В своём проекте исследователи подключили кодировщик Wi-Fi CSI к модели Stable Diffusion 3, которая принимала его данные как запросы на генерацию изображения, что позволило экономить вычислительные ресурсы. Важно, что модель проходила предварительное обучение на реальных фотографиях изучаемого помещения, то есть она знала, как оно выглядит пустым. После этого ИИ восстанавливал положение переменной среды, показывая, сколько человек находилось в комнате, где они стояли, и каково было общее расположение объектов внутри.

Едва ли провайдеры теперь смогут следить за абонентами при помощи маршрутизаторов, но некоторые вопросы об угрозе конфиденциальности технология LatentCSI всё-таки вызывает. Она, вероятно, поможет следить за людьми, хотя сейчас это просто лабораторная демонстрация. Это уже не первое подобное решение: ранее итальянские учёные предложили способ идентифицировать людей по искажениям, которые их тела вносят в сигналы Wi-Fi; а американские исследователи построили на радиосигналах систему зрения для роботов.

Stability AI выпустила ИИ-генератор музыки, который быстро работает даже на смартфоне

Stability AI, разработчик популярной нейросети Stable Diffusion, представила музыкальную ИИ-модель Stable Audio Open Small, которая генерирует аудио в стереозвучании и способна работать на смартфонах без подключения к интернету. Модель создана совместно с производителем чипов Arm, чьи процессоры используются в большинстве мобильных устройств, и способна быстро генерировать аудио в высоком качестве даже на устройствах с ограниченными вычислительными ресурсами.

 Источник изображения: AI

Источник изображения: AI

В отличие от конкурентов, таких как Suno и Udio, которым требуется облачная обработка, Stable Audio Open Small работает локально. При этом, как отмечает TechCrunch, обучение модели проводилось только на данных из бесплатных аудиобиблиотек Free Music Archive и Freesound, что снижает риски нарушения авторских прав и выгодно отличает её от некоторых других ИИ-сервисов, использующих защищённый контент.

Модель содержит 341 миллион параметров и оптимизирована для процессоров Arm. Она предназначена для быстрого создания коротких аудиосэмплов и звуковых эффектов, например, ударных или инструментальных партий. По заявлению Stability AI, на смартфоне ИИ может сгенерировать 11-секундное аудио менее чем за восемь секунд.

Одновременно у Stable Audio Open Small есть некоторые ограничения. Например, она понимает текстовые запросы только на английском языке, не умеет создавать реалистичный вокал или сложные музыкальные композиции. Кроме того, компания признаёт, что из-за того, что модель обучалась на западно-ориентированных данных, она лучше справляется со стилями, присущими западной музыке.

Ещё одна сложность заключается в условиях использования. Для исследователей, любителей и малого бизнеса ИИ-модель доступна бесплатно, но если годовой доход компании превышает $1 млн, потребуется покупка коммерческой лицензии. И хотя для инди-разработчиков такие условия выгодны, для крупных проектов это может стать определённой сложностью.

Напомним, Stability AI, известная по своей модели глубокого обучения Stable Diffusion, генерирующей изображения по текстовым описаниям, в последние месяцы пытается восстановить репутацию после финансовых проблем при бывшем генеральном директоре Эмаде Мостаке (Emad Mostaque). Компания привлекла инвестиции, назначила нового главу и добавила в совет директоров режиссёра Джеймса Кэмерона (James Cameron). Параллельно она продолжает выпускать новые генеративные модели, включая новые инструменты для создания изображений.

StabilityAI представила улучшенную ИИ-модель для генерации изображений Stable Diffusion 3.5

Компания StabilityAI представила новую версию ИИ-модели для генерации изображений Stable Diffusion 3.5 с улучшенным реализмом, точностью и стилизацией. По сообщению Tom's Guide, модель бесплатна для некоммерческого использования, включая научные исследования, а также для малых и средних предприятий с доходом до $1 млн.

 Источник изображения: StabilityAI

Источник изображения: StabilityAI

Как и предыдущая версия SD3, Stable Diffusion 3.5 доступен в трёх конфигурациях: Large (8B), Large Turbo (8B) и Medium (2,6B). Все конфигурации оптимизированы для работы на обычном пользовательском оборудовании и их можно настраивать. В своём пресс-релизе StabilityAI признала, что модель Stable Diffusion 3 Medium, выпущенная в июне, не полностью соответствовала стандартам и ожиданиям сообщества. «После того как мы выслушали ценные отзывы, вместо быстрого исправления мы решили уделить время разработке версии, которая продвигает нашу миссию по трансформации визуальных медиа», — сказали в компании.

Новые модели ориентированы на возможность гибкой настройки, высокую производительность и разнообразие результатов. Поддерживаются стилистические настройки, включая фотографию и живопись. Для указания определённого стиля можно также использовать хештеги, например, boho, impressionism или modern. Ещё можно выделять ключевые слова в запросе для получения более реалистичных изображений.

Модель Stable Diffusion 3.5 Large лидирует на рынке по лучшему соответствию запросам и качеству изображений. Модель Turbo имеет минимальное время вывода результатов. Medium превосходит другие модели в плане баланса между качеством изображений и соответствия запросам, что делает её, по утверждению компании, самым эффективным выбором для создания контента.

Все три конфигурации свободно доступны по лицензии Stability AI Community License. Для использования в коммерческих целях потребуется лицензия Enterprise License.


window-new
Soft
Hard
Тренды 🔥
Кибербезопасность пожертвований: как защитить данные доноров от хакеров 20 мин.
Стоимость развёртывания ведущих мировых ИИ-моделей в России за год выросла в 2,8 раза 60 мин.
Грандиозная космическая опера Exodus в духе Mass Effect заинтересовала более полумиллиона игроков — разработчики подготовили награды 3 ч.
Telegram регистрирует .gram — все пользователи получат собственные домены 3 ч.
Microsoft Copilot сам рассказал, как обойти его защиту — исследователи нашли способ красть данные по ссылке 4 ч.
Пиратское кино в России пошло в рост впервые с 2019 года — рынок нелегального видео достиг $17,3 млн 4 ч.
Угодить всем будет сложно: разработчики The Expanse: Osiris Reborn рассказали, как решения игрока влияют на сюжет, фракции и персонажей 4 ч.
«Мы не можем требовать $60 за игру на пять часов без мультиплеера!»: ветеран Naughty Dog раскрыл, как Uncharted: Drake's Fortune замедляла игроков 5 ч.
«Яндекс» начал активно заполнять ИИ-поиск рекламой — пока ещё в тестовом режиме 5 ч.
ИИ на самом деле не взбунтовался — он просто выполнял инструкции 5 ч.
Разработчик инференс-чипов Etched привлёк ещё $700 млн, доведя оценку капитализации до $21 млрд 14 мин.
Seasonic готовит первый потребительский блок питания с сертификатом 80 Plus Ruby — он даст КПД от 85 до 95 % 16 мин.
Google раскрыла, когда проведёт официальную презентацию Googlebook 23 мин.
Представлен 3D-принтер для атомарной печати невозможных в природе материалов — к нему уже прикрутили ИИ и дали свободу творить 25 мин.
Cerebras представила ИИ-стойки CS-4 с тремя разогнанными царь-ускорителями WSE-3 Turbo 2 ч.
Nokia не выдержала конкуренции и собирается свернуть бизнес в Китае до конца года 2 ч.
Credo организовала разработку открытого чиплетного интерконнекта для ИИ-систем в рамках OCP 3 ч.
Дивиденды ИИ-бума: SK hynix раздаст акционерам $29 млрд — компания запускает рекордный выкуп акций 4 ч.
Электромобили начнут заряжаться от Солнца — крупнейший производитель автостёкол готов к массовому выпуску солнечных крыш 4 ч.
Samsung заработает на дефиците чипов — она подняла цены на контрактное производство на 15 % 4 ч.