|
Опрос
|
реклама
Быстрый переход
Японцы научили ИИ видеть сквозь стены при помощи Wi-Fi
02.10.2025 [18:52],
Павел Котов
Подключённые к Wi-Fi устройства вокруг нас постоянно обмениваются сигналами пространственно ориентированных радиоволн. Эти радиоволны отражаются от стен, мебели и других предметов в пространстве, формируя информацию о местоположении этих объектов. Такой набор данных или информацию о состоянии канала Wi-Fi (Wi-Fi CSI) ранее научились использовать для построения грубых эскизов помещений, и точность этих эскизов можно повысить при помощи искусственного интеллекта.
Источник изображения: Institute of Science Tokyo Исследователи Токийского университета науки предложили способ обрабатывать данные Wi-Fi CSI при помощи диффузионных моделей ИИ. Построенная на математических алгоритмах визуализация Wi-Fi CSI даёт лишь приблизительные результаты из-за недостаточных объёмов исходной информации и требует слишком больших вычислительных ресурсов — эти пробелы способна восполнить диффузионная модель ИИ, обученная создавать фотореалистичные изображения. Это достигается преобразованием Wi-Fi CSI в латентное (скрытое) пространство — общее представление объектов, которым оперируют диффузионные модели ИИ, а не в набор пикселей; поэтому метод получил название LatentCSI. Технология LatentCSI предполагает перевод Wi-Fi CSI в латентное пространство, которое затем транслируется в предварительно обученную диффузионную модель, а она уже генерирует изображение высокого разрешения с мелкими деталями и текстурами, которые Wi-Fi сам по себе «разглядеть» не в состоянии. В своём проекте исследователи подключили кодировщик Wi-Fi CSI к модели Stable Diffusion 3, которая принимала его данные как запросы на генерацию изображения, что позволило экономить вычислительные ресурсы. Важно, что модель проходила предварительное обучение на реальных фотографиях изучаемого помещения, то есть она знала, как оно выглядит пустым. После этого ИИ восстанавливал положение переменной среды, показывая, сколько человек находилось в комнате, где они стояли, и каково было общее расположение объектов внутри. Едва ли провайдеры теперь смогут следить за абонентами при помощи маршрутизаторов, но некоторые вопросы об угрозе конфиденциальности технология LatentCSI всё-таки вызывает. Она, вероятно, поможет следить за людьми, хотя сейчас это просто лабораторная демонстрация. Это уже не первое подобное решение: ранее итальянские учёные предложили способ идентифицировать людей по искажениям, которые их тела вносят в сигналы Wi-Fi; а американские исследователи построили на радиосигналах систему зрения для роботов. Stability AI выпустила ИИ-генератор музыки, который быстро работает даже на смартфоне
14.05.2025 [23:39],
Анжелла Марина
Stability AI, разработчик популярной нейросети Stable Diffusion, представила музыкальную ИИ-модель Stable Audio Open Small, которая генерирует аудио в стереозвучании и способна работать на смартфонах без подключения к интернету. Модель создана совместно с производителем чипов Arm, чьи процессоры используются в большинстве мобильных устройств, и способна быстро генерировать аудио в высоком качестве даже на устройствах с ограниченными вычислительными ресурсами.
Источник изображения: AI В отличие от конкурентов, таких как Suno и Udio, которым требуется облачная обработка, Stable Audio Open Small работает локально. При этом, как отмечает TechCrunch, обучение модели проводилось только на данных из бесплатных аудиобиблиотек Free Music Archive и Freesound, что снижает риски нарушения авторских прав и выгодно отличает её от некоторых других ИИ-сервисов, использующих защищённый контент. Модель содержит 341 миллион параметров и оптимизирована для процессоров Arm. Она предназначена для быстрого создания коротких аудиосэмплов и звуковых эффектов, например, ударных или инструментальных партий. По заявлению Stability AI, на смартфоне ИИ может сгенерировать 11-секундное аудио менее чем за восемь секунд. Одновременно у Stable Audio Open Small есть некоторые ограничения. Например, она понимает текстовые запросы только на английском языке, не умеет создавать реалистичный вокал или сложные музыкальные композиции. Кроме того, компания признаёт, что из-за того, что модель обучалась на западно-ориентированных данных, она лучше справляется со стилями, присущими западной музыке. Ещё одна сложность заключается в условиях использования. Для исследователей, любителей и малого бизнеса ИИ-модель доступна бесплатно, но если годовой доход компании превышает $1 млн, потребуется покупка коммерческой лицензии. И хотя для инди-разработчиков такие условия выгодны, для крупных проектов это может стать определённой сложностью. Напомним, Stability AI, известная по своей модели глубокого обучения Stable Diffusion, генерирующей изображения по текстовым описаниям, в последние месяцы пытается восстановить репутацию после финансовых проблем при бывшем генеральном директоре Эмаде Мостаке (Emad Mostaque). Компания привлекла инвестиции, назначила нового главу и добавила в совет директоров режиссёра Джеймса Кэмерона (James Cameron). Параллельно она продолжает выпускать новые генеративные модели, включая новые инструменты для создания изображений. StabilityAI представила улучшенную ИИ-модель для генерации изображений Stable Diffusion 3.5
23.10.2024 [05:06],
Анжелла Марина
Компания StabilityAI представила новую версию ИИ-модели для генерации изображений Stable Diffusion 3.5 с улучшенным реализмом, точностью и стилизацией. По сообщению Tom's Guide, модель бесплатна для некоммерческого использования, включая научные исследования, а также для малых и средних предприятий с доходом до $1 млн.
Источник изображения: StabilityAI Как и предыдущая версия SD3, Stable Diffusion 3.5 доступен в трёх конфигурациях: Large (8B), Large Turbo (8B) и Medium (2,6B). Все конфигурации оптимизированы для работы на обычном пользовательском оборудовании и их можно настраивать. В своём пресс-релизе StabilityAI признала, что модель Stable Diffusion 3 Medium, выпущенная в июне, не полностью соответствовала стандартам и ожиданиям сообщества. «После того как мы выслушали ценные отзывы, вместо быстрого исправления мы решили уделить время разработке версии, которая продвигает нашу миссию по трансформации визуальных медиа», — сказали в компании. Новые модели ориентированы на возможность гибкой настройки, высокую производительность и разнообразие результатов. Поддерживаются стилистические настройки, включая фотографию и живопись. Для указания определённого стиля можно также использовать хештеги, например, boho, impressionism или modern. Ещё можно выделять ключевые слова в запросе для получения более реалистичных изображений. Модель Stable Diffusion 3.5 Large лидирует на рынке по лучшему соответствию запросам и качеству изображений. Модель Turbo имеет минимальное время вывода результатов. Medium превосходит другие модели в плане баланса между качеством изображений и соответствия запросам, что делает её, по утверждению компании, самым эффективным выбором для создания контента. Все три конфигурации свободно доступны по лицензии Stability AI Community License. Для использования в коммерческих целях потребуется лицензия Enterprise License. |