Сегодня 22 февраля 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Apple незаметно выпустила нейросеть Ferret, которая работает с текстом и изображениями

Apple при поддержке учёных Корнеллского университета ещё в октябре выложила в открытый доступ собственную мультимодальную большую языковую модель Ferret, которая в качестве запросов может принимать фрагменты изображений.

 Источник изображения: Laurenz Heymann / unsplash.com

Источник изображения: Laurenz Heymann / unsplash.com

Выход Ferret на GitHub в октябре не сопровождался со стороны Apple крупными объявлениями, но проект впоследствии привлёк участие специалистов отрасли. Принцип работы Ferret состоит в том, что модель изучает указанный фрагмент изображения, идентифицирует объекты на этом участке и очерчивает их рамкой. Распознанные на фрагменте изображения объекты система воспринимает как часть запроса, ответ на который предоставляется в текстовом формате. К примеру, пользователь может выделить на картинке изображение животного и попросить Ferret распознать его. Модель даст ответ, к какому виду относится животное, и ей можно будет задать дополнительные вопросы в контексте, уточнив информацию по другим объектам или действиям.

 Источник изображения: twitter.com/zhegan4

Источник изображения: twitter.com/zhegan4

Открытая модель Ferret — это система, способная «давать ссылки и обосновывать что угодно, где угодно и с любыми подробностями», пояснил исследователь из ИИ-подразделения Apple Чжэ Гань (Zhe Gan). Отраслевые эксперты отмечают важность выхода проекта в этом формате — он демонстрирует открытость традиционно закрытой компании. По одной из версий, Apple решилась на этот шаг, поскольку стремится конкурировать с Microsoft и Google, но не обладает сопоставимыми вычислительными ресурсами. Из-за этого она не смогла рассчитывать на выпуск собственного конкурента ChatGPT и была вынуждена выбирать между партнёрством с облачным гиперскейлером и выпуском проекта в открытом формате, как это ранее сделала Meta.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Количество слияний и поглощений в российском IT-секторе в 2024 году выросло на треть 10 мин.
В рекордной краже криптовалюты у ByBit обвинили северокорейских хакеров 10 ч.
OpenAI провела зачистку ChatGPT от аккаунтов из Китая и Северной Кореи, подозреваемых во вредоносной деятельности 10 ч.
«Нам просто нужно больше мощностей»: OpenAI постепенно поборет зависимость от Microsoft 10 ч.
Трамповская криптооттепель: Coinbase удалось малой кровью отделаться от иска Комиссии по ценным бумагам США 11 ч.
Apple выпустила первую бету iOS 18.4, в которой появились «приоритетные уведомления» 13 ч.
Новая статья: Kingdom Come: Deliverance II — ролевое вознесение. Рецензия 24 ч.
Apple отключила сквозное шифрование в iCloud по требованию властей Великобритании 24 ч.
Взрывной платформер Shotgun Cop Man от создателя My Friend Pedro предложит спуститься в ад и арестовать Дьявола — трейлер и демоверсия в Steam 21-02 22:01
Valve заблокировала игру в российском Steam по требованию Роскомнадзора 21-02 20:20
Lenovo сообщила о двузначном росте выручки за III финансовый квартал по всем подразделениям — ISG снова в плюсе благодаря ИИ 14 мин.
Учёные придумали, как дуть на серверы так, чтобы расходы на охлаждение упали на 60 % 39 мин.
В облаке Google Cloud появились инстансы A4X на базе суперускорителей NVIDIA GB200 NVL72 40 мин.
STMicroelectronics представила фотонный чип для 1,6-Тбит/с сетей 47 мин.
Несмотря на риск землетрясений, геотермальную энергию ждёт светлое будущее, считают учёные 2 ч.
Размышляющий ИИ DeepSeek R1 встроят в смартфоны Infinix Note 50 5 ч.
Nvidia признала, что не знает, когда сможет решить все проблемы видеокарт GeForce RTX 5000 7 ч.
Huawei захватила больше половины рынка складных смартфонов в Китае — на втором месте Honor 8 ч.
В Asus разогнали GeForce RTX 5090 до 3,5 ГГц и установили несколько рекордов 9 ч.
Норвежцы представили человекоподобного робота для дома и семьи — он мягкий и обтекаемый 10 ч.