|
Опрос
|
реклама
Быстрый переход
DeepSeek похвасталась расчётной рентабельностью своих ИИ-сервисов на уровне 545 %
02.03.2025 [06:51],
Алексей Разин
Китайские разработчики языковых моделей DeepSeek на этой неделе опубликовали интересные данные о расчётной рентабельности своих языковых моделей V3 и R1 в течение условного 24-часового периода. По данным авторов расчётов, эти модели позволяют заработать в шесть с половиной раз больше, чем расходуют на аренду вычислительных мощностей.
Источник изображения: Unsplash, Solen Feyissa По сути, если опираться на опубликованную представителями DeepSeek на страницах GitHub информацию, за произвольно выбранные сутки компания потратила на аренду ускорителей вычислений $87 072, тогда как потенциальная монетизация её моделей V3 и R1 могла бы принести ей $562 027 за тот же период. Соотнеся эти величины, авторы расчётов и получили условную рентабельность в размере 545 %. Впрочем, важно понимать, что расчёты по этой методике подразумевают ряд допущений. Прежде всего, потенциальные доходы рассчитывались без учёта скидок, а за основу бралась ценовая политика в отношении более дорогой модели R1. Во-вторых, далеко не все публично доступные сервисы DeepSeek монетизированы и являются платными для пользователей. Если бы плата за доступ к ним взималась по коммерческой стоимости, количество пользователей могли бы сократиться, а это уменьшило бы получаемую выручку. Наконец, расчёты в этом примере никак не учитывают расходы DeepSeek на электроэнергию и аренду хранилищ для данных, а также на исследования и разработки как таковые. В любом случае, данная попытка продемонстрировать потенциальным инвесторам свою перспективность и состоятельность должна вдохновить представителей других стартапов на публикацию подобных расчётов. Пока сфера искусственного интеллекта требует от инвесторов огромных затрат, а финансовая отдача весьма эфемерна и отдалена во времени. DeepSeek поясняет, что высокой эффективности своих сервисов компания добилась за счёт ряда оптимизаций. Во-первых, трафик распределяется между несколькими центрами обработки данных максимально равномерно. Во-вторых, гибко регулируется время обработки запроса пользователя. В-третьих, обрабатываемые данные сортируются по партиям для оптимальной нагрузки на инфраструктуру. «Яндекс» выпустит рассуждающий ИИ уже в этом году — некоторым он уже доступен в тестовом режиме
01.03.2025 [18:26],
Павел Котов
«Яндекс» ведёт разработку «рассуждающей» модели искусственного интеллекта, которая станет общедоступной в 2025 году. Она будет встроена в сервисы компании, которые работают на базе искусственного интеллекта — в первую очередь это «Поиск с Нейро» и голосовой помощник «Алиса». Об этом сообщил «Коммерсантъ» со ссылкой на пресс-службу компании.
Источник изображения: alice.yandex.ru У некоторых пользователей с платной подпиской «Алиса Про» кнопка «Рассуждай» появилась уже два или три дня назад. На кнопке имеется отметка, что функция находится на стадии бета-тестирования. Пользователям предлагается 10 запросов в день. Рассуждающими называют модели ИИ, которые самостоятельно выстраивают цепочку рассуждений, проверяют себя и выявляют допущенные ошибки; при поиске ответа они также могут изучить несколько подходов к решению задачи. К рассуждающим относят зарубежные модели OpenAI o3, DeepSeek R1, Alibaba QwQ-32B-Preview, Google Gemini 2.0 Flash Thinking и Anthropic Claude 3.7 Sonnet, но на российском рынке о таких ранее не сообщалось. «Мы ожидаем, что в 2025 году „рассуждающие“ модели появятся у большинства компаний. MTS AI также имеет зрелые наработки в данном направлении, и мы будем использовать их в новых поколениях корпоративных моделей семейства Cotype, которые выйдут в текущем году», — рассказали в подразделении MTS AI. Новая модель GigaChat от «Сбера» также сможет «развивать разные возможности, включая и рассуждения», сообщили в компании, но сроков её выхода не уточнили. Рассуждающий ИИ способен повысить качество решения задач, которые ставят бизнес-пользователи, а среди потребителей его можно монетизировать подписками, считают опрошенные «Коммерсантом» эксперты. Разработка такой модели может обойтись «Яндексу» в сумму от 500 млн до 1 млрд руб. Но есть и способы её быстрой разработки: недавно американские учёные описали метод улучшения стандартной модели ИИ до рассуждающей — в их случае потребовались 26 минут работы 16 чипов, а результат в нескольких испытаниях оказался выше, чем у OpenAI o1 preview. Сергей Брин призвал разработчиков ИИ в Google прекратить нянчиться с пользователями и больше работать
01.03.2025 [13:46],
Павел Котов
С началом бума искусственного интеллекта вышедший было на заслуженный отдых сооснователь Google Сергей Брин (Sergey Brin) вернулся к полноценной работе в компании. На этой неделе он обратился к подчинённым, напомнив, что конкуренция усилилась, и дав рекомендации по дальнейшей работе в коллективе, сообщает The Verge.
Сергей Брин. Источник изображения: wikipedia.org Крупнейшие игроки вступили в финальную фазу гонки, победителем в которой окажется первый разработчик сильного ИИ (AGI), заявил Брин. Для этого разработчикам в Google придётся трудиться быстрее, отдавать приоритет простым решениям, не тратить время попусту и прекратить нянчиться с пользователями, которым нужно доверять. Служебная записка адресована сотрудникам подразделения Google DeepMind, но она наглядно отражает закулисье отрасли ИИ. Приводим её полный текст: «Программе Gemini и GDM (Google DeepMind) исполнилось два года. За это время мы прошли долгий путь и приложили немало усилий, которыми следует гордиться. В то же время конкуренция чрезвычайно усилилась, и началась последняя гонка за сильный ИИ. Думаю, у нас есть все составляющие, чтобы выиграть эту гонку, но для этого придётся отдать все силы. Важнее всего код — сильный ИИ взлетит, когда ИИ начнёт совершенствовать сам себя. Вероятно, поначалу потребуется значительное содействие человека, поэтому самое важное — производительность кода. Более того, это касается кода, написанного нами. Мы должны быть самыми эффективными программистами и исследователями в области ИИ в мире, используя наш собственный ИИ. Производительность — по моему опыту, 60 часов в неделю — золотая середина для темпа работы. Некоторые работают намного больше, но при этом могут выгореть или растерять творческий подход. Некоторые работают меньше 60 часов, но есть и те, кто работает по минимуму, просто чтобы выкрутиться. Вот такие люди не только нерезультативны, но и могут серьёзно подорвать дисциплину всего коллектива. Место работы — важно работать в офисе, потому что личное присутствие гораздо эффективнее виртуального общения. Нам необходимо физически находиться рядом с коллегами, работающими над теми же задачами. Нужно свести к минимуму число уровней субординации между странами, городами и офисными зданиями. Советую находиться в офисе хотя бы каждый будний день. Организация — нам нужны чёткие принципы ответственности и структура с высокоэффективными отделами, общим управлением и технологическим лидерством. Простота — давайте использовать простые решения там, где это возможно. Например, если запросы срабатывают, пусть они просто работают — обучать отдельную модель дальше не нужно. Никаких лишних технических сложностей (вроде LoRA). В идеале у нас должна быть одна архитектура и одна модель, которую можно запрашивать для разных целей. Качество — будь то оценка, источник данных, панель управления или сообщение во внутреннем интерфейсе, убедитесь, что они работают и выполнены на высоком уровне. Скорость — наши продукты, модели и внутренние инструменты должны работать быстро. Я не могу 20 минут ждать Borg, чтобы запустить небольшой код на Python. Итерации в малых масштабах — нам нужно много идей, которые можно тестировать быстро. Лучший способ сделать это — проводить эксперименты в небольших масштабах, а затем, если они успешны, расширять их. Это отличный способ проверки. Если сразу работать в больших масштабах, появляется тенденция ограничиваться незначительными доработками, подстраиваться под оценочные показатели, гнаться за контрольными точками и т. д. В крупном масштабе нам нужны настоящие победы. Хватит перекладывать ответственность — нельзя создавать продукты-няньки. Наши продукты переполнены фильтрами и всевозможными компромиссами. Нам нужны работоспособные решения, и мы должны доверять своим пользователям». У OpenAI закончились ИИ-ускорители — глава компании объяснил задержку GPT-4.5
28.02.2025 [17:55],
Павел Котов
OpenAI сообщила о выходе модели искусственного интеллекта GPT-4.5, но доступ к ней получили только пользователи подписки ChatGPT Pro, которые платят $200 в месяц. Полномасштабное развёртывание новой модели пришлось отложить, поскольку «мы слишком выросли, и у нас закончились графические процессоры», необходимые для этого, сообщил глава компании Сэм Альтман (Sam Altman).
Источник изображения: nvidia.com «На следующей неделе мы добавим несколько десятков тысяч графических процессоров и выпустим её на тариф Plus», — пообещал гендиректор OpenAI и добавил, что вскоре компания получит ещё сотни тысяч ускорителей. Из-за мирового дефицита вычислительных мощностей компания была вынуждена обратиться к Broadcom с целью совместной разработки собственного ускорителя для ИИ. Однако на это уйдёт не один год, а пока для удовлетворения своих потребностей и потребностей клиентов компании приходится работать с оборудованием Nvidia и других поставщиков. Это в очередной раз подчёркивает, в каком выгодном положении остаётся Nvidia. Недавно компания заявила, что ускорители последнего поколения Blackwell распроданы до октября текущего года. А поскольку мировая отрасль центров обработки данных планирует крупномасштабное расширение существующих и строительство новых объектов, успех будет сопутствовать «зелёным» ещё несколько лет. Только OpenAI и Microsoft работают над суперкомпьютером, который обойдётся в $100 млрд, а Илон Маск (Elon Musk) намеревается расширить свой суперкомпьютер Colossus в Мемфисе (штат Теннесси, США) до более чем миллиона ускорителей. В Южной Корее одобрение получил объект мощностью 3 ГВт, а ЦОД планируют запустить даже на Луне. Глава Microsoft Сатья Наделла (Satya Nadella) выразил опасение, что мощности объектов для ИИ окажутся чрезмерными, хотя новые модели становятся всё более требовательными к вычислительным ресурсам. Яркий тому пример — новая OpenAI GPT-4.5. Это «гигантская, дорогая модель», как охарактеризовал её Сэм Альтман. Стоимость подключения к ней составит $75 за 1 млн входных токенов и $150 за 1 млн выходных — для сравнения, у GPT-4o эти тарифы составляют $2,50 и $10 соответственно. Несмотря на цену, это «не рассуждающая модель, и [она] не побьёт эталонных показателей», признался гендиректор OpenAI, но, по его словам, «это другой вид интеллекта, [у него] есть волшебство, которого я прежде не ощущал». Создатель PUBG показал первый геймплейный трейлер Prologue: Go Wayback! — выживания в непредсказуемом открытом мире, сгенерированном ИИ
28.02.2025 [16:29],
Михаил Романов
Основанная создателем PUBG Бренданом Грином (Brendan Greene) амстердамская студия PlayerUnknown Productions представила первый геймплейный трейлер Prologue: Go Wayback! — симулятора выживания на базе технологии машинного обучения. Prologue: Go Wayback! предназначена для одиночного прохождения и предлагает пользователям исследовать обширный и непредсказуемый открытый мир, созданный с помощью технологии генерации ландшафта на основе ИИ. Игрокам предстоит ориентироваться на местности, следить за ресурсами, справляться с динамическими погодными условиями (ливни, метели, падения температуры) и пытаться отыскать метеовышку — единственную точку эвакуации. Представленный геймплейный трейлер Prologue: Go Wayback! состоит целиком из кадров непосредственного игрового процесса и даёт представление об основных механиках и разноплановости мира. По словам разработчиков, каждое новое прохождение Prologue: Go Wayback! не будет похоже на предыдущее. Игроки начинают сессию ни с чем и прокладывают собственный путь, пока учатся ориентироваться, адаптироваться и выживать. Ранний доступ Prologue: Go Wayback! стартует в Steam ближайшим летом. Обещают стоимость в $20, комплексные системы выживания (включая потребление калорий), возможность ремонтировать предметы и здания. Русский язык не заявлен. Стоит отметить, что Prologue: Go Wayback! позиционируется лишь как первый шаг в путешествии PlayerUnknown Productions на пути к главной цели — амбициозной мультиплеерной песочнице Artemis и собственному игровому движку Melba. Microsoft выпустила приложение Copilot для самых популярных ИИ ПК в мире — Apple Mac
28.02.2025 [16:16],
Николай Хижняк
Компания Microsoft выпустила цифрового ИИ-помощника Copilot в виде отдельного приложения для пользователей операционных систем macOS в США, Великобритании и Канаде. Приложение доступно в магазине приложений Mac. На данный момент Mac являются самыми распространёнными компьютерами с ИИ-функциями в мире.
Источник изображения: Tom's Hardware Для работы Copilot для macOS требуется компьютер Mac с процессором серии Apple M1 и новее, а также операционная система не старше macOS 14 Sonoma. Приложение поддерживает тёмный режим. Для него также заявлена поддержка команды быстрого доступа для активации ИИ-помощника с помощью сочетаний клавиш Command + Space, что во многом похоже на команду запуска при помощи сочетания клавиш Alt + Space в версии Copilot для Windows. Версия Copilot для iPad получит обновление с поддержкой раздельного экрана. В Copilot также можно будет входить через iPhone или iPad с помощью Apple ID. В приложение можно подгружать текстовые или PDF-файлы, задать вопросы о документах или попросить ИИ-ассистента создать по ним сводку. Функция создания сводок документов в скором времени появится и в приложении Copilot для macOS. Запуск Copilot на macOS произошёл всего через несколько дней после того, как Microsoft сделала функции Copilot Voice и Think Deeper бесплатными и с неограниченным использованием. Ранее Think Deeper (на базе модели o1 от OpenAI) и Voice в Copilot имели ограничения для бесплатных пользователей, но теперь Microsoft их убрала, чтобы позволить пользователям Copilot вести расширенные беседы с ИИ-помощником. В конце добавим, что на днях стало известно о том, что в прошлом году из всех компьютеров с ускорителями искусственного интеллекта больше половины поставила компания Apple. Так что Microsoft фактически выпустила теперь Copilot для большинства ИИ ПК в мире. Tecno предварительно представила сверхтонкий смартфон Spark Slim и элегантные умные очки с ИИ и AR
28.02.2025 [12:00],
Владимир Мироненко
Компания Tecno в преддверии выставки MWC 2025 решила подогреть интерес к грядущим анонсам, предварительно представив сверхтонкий смартфон Tecno Spark Slim. Он обладает толщиной всего 5,75 мм и компания называет его самым тонким смартфоном с батареей на 5200 мА·ч. Также производитель показал смарт-очки. ![]() Tecno Spark Slim оснащён 6,78-дюймовым изогнутым AMOLED-дисплеем с разрешением 1,5K (1224p), частотой обновления 144 Гц и пиковой яркостью 4500 кд/м2. В его верхней части размещена фронтальная 13-Мп камера для селфи. На задней панели находится основная камера, включающая два 50-Мп сенсора. Обе камеры оснащены интерактивной световой полосой. ![]() Аккумулятор ёмкостью 5200 мА·ч с поддержкой быстрой зарядки имеет толщину всего 4,04 мм. Также сообщается, что Tecno Spark Slim построен на высокопроизводительном восьмиядерном чипе, название которого пока не раскрывается. Остальные характеристики тоже пока держатся в секрете — скорее всего их раскроют уже на MWC. ![]() Помимо новой модели смартфона компания планирует представить на MWC 2025 свои первые умные очки с ИИ — базовую версию AI Glasses и модель AI Glasses Pro с поддержкой дополненной реальности. Предполагается, что новинки органично впишутся в комплексную экосистему продуктов Tecno с ИИ, охватывающую смартфоны, ноутбуки и носимые устройства. ![]() С помощью прикосновения к дужкам очков или голосовой команды активируется встроенный голосовой помощник ИИ Tecno Ella, позволяя пользователям управлять функциями гаджета, использовать экосистему Tecno и просматривать заметки и бизнес-расписание. ![]() Выступая в качестве персонального компаньона с ИИ, очки предлагают такие функции, как распознавание объектов, обобщение информации, предоставление туристической информации и бизнес-рекомендаций. Модель AI Glasses Pro также поддерживает навигацию в реальном времени и приложения с расширенными возможностями дополненной реальности. Новинки изготовлены из магниевого сплава и сверхлёгких композитных материалов, благодаря чему обладают таким же весом, как и обычные солнцезащитные очки. Предполагается, что компания продемонстрирует модели в стиле Eyebrow Frame и Aviator Style. Презентация новинок Tecno пройдёт в рамках MWC 2025 на мероприятии Tecno AI Ecosystem Product Launch Event. Чат-бот Meta✴ AI скоро получит отдельное приложение для конкуренции с ChatGPT
28.02.2025 [11:17],
Владимир Мироненко
Meta✴✴ планирует вскоре запустить отдельное приложение для своего чат-бота на основе ИИ, сообщил ресурс CNBC со ссылкой на информированные источники. По их данным, анонс программного продукта состоится во втором квартале. В настоящее время Meta✴✴ AI доступен пользователям только через веб-сайт, а также соцсеть Facebook✴✴ и мессенджер WhatsApp.
Источник изображения: Igor Omilaev / unsplash.com Хотя обширная аудитория пользователей семейства приложений Meta✴✴ имеет доступ к Meta✴✴ AI, им было бы удобнее взаимодействовать с цифровым помощником, и они могли бы в полной мере использовать его возможности, если бы чат-бот был доступен в виде отдельного приложения, утверждают многие пользователи. В январе один из пользователей Threads написал, что отдельное приложение Meta✴✴ AI могло бы помочь компании объединить цифрового помощника на смартфонах и различных аппаратных платформах, таких как умные очки Ray-Ban Meta✴✴, что позволило бы пользователям организовать истории разговоров с цифровым помощником и обеспечить «более глубокую персонализацию и настройку». Гендиректор Meta✴✴ Марк Цукерберг (Mark Zuckerberg) ответил ему красным эмодзи «100» в знак полного согласия. В январе в ходе финансового отчёта за четвёртый квартал Цукерберг заявил, что в этом году аудитория Meta✴✴ AI превысит 1 млрд человек, и он ожидает, что «Meta✴✴ AI станет ведущим помощником ИИ». По словам источников, Meta✴✴ также планирует протестировать платную подписку на Meta✴✴ AI, подобно практике OpenAI и Microsoft, которые предлагают пользователям за ежемесячную плату доступ к более мощным версиям своих чат-ботов ChatGPT и Copilot. Dell нацелилась на кусок ИИ-пирога побольше — она планирует поднять продажи ИИ-серверов в полтора раза в этом году
28.02.2025 [10:23],
Алексей Разин
Компании так называемой «великолепной семёрки» (Microsoft, Google и другие) в совокупности готовы потратить на развитие вычислительной инфраструктуры ИИ несколько сотен миллиардов долларов в текущем году, поэтому планы поставщиков серверного оборудования в какой-то мере подстраиваются под конъюнктуру спроса. Dell собирается в этом году выручить на поставках серверного оборудования для ИИ около $15 млрд.
Источник изображения: Dell Technologies Если учесть, что в прошлом фискальном году на этом направлении Dell Technologies выручила $10 млрд, то речь идёт о 50-% увеличении. В прошлом фискальном квартале компания выручила $23,9 млрд вместо ожидаемых инвесторами $24,55 млрд, но удельный доход на одну акцию превысил ожидания: $2,68 против $2,53. В текущем квартале Dell рассчитывает выручить от $22,5 до $23,5 млрд, что несколько ниже ожиданий аналитиков ($23,59 млрд). Удельный доход на одну акцию в размере $1,65 также окажется ниже прогноза инвесторов ($1,76), если соответствующий показатель будет достигнут по итогам текущего квартала. Зато прогноз по выручке на весь текущий фискальный год примерно совпадает с ожиданиями инвесторов. По мнению руководства Dell, компания в этом фискальном году, который завершается в конце октября, выручит от $101 до $105 млрд. Доход на одну акцию ($9,3) может превысить величину, ожидаемую инвесторами ($9,23). В прошлом квартале рост выручки Dell на 7 % до $23,9 млрд в значительной мере стимулировался ростом поставок серверного оборудования. На направлении инфраструктурных решений выручка компании увеличилась на 22 % до $11,35 млрд. Впрочем, аналитики рассчитывали в среднем на $11,7 млрд. В конце прошлого квартала Dell располагала портфелем заказов на серверы для систем искусственного интеллекта на общую сумму $9 млрд. Только компания Илона Маска (Elon Musk) оформила заказ на $5 млрд, как сообщалось ранее. В прошлом квартале на направлении ИИ-серверов Dell выручила $2,1 млрд, что ниже ожидавшихся $2,77 млрд. В потребительском сегменте выручка Dell выросла только на 5 % до $11,88 млрд, поскольку спрос на ноутбуки был скромным. По итогам всего минувшего фискального года выручка Dell от реализации ПК в корпоративном сегменте выросла на 5 % до $10 млрд. В целом поставки ПК по итогам четвёртого квартала обеспечили Dell выручкой в размере $11,9 млрд, что соответствует приросту на 1 %, но в потребительском сегменте профильная выручка сократилась на 12 % до $1,9 млрд. OpenAI представила GPT-4.5 — самую большую и осведомлённую ИИ-модель для ChatGPT без поддержки размышлений
28.02.2025 [00:31],
Андрей Созинов
OpenAI выпустила GPT-4.5 — свою самую передовую и крупную большую языковую модель (LLM) искусственного интеллекта. Разработчик называет этот релиз своей «самой осведомлённой моделью», но предупреждает, что GPT-4.5 не является прорывной моделью и может не демонстрировать таких высоких результатов, как o1 или o3-mini, обладающие способностями к рассуждению.
Источник изображений: OpenAI GPT-4.5 предлагает улучшенные навыки написания текстов, более качественные знания о мире и то, что OpenAI называет «усовершенствованной индивидуальностью по сравнению с предыдущими моделями». Компания утверждает, что взаимодействие с GPT-4.5 будет более «естественным» и отмечает, что модель лучше распознаёт паттерны и определяет взаимосвязи, что делает её идеальной для написания текстов, программирования и «решения практических задач». ![]() При этом OpenAI предупредила, что в GPT-4.5 недостаточно новых возможностей, чтобы считать её передовой моделью. «GPT-4.5 не является прорывной моделью, но это самая большая LLM OpenAI, превосходящая вычислительную эффективность GPT-4 более чем в 10 раз, — говорится в документе OpenAI, который просочился в Сеть до анонса. — Она не представляет семь новых возможностей по сравнению с предыдущими версиями со способностью к рассуждениям, и её производительность ниже, чем у o1, o3-mini и Deep Research в большинстве тестов». Ранее сообщалось, что OpenAI использует свою модель с возможностью рассуждений o1 для обучения GPT-4.5 на синтетических данных. Сама OpenAI заявила, что обучила GPT-4.5 «с помощью новых методов контроля в сочетании с традиционными методами, такими как контролируемая тонкая настройка (SFT) и обучение с подкреплением на основе человеческой обратной связи (RLHF), аналогичными тем, что использовались для GPT-4o». «Мы адаптировали GPT-4.5 так, чтобы он лучше сотрудничал, делая разговоры более тёплыми, интуитивными и эмоционально насыщенными, — сказал Рафаэль Гонтихо Лопес (Raphael Gontijo Lopes), исследователь из OpenAI. — Чтобы оценить это, мы попросили тестировщиков сравнить её [новую модель] с GPT-4o, и GPT-4.5 оказалась впереди практически по всем категориям». Несмотря на некоторые ограничения, GPT-4.5 галлюцинирует значительно меньше, чем GPT-4o, и немного меньше, чем модель o1, заявила OpenAI. Также новинка демонстрирует более развитую интуицию и творческие способности, лучше понимает, что имеют в виду пользователи, и «интерпретирует тонкие сигналы или неявные ожидания с большим количеством нюансов». GPT-4.5 с сегодняшнего дня доступна пользователям с подпиской ChatGPT Pro за $200 в месяц, а также исследователям. Сейчас модель находится на стадии предварительного исследовательского тестирования. Решение выпустить её в таком виде обусловлено желанием «лучше понять её сильные стороны и ограничения». «Мы всё ещё изучаем её возможности и с нетерпением ждём, когда люди начнут использовать её так, как мы, возможно, не ожидали», — подытожили в OpenAI. В компании не сообщили, когда сделают новинку доступной более широкой публике. На прошлой неделе сообщалось, что OpenAI планирует запустить GPT-4.5 к концу февраля, а GPT-5 — уже в конце мая. Генеральный директор OpenAI Сэм Альтман (Sam Altman) назвал GPT-5 «системой, объединяющей множество наших технологий», отметив, что она будет включать модель OpenAI o3. В прошлом месяце OpenAI выпустила o3-mini, но полноценная o3 появится только как часть GPT-5. Компания таким образом намерена объединить свои большие языковые модели, чтобы в итоге создать одну более мощную систему, способную самостоятельно определять, какие ресурсы необходимо задействовать для решения той или иной задачи. Китайцы представили быстро думающий ИИ Turbo S — он отвечает быстрее DeepSeek
27.02.2025 [19:52],
Владимир Мироненко
Компания Tencent Holdings представила модель ИИ Hunyuan Turbo S, которая, по её словам, превосходит по скорости реагирования на запросы модель DeepSeek R1, обладающую способностью к размышлению. Tencent также отметила, что стоимость использования Hunyuan Turbo S во много раз ниже, чем у предыдущих версий её ИИ-моделей, пишет Bloomberg.
Источник изображения: Tencent Hunyuan Turbo S способна отвечать на запросы в течение секунды, что отличает её «от DeepSeek R1, Hunyuan T1 и других медленно думающих моделей, которым нужно немного “подумать”, прежде чем ответить», заявила Tencent. Компания добавила, что при тестировании в таких областях, как знания, математика и рассуждения, возможности Turbo S соответствуют ИИ-модели DeepSeek V3, обеспечивающей работу чат-бота DeepSeek, который превзошёл ChatGPT от OpenAI по количеству загрузок в магазинах приложений. В подтверждение своих заявлений Tencent привела данные, показывающие, что Hunyuan Turbo S вполне может состязаться с моделью DeepSeek V3 в популярных тестах ИИ. Успех моделей DeepSeek R1 и V3, ставших широко известными и вызвавших интерес в Кремниевой долине, заставил китайские технологические гиганты, такие как Tencent и Alibaba, ускорить выпуск новых версий ИИ-моделей. Спустя всего несколько дней после выхода DeepSeek R1 гигант электронной коммерции Alibaba представил модель Qwen 2.5-Max, которая, по его словам, превосходит DeepSeek V3 по всем показателям, а также опережает по возможностям другие ведущие модели, такие, как GPT-4o и Claude-3.5 Sonnet. Tencent, которая наряду с Alibaba является одним из крупнейших провайдеров облачной инфраструктуры в Китае, интегрировала технологию DeepSeek в свой мессенджер WeChat, благодаря чему её акции выросли. Чат-бот DeepSeek также широко используется государственными органами по всему Китаю, в том числе в Гонконге. Чтобы справиться с резкими перепадами нагрузки на сервисы, DeepSeek на этой неделе снизила цены на доступ к своему API в ночные часы. Стратегия DeepSeek, направленная на предложение решений с открытым исходным кодом и низкими ценами, вынудила другие ведущие китайские компании на рынке ИИ взимать с пользователей меньшую плату, отмечает Bloomberg. «Торрент для запуска ИИ»: вышла утилита для распределённого запуска ИИ-моделей на любом оборудовании
27.02.2025 [18:30],
Павел Котов
Большие языковые модели искусственного интеллекта требуют значительных ресурсов не только при обучении, но и при запуске — необходимы существенные объёмы оперативной памяти и мощные графические процессоры. Альтернативу предложили создатели Exo — бесплатной программы для распределённого запуска ИИ на нескольких устройствах. Почти как торренты, только для запуска ИИ.
Источник изображения: github.com/exo-explore/exo Приложение позволяет объединять вычислительные ресурсы нескольких компьютеров, смартфонов и даже одноплатных компьютеров, в том числе Raspberry Pi, для запуска моделей, с которыми ни одна из имеющихся в распоряжении пользователя систем не справилась бы самостоятельно. Ресурсы устройств объединяются по одноранговой сети. Exo динамически распределяет нагрузку, создаваемую большой языковой моделью, по доступным в сети устройствам, размещая её слои, исходя из доступного объёма оперативной памяти и имеющейся вычислительной мощности. Поддерживаются LLaMA, Mistral, LlaVA, Qwen и DeepSeek. Программа устанавливается на устройства под управлением Linux, macOS, Android или iOS — версии под Windows пока нет. Для работы Exo требуется минимальная версия Python 3.12.0 и, в случае машин под Linux с графикой Nvidia, ряд других компонентов. Модель ИИ, требующую 16 Гбайт оперативной памяти, можно запустить на двух ноутбуках с 8 Гбайт на каждом; а мощную DeepSeek R1, которой нужны 1,3 Тбайт памяти, в теории можно запустить на кластере из 170 Raspberry Pi 5 с 8 Гбайт. Скорость сети и задержка могут снизить качество работы модели, и разработчики Exo предупреждают, что устройства небольшой производительности способны замедлить ИИ, но с каждым добавленным в сети устройством общая производительность увеличивается. Нельзя также забывать об угрозах безопасности, которые неизбежно возникают при совместном выполнении рабочих нагрузок на нескольких машинах. И даже с учётом этих оговорок Exo представляется перспективной альтернативой облачным ресурсам. Microsoft выпустила пару открытых эффективных ИИ-моделей Phi-4 — одну дообучили по новой методике
27.02.2025 [12:38],
Павел Котов
Microsoft расширила линейку собственных больших языковых моделей искусственного интеллекта Phi-4 двумя новыми проектами с относительно скромными системными требованиями. Одна из них является мультимодальной, то есть работает с несколькими форматами данных.
Источник изображений: microsoft.com Модель Microsoft Phi-4-mini является исключительно текстовой, а Phi-4-multimodal — её улучшенная версия, способная обрабатывать также запросы в визуальном и звуковом форматах. Обе модели, утверждает разработчик, в значительной мере превосходят альтернативы сопоставимых размеров при выполнении определённых задач. Microsoft Phi-4-mini имеет 3,8 млрд параметров, то есть она достаточно компактна для запуска на мобильных устройствах. В основу модели легла особая версия архитектуры «Трансформер» (Transformer). В стандартном варианте модели-трансформеры, чтобы понять значение каждого слова, анализируют текст до и после него; при разработке Phi-4-mini в Microsoft использовали версию Decoder-Only Transformer, которая предполагает анализ только предшествующего слову текста, что снижает нагрузку на вычислительные ресурсы и повышает скорость обработки данных. Для дополнительной оптимизации использована технология Grouped Query Attention — этот механизм помогает модели определять, какие фрагменты данных наиболее релевантны при обработке текущей задачи. Phi-4-mini может генерировать текст, переводить документы и управлять внешними приложениями; модель, по словам разработчиков, преуспела в решении математических задач и написании компьютерного кода, даже когда требуются «сложные рассуждения». Точность ответов Phi-4-mini, по оценкам самой Microsoft, «значительно» превосходит результаты, которые дают несколько других моделей аналогичного размера. ![]() Phi-4-multimodal — это расширенная версия Phi-4-mini с 5,6 млрд параметров; в качестве запросов она воспринимает не только текст, но также изображения, аудио и видео. Для дообучения модели в Microsoft использовали новый метод Mixture of LoRAs. Обычно адаптация ИИ к новой задаче требует изменения его весов — параметров конфигурации, которые определяют, как он обрабатывает данные. Чтобы облегчить эту задачу, используется метод LoRA (Low-Rank Adaptation) — для выполнения незнакомой задачи модели добавляется небольшое количество новых весов, оптимизированных для этой задачи. Метод Mixture of LoRAs адаптирует этот механизм к мультимодальной обработке данных: при разработке Phi-4-multimodal исходную Phi-4-mini дополнили весами, оптимизированными для работы с аудио и видео. В результате, рассказали в Microsoft, удалось смягчить некоторые компромиссы, связанные в прочими подходами к построению мультимодальных моделей. В тестах, связанных с обработкой визуальных данных, Phi-4-multimodal набрала 72 балла, незначительно уступив ведущим моделям от OpenAI и Google. В одновременной обработке видео и звука она «с большим отрывом» обошла Google Gemini-2.0 Flash, а также открытую InternOmni. Phi-4-mini и Phi-4-multimodal доступны на платформе Hugging Face по лицензии MIT, которая допускает их коммерческое использование. Apple выпустила больше ИИ-совместимых ПК в прошлом году, чем все остальные производители вместе взятые
27.02.2025 [11:52],
Алексей Разин
Уже второй год подряд производители процессоров и ПК пытаются продвигать новые продукты, обеспечивающие возможность локального запуска функций искусственного интеллекта и их ускорение. Исследование Canalys показало, что в прошлом квартале доля подобных ПК в структуре поставок на мировом рынке выросла до 23 %.
Источник изображения: Dell В абсолютном выражении количество таких ПК в прошлом квартале достигло 15,4 млн штук. К ним относились ноутбуки и настольные компьютеры, оснащённые центральными процессорами с нейронным блоком (NPU), позволяющим на аппаратном уровне ускорять работу функций искусственного интеллекта. Последовательно количество поставленных ПК такого класса в четвёртом квартале выросло на 18 %.
Источник изображений: Canalys В целом по году ИИ-компьютеры заняли 17 % первичного рынка, причём лидером по их экспансии оказалась компания Apple, наделившая 54 % поставленных в прошлом году ПК всех марок соответствующими аппаратными функциями. Lenovo и HP Inc. заметно отстали, но поделили между собой второе место с долей по 12 % соответственно. По прогнозам Canalys, в текущем году именно завершение поддержки Windows 10 станет главным фактором, побуждающим клиентов покупать новые ПК. Серьёзным вызовом для мирового рынка могут стать и таможенные пошлины в США, которые грозится повысить президент Дональд Трамп (Donald Trump). ![]() Поставщики центральных процессоров распределили свои маркетинговые усилия по различным ценовым сегментам. Intel старается играть в верхнем диапазоне с процессорами семейства Lunar Lake, тогда как AMD старается занимать позиции в премиум-сегменте и среднем ценовом диапазоне. Один из пионеров рынка в лице Qualcomm после дебюта в верхней ценовой категории теперь пытается освоить и ценовые сегменты в районе $600 за весь ноутбук. Даже Apple в какой-то мере демократизирует свою профильную продукцию, предлагая ноутбуки ранних поколений со скидками, и они пользуются хорошим спросом в странах с не очень развитой экономикой. ![]() Почти треть участников торговой цепочки на рынке ПК считает, что в текущем году основным локомотивом продаж станет конец цикла технической поддержки Windows 10. Конечные клиенты, как ожидается, особенно активно будут обновлять свои парки компьютеров во втором полугодии. Само по себе обновление аппаратных или программных возможностей ПК при принятии решений о покупке отходит на второй план сильнее, чем это было в прошлом году. Если учитывать только ПК под управлением Windows, то среди них ИИ-совместимые модели по итогам четвёртого квартала составили 26 %, а в общей массе Windows-ПК они формировали 15 % продаж. Продукция Apple заняла по итогам квартала 10,2 % всего рынка ПК, причём 45 % поставленных компанией систем были готовы к аппаратному ускорению ИИ. На втором месте оказалась Lenovo с долей 15 %, хотя в сегменте ПК в целом она занимает первое место и 25 % рынка. Следом идёт HP Inc. с долей 14 % среди ПК с функциями ИИ, Dell на третьем месте отстаёт сильнее с 9 % рынка. Показателен пример Huawei, которая среди ПК с ускорением ИИ занимает 3 % рынка, тогда как её доля на рынке ПК в целом не превышает 2 %. Подобный перекос среди восьми крупнейших игроков рынка заметен только у Apple и Microsoft. Последняя смогла добиться 2-процентной доли в ИИ-сегменте, но на рынке ПК в целом довольствуется 0,4 %. Nvidia отчиталась о рухнувших продажах GeForce, но «удивительный» спрос на ИИ-чипы поднял прибыль на 80 %
27.02.2025 [07:29],
Алексей Разин
Многие инвесторы ждали квартальной отчётности Nvidia с некоторой тревогой, поскольку к традиционному тезису о неизбежности снижения спроса на ускорители вычислений добавлялся фактор DeepSeek, теоретически работающий в том же направлении. В действительности же выручка Nvidia в прошлом квартале превзошла ожидания рынка, равно как и прогноз на текущий квартал.
Источник изображений: Nvidia Хронологическая обособленность отчётного мероприятия Nvidia обусловлена тем, что в календаре компании четвёртый квартал 2025 фискального года завершился только 26 января текущего года. Более оптимистичная отчётность компании по сравнению с ожиданиями инвесторов не вызвала роста курсовой стоимости акций после закрытия торгов. Напротив, она снизилась на полтора процента, поскольку инвесторы поняли, что темпы роста выручки компании снижаются по сравнению с первыми двумя годами ИИ-бума. Квартальная выручка Nvidia увеличилась в годовом сравнении на 78,8 % до $39,33 млрд, что выше ожидавшихся $38,05 млрд. Удельный доход на одну акцию достиг $0,89, что также выше прогнозной величины в $0,84. В текущем квартале компания рассчитывает выручить $43 млрд против ожидаемых инвесторами $41,78 млрд, данная величина будет соответствовать годовому росту на 65 %. Если учесть, что год назад подобный прирост достигал 262 %, это могло стать некоторым разочарованием для инвесторов. Судя по заявлениям представителей Nvidia, проблемы с выпуском ускорителей Blackwell, которые наблюдались на старте, удалось решить, и в прошедшем квартале поставки данной продукции принесли компании $11 млрд выручки. Об их экспансии можно говорить, как о самой быстрой в истории компании, по словам финансового директора Колетт Кресс (Colette Kress). Больше всего ускорители Blackwell покупались провайдерами облачных услуг, клиенты такого класса обеспечили половину всей выручки серверного подразделения Nvidia. В целом, направление центров обработки данных увеличило выручку Nvidia на 93 % до $35,6 млрд, что также превышает прогнозы инвесторов. Непосредственно поставки вычислительных средств в серверном сегменте увеличили выручку на 116 % до $32,6 млрд, а вот сетевые решения сократили её на 9 % до $3 млрд. Тем не менее, руководство Nvidia с гордостью отметило, что компоненты сетевой инфраструктуры проекта Stargate в США будут поставляться именно этой компанией. Рост выручки от поставок вычислительных решений для ЦОД в прошлом квартале был обусловлен не только высоким спросом на ускорители Blackwell, но и последовательным ростом спроса на ускорители H200 поколения Hopper. Направление ЦОД обеспечивает до 91 % всей выручки Nvidia, за два предыдущих года его выручка увеличилась примерно в десять раз. ![]() Чистая прибыль Nvidia в прошлом квартале выросла на 80 % до $22,1 млрд. Норма прибыли сократилась с 76 до 73 %, но в компании объясняют это ростом затрат на экспансию ускорителей Blackwell, одновременно рассчитывая на улучшение прибыльности во втором полугодии. В прошлом же квартале операционные расходы выросли на 48 % до $4,7 млрд. Операционная прибыль при этом выросла на 77 % до $24 млрд. Если в сфере вычислений и сетевых решений выручка Nvidia по итогам четвёртого квартала увеличилась на 101 % до $36 млрд, то поставки графических решений сократили профильную выручку на 22 % до $3,3 млрд. В игровом сегменте выручка компании упала на 11 % в годовом сравнении, и на 22 % последовательно, до $2,54 млрд. Финансовый директор компании подобную динамику объяснила дефицитом графических процессоров как поколения Blackwell, так и семейства Ada Lovelace. По итогам 2025 фискального года в целом игровая выручка выросла на 9 % до $11,35 млрд, во многом за счёт популярности видеокарт семейства GeForce RTX 40-й серии. По итогам всего фискального года выручка Nvidia выросла на 114 % до $130,5 млрд, операционная прибыль выросла на 147 % до $81,5 млрд, чистая прибыль увеличилась на 145 % до $72,9 млрд, а норма прибыли поднялась с 72,7 до 75 %. По сути, замедление темпов роста финансовых показателей по итогам четвёртого квартала в отдельности и вызвало обеспокоенность отдельных инвесторов. В текущем календарном году выручка Nvidia должна заметно увеличиться, как заявил генеральный директор. ![]() Руководство компании предсказуемо делало эмоциональные заявления, которые были направлены на переубеждение скептиков. Генеральный директор и основатель Nvidia Дженсен Хуанг (Jensen Huang) назвал спрос на Blackwell «удивительным». Финансовый директор компании добавила, что «языковые модели с рассуждением требуют в 100 раз больше вычислительных ресурсов». Хуанг присоединился в своих выражениях к этому тезису, традиционно усилив его прогнозом о предстоящем появлении ИИ-алгоритмов нового поколения, которые потребуют «в миллионы раз бόльших вычислительных ресурсов». Уже сейчас, по его словам, основная часть вычислительных нагрузок на инфраструктуру ИИ подразумевает функцию рассуждения. Угрозу со стороны разрабатываемых облачными провайдерами собственных ускорителей глава Nvidia игнорирует. Как он убеждён, существование подобных чипов ещё не означает, что они в массовом порядке применяются. По поводу влияния DeepSeek глава Nvidia повторился, что распространение подобных более эффективных моделей будет лишь способствовать увеличению спроса на ускорители вычислений. Прорыв DeepSeek он назвал «превосходной инновацией». Оценить потенциальное влияние таможенных тарифов США на бизнес Nvidia он не взялся. «ИИ продвигается вперёд со скоростью света», — подытожил свою оценку текущего состояния рынка Дженсен Хуанг. |
|
✴ Входит в перечень общественных объединений и религиозных организаций, в отношении которых судом принято вступившее в законную силу решение о ликвидации или запрете деятельности по основаниям, предусмотренным Федеральным законом от 25.07.2002 № 114-ФЗ «О противодействии экстремистской деятельности»; |