Сегодня 16 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → deepseek
Быстрый переход

ИИ-модель DeepSeek V4 Pro выпущена официально

Специализирующийся на технологиях искусственного интеллекта китайский стартап DeepSeek объявил об официальном выпуске обновлённой модели V4 Pro, призванной помочь ему отыграть позиции у местных конкурентов, которые развиваются очень быстро. Сейчас компания расширяет штат сотрудников, наращивает вычислительные мощности и привлекает инвестиции.

 Источник изображения: Solen Feyissa / unsplash.com

Источник изображения: Solen Feyissa / unsplash.com

Модель DeepSeek V4-Pro-0813 значительно расширила возможности управления ИИ-агентами, отметил разработчик, — доступ к ней открыт через API, мобильное приложение и веб-интерфейс. Ранее компания также сообщила о повышении цен на доступ по API к V4 Pro и V4 Flash: тарификация теперь зависит от нагрузки в пиковые часы. Сообщество будет внимательно следить за свежим выпуском, потому что недорогая V4 Flash в независимых тестах внезапно показала лучшие результаты, чем выпущенный в апреле предварительный вариант V4 Pro. Это необычно, ведь Pro разрабатывалась как более функциональный продукт, но свидетельствует, что DeepSeek быстро улучшает технические решения в период между предварительным запуском и официальным релизом.

В начале 2025 года DeepSeek привлекла внимание общественности, выпустив рассуждающую R1 — она получила широкое распространение и вызвала вопросы о возможности создания мощных систем ИИ значительно дешевле, чем у американских конкурентов. С тех пор её лидерство в Китае оспорило множество конкурентов, в том числе Moonshot AI, Zhipu AI, MiniMax, Alibaba и ByteDance.

Ещё более сложной задачей для DeepSeek стало превращение своего лидерства в устойчивый бизнес. В июне компания привлекла инвестиций на $7,4 млрд; а в июле стало известно, что она готовится провести новый раунд финансирования при оценке около $71 млрд. Это знаменательная перемена для компании, которая долгое время избегала внешнего капитала. Конкуренция в области ИИ неуклонно дорожает: требуются инвестиции в ИИ-ускорители, центры обработки данных и кадровый ресурс. DeepSeek намерена удвоить штат сотрудников во всех подразделениях, включая ЦОД и отделы ИИ-агентов. Ранее также стало известно, что компания увеличила набор разработчиков микросхем — она хочет создать собственный ускоритель для запуска моделей, чтобы снизить свою зависимость от Nvidia и Huawei.

DeepSeek больше не хочет быть дешёвой — тарифы на флагманские ИИ-модели взлетят до 4,5 раза

Китайская компания DeepSeek резко повысит стоимость использования флагманских моделей V4, отказавшись от прежних сверхнизких тарифов. Новые цены начнут действовать с 16 августа и будут зависеть от загрузки вычислительных ресурсов.

 Источник изображения: John Cameron/Unsplash

Источник изображения: John Cameron/Unsplash

По информации Bloomberg, стоимость 1 млн выходных токенов DeepSeek-V4-Flash в часы пик составит $1,32 против прежних $0,28. В остальное время тариф будет вдвое дешевле. Более продвинутая модель DeepSeek-V4-Pro также подорожает: цена вырастет с $0,87 до $3,96 за 1 млн токенов в часы максимальной нагрузки, а вне этого периода будет вдвое ниже.

В компании объяснили изменение тарифов необходимостью более рационально распределять вычислительные ресурсы, а динамическая модель ценообразования должна побудить разработчиков переносить ресурсоёмкие задачи на менее загруженные периоды. При этом даже после повышения цен тарифы DeepSeek останутся ниже тарифов некоторых крупных конкурентов. Например, стоимость аналогичного объёма токенов у Anthropic для Claude 3.5 Sonnet составляет $50.

Bloomberg отмечает, что резкое изменение тарифов произошло на фоне растущего внимания к ценам высокопроизводительных ИИ-моделей. Ранее необычно низкая стоимость сервисов DeepSeek породила дискуссии о так называемой «зоне смерти DeepSeek», в которой более дорогие или менее производительные модели могут потерять конкурентоспособность.

Одновременно DeepSeek, как ранее сообщал 3DNews, готовится к масштабному привлечению финансирования и рассматривает возможность проведения IPO уже в этом году, из-за чего её основателю Лян Вэньфэну (Liang Wenfeng) приходится учитывать не только темпы расширения бизнеса, но и растущие расходы на вычислительную инфраструктуру.

Unitree подготовилась к выходу на биржу — DeepSeek закупит акций на $20,8 млн

Китайский производитель роботов Unitree завершил приготовления к выходу на Шанхайскую биржу. Цена размещения акций (IPO) установлена на уровне 150,8 юаня ($22,34) при оценке компании в 61 млрд юаней ($9,04 млрд). Это будет первый в стране производитель роботов, акции которого будут размещены в материковом Китае. Компания намеревается привлечь 6,1 млрд юаней ($904 млн); в рамках IPO заключено партнёрское соглашение с разработчиком систем искусственного интеллекта DeepSeek.

 Источник изображения: unitree.com

Источник изображения: unitree.com

DeepSeek инвестирует в Unitree 140,8 млн юаней ($20,8 млн) и получит 933 399 акций производителя роботов, или 2,31 % от общего объёма размещаемых ценных бумаг. В рамках партнёрского соглашения Unitree будет отдавать предпочтение DeepSeek при закупке услуг по обучению моделей и технических решений; DeepSeek, в свою очередь, будет отдавать предпочтение Unitree при закупке роботов и проведении исследований в области «воплощённого ИИ».

Партнёрский проект направлен на решение ключевой проблемы разработчиков человекоподобных роботов — создания «мозга» для машин, способного ориентироваться в незнакомой обстановке и надёжно преобразовывать команды человека в реальные действия. В Китае создано множество относительно недорогих роботов, которые умеют ходить, бегать и танцевать, но для эффективной работы в автономном режиме необходимы модели, обученные на данных о физическом мире: роботы должны уметь манипулировать объектами и реагировать на изменения в окружающей среде. Китайские производители роботов проводят обучение в центрах сбора данных, где люди многократно направляют человекоподобные машины при выполнении таких задач, как складывание одежды и открывание дверей.

ИИ-модели DeepSeek демонстрируют высокие результаты в тестах на программирование, математику и логическое мышление и работают с минимальными затратами. При этом сильной стороной компании являются языковые, а не мультимодальные модели, способные обрабатывать не только текст, но и изображения. В качестве исследовательского проекта у DeepSeek есть система VL2, способная обрабатывать как визуальную, так и языковую информацию, однако во флагманскую коммерческую модель она не интегрирована. В апреле один из исследователей DeepSeek опубликовал материалы проекта по улучшению визуального мышления ИИ, но впоследствии статья и связанные с ней материалы на GitHub были отозваны без объяснения причин. Партнёрство с Unitree поможет DeepSeek ускорить работу в этом направлении.

DeepSeek планирует существенно поднять цены на свои услуги в сфере ИИ

Принято считать, что китайские разработчики ИИ-моделей осуществляют свою экспансию на мировом рынке во многом благодаря низким ценам на свои услуги, но предполагаемые шаги компании DeepSeek в этой сфере разрушают данный стереотип. Стартап уведомил клиентов, что собирается существенно поднять расценки на свои услуги.

 Источник изображения: Unsplash, John Cameron

Источник изображения: Unsplash, John Cameron

Точная величина изменений не была указана, но текущие цены позволяют говорить о существенной разнице в меньшую сторону по сравнению с конкурентами. DeepSeek взимает с клиентов $0,14 за миллион входящих токенов и $0,28 за миллион исходящих. Для сравнения, Moonshot AI берёт по $3 за миллион входящих токенов и по $5 за миллион исходящих. В случае с американской Anthropic расценки ещё выше: $10 и $50 соответственно.

До сих пор считалось, что действующая ценовая политика DeepSeek надёжно защищает компанию от конкурентов, поскольку те не могут предложить доступ к сопоставимым по производительности ИИ-моделям по столь же низким ценам. Впрочем, для всей мировой отрасли ИИ сейчас характерна ориентация на окупаемость, поскольку многомиллиардные инвестиции надо отбивать, а предлагая доступ к ИИ-моделям за бесценок, этого сделать в разумные сроки нельзя. DeepSeek намеревается выйти на биржу в этом году, а потому инвесторам нужно продемонстрировать способность компании зарабатывать деньги.

DeepSeek намерена получить в своё распоряжение минимум 1 ГВт вычислительных мощностей, как благодаря строительству крупного ЦОД в районе Внутренней Монголии, так и через аренду у других компаний. В США для строительства ЦОД мощностью 1 ГВт могут требоваться затраты в размере около $50 млрд, но в Китае они традиционно ниже. В любом случае, DeepSeek нуждается в дополнительных капиталовложениях для достижения стоящих перед компанией целей.

Пользователи модели V4-Flash могут получать к ней доступ не только напрямую от DeepSeek, но и через партнёров компании, которые разместили её на своих вычислительных мощностях. Теоретически, именно сторонние провайдеры могут сохранить более привлекательные цены на доступ к V4-Flash, если DeepSeek слишком сильно задерёт тарифы.

Alibaba представила свою самую мощную ИИ-модель, а DeepSeek V4-Flash оказалась самой доступной

В понедельник китайская компания Alibaba представила свою крупнейшую и наиболее мощную на сегодняшний день модель искусственного интеллекта, что привело к резкому росту её акций, пишет Reuters. В то же время сообщается, что новейшая ИИ-модель от компании DeepSeek предлагается более чем в 100 раз дешевле, чем Claude Fable 5 от Anthropic.

 Источник изображения: Unsplash / Markus Winkler

Источник изображения: Unsplash / Markus Winkler

Издание сообщает, что указанные два события подчеркивают стремительные темпы развития искусственного интеллекта китайскими технологическими компаниями, которые ведут ожесточённую борьбу за создание более мощных систем, не делая их при этом непомерно дорогими в эксплуатации.

Обе модели — Qwen3.8-Max от Alibaba и V4-Flash от DeepSeek — демонстрируют приверженность Китая открытым моделям, поскольку компании стремятся завоевать популярность среди разработчиков по всему миру. «Китайские компании, занимающиеся ИИ, нашли важный рынок. Для многих бизнес-процессов не требуется самая лучшая в отрасли модель. Им нужны модели, которые достаточно хороши, доступны по цене, прозрачны и удобны в использовании, и модели с открытым исходным кодом помогают удовлетворить этот спрос», — отметил в разговоре с Reuters главный аналитик исследовательской фирмы Omdia Лянь Цзе Су (Lian Jye Su).

В случае с моделью с открытым исходным кодом, базовые параметры обучения, позволяющие разработчикам запускать или адаптировать систему, доступны для загрузки. В отличие от них, OpenAI, Anthropic и Google используют модели с закрытым исходным кодом.

ИИ-модель Alibaba Qwen3.8-Max сразу же взлетела в рейтингах, оценивающих возможности моделей ИИ, после своего дебюта в понедельник. На фоне этого цена акций компании подскочила на 7 % на торгах в Гонконге. Новая модель поддерживает 2,4 триллиона параметров — числовых настроек, которые модель изучает на основе данных и использует для распознавания закономерностей, генерации ответов и выполнения задач. Она несильно отстаёт от своего отечественного конкурента, модели Kimi K3 от Moonshot AI, которая была запущена в прошлом месяце и поддерживает 2,8 триллиона параметров. Более высокое значение параметра не делает модель автоматически лучше, но оно стало важным показателем масштаба вычислительных ресурсов и данных, лежащих в основе передовых систем искусственного интеллекта.

Qwen3.8-Max была представлена на краудсорсинговой платформе сравнения моделей Arena.AI. Вскоре она оказалась одной из самых высокорейтинговых китайских моделей в категории текстовых моделей ИИ, хотя всё ещё отстаёт от Claude Fable 5 и трёх вариантов моделей Opus, все из которых разработаны Anthropic. В таблице лидеров Arena.AI для моделей ИИ, анализирующих изображения и другие визуальные материалы, Qwen3.8-Max заняла второе место в мире, уступив только модели Claude Fable 5.

Как Qwen3.8-Max, так и Kimi K3 могут работать с текстом, изображениями и видео, обрабатывая до 1 млн токенов за раз. Токены — это фрагменты данных, часто части слов или короткие слова. Чем больше это значение, тем больше материала модель может обрабатывать за один раз, например, длинные юридические документы, обширную базу программного кода или сотни страниц документов.

Компания Alibaba заявила, что Qwen3.8-Max, выпуск которой запланирован на следующую неделю, завершила проект по разработке программного обеспечения за 16 дней. Она использует архитектуру «смешанных экспертов», которая распределяет работу между специализированными частями системы, вместо того чтобы включать всю мощность ИИ для каждого запроса. Одновременно используется 95 млрд параметров, что снижает затраты и задержки ответа.

По данным исследовательской компании Artificial Analysis, модель DeepSeek V4-Flash, выпущенная в пятницу, является самой недорогой среди известных моделей в мире согласно тестам. Использование V4-Flash стоит $0,14 за миллион входных токенов и $0,28 за миллион выходных токенов. Artificial Analysis оценила среднюю стоимость теста V4-Flash в $0,03, по сравнению с $0,86 для Kimi K3, $1,86 для GPT-5.6 Sol от OpenAI и $3,15 для Claude Fable 5.

Переписки пользователей с DeepSeek оказалась общедоступны в поиске Google

Сеансы переписки пользователей с китайским чат-ботом с искусственным интеллектом DeepSeek проиндексировал поисковый сервис Google, обнаружили «Коммерсантъ» и РБК. В общем доступе оказались чаты, для которых создавались публичные ссылки.

 Источник изображения: Solen Feyissa / unsplash.com

Источник изображения: Solen Feyissa / unsplash.com

Поиск Google добавил в выдачу переписку пользователей с DeepSeek — в неё вошли личные сообщения чат-боту и загруженные на платформу рабочие документы. Поисковик проиндексировал только те сеансы, которыми пользователи решили поделиться с другими: сервис предлагает возможность создавать публичные ссылки чатов. При этом DeepSeek предупреждает, что содержимое сможет прочитать любой человек, у которого окажется доступ к этой ссылке, а также рекомендует проверять наличие конфиденциальной информации.

Закрытой информации в открытых переписках пользователей с DeepSeek обнаружить пока не удалось, нет возможности и скачивать приложенные документы. Но сервис предлагает сформировать новый запрос к ИИ и продолжить диалог. Доступ к чужим учётным записям и возможность читать закрытую историю запросов в DeepSeek отсутствует. Это не первый инцидент подобного рода: в 2023 году поиск Google проиндексировал аналогичные публичные ссылки на переписку пользователей с ChatGPT — тогда проблема оказалась связана с ошибкой в библиотеке с открытым исходным кодом.

DeepSeek готовится привлечь новые миллиарды — оценка стартапа вырастет до $71 млрд

В конце мая китайская компания DeepSeek провела первый в своей истории раунд привлечения внешнего финансирования, который позволил собрать $7,4 млрд и оценить капитализацию разработчика в $52 млрд. Теперь появилась информация, что стартап уже готовит второй раунд финансирования, который поднимет планку капитализации до $71 млрд.

 Источник изображения: Unsplash, Solen Feyissa

Источник изображения: Unsplash, Solen Feyissa

Об этом накануне сообщило издание Financial Times, напомнив, что с момента предыдущего привлечения капитала DeepSeek прошло чуть более месяца. Капитализация стартапа при этом должна вырасти на 37 %, исходя из приводимых оценок. Средства требуются компании на строительство центров обработки данных и покупку ускорителей вычислений для инфраструктуры искусственного интеллекта. В рамках предыдущего раунда основатель компании Лян Вэньфэн (Liang Wenfeng) вложил в капитал DeepSeek около $3 млрд собственных средств, а ещё акционерами стартапа стали CATL, Tencent, JD.com и NetEase. Небольшой пакет акций DeepSeek также достался одному из государственных инвестиционных фондов КНР.

Помимо строительства ЦОД, выручка от первого раунда финансирования будет направлена DeepSeek на привлечение дополнительных кадровых ресурсов. На ключевых направлениях численность команд специалистов будет удвоена, как сообщает Financial Times. Конкуренция в сегменте ИИ растёт не только среди китайских разработчиков, но и на мировом рынке, поэтому его участникам требуется всё больше финансовых ресурсов. DeepSeek уже считается самым дорогим стартапом в Китае, а её основатель является самым богатым разработчиком ИИ-моделей благодаря высокой концентрации капитала в его руках.

Попутно Bloomberg и The Wall Street Journal сообщили, что DeepSeek начала подготовку к проведению IPO в Шанхае, заявка на которое может быть подана до конца текущего года, а само размещение произойдёт уже в 2027 году. Переговоры с финансовыми консультантами на эту тему руководство стартапа уже проводит.

Основатель DeepSeek стал богатейшим разработчиком ИИ-моделей в истории

Состояние основателя китайской компании DeepSeek Ляна Вэньфэна (Liang Wenfeng) после последнего инвестиционного раунда выросло более чем вдвое — примерно с $16,7 млрд до $36 млрд. По оценке Bloomberg Billionaires Index, это сделало его самым богатым предпринимателем среди основателей компаний, специализирующихся непосредственно на создании больших моделей искусственного интеллекта.

 Источник изображения: VCG

Источник изображения: VCG

Китайский предприниматель с существенным отрывом опередил сооснователя Anthropic Дарио Амодеи (Dario Amodei) и сооснователя OpenAI Грега Брокмана (Greg Brockman). Резкий рост состояния связан с июньским раундом финансирования DeepSeek, достигшим объёма более $7,4 млрд. Инвесторы оценили китайский стартап приблизительно в $50 млрд, тогда как ещё в апреле его ориентировочная стоимость составляла около $10 млрд. Сам Лян вложил в раунд примерно $3 млрд и после размещения, по расчётам Bloomberg, сохранил около 78 % компании.

Таким образом, состояние предпринимателя остаётся преимущественно «бумажным»: оно определяется расчётной стоимостью его доли в непубличной части DeepSeek, акции которой не торгуются на бирже. При следующем раунде финансирования или изменении оценки компании размер состояния Ляна может существенно измениться. Его высокая позиция в рейтинге богачей объясняется не только ростом DeepSeek, но и тем, что он сохранил гораздо большую долю бизнеса, чем многие американские основатели, привлекавшие капитал в течение нескольких раундов.

В общем рейтинге миллиардеров Лян Вэньфэн занимается 63-ю строчку. В Китае по этому параметру он примерно на восьмом месте. Следует учесть, что Bloomberg составил рейтинг с высоким положением основателя DeepSeek без учёта всего спектра бизнеса в ИИ (от разработки чипов до дата-центров). В ином случае на первое место претендовал бы Илон Маск с его триллионами, в том числе, за ИИ-модели. Несмотря на отчасти «бумажную» основу успеха основателя DeepSeek, у компании ещё есть резерв для роста, который опирается на самое настоящее «железо» — по слухам, компания разрабатывает свой чип для ИИ-инференса и намерена соскочить с оборудования Nvidia и Huawei.

Что касается лидеров компаний Anthropic и OpenAI, пусть почаще изымают свои передовые ИИ-модели из общего пользования — это «верный» путь к успеху.

Китайская DeepSeek тайно разрабатывает собственный чип для инференса ИИ

Китайский стартап DeepSeek, по информации источников Reuters, уже около года интересуется возможностью разработки собственного ИИ-чипа для ускорения работы с инференсом, а потому проводит консультации с возможными партнёрами и привлекает профильных специалистов без лишней огласки.

 Источник изображения: Unsplash

Источник изображения: Unsplash

По замыслу DeepSeek, собственный чип поможет компании снизить зависимость от компонентов Nvidia и Huawei. Если первые до некоторых пор поставлялись в Китай в ограниченном ассортименте из-за экспортных ограничений США, то в последнее время их сложно импортировать уже из-за позиции китайских властей, которые настаивают на импортозамещении. Продукция Huawei хоть и пользуется растущей популярностью у китайских разработчиков, доступна в ограниченных количествах из-за тех же санкций США, которые не позволяют подрядчикам компании выпускать необходимые чипы в достаточных количествах и закупать за границей скоростную память типа HBM. В любом случае, доля Huawei на китайском рынке ИИ-ускорителей сейчас приближается к 50 %, тогда как Nvidia практически утратила своё присутствие на первичном рынке КНР.

Пока сложно судить, кому именно DeepSeek поручит выпуск своего ускорителя для инференса, и какая память ему потребуется, но компании наверняка предстоит найти и партнёра по разработке. По информации Reuters, стартап привлекает специалистов по разработке чипов, но старается не афишировать подобную деятельность, а потому соответствующие объявления о вакансиях не публикуются в открытом виде. Если первые ИИ-модели DeepSeek были обучены на ускорителях Nvidia H800, которые с определённых пор не поставляются в Китай из-за санкций, то весной этого года стартап адаптировал свои новейшие модели под чипы Huawei Ascend. Если ускорители собственной разработки DeepSeek сможет поставить на конвейер и не попасть под санкции США, это позволит стартапу получить определённое преимущество по сравнению с прочими китайскими разработчиками.

Многие компании ИИ-сектора стремятся разрабатывать собственные ускорители вычислений. Помимо американских OpenAI и Anthropic, в подобную активность вовлечены китайские Alibaba и Baidu. По всей видимости, DeepSeek предпочитает двигаться по такой же траектории.

Tencent начала тестировать ИИ-агента на базе DeepSeek в корпоративной версии WeChat

Tencent начала подготовку к запуску агента искусственного интеллекта в корпоративном мессенджере. Китайские технологические гиганты усилили ожесточённую борьбу за привязку пользователей к своим экосистемам, передаёт Bloomberg.

 Источник изображения: tencent.com

Источник изображения: tencent.com

ИИ-агент уже начал развёртываться для некоторых пользователей мессенджера WeCom — корпоративной версии популярного в Китае суперприложения WeChat, рассказал глава отдела по связям с общественностью Tencent Чжан Цзюнь (Zhang Jun). Помощник, получивший название Dayuan, работает на базе модели DeepSeek V4 и поддерживает запросы на естественном языке.

Dayuan обещает стать серьёзным рабочим инструментом, способным использовать огромные массивы данных, присутствующие в WeCom. ИИ-агент анализирует групповые чаты, переписку по электронной почте и записи в корпоративном календаре — он помогает эффективнее оценивать отзывы клиентов и оптимизирует взаимодействие с ними. Приложение умеет автоматизировать повторяющиеся задачи, составляя ежедневные отраслевые обзоры и готовя еженедельные отчёты.

Tencent сейчас выступает в качестве догоняющей сегменте ИИ, уступая таким игрокам как Alibaba и ByteDance. Корпоративный мессенджер WeCom является прямым конкурентом Alibaba DingTalk и ByteDance Lark на китайском рынке рабочих приложений. Эти приложения служат интерфейсом для облачных подразделений китайских техногигантов — их клиенты сейчас наращивают потребление токенов. Преимущество WeCom состоит в интеграции с популярной в стране потребительской экосистемой WeChat — обладая им, Tencent стремится укрепить свои позиции.

CATL и Tencent стали инвесторами DeepSeek, но больше всех вложился основатель стартапа

Не только западные стартапы привлекают крупные суммы на развитие инфраструктуры искусственного интеллекта. Как сообщает The Information, первая попытка китайской DeepSeek обратиться за финансированием к внешним источникам позволила этой компании привлечь $7,4 млрд и оценить свою капитализацию более чем в $50 млрд. Среди инвесторов оказались компании Tencent и CATL.

 Источник изображения: Unsplash, Sollen Feyissa

Источник изображения: Unsplash, Sollen Feyissa

Структура сделки, как сообщает источник, была направлена на сохранение основателем и генеральным директором DeepSeek Ляном Вэньфэном (Liang Wenfeng) абсолютного контроля над своим детищем. По этой причине инвесторы формально вкладывались в капитал не самой DeepSeek, а контролируемой им партнёрской организации. Кроме того, продать свои доли в капитале этой структуры инвесторы не смогут на протяжении ближайших пяти лет. Исключением стал Национальный фонд инвестиций в ИИ-отрасль КНР, которому было позволено вложить $148 млн напрямую в капитал DeepSeek, а также в дальнейшем продать свою долю в любое время без ограничений. Кроме того, эта структура ещё и сохранила право голоса в управлении DeepSeek, в отличие от прочих внешних инвесторов.

Впрочем, в качестве привилегий для последних можно рассматривать сохранение доступа к подробной финансовой отчётности DeepSeek, а также право первоочередного участия в новых раундах финансирования. Непосредственно основатель компании внёс в её капитал дополнительные $3 млрд, что сделало его основным участником раунда. Tencent внесла $1,5 млрд, производитель тяговых батарей CATL внёс вдвое меньше, а ряд прочих инвесторов ограничились суммами по $444 млн. Сбор средств вёлся с апреля этого года. Основанная в 2023 году DeepSeek до этого не привлекала внешний капитал. Успех ИИ-модели R1 в начале 2025 года вызвал необходимость в более активном финансировании компании, поэтому ей пришлось обратиться к внешним инвесторам. Новые средства будут направлены не только на обучение ИИ-моделей и развитие вычислительной инфраструктуры, но и увеличение штата профильных специалистов.

Китайские DeepSeek и CXMT увернулись от попадания в чёрный список Минторга США

Ограничения на взаимодействие с теми или иными иностранными компаниями в США диктуются разными ведомствами, но Министерство торговли воздержалось, вопреки опасениям, от включения в свой «чёрный список» китайских DeepSeek, CXMT и в общей сложности более чем 100 других компаний из КНР.

 Источник изображения: Unsplash, Sollen Feyissa

Источник изображения: Unsplash, Sollen Feyissa

Об этом сообщило накануне агентство Reuters, которое объяснило подобную осторожность нежеланием властей США обострять взаимоотношения с Китаем. Кандидаты из числа китайских компаний на включение в новую редакцию перечня были отобраны межведомственной комиссией ещё в прошлом году, но последнее слово оставалось именно за внешнеторговым ведомством США.

К китайской DeepSeek у властей США накопилось немало претензий. Её подозревают не только в нелегальном получении доступа к американским ускорителям вычислений, но и в использовании разработок Anthropic и OpenAI для создания схожих ИИ-моделей. Кроме того, в эту копилку добавился и традиционный фактор подозрений в содействии DeepSeek китайским военным и спецслужбам.

Китайский производитель памяти CXMT был уличён в содействии китайским военным ещё при президенте Байдене, а действующая администрация США рассматривала возможность введения санкций против этой компании на протяжении более чем полутора лет. Если бы экспортные ограничения по линии Министерства торговли США в отношении указанных китайских компаний вступили в силу, то любое сотрудничество с ними со стороны американских юридических лиц потребовало бы получения специальной лицензии, которую на практике было бы практически нереально оформить. «Чёрный список» в последний раз обновлялся Министерством торговли США в октябре прошлого года, пауза стала самой продолжительной за последние десять с лишним лет.

Предполагалось, что этот список может пополниться теми китайскими компаниями, которые снабжают своей продукцией вооружённые силы КНР и могут поставлять соответствующее оборудование в Россию, а также снабжать китайские университеты санкционными ускорителями вычислений Nvidia. С конца прошлого года руководство американского министерства предпочло не обострять напряжённость во взаимоотношениях с Китаем. Считается, что это даже немного упростило китайским компаниям процесс закупки американских ускорителей вычислений. Не менее 75 китайских компаний и организаций были предварительно отобраны для включения в новую редакцию списка, но она так и не была опубликована с осени прошлого года.

Microsoft подключит DeepSeek к Copilot Cowork в качестве экономичной альтернативы OpenAI и Anthropic

Microsoft планирует перевести Copilot Cowork на оплату по факту использования вычислительных ресурсов и одновременно рассматривает возможность подключить модель DeepSeek в качестве более дешёвой альтернативы для своих корпоративных клиентов, сообщает Axios.

 Источник изображения: Rubaitul Azad/unsplash.com

Источник изображения: Rubaitul Azad/unsplash.com

Рост популярности агентских инструментов, включая Copilot Cowork, Anthropic Claude Code и OpenAI Codex, сопровождается многократным увеличением числа запросов к ИИ-моделям в ходе выполнения задач, что порождает непредсказуемо высокие счета для клиентов в корпоративном сегменте и одновременно увеличивает нагрузку на вычислительные ресурсы. Данная проблема побудила Microsoft пересмотреть подход к ценообразованию, поскольку безлимитные тарифы оказались экономически невыгодными при интенсивной эксплуатации моделей.

Компания уже проводит тестирование доработанной версии DeepSeek V4, а также изучает другие открытые модели, стремясь предложить заказчикам альтернативу OpenAI и Anthropic. Ожидается, что окончательное решение о выборе конкретной модели будет объявлено в течение нескольких недель.

В случае утверждения DeepSeek эта модель будет полностью развёрнута на инфраструктуре Azure, благодаря чему все данные останутся в облаке корпорации с сохранением стандартных механизмов безопасности, соответствуя требованиям и контролю за местонахождением информации. Инженеры Microsoft уже провели тонкую настройку модели и внедрили дополнительные защитные фильтры.

Вице-президент Чарльз Ламанна (Charles Lamanna) также пояснил, что тестирования показали невозможность сохранения безлимитного доступа, поскольку сотни задач в неделю от одного пользователя, хотя и свидетельствуют о высокой эффективности модели, ведут к чрезмерным издержкам.

DeepSeek стала самым дорогим стартапом в Китае

Китайская DeepSeek, специализирующаяся на технологиях искусственного интеллекта, провела первый раунд финансирования и привлекла более 50 млрд юаней ($7,4 млрд) при оценке более чем в $50 млрд. Это значит, что компания является самым дорогим китайским стартапом, пишет The Information.

 Источник изображения: Solen Feyissa / unsplash.com

Источник изображения: Solen Feyissa / unsplash.com

Из указанной суммы $3 млрд вложил Лян Вэньфэн (Liang Wenfeng), основатель и владелец 90 % самой DeepSeek. Большинство инвесторов вкладывало деньги не напрямую, а через специальный созданные господином Ляном фонд — эта схема обеспечит ему сохранение контроля над компанией, отмечают источники. Прямые инвестиции в DeepSeek сделал китайский Национальный фонд инвестиций в отрасль ИИ, но размер его вложения составил относительно небольшие $150 млн.

Полученные от инвесторов средства DeepSeek намерена направить на программу дальнейших исследования и разработки, а также на расширение принадлежащей ей вычислительной инфраструктуры.

Американские ИТ-компании стали выбирать ИИ DeepSeek — он дешевле

Всё большее число американских технологических компаний стало внедрять китайские модели и прочие инструменты искусственного интеллекта, в том числе DeepSeek. Работа с ними обходится значительно дешевле систем, разработанных в США, пишет South China Morning Post.

 Источник изображения: Solen Feyissa / unsplash.com

Источник изображения: Solen Feyissa / unsplash.com

DeepSeek предлагает клиентам значительно более низкие затраты по сравнению с лидерами американской отрасли, такими как OpenAI и Anthropic, но обеспечивает при этом достаточно высокое качество. В результате DeepSeek удалось подняться на вершину в нескольких рейтингах разработчиков, потому что американские компании продолжают сокращать расходы и повышать эффективность — исключительное качество уступает стремлению найти сбалансированное решение.

Ещё одно достоинство DeepSeek — открытый исходный код. Эти модели можно скачивать, настраивать и развёртывать на своей собственной инфраструктуре, что помогает снизить зависимость от внешних поставщиков. Китайские разработчики обратили внимание на свою популярность среди американских стартапов и начали выпускать более лёгкие модели, работа с которыми обходится дешевле, чем у типичных поставщиков из США.

DeepSeek обрела популярность, когда предложила способ разработки конкурентоспособных моделей ИИ, используя меньше ресурсов, а также открыла более эффективные методы обучения по сравнению с конкурентами, что актуально в условиях американских санкций в отношении Китая. Недавно компания привлекла инвестиции в размере $7,4 млрд, в том числе от таких гигантов как Tencent и CATL; оценочная стоимость DeepSeek составила около $60 млрд.


window-new
Soft
Hard
Тренды 🔥
Новая статья: Big Walk — друзья познаются на прогулке. Рецензия 8 ч.
Прицениваясь к Anthropic, инвесторы всерьёз прикидывают её выручку через два года 8 ч.
Microsoft предупредила о завершении поддержки Windows 10 Enterprise LTSB 2016 и других версий ОС 14 ч.
В интернете кончились тексты: разработчики ИИ начали скупать корпоративные чаты и письма 16 ч.
OpenAI переосмыслила подход к безопасности после инцидента со взломом Hugging Face 16 ч.
В модулях памяти Corsair, G.Skill и Adata нашли уязвимость, через которую можно обходить защиту Windows 18 ч.
Высший суд Франции отклонил закон о запрете соцсетей для детей до 15 лет — он нарушает свободу слова 19 ч.
Опасная ошибка в macOS позволяла удалённо управлять чужим Mac без пароля 20 ч.
Anthropic уже создала ИИ-модель мощнее Mythos, но решила никому её не показывать 22 ч.
Исход руководителей из OpenAI посеял в компании хаос перед выходом на биржу 22 ч.
Власти США предостерегают союзников от сотрудничества с китайскими разработчиками ИИ 24 мин.
Обвиняемый в промышленном шпионаже тайваньский инженер прокололся, оставив передатчики скрытой камеры включенными 2 ч.
Intel предрекает разделение рынка ПК: новые сокеты — для энтузиастов, старые — для масс 12 ч.
Пузырь ИИ надувается: крупнейшие IT-компании всё больше зарабатывают на инвестициях друг в друга 14 ч.
В Пекине пройдут Всемирные игры человекоподобных роботов с участием 2026 роботов 14 ч.
Производители видеокарт предупреждают о надвигающемся дефиците — сильнее всего пострадают бюджетные модели 15 ч.
Власти США призвали Apple не закупать китайскую память 16 ч.
Tesla скоро представит новый Roadster, и он будет летать 16 ч.
D-Wave сообщила о прорыве в коррекции ошибок квантовых вычислений 16 ч.
196 Пбайт на стойку: хранилище Dell ObjectScale первым в мире получило поддержку 245-Тбайт SSD 17 ч.