Сегодня 30 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → deepseek
Быстрый переход

Microsoft подключит DeepSeek к Copilot Cowork в качестве экономичной альтернативы OpenAI и Anthropic

Microsoft планирует перевести Copilot Cowork на оплату по факту использования вычислительных ресурсов и одновременно рассматривает возможность подключить модель DeepSeek в качестве более дешёвой альтернативы для своих корпоративных клиентов, сообщает Axios.

 Источник изображения: Rubaitul Azad/unsplash.com

Источник изображения: Rubaitul Azad/unsplash.com

Рост популярности агентских инструментов, включая Copilot Cowork, Anthropic Claude Code и OpenAI Codex, сопровождается многократным увеличением числа запросов к ИИ-моделям в ходе выполнения задач, что порождает непредсказуемо высокие счета для клиентов в корпоративном сегменте и одновременно увеличивает нагрузку на вычислительные ресурсы. Данная проблема побудила Microsoft пересмотреть подход к ценообразованию, поскольку безлимитные тарифы оказались экономически невыгодными при интенсивной эксплуатации моделей.

Компания уже проводит тестирование доработанной версии DeepSeek V4, а также изучает другие открытые модели, стремясь предложить заказчикам альтернативу OpenAI и Anthropic. Ожидается, что окончательное решение о выборе конкретной модели будет объявлено в течение нескольких недель.

В случае утверждения DeepSeek эта модель будет полностью развёрнута на инфраструктуре Azure, благодаря чему все данные останутся в облаке корпорации с сохранением стандартных механизмов безопасности, соответствуя требованиям и контролю за местонахождением информации. Инженеры Microsoft уже провели тонкую настройку модели и внедрили дополнительные защитные фильтры.

Вице-президент Чарльз Ламанна (Charles Lamanna) также пояснил, что тестирования показали невозможность сохранения безлимитного доступа, поскольку сотни задач в неделю от одного пользователя, хотя и свидетельствуют о высокой эффективности модели, ведут к чрезмерным издержкам.

DeepSeek стала самым дорогим стартапом в Китае

Китайская DeepSeek, специализирующаяся на технологиях искусственного интеллекта, провела первый раунд финансирования и привлекла более 50 млрд юаней ($7,4 млрд) при оценке более чем в $50 млрд. Это значит, что компания является самым дорогим китайским стартапом, пишет The Information.

 Источник изображения: Solen Feyissa / unsplash.com

Источник изображения: Solen Feyissa / unsplash.com

Из указанной суммы $3 млрд вложил Лян Вэньфэн (Liang Wenfeng), основатель и владелец 90 % самой DeepSeek. Большинство инвесторов вкладывало деньги не напрямую, а через специальный созданные господином Ляном фонд — эта схема обеспечит ему сохранение контроля над компанией, отмечают источники. Прямые инвестиции в DeepSeek сделал китайский Национальный фонд инвестиций в отрасль ИИ, но размер его вложения составил относительно небольшие $150 млн.

Полученные от инвесторов средства DeepSeek намерена направить на программу дальнейших исследования и разработки, а также на расширение принадлежащей ей вычислительной инфраструктуры.

Американские ИТ-компании стали выбирать ИИ DeepSeek — он дешевле

Всё большее число американских технологических компаний стало внедрять китайские модели и прочие инструменты искусственного интеллекта, в том числе DeepSeek. Работа с ними обходится значительно дешевле систем, разработанных в США, пишет South China Morning Post.

 Источник изображения: Solen Feyissa / unsplash.com

Источник изображения: Solen Feyissa / unsplash.com

DeepSeek предлагает клиентам значительно более низкие затраты по сравнению с лидерами американской отрасли, такими как OpenAI и Anthropic, но обеспечивает при этом достаточно высокое качество. В результате DeepSeek удалось подняться на вершину в нескольких рейтингах разработчиков, потому что американские компании продолжают сокращать расходы и повышать эффективность — исключительное качество уступает стремлению найти сбалансированное решение.

Ещё одно достоинство DeepSeek — открытый исходный код. Эти модели можно скачивать, настраивать и развёртывать на своей собственной инфраструктуре, что помогает снизить зависимость от внешних поставщиков. Китайские разработчики обратили внимание на свою популярность среди американских стартапов и начали выпускать более лёгкие модели, работа с которыми обходится дешевле, чем у типичных поставщиков из США.

DeepSeek обрела популярность, когда предложила способ разработки конкурентоспособных моделей ИИ, используя меньше ресурсов, а также открыла более эффективные методы обучения по сравнению с конкурентами, что актуально в условиях американских санкций в отношении Китая. Недавно компания привлекла инвестиции в размере $7,4 млрд, в том числе от таких гигантов как Tencent и CATL; оценочная стоимость DeepSeek составила около $60 млрд.

В России сбоит DeepSeek — РКН отрицает блокировку

С вечера субботы, 23 мая, и в воскресенье российские пользователи жалуются на проблемы с доступом к нейросети DeepSeek, о чём свидетельствуют данные ресурсов Downdetector и «Сбой.рф». Согласно сведениям Downdetector, пик сбоев пришёлся на 10 часов утра, всего за сутки поступило около 23 тыс. жалоб пользователей, больше всего — из Москвы, Петербурга, Новосибирской, Московский областей.

 Источник изображения: Solen Feyissa/unsplash.com

Источник изображения: Solen Feyissa/unsplash.com

В большинстве своём жалобы поступали от владельцев Android-устройств (57,4 %) и компьютеров на Windows (21,9 %). Также зафиксированы жалобы от пользователей устройств на iOS (18,6 %) и Mac OS X (1,4 %). Большей частью пользователи жалуются на общий сбой (35 %), а также на работу мобильного приложения (17 %) и сайта (14 %). При этом сайт открывается при использовании VPN. Как сообщил ресурс «Код Дурова», жалобы на работу DeepSeek поступают только из России. При проверке интернет-соединения, проведённой «Кодом Дурова», соединение с сайтом обрывается на этапе TLS — это поведение совпадает с заблокированными Роскомнадзором сайтами. Однако, как сообщили в ведомстве ТАСС: «Роскомнадзор не получал решения уполномоченных органов и не вводил ограничения в отношении Deepseek».

«Код Дурова» отметил, что DeepSeek был единственным зарубежным ИИ-сервисом из пятёрки самых крупных, который официально не ограничивал россиянам доступ к сервису.

В предыдущий раз сбой в работе DeepSeek наблюдался 8 мая, но тогда жалобы на работу сервиса также поступали от пользователей из США, Великобритании и других стран. При этом в большинстве случаев (89 %) нейросеть была недоступна в России. Тогда компания объяснила сбой крупным отключением электроэнергии на шкале отслеживания работы службы API и веб-чата.

DeepSeek оставила навсегда 75-процентную скидку на ИИ-модель V4-Pro

Китайский ИИ-стартап DeepSeek объявил о решении сохранить навсегда 75-процентную скидку на использование своей флагманской ИИ-модели V4-Pro, срок действия которой должен был завершиться в конце мая. Как полагают эксперты, это решение связано с возможностью более широкого использования DeepSeek чипов Huawei.

 Источник изображения: Solen Feyissa/unsplash.com

Источник изображения: Solen Feyissa/unsplash.com

Во всяком случае, представляя V4-Pro, компания заявили, что она будет стоить до 12 раз дороже, чем менее мощная версия Flash, из-за «ограничений в высокопроизводительных вычислительных мощностях». Вместе с тем DeepSeek тогда добавила, что следует ожидать резкое снижение цен на версию V4-Pro после массового запуска суперузлов на базе Huawei Ascend 950 во второй половине 2026 года.

Согласно заявлению компании, стоимость использования API V4-Pro с 75-процентной скидкой находится в диапазоне 0,025–6 юаней (около $0,0035 до $0,83) за 1 млн токенов. Снизив цену, DeepSeek стремится укрепить свои позиции на всё более переполненном рынке, чтобы привлечь разработчиков и корпоративных пользователей, и, как результат, обойти как отечественных конкурентов, так и западные компании в сфере ИИ-услуг.

Оптимизировав ИИ-модели V4 для работы на китайских процессорах Huawei Ascend 950, а не на дорогостоящих ускорителях Nvidia, доступ к которым к тому же ограничен, DeepSeek смогла значительно снизить свои операционные затраты на инфраструктуру. Это позволило ей предлагать свои решения клиентам на более привлекательных условиях, вступая в прямую конкуренцию с западными ИИ-гигантами.

Экспортные ограничения США на поставку продвинутых графических процессоров Nvidia китайским компаниям, призванные замедлить прогресс Китая в сфере ИИ, оказали противоположный эффект: создали масштабный, эксклюзивный рыночный бум для крупнейшего китайского конкурента Nvidia, компании Huawei, а также других китайских производителей микросхем.

Китайский «Большой фонд» может возглавить финансирование DeepSeek при оценке $45 млрд

Государственный фонд Китая, созданный для поддержки полупроводниковой отрасли, обсуждает первую крупную инвестицию в один из ведущих отечественных ИИ-стартапов. Фонд может возглавить первый раунд финансирования DeepSeek и оценить компанию примерно в $45 млрд. Такая оценка поставила бы её в ряд самых дорогих ИИ-стартапов мира.

 Источник изображения: deepseek.com

Источник изображения: deepseek.com

Формальное название инвестора — Национальный фонд инвестиций в индустрию интегральных схем (China Integrated Circuit Industry Investment Fund). В Китае его ещё называют «Большим фондом» (Big Fund). Это главный государственный инструмент для развития китайской полупроводниковой отрасли. Раньше «Большой фонд» направлял миллиарды на поддержку китайских производителей оборудования, прежде всего Semiconductor Manufacturing International Corp. (SMIC). О переговорах c DeepSeek сообщили издания Financial Times и Reuters со ссылкой на четырёх собеседников, знакомых с ситуацией.

Если фонд действительно возглавит раунд финансирования, для Пекина это станет непривычным шагом. До сих пор «Большой фонд» работал в основном с производителями оборудования, а DeepSeek разрабатывает большие языковые модели (LLM), аналогичные моделям OpenAI. Иными словами, фонд впервые расширяет свои инвестиции с чипов на ИИ, который на этих чипах работает. Этим шагом Пекин, по сути, признаёт, что одних только производственных мощностей для самодостаточности в сфере ИИ уже недостаточно.

Этот разворот вписывается в более широкую национальную стратегию ускоренного развития «новых производительных сил», где ИИ обозначен как ключевой компонент. Поддерживая передовой ИИ-стартап, правительство не просто делает ставку на одну компанию, а целенаправленно растит национального чемпиона, способного конкурировать на мировой ИИ-арене. Однако DeepSeek — не единственный сильный игрок на китайском рынке ИИ. Среди его конкурентов — Zhipu AI, за которой стоят Alibaba и Tencent, и Moonshot AI, недавно привлёкшая более $1 млрд инвестиций. Жёсткая внутренняя конкуренция, подпитываемая теперь государственным капиталом, формирует динамичную среду для развития ИИ.

Условия инвестиционного раунда пока не согласованы. Если оценка в $45 млрд подтвердится, она станет показателем доверия инвесторов к технологиям DeepSeek и к её шансам захватить заметную долю рынка. Деньги нужны на главные расходы любой ИИ-компании: закупку мощных графических процессоров (GPU), на которых обучают LLM, и привлечение специалистов высокого уровня. Для рынка это сигнал: несмотря на общее замедление экономики, ведущие китайские ИИ-компании по-прежнему могут рассчитывать на высокие оценки государства, особенно если их деятельность совпадает с национальными стратегическими целями.

Выход DeepSeek V4 взвинтил спрос на ИИ-ускорители Huawei Ascend 950

После выхода ИИ-модели DeepSeek V4, специально оптимизированной для работы на чипах Huawei, в Китае резко вырос спрос на ИИ-ускорители Ascend 950, пишет агентство Reuters. По словам его источников, крупнейшие китайские интернет-компании, включая ByteDance, Tencent и Alibaba, обращаются к Huawei с заявками на новые заказы.

 Источник изображения: huaweicentral.com

Источник изображения: huaweicentral.com

Также стремятся разместить заказы на поставку Ascend 950 компании, специализирующиеся на облачных вычислениях и услугах аренды графических процессоров (GPU). Чип Ascend 950PR значительно превосходит по производительности Nvidia H20 — самый мощный чип, который Nvidia разрешалось продавать в Китае до того, как Пекин заблокировал его импорт в прошлом году. Но он всё же уступает чипу H200, который пока так и поставляется в Китай из-за разногласий Пекина и Вашингтона относительно условий его продажи.

Решение DeepSeek оптимизировать версию DeepSeek V4 специально для использования с чипами Huawei знаменует собой стратегический сдвиг от зависимости от американских полупроводников к развитию собственного китайского оборудования для ИИ-технологий, что является приоритетом для Пекина в стремлении к технологическому превосходству, отметило Reuters.

Серия Huawei Ascend 950 — в частности, вариант 950PR — является единственным китайским чипом с поддержкой технологии обработки ИИ-вычислений в более сжатом вычислительном формате, что позволяет производить больше вычислений в секунду при меньших затратах.

Сразу же после анонса платформа Bailian от Alibaba Cloud предоставила доступ к DeepSeek V4, предложив варианты V4-Pro и V4-Flash по официальным ценам разработчика. Аналогично поступила Tencent Cloud. Быстрый запуск ИИ-модели крупными облачными платформами означает, что миллионы пользователей и разработчиков теперь могут получить доступ к V4, что резко увеличивает объём запросов, и, соответственно, спрос на базовые чипы для их обработки.

DeepSeek заявила, что цена V4-Pro может значительно снизиться во второй половине 2026 года, как только кластеры на Huawei Ascend 950 начнут «поставляться в больших масштабах». Следует отметить, что из-за экспортных ограничений США на поставку передового оборудования для производства микросхем Huawei не сможет удовлетворить потребности отрасли в чипах Ascend 950.

По словам источников, Huawei планирует отгрузить около 750 тыс. единиц Ascend 950PR в этом году. Старт его серийного производства был намечен на апрель, а полномасштабные поставки должны начаться во второй половине 2026 года.

DeepSeek-V4 вышла без «вау-эффекта» — рынок уже привык к дешёвому ИИ

Реакция рынка на предварительную версию новой ИИ-модели DeepSeek-V4 пока выглядит сдержанной по сравнению с тем, что можно было наблюдать в прошлом году, когда китайский стартап анонсировал свои недорогие и производительные алгоритмы. Это указывает на то, что за прошедшее с тех пор время рынки адаптировались и привыкли к появлению недорогих и высокоэффективных ИИ-моделей.

 Источник изображения: Unsplash, Sollen Feyissa

Источник изображения: Unsplash, Sollen Feyissa

Релиз алгоритмов DeepSeek-V3 и R1, которые по заявлению разработчиков были обучены с использованием лишь части вычислительных мощностей, используемых американскими конкурентами, вызвал бурную реакцию в отрасли. Инвесторы усомнились в целесообразности огромных вложений в ИИ-инфраструктуру, которые требуются западным компаниям для обучения передовых моделей.

Сдержанная реакция на выпущенную в конце прошлой недели предварительную версию DeepSeek-V4 подчёркивает, как быстро меняется положение дел в отрасли. Рынки успели привыкнуть к недорогим и эффективным моделям, разработанным в условиях ограниченных вычислительных мощностей. За счёт этого исчез элемент неожиданности. «Этот анонс прошёл по довольно предсказуемому пути», — отметил главный аналитик Omdia Лиан Джи Су (Lian Jye Su). Он добавил, что с момента прошлого анонса DeepSeek достижения разработчиков в области архитектуры и эффективности ИИ-моделей активно изучаются в промышленных и академических кругах.

Данные бенчмарков подтверждают эту точку зрения. Согласно Artificial Analysis, DeepSeek-V4 Pro показывает значительное улучшение производительности по сравнению с предыдущими версиями, но в целом входит в число ведущих моделей с открытым кодом, а не явно превосходит конкурентов. При этом конкуренты, такие как Kimi и Qwen, постепенно сокращают отставание.

Это контрастирует с тем, что было в прошлом году. На тот момент DeepSeek, казалось, вырвалась вперёд среди китайских конкурентов, что привело к быстрому распространению алгоритма на домашнем рынке и помогло компании закрепиться в глобальных масштабах. Аналитики считают, что такой результат был вызван совпадением факторов: завышенные оценки американских технологических компаний, ожидания продолжающегося доминирования нескольких крупнейших игроков и появление относительно неизвестного китайского стартапа, показавшего неожиданно сильный результат.

«Ожидание появления новых игроков теперь заложено в оценки», — рассказал Су, отметив, что рынки стали более реалистично оценивать возможности и ограничения ИИ. В это же время усилилась конкуренция внутри Китая, поскольку несколько компаний выпускают всё более производительные модели, тем самым подрывая лидерство DeepSeek.

В понедельник фондовые рынки Южной Кореи и Тайваня достигли новых максимумов на фоне оптимизма инвесторов в отношении ценных бумаг, связанных с ИИ. В компании Ankura China Advisors заявили, что значение модели DeepSeek-V4 заключается меньше в рыночном влиянии и больше в гонке США и Китая за технологическое превосходство. Там отметили адаптацию новой модели к работе на базе ускорителей Huawei, что стало необходимостью на фоне жёстких экспортных ограничений со стороны США, из-за которых китайские компании не имеют доступа к передовым ускорителям Nvidia.

«Фактор "вау" был в прошлом году — он уже учтён в ценах. Теперь важно, сможет ли Китай продолжать продвигаться в разработке ИИ и, возможно, делать это на ускорителях собственного производства — геополитические последствия были бы значительными», — отметил представитель Ankura China Advisors.

DeepSeek снизила на 75 % цены за доступ к ИИ-модели DeepSeek-V4-Pro

DeepSeek предложила разработчикам скидку 75 % на новую флагманскую ИИ-модель DeepSeek-V4-Pro. Одновременно китайская компания в 10 раз удешевила повторные и похожие запросы на всех своих платформах за счёт кеширования входных данных.

 Источник изображения: deepseek.com

Источник изображения: deepseek.com

Резкое снижение цен DeepSeek грозит вернуть ИИ-индустрию к ценовой войне, которая вспыхнула после того, как DeepSeek устроила переполох в Кремниевой долине своей ИИ-моделью R1 в начале прошлого года. OpenAI, Anthropic и Google наперегонки выпускают новые ИИ-продукты, но их использование обходится дорого. Китайские компании рассчитывают, что разница в тарифах ускорит переход разработчиков на их платформы и изменит расклад сил в технологическом соперничестве с США.

 Источник изображения: @deepseek_ai / x.com

Источник изображения: @deepseek_ai / x.com

Однако DeepSeek рассчитывает привлечь пользователей не только ценой. Контекстное окно DeepSeek-V4 — максимальный объём данных, который модель обрабатывает за один раз, — позволяет работать со сложными кодовыми базами и объёмными документами. Модель легко подключается к Claude Code, OpenClaw и OpenCode, что упрощает её взаимодействие с более широкой ИИ-экосистемой.

«Ценообразование, открытый исходный код и контекстное окно в миллион токенов снижают порог входа для разработчиков, стартапов и малого бизнеса», — сказал Акшар Керемане (Akshar Keremane), сооснователь ИИ-стартапа O-Health. По словам Керемане, раньше разработчики не могли экспериментировать с моделями такого уровня и масштаба.

Представлена DeepSeek V4 — открытая ИИ-модель, которая потягается с лучшими решениями OpenAI и Google

Китайская компания DeepSeek выпустила предварительную версию большой языковой модели V4. Релиз состоялся спустя более чем год после того, как DeepSeek представила свою модель с поддержкой рассуждения R1, которая потрясла глобальные технологические рынки благодаря высокому уровню производительности и экономической эффективности. Также интересно, что DeepSeek V4 вышла через несколько часов после анонса OpenAI GPT-5.5.

 Источник изображения: AI

Источник изображения: AI

Как и предыдущая модель DeepSeek V3, новая версия алгоритма имеет открытый исходный код, что позволяет разработчикам разворачивать нейросеть локально и модифицировать её по собственному усмотрению. DeepSeek заявила, что V4 демонстрирует высокую производительность по сравнению с китайскими конкурентами, особенно в агентных задачах, обработке данных и логических выводах. В дополнение к этому DeepSeek V4 оптимизирована для использования с популярными ИИ-агентами, такими как OpenClaw и Anthropic Claude Code. Доступны версии «pro» и «flash», отличающиеся размером и производительностью. DeepSeek-V4-Pro предлагает 1,6 триллионов параметров (49 миллиардов активных) и производительность, «сопоставимую с лучшими в мире закрытыми моделями». DeepSeek-V4-Flash обеспечивает только 284 млрд параметров, из которых 13 млрд активных.

Версия Pro превосходит все существующие открытые модели в математике и программировании, и способна потягаться здесь даже с лучшими закрытыми моделями. А знания о мире этой модели «уступают только Gemini 3.1 Pro». В свою очередь версия Flash даёт возможности рассуждения близкие к уровню V4-Pro, и выполняет простые задачи в режиме агента на уровне V4-Pro.

DeepSeek основана в 2023 году, а внимание компания привлекла в 2024 году, когда выпустила бесплатную ИИ-модель V3 с открытым исходным кодом. Этот алгоритм оказался экономически эффективным, поскольку на его создание ушло значительно меньше средств по сравнению с западными конкурентами, например, от OpenAI и Google.

В январе 2025 года DeepSeek выпустила модель R1, которая показала аналогичную производительность или превзошла многих конкурентов. Модель R1 встревожила инвесторов, когда DeepSeek объявила, что на её создание с использованием не самых мощных ускорителей Nvidia потребовалось всего два месяца и менее $6 млн. Это поставило под сомнение лидерство США в сфере ИИ, а также огромные расходы технологических компаний на инфраструктуру для ИИ.

Аналитик MorningStar Айвен Су (Ivan Su) считает, что алгоритм V4 вряд ли окажет на индустрию такое же влияние, как R1, поскольку рынки учли то, что китайский ИИ конкурентоспособен и дешевле в использовании. Он добавил, что новая позиция DeepSeek делает другие китайские ИИ-модели с открытым исходным кодом прямыми конкурентами. «Такой формулировки не существовало во времена R1, и уже это говорит о том, насколько усилилась внутренняя конкуренция», — добавил Су.

Главный вопрос после запуска DeepSeek V4 в том, какие ускорители использовались для обучения модели. Китайский технологический гигант Huawei на этой неделе подтвердил, что его новейший вычислительный ИИ-кластер, работающий на ускорителях Ascend, может поддерживать модель DeepSeek V4. Однако не ясно, в какой степени ускорители Huawei использовались для обучения новой ИИ-модели.

Новые модели DeepSeek уже доступны в веб-версии и приложении чат-бота DeepSeek, где режим Instant основан на V4-Flash, а Expert — на V4-Pro. Разработчики также получили доступ к новинкам через API.

Tencent и Alibaba готовы инвестировать в DeepSeek — стартап уже оценивается в более чем $20 млрд

Китайские технологические гиганты Tencent Holdings и Alibaba Group ведут переговоры об инвестициях в стартап DeepSeek, занимающийся разработкой искусственного интеллекта. DeepSeek с рыночной оценкой в $20 млрд. принадлежащая китайскому хедж-фонду High-Flyer Capital Management, стремится привлечь дополнительное финансирование. Возможность инвестирования средств в DeepSeek вызвала огромный интерес у венчурных капиталистов.

Издание The Information сообщило, что DeepSeek впервые начала переговоры о привлечении внешнего капитала с целью получения не менее $300 млн дополнительного финансирования. Такие «аппетиты» подчёркивают огромные капиталовложения, необходимые для разработки и эксплуатации передовых моделей ИИ, особенно с учётом растущей сложности логических рассуждений и автономных ботов-агентов.

Переговоры все ещё продолжаются, и, согласно сообщению, как оценка, так и объем привлекаемого капитала могут измениться. Американские венчурные капиталисты оценивают риски инвестиций в DeepSeek из-за непримиримой борьбы между китайскими и американскими разработчиками ИИ и не менее непримиримой позиции правительств двух стран.

Ранее в этом году агентство Reuters сообщало, что компания не показала американским производителям чипов свою флагманскую модель для оптимизации производительности и обучила одну из своих новейших моделей на передовом чипе Nvidia, несмотря на то, что его экспорт в Китай был запрещён правительством США.

Китайскую DeepSeek оценили в $10 млрд — компания хочет привлечь $300 млн на развитие

Основные капиталы в сфере ИИ сейчас формируются в США, но это не мешает китайским стартапам типа DeepSeek демонстрировать сопоставимые результаты в своей деятельности при заметно меньшем финансировании. По слухам, DeepSeek сейчас ведёт переговоры о привлечении $300 млн, чтобы поднять свою капитализацию до $10 млрд.

 Источник изображения: Unsplash, Sollen Feyissa

Источник изображения: Unsplash, Sollen Feyissa

Напомним, что американская OpenAI сейчас оценивается в $850 млрд, а конкурирующая Anthropic её стремительно догоняет, претендуя на величину капитализации около $800 млрд. По данным The Information, на которые ссылается Reuters, ранее китайский стартап DeepSeek отверг ряд предложений местных венчурных фондов о финансировании, но теперь ведёт переговоры с инвесторами о привлечении $300 млн. Текущий уровень капитализации DeepSeek оценивается в $10 млрд.

Американские венчурные фонды не готовы вкладываться в китайский DeepSeek, опасаясь претензий американских регуляторов, поскольку сфера искусственного интеллекта считается полем острой конкуренции между США и КНР, и власти первой из стран не одобряют финансирование соответствующих отраслей китайской экономики. Китайские власти также вмешиваются в развитие DeepSeek, предположительно настаивая на использовании ускорителей китайского происхождения для обучения местных ИИ-моделей. Считается, что DeepSeek при этом пытается ради достижения лучших результатов получать доступ к наиболее современным ускорителям американской Nvidia.

Основатель DeepSeek назвал дату выхода флагманской модели V4

Основатель компании DeepSeek Лян Вэньфэн (Liang Wenfeng) подтвердил в ходе внутреннего общения с сотрудниками, что флагманская модель следующего поколения DeepSeek V4 будет официально представлена в конце апреля 2026 года. По сообщению AIBase, система впервые получит многоуровневый режим работы, а релиз совпадёт с выходом конкурирующей модели Tencent.

 Источник изображения: AI

Источник изображения: AI

Быстрый режим (Fast Mode) ориентирован на повседневные диалоги и мгновенные ответы, поддерживает распознавание текста на изображениях и в файлах с акцентом на скорость работы. Экспертный режим (Expert Mode) разработан для решения задач со сложной логикой и глубоким анализом, обладает усиленными возможностями интеллектуального поиска. Однако этот режим пока не поддерживает загрузку файлов и мультимодальные функции, а в часы пик может потребоваться ожидание.

 Источник изображения: aibase.com

Источник изображения: aibase.com

Несмотря на приближающийся релиз новой модели, текущая ситуация в DeepSeek характеризуется контрастами. Пользователи отметили существенные улучшения в логической обработке данных и возможностях программирования. Однако платформа три дня подряд испытывает масштабные технические сбои, включая один сбой продолжительностью до 12 часов. Эксперты отрасли рассматривают это как «болезненный период» переходного этапа между старой и новой моделями.

Дата релиза DeepSeek V4 выбрана в условиях высокой конкуренции. Команда Яо Шунью (Yao Shunyu) в Tencent также планирует выпустить новую модель под названием Hunyuan в следующем месяце. Таким образом, конец апреля станет временем прямого соперничества между двумя ведущими китайскими разработчиками базовых ИИ-моделей, что может повлиять на расстановку сил в индустрии.

Поддержка ИИ-моделью DeepSeek V4 ускорителей Huawei вызвала рост спроса на них в Китае

Для разработчиков систем искусственного интеллекта поддержка определённых аппаратных решений на уровне привычного программного обеспечения имеет огромное значение, поскольку миграция на новую платформу требует не только финансовых затрат, но и вынуждает терять драгоценное время. Китайская DeepSeek свою модель V4 адаптировала под ускорители Huawei, в результате чего популярность последних заметно выросла.

 Источник изображения: Huawei Technologies

Источник изображения: Huawei Technologies

Об этом сообщает Reuters со ссылкой на The Information. Наличие такой совместимости, по данным источника, уже позволило Alibaba, ByteDance и Tencent разместить заказы на новейшую версию ускорителей Huawei семейства Ascend в количестве нескольких сотен тысяч штук. Дебют модели DeepSeek V4 намечен на ближайшие недели. Как уточняется, этот разработчик ИИ-систем плотно сотрудничал с Huawei и конкурирующей Cambricon Technologies, чтобы адаптировать новую ИИ-модель к особенностям аппаратного обеспечения двух последних компаний.

Модель DeepSeek V4 выйдет как минимум в двух дополнительных вариантах, учитывающих особенности ускорителей китайской разработки. Ранее сообщалось, что DeepSeek не стала делиться предварительными итогам разработки своей передовой модели с американскими поставщиками чипов для ИИ, нарушив негласную отраслевую практику. Вместо этого ранний доступ к программному коду DeepSeek V4 получили китайские разработчики чипов, включая Huawei Technologies. Интерес к новой ИИ-модели DeepSeek в мировом сообществе высок, поскольку предыдущие решения этой китайской компании серьёзно перекроили расстановку сил на рынке, нарушив намечавшуюся гегемонию американских моделей с закрытым исходным кодом.

В Сети всплыла «ничейная» мощная ИИ-модель — в ней заподозрили разработку DeepSeek

Мощная ИИ-модель без указания авторства, появившаяся недавно на платформе OpenRouter, породила слухи о том, что китайский стартап DeepSeek может в скрытом режиме тестировать свою систему следующего поколения перед официальным запуском. Бесплатная модель под названием Hunter Alpha возникла на OpenRouter 11 марта без какой-либо атрибуции разработчика и позже была промаркирована самой платформой как «скрытая модель».

 Источник изображения: AI

Источник изображения: AI

Во время тестов, проведённых агентством Reuters, чат-бот Hunter Alpha описал себя как китайскую ИИ-модель, обученную преимущественно на китайском языке, и сообщил, что его данные обучения охватывают период до мая 2025 года. Эта дата знаний совпадает с точкой, указанной собственным чат-ботом компании DeepSeek. Однако, когда собеседник спросил о создателе системы, она отказалась идентифицировать разработчика, заявив, что знает только своё имя, масштаб параметров и длину контекстного окна. Ни компания DeepSeek, ни платформа OpenRouter также не назвали создателя модели и не ответили на запросы о комментарии.

Страница профиля Hunter Alpha раскрывает её внушительные технические характеристики: модель обладает 1 трлн параметров, что подразумевает высокие требования к вычислительным мощностям. Кроме того, система поддерживает контекстное окно до 1 млн токенов, позволяя обрабатывать огромные объёмы текста за один сеанс. Инженер, специализирующийся на создании ИИ-агентов, Набиль Хауам (Nabil Haouam), отметил, что сочетание окна в 1 млн токенов, возможностей логического рассуждения и бесплатного доступа сразу бросается в глаза, поскольку аналогичные по характеристикам модели обычно требуют значительных затрат при масштабировании.

Именно эти значения (1 трлн параметров и 1 млн токенов контекста) связывают с грядущей моделью DeepSeek V4, чей выход прогнозируется в апреле. Совпадение породило волну слухов о том, что Hunter Alpha может быть ранней тестовой версией нового продукта китайского стартапа. Анализ модели, также проведённый инженером Дэниелом Дьюхерстом (Daniel Dewhurst), показал, что ключевым сигналом может служить паттерн цепочки рассуждений. По его словам, стиль логических построений, который использует чат-бот, очень трудно подделать, и он обычно отражает метод обучения модели.

Тем не менее не все разделяют эту уверенность. Умур Озкул (Umur Ozkul), проведя независимый бенчмарк, заявил, что его анализ указывает на то, что Hunter Alpha, вероятно, не является DeepSeek V4. Он сослался на различия в поведении, связанном с токенами, и архитектурных паттернах по сравнению с существующими системами DeepSeek.

Независимо от авторства модель быстро набрала популярность. Согласно статистике OpenRouter, по состоянию на воскресенье она обработала более 160 млрд токенов. Значительная часть активности исходила от инструментов разработки и фреймворков для ИИ-агентов. Отметим, что практика анонимного запуска моделей не является чем-то исключительным — это распространённый способ получения разработчиками объективной обратной связи от сообщества.


window-new
Soft
Hard
Тренды 🔥
Новая статья: Mortal Shell 2 — вдвое больше. Рецензия 2 ч.
Южная Корея обеспечит всех граждан страны безлимитным доступом к генеративным ИИ-сервисам 4 ч.
Следующая жертва ИИ — актёры: в Китае их массово заменяют цифровыми двойниками 7 ч.
Бигтехи теряют доверие людей — ИИ, соцсети и наступление ЦОД всё чаще вызывают страх и недовольство 9 ч.
В роботах Unitree нашли опасную уязвимость, через которую можно поднять «восстание машин» 15 ч.
Google изменила политику по борьбе со спамом в ЕС, чтобы избежать антимонопольного штрафа 17 ч.
Раннюю версию DLSS 5 уже адаптировали для видеокарт GeForce RTX 4000 29-08 00:36
Новая статья: Были демоны, но они самоликвидировались: история серии Onimusha 29-08 00:00
Спасительный патч для Dragon’s Dogma 2 получил дату выхода — улучшения производительности и лечение от драконьей чумы задержатся 28-08 23:07
The Witcher 4 не пошла по пути Cyberpunk 2077 — CD Projekt Red рассказала о прогрессе разработки амбициозной RPG 28-08 20:42
SpaceX провела полномасштабный огневой тест двигателей ускорителя Super Heavy — 14-й полёт не за горами 5 ч.
Робоутка за $399 покорила сердца разработчиков — за сутки её заказали на $2,6 млн 5 ч.
После анонса GTA VI из американской розницы исчезли Sony PlayStation 5 Pro, а спекулянты взвинтили цены 8 ч.
Наноантенны многократно усилили яркость свечения живых клеток — это поможет увидеть активность мозга и не только 8 ч.
Ubiquiti выпустила карманный маршрутизатор UniFi Travel Router Long-Range за €89 11 ч.
Пропускная способность оптических модулей XPO вырастет вдвое — до 25,6 Тбит/с 11 ч.
Следующая Xbox будет не одной консолью — Microsoft готовит целое семейство 12 ч.
Android всё ещё контролирует три четверти мирового рынка смартфонов, но iOS и HarmonyOS наступают 13 ч.
NASA вернуло к работе обречённую обсерваторию Swift — теперь она сгорит в атмосфере ещё быстрее 13 ч.
Китайская ракета выбросила на орбиту кучу обломков — они угрожают Starlink 15 ч.