Сегодня 11 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Представлена обновлённая быстрая модель DeepSeek V4.1-Flash — местами она быстрее GPT 5.6-Sol

Китайская лаборатория искусственного интеллекта DeepSeek представила обновлённый вариант компактной модели с поддержкой функции визуального восприятия. DeepSeek V4.1-Flash предназначается для быстрой обработки и генерации токенов, то есть работы с высокой пропускной способностью.

 Источник изображений: deepseek.com

Источник изображений: deepseek.com

Модель имеет размер 552 млрд параметров, используется механизм MoE (Mixture-of-Experts) с обновлённой архитектурой Causal Encoder–Decoder с 8 млрд параметров на вводе и 16 млрд — на выводе. Новые методы предварительного обучения и масштабный этап последующего обучения с подкреплением обеспечили результаты, которые превзошли показатели флагманских моделей, включая мощную DeepSeek V4-Pro.

Например, в тесте DeepSWE v1.1 новая модель набрала 74,2 балла, немного опередив GPT-5.6-Sol (73) и Claude Opus 5 (74). На CyberGym результат V4.1-Flash составил 88,1 балла — выше, чем у GPT-5.6-Sol и GLM-5.3 (по 84,5) и Kimi K3 (80). В тесте Terminal-Bench 3.0 модель получила 30 балла, обойдя GLM-5.3 (28,3) и Kimi K3 (17,7), но уступив GPT-5.6-Sol (34,4) и Claude Opus 5 (43,3).

Разработчик сократил использование KV-кеша — модель DeepSeek-V4.1-Flash потребляет вчетверо меньше памяти HBM и в восемь раз меньше места на SSD. Расходы на обработку запросов с попаданием в кеш часто составляют значительную часть стоимости работы ИИ-агентов, поэтому сжатие кеша позволяет существенно сократить затраты.

С выпуском DeepSeek-V4.1-Flash прекращается поддержка моделей V4-Flash и V4-Flash-Vision-Exp — все обращения к ним временно перенаправляются на новую модель. Учитывая, что V4.1-Flash превосходит V4-Pro по производительности, скорости и общему времени выполнения задач, последняя тоже будет постепенно выводиться из эксплуатации — с 14 сентября включится полная переадресация запросов к V4-Pro на V4.1-Flash по тарифам последнего. Официальные партнёры WorkBuddy, CodeBuddy и OpenCode объявили о поддержке V4.1-Flash.

Модель уже доступна через API DeepSeek с нативной поддержкой мультимодальности; для её использования необходимо выбрать модель deepseek-flash. При доступе к DeepSeek V4.1-Flash по API применяется гибкая тарификация с разделением на пиковые и непиковые часы — во втором случае цены ниже на 50 %. В непиковые часы обработка входных данных с попаданием в кеш стоит $0,003 за 1 млн токенов, без попадания в кеш — $0,15, а обработка выходных данных — $0,60. В пиковые часы эти тарифы составляют соответственно $0,006, $0,30 и $1,20 за 1 млн токенов.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Смешанные» отзывы в Steam не помешали тактическому шутеру Wardogs стать хитом продаж — более миллиона копий за первый день раннего доступа 26 мин.
ИИ ослабляет умственные способности человека и распространяется как вирус, установили учёные 34 мин.
OpenAI готова замедлить гонку разработки ИИ, если конкуренты сделают то же самое 3 ч.
Стартовал ранний доступ сетевого шутера Wardogs с инновационной экономикой — онлайн в Steam уже превысил 330 тысяч человек 12 ч.
ИИ упростил подачу жалоб — и граждане завалили обращениями госслужбы по всему миру 13 ч.
Nintendo отблагодарит американских игроков за отмену таможенных пошлин Трампа новой распродажей, но не возвратом средств 13 ч.
IBM и NASA выпустили ИИ-модель для изучения и освоения Луны 14 ч.
Не лучший в своём деле: критики вынесли вердикт Marvel’s Wolverine 14 ч.
Сага об уволенных со скандалом разработчиках GTA VI вышла на финишную прямую, и Rockstar настроена «решительно» 16 ч.
Apple раскрыла лимит для Apple Intelligence — без доплаты ряд функций будет временно отключаться 16 ч.
ЦОД как чип: Meta и Panmnesia предложили CXL-фабрику размером с целый дата-центр 33 мин.
Altera собирается вернуться на биржу спустя одиннадцать лет, как Intel увела её оттуда за $16,7 млрд 2 ч.
По норме прибыли китайская CXMT уже обошла ведущих мировых производителей памяти 2 ч.
Электрические аэротакси получили разрешение на испытательные полёты в Техасе 4 ч.
Новая статья: Обзор складного смартфона nubia Flip2: когда раскладушка – не роскошь 10 ч.
AMD выпустила шестиядерные Ryzen 5 7500 и Ryzen 5 5500F для бюджетных сборок на AM5 и AM4 13 ч.
Мышь Finalmouse Starlight X установила рекорд по скорости клика — она обогнала Logitech G Pro X2 Superstrike 13 ч.
Apple раскрыла, насколько выросла ёмкость батарей в iPhone 18 Pro и iPhone 18 Pro Max 14 ч.
Смартфон Trump Mobile T1 подорожал на $250 — в полтора раза 14 ч.
Nvidia представила универсальный контроллер на базе ИИ для обучения гуманоидных роботов широкому кругу задач 14 ч.