Сегодня 20 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Mistral AI сделал заявку на лидерство на рынке открытых моделей, выпустив Mistral 3

Французский ИИ-стартап Mistral AI представил семейство моделей Mistral 3 следующего поколения с открытыми весами (Open-weight), сделав серьёзную заявку на лидерство в сегменте общедоступных ИИ-моделей, которые обладают рядом преимуществ для корпоративных клиентов по сравнению с решениями крупных технологических компаний.

 Источник изображения: Mistral AI

Источник изображения: Mistral AI

Семейство Mistral 3 состоит из 10 моделей, включая большую модель разреженной архитектуры (Mixture of Experts, MoE) с открытыми весами, мультимодальными и многоязычными возможностями — Mistral Large 3. Это самая мощная на сегодняшний день модель компании, обученная с 41 млрд активных и 675 млрд общих параметров. Также в состав семейства входят девять небольших моделей с возможностью автономной работы и полной настройкой, в том числе три современные модели Ministral высокой плотности с 4, 8 и 3 млрд параметров.

Модели Mistral обладают лучшим соотношением производительности и стоимости в своей категории. В то же время Mistral Large 3 входит в число передовых моделей с открытым исходным кодом, оптимизированных под тонко настроенные инструкции.

Компания указала, что все модели выпускаются по лицензии Apache 2.0, добавив, что открытый исходный код моделей в различных сжатых форматах расширяет возможности сообщества разработчиков и позволяет использовать возможности ИИ благодаря распределённому интеллекту.

Как сообщает TechCrunch, стартап Mistral, основанный бывшими сотрудниками DeepMind и Meta, существует всего два года и на сегодняшний день привлек около $2,7 млрд инвестиций при оценке рыночной стоимости в $13,7 млрд. Это значительно меньше, чему у конкурентов, таких как OpenAI (привлечено $57 млрд при оценке в $500 млрд) и Anthropic (привлечено $45 млрд при оценке в $350 млрд).

Mistral утверждает, что больше не всегда значит лучше, особенно для корпоративных сценариев использования ИИ-продуктов.

«Наши клиенты иногда рады начать с очень большой [закрытой] модели, которую им не нужно настраивать… но, развернув её, они понимают, что это дорого и медленно, — рассказал ресурсу TechCrunch Гийом Лампле (Guillaume Lample), соучредитель и главный научный сотрудник Mistral. — Затем они обращаются к нам, чтобы мы настроили небольшие модели для более эффективного решения конкретной задачи». По его словам, подавляющее большинство корпоративных сценариев использования ИИ-решений можно реализовать с помощью небольших моделей с тонкой настройкой.

Лампле утверждает, что при сравнении с эталонными моделями, когда открытые модели значительно отстают от конкурентов с закрытым исходным кодом, результаты могут быть обманчивы. Он отметил, что большие закрытые модели могут со старта работать лучше, но реальный выигрыш при использовании небольших моделей достигается при настройке.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Xiaomi 18 Fold оказался золотым в ремонте — замена материнской платы обойдётся в почти 40 % цены смартфона 6 ч.
Президент США объявил о создании «Сил ИИ» — их возглавит «царь ИИ»  8 ч.
Популярные чат-боты в большинстве случаев дают вредные советы в сфере финансов 16 ч.
Новая статья: The Blood of Dawnwalker — начало чего-то выдающегося. Рецензия 23 ч.
Путь на дно: суд обязал Microsoft раскрыть внутренние документы и переписку топ-менеджеров в деле о перепродаже лицензий на ПО 19-09 17:43
Персональный ИИ-агент Muse от Meta возглавил рейтинг App Store всего через неделю после релиза 19-09 14:11
SpaceXAI удвоила точность распознавания речи в новой модели Grok Voice Transcribe 2.0 19-09 12:59
Anthropic сделала первый шаг к замедлению ИИ — Accenture будет проверять Claude изнутри 19-09 12:51
Европейские разработчики ИИ выступили против призывов США замедлить темп 19-09 10:43
Alibaba выпустила всеядную модель Qwen3.8-Omni-Flash с контекстом на 1 млн токенов 19-09 10:08
Крупнейший в мир рынок ЦОД притормаживает развитие 2 ч.
От SLC до QLC: Unigen выпустила новые SSD семейства Cheetah для ИИ-платформ 10 ч.
Продажи умных очков в Китае удвоились за первые восемь месяцев 2026 года 11 ч.
Китайская CXMT запустила массовое производство памяти DRAM пятого поколения 11 ч.
GPT-6 Astra и Claude Fable превратили роботов в комичных убийц — ИИ провалил новый тест безопасности 15 ч.
На следующей неделе Meta покажет AR-гарнитуру Phoenix и фотореалистичные голографические аватары для видеозвонков 17 ч.
Anthropic и OpenAI переключились на аренду небольших ИИ ЦОД 20 ч.
Урезанная Radeon RX 9050 с 4 Гбайт памяти оказалась в среднем на 37 % медленнее версии с 8 Гбайт 19-09 17:50
Исследователь OpenAI предупредил: ИИ-агенты способны общаться даже на отключённых от Сети компьютерах 19-09 17:04
Создана не имеющая аналогов плёночная теплоизоляция — она сдерживает тепло в пять раз лучше силикона 19-09 16:45