Сегодня 11 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → k1

Китайская ИИ-модель Kimi k1.5 освоила мультимодальные рассуждения и превзошла OpenAI o1

Если 2024 год стал годом клонов ChatGPT, то 2025 год обещает стать эрой рассуждающих моделей ИИ, а лидерство в этой области захватывают китайские лаборатории. На прошлой неделе много шума наделала DeepSeek со своей рассуждающей моделью R1. А на днях Moonshot AI представила мультимодальную Kimi k1.5, которая обгоняет в тестах OpenAI o1, а стоит в разы меньше. Эти модели представляют собой смену представления о «мыслительном процессе» ИИ.

 Источник изображения: kimi.ai

Источник изображения: kimi.ai

Новые модели далеко ушли от банального пересказа Википедии. Им по силам сложные проблемы — от решения головоломок до объяснения квантовой физики. А Kimi k1.5 уже успела заработать звание «первого настоящего конкурента o1». По оценкам экспертов, Kimi k1.5 — это не просто ещё одна модель ИИ — это скачок вперёд в мультимодальном рассуждении и обучении с подкреплением. Kimi k1.5 от Moonshot AI объединяет текст, код и визуальные данные для решения сложных задач, порою в разы превосходя таких лидеров отрасли, как GPT-4o и Claude Sonnet 3.5 в ключевых тестах.

Контекстное окно Kimi k1.5 на 128 тыс. токенов позволяет модели «за один подход» обрабатывать объём информации, эквивалентный солидному роману. В математических задачах модель может планировать, отражать и корректировать свои шаги на протяжении сотен токенов, имитируя решение проблемы человеком. Вместо того, чтобы повторно генерировать полные ответы, Kimi использует фрагменты предыдущих траекторий, повышая эффективность и сокращая затраты на обучение.

 Источник изображений: medium.com

Источник изображений: medium.com

Традиционный подход, основанный на принципах обучения с подкреплением, предполагает использование сложных инструментов, таких как поиск по дереву Монте-Карло или сети ценностей. Команда Moonshot AI отказалась от них и создала упрощённый фреймворк на базе обучения с подкреплением, используя штраф за длину и баланс между исследованием и эксплуатацией. В результате разработчикам удалось создать модель, которая обучается быстрее и избегает «чрезмерного обдумывания» — распространённой ошибки, когда ИИ тратит вычислительные ресурсы на ненужные шаги.

Kimi k1.5 успела показать себя как мощный инструмент визуализации и одновременной работы с текстом. Модель умеет анализировать диаграммы, решать геометрические задачи и отлаживать код — в тесте MathVista модель показала точность 74,9 %, объединив текстовые подсказки с графическими диаграммами.

Исследователи Moonshot AI, вместо того чтобы полагаться на мощные, но медленные длинноцепочечные рассуждения (Long-CoT), использовали метод Long2Short («длинные-в-короткие»), добившись более лаконичных и быстрых ответов. Для этого применялись следующие методы:

  • Объединение моделей путём смешивания весов длинных и коротких версий CoT.
  • Выборка кратчайшего отклонения — отбор самого короткого и корректного ответа из восьми сгенерированных вариантов.
  • Оптимизация DPO — обучение модели предпочтению кратких ответов без потери смысла.

Даже при прямом сравнении Kimi K1.5 оставляет GPT-4o и Claude Sonnet 3.5 далеко позади. Разработчикам Moonshot AI удалось оптимизировать процесс обучения с подкреплением благодаря:

  • Гибридному развёртыванию — совместному использованию ресурсов GPU для обучения и вывода.
  • Частичным развёртываниям — разделению длинных траекторий на управляемые фрагменты для более эффективного обучения.
  • Песочницам кода — безопасным средам для тестирования выходных данных кода, что гарантирует их надёжность.

По мнению экспертов, Kimi K1.5 — это не просто технологический прорыв, а взгляд в будущее ИИ. Объединяя обучение с подкреплением с мультимодальным рассуждением, эта модель решает задачи быстрее, умнее и эффективнее.


window-new
Soft
Hard
Тренды 🔥
Культовый боевик по «Властелину колец» вернулся из небытия в улучшенном виде — трейлер и детали The Lord of the Rings: War in the North — Legacy Edition 12 мин.
Критическую уязвимость в Zoom нашли за один день с помощью обычной ИИ-модели 3 ч.
Босс Persona признал, что Atlus «обязана» выпустить ремейки Revelations: Persona и Persona 2 3 ч.
«Подождите, это же выглядит… очень хорошо»: версия The Elder Scrolls IV: Oblivion Remastered для Nintendo Switch 2 приятно удивила игроков 4 ч.
Spotify исключила ИИ-исполнителей из рекомендательного алгоритма 4 ч.
Французские СМИ потребовали от Google компенсации за использование статей в ИИ-сводках 4 ч.
Google зарегистрировала в России бренд Gemini, но это ещё не означает запуск ИИ-бота 5 ч.
Разработчики Until Dawn и Directive 8020 объявили о массовых увольнениях — за три года Supermassive Games потеряла больше половины сотрудников 5 ч.
ИИ ускорил разработку Linux и добавил работы Линусу Торвальдсу 6 ч.
Samsung закрыла 176 уязвимостей в своих мобильных приложениях 6 ч.
Apple готовит защиту от дипфейков — iPhone сможет подтверждать подлинность снимков 13 мин.
Китайские учёные научили дроны заряжаться от лазера прямо в полёте 53 мин.
Япония завершила создание суверенной системы спутниковой навигации, но от GPS не откажется 56 мин.
США профинансировали разработку «фермы» топлива для термоядерных реакторов 59 мин.
Xiaomi представила смартфоны Redmi K100 Pro и K100 Pro Max — 200-Мп камеры и аккумуляторы до 9070 мА·ч 4 ч.
Калифорния готовит запрет на «чтение мыслей» сотрудников — работодатели недовольны 4 ч.
Широкоформатные Galaxy Z Fold8 стали хитом: Samsung выпустит дополнительный миллион смартфонов 5 ч.
Arctic выпустила вентиляторы BioniX P12 и BioniX P14 с высокой скоростью вращения и ARGB-подсветкой 5 ч.
Разработчик радиокабелей Point2 Technology получил $136 млн инвестиций от Arm, Bosch, NVIDIA и др. 5 ч.
Австралийская Firmus привлекла $2 млрд на ИИ ЦОД при оценке $10,5 млрд 6 ч.