Сегодня 26 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google представила рассуждающую ИИ-модель Gemini 2.5 Flash с высокой производительностью и эффективностью

Google выпустила новую ИИ-модель, призванную обеспечить высокую производительность с упором на эффективность. Она называется Gemini 2.5 Flash и вскоре станет доступна в составе платформы Vertex AI облака Google Cloud для развёртывания и управления моделями искусственного интеллекта (ИИ).

 Источник изображения: Google

Источник изображения: Google

Компания отмечает, что Gemini 2.5 Flash предлагает «динамические и контролируемые» вычисления, позволяя разработчикам регулировать время обработки запроса в зависимости от их сложности.

«Вы можете настроить скорость, точность и баланс затрат для ваших конкретных нужд. Эта гибкость является ключом к оптимизации производительности Flash в высоконагруженных и чувствительных к затратам приложениях», — написала компания в своём официальном блоге.

На фоне растущей стоимости использования флагманских ИИ-моделей Gemini 2.5 Flash может оказаться крайней полезной. Более дешёвые и производительные модели, такие как 2.5 Flash, представляют собой привлекательную альтернативу дорогостоящим флагманским вариантам, но ценой потери некоторой точности.

Gemini 2.5 Flash — это «рассуждающая» модель по типу o3-mini от OpenAI и R1 от DeepSeek. Это означает, что для проверки фактов ей требуется немного больше времени, чтобы ответить на запросы. Google утверждает, что 2.5 Flash идеально подходит для работы с большими объёмами данных и использования в реальном времени, в частности, для таких задач, как обслуживание клиентов и анализ документов.

«Эта рабочая модель оптимизирована специально для низкой задержки и снижения затрат. Это идеальный движок для отзывчивых виртуальных помощников и инструментов резюмирования в реальном времени, где эффективность при масштабировании является ключевым фактором», — описывает новую ИИ-модель компания.

Google не опубликовала отчёт по безопасности или техническим характеристикам для Gemini 2.5 Flash, что усложнило задачу определения её преимуществ и недостатков. Ранее компания говорила, что не публикует отчёты для моделей, которые она считает экспериментальными.

Google также объявила, что с третьего квартала планирует интегрировать модели Gemini, такие как 2.5 Flash в локальные среды. Они будут доступны в Google Distributed Cloud (GDC), локальном решении Google для клиентов со строгими требованиями к управлению данными. В компании добавили, что работают с Nvidia над установкой Gemini на совместимые с GDC системы Nvidia Blackwell, которые клиенты смогут приобрести через Google или по своим каналам.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Хватит пугать людей» — Дженсен Хуанг раскритиковал апокалиптическую риторику ИИ-отрасли 14 ч.
Новая статья: Moss: The Forgotten Relic — сказочный сборник, сбежавший из VR-плена. Рецензия 14 ч.
В США разгорелись споры между сторонниками и противниками открытых ИИ-моделей 18 ч.
OpenAI целую неделю не замечала, что её ИИ-агенты взломали Hugging Face 25-07 11:18
Microsoft представила ИИ-модели для работы с изображениями и речью — они значительно экономнее аналогов OpenAI 25-07 11:11
Sony подтвердила дату выхода God of War Laufey и новую God of War про Кратоса 25-07 10:24
Чат-бот Meta AI получил возможности персонального помощника как в ChatGPT и Gemini 25-07 06:00
Новая статья: The Alters: Last Variable — последняя тайна. Рецензия 25-07 00:04
Глава Amazon Games перенёс Tomb Raider: Catalyst на 2028 год, но Amazon Games это опровергла 24-07 23:12
Anthropic внезапно выпустила Claude Opus 5 — почти как Fable 5, но по ценам на уровне предшественника 24-07 23:11
Astera Labs представила первые в отрасли 3,2-Тбит/с интеллектуальные ретаймеры и редрайверы для Ethernet и UALink 47 мин.
Цены на клиентские процессоры Intel выросли на 27 %, объёмы продаж сократились на 8 %, но чипов всё равно не хватило на всех 7 ч.
OpenAI настроена интегрировать ChatGPT в умные очки сторонних разработчиков 13 ч.
Графические процессоры Nvidia отправятся на Луну до конца года 15 ч.
«АМДтехнологии» и «Е-Флопс» развернули «двухконтурный» суперкомпьютер для ИИ- и HPC-задач 16 ч.
ИИ-платформа Liqid UltraStack объединяет 30 ускорителей AMD Instinct MI350P 17 ч.
В семейство AMD Ryzen AI Embedded X100 вошли процессоры с 8–16 ядрами 17 ч.
Anthropic запросила у SK hynix чипы памяти для собственных ИИ-ускорителей 21 ч.
Samsung и Broadcom заключили соглашение о сотрудничестве в сфере ИИ-чипов на $200 млрд 21 ч.
SK hynix ускоряет разработку 3D-стекированной DRAM — технологии, аналогичной 3D V-Cache, но для памяти 22 ч.