Сегодня 05 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google сама показала, что новая Gemini 3.5 Flash не лучшая ИИ-модель для Android-разработки

Google обновила рейтинг Android Bench, и картина оказалась загадочной: новая модель искусственного интеллекта Gemini 3.5 Flash по качеству написания программного кода для приложений под Android оказалась слабее предшественницы, и за её работу взимается плата втрое выше.

 Источник изображения: blog.google

Источник изображения: blog.google

Новая модель Google Gemini 3.5 Flash только попала в этот рейтинг и не добралась даже до пятёрки лидеров. На первом месте оказалась OpenAI GPT 5.5 с результатом в 74 балла, второе и третье места поделили GPT 5.4 и Google Gemini 3.1 Pro Preview с результатом в 72,4 балла, вариант Flash оказался и ниже новых моделей Anthropic Claude Opus.

Google Gemini 3.5 Flash набрала 63,7 балла, заняв шестое место в общем зачёте. Неприятно удивили показатели её эффективности: среднее число токенов составило 355,9, и это значительно больше, чем у других систем. Средняя стоимость достигла $147,1, это самая дорогая модель в списке, и притом с самой низкой производительностью, чем у конкурентов.

 Источник изображения: developer.android.com

Источник изображения: developer.android.com

Показатели удивительны тем, что модели серии Google Flash традиционно отличаются высокой скоростью и низкими ценами. Представив Gemini 3.5 Flash, компания заявила, что она генерирует качественный программный код, эффективно поддерживает управление ИИ-агентами и сложными рабочими процессами; а по ряду тестов она даже обошла Gemini 3.1 Pro.

Но Android Bench говорит об обратном. Вопрос в том, сможет ли Google повысить качество Gemini 3.5 Flash, или перспективная Gemini 3.5 Pro будет больше соответствовать обещаниям компании. Пока же собственные цифры Google демонстрируют, что новое — не всегда лучшее.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Новая статья: Resonance: A Plague Tale Legacy — корабль, с которого сбежали крысы. Рецензия 5 ч.
Основателя Oracle вызвали в Конгресс — компания за восемь лет выполнила лишь десятую часть контракта для военных, а денег хочет почти втрое больше оговоренного 6 ч.
Crusoe заключила крупнейшую за свою историю облачную сделку с Jane Street — $13 млрд за 5 лет 6 ч.
Комедийный симулятор водителя автобуса Thank You Bus Driver от Double Fine отправит игроков раздавать пощёчины и принимать благодарности 7 ч.
С Gmail, Google Docs и Keep теперь можно разговаривать — Gemini научился понимать голосовые команды 8 ч.
ИИ-агент Meta во время тестов начал самовольничать — менял пароли и отправлял письма от имени пользователей 10 ч.
Nintendo анонсировала сразу две игровые презентации Nintendo Direct — обе пройдут на следующей неделе 11 ч.
Патчи для Heroes of Might & Magic: Olden Era станут выходить чаще — разработчики готовят два крупных обновления 12 ч.
AMD выпустила драйвер с поддержкой Onimusha: Way of the Sword и The Blood of Dawnwalker 13 ч.
ИИ-агенты OpenAI захватили немецкий сайт и превратили его в подпольный форум для ИИ 13 ч.
Больше инвестиций — ниже тарифы: США будут оказывать давление на поставщиков полупроводниковых компонентов 5 ч.
DLSS 5 портировали на видеокарты Radeon RX 9000 — производительность пока оставляет желать лучшего 5 ч.
Дефицит и рост цен не отпугнули покупателей видеокарт — продажи выросли на 14 % 8 ч.
Представлен защищённый ноутбук Oukitel RG14-P с солнечной батареей в крышке 8 ч.
CXMT удвоит мощности по выпуску памяти, но приблизиться к Samsung и SK Hynix ей не светит 8 ч.
Из-за подорожания компонентов ноутбук за $900 теперь должен стоить $1600 10 ч.
Из-за реформы лицензирования связи в России могут исчезнуть несколько тысяч малых интернет-провайдеров 10 ч.
Equinix представила решения Fabric One и Inference Exchange для распределённого ИИ-инференса в системах NVIDIA и Together AI 11 ч.
«Украсть технологии, переманить инженеров»: у CXMT с самого начала был этот план, и она его придерживалась 12 ч.
AMD представила рабочую станцию Threadripper Halo Station — 96 ядер, 2 Тбайт ОЗУ и до четырёх Instinct MI350P 12 ч.