Сегодня 26 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → gemini
Быстрый переход

С обновлением Gemini 3.8 Live у ИИ-моделей Google появилось лицо

Очередное обновление ИИ-модели Google Gemini 3.8 Live позволит пользователям вести беседу с ботом и одновременно наблюдать, как анимированный аватар реагирует на разные реплики в режиме онлайн. Новая функция Live Avatar используется для синхронизации движения губ виртуального аватара с репликами ИИ-бота, а также изменения выражения лица во время диалогов с пользователями.

 Источник изображения: Google

Источник изображения: Google

В сообщении Google сказано, что виртуальный аватар может переключаться между 97 поддерживаемыми языками «без потери качества изображения или появления визуальных искажений». В одном из демонстрационных видео Live Avatar общается на английском и японском языках, при этом анимация рта аватара точно совпадает с тем, что ИИ-бот произносит на обоих языках. В дополнение к этому во время разговора аватар может параллельно выводить информацию на экран.

Запуск Live Avatar состоялся примерно через неделю после того, как Google представила ИИ-модель Gemini 3.8 Live, которая, по заявлению компании, «обрабатывает визуальные данные практически в режиме реального времени». Помимо выбора из библиотеки уже готовых аватаров, пользователи смогут создавать собственные варианты внешнего облика Live Avatar. Отмечается, что генерируемые алгоритмом данные помечаются невидимым для человека водяным знаком SynthID. В дополнение к этому предусмотрены защитные меры для «соблюдения правил использования образов». На данном этапе это нововведение доступно только подписчикам Gemini Enterprise.

Google выпустит флагманскую ИИ-модель Gemini 4 до конца года и сократит отставание от конкурентов

Компания Google вскоре выпустит ИИ-модель Gemini 4. Как сообщил ресурсу The Information руководитель подразделения DeepMind Корай Кавукчуоглу (Koray Kavukcuoglu), в настоящий момент Gemini 4 находится на стадии доработки, так что её выпуск состоится до конца текущего года.

 Источник изображения: MARCO/unsplash.com

Источник изображения: MARCO/unsplash.com

«Мы хотим как можно скорее выпустить предварительную версию после обучения, потому что мы видим результаты и воодушевлены ими», — заявил Кавукчуоглу, добавив, что Google продолжит быстрые итерации в дальнейшем. Это, как полагает ресурс The Verge, означает, что Google возвращается к более стабильному графику выпуска новых моделей искусственного интеллекта, поскольку при прежнем руководстве было допущено серьёзное отставание от конкурентов по срокам выпуска флагманских ИИ-решений.

Google не выпускала новые флагманские ИИ-модели с ноября 2025 года, когда вышла серия Gemini 3. С тех пор были выпущены модели GPT-6 компанией OpenAI и Mythos ИИ-стартапом Anthropic. Обе модели превосходят Gemini 3, обеспечивая конкурирующим разработчикам значительное преимущество перед Google в гонке ИИ. В мае на конференции I/O генеральный директор Google Сундар Пичаи (Sundar Pichai) заявил, что в июне выйдет Gemini 3.5 Pro, которая поможет сократить отставание от конкурентов, но модель так и не была выпущена.

Кавукчуоглу пояснил, что компания сделала небольшой шаг назад, чтобы быстрее запустить менее мощные модели Flash вместо Gemini 3.5 Pro. На вопрос о том, беспокоит ли его отставание Google от конкурентов в области разработки искусственного интеллекта, он ответил: «Я уверен, что мы всегда будем на передовой».

Google выпустила ИИ-модели для синтеза речи Gemini 3.8 Flash TTS, которые умеют клонировать голос

Google представила Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS — две новые модели синтеза речи, которые превращают генерацию голоса из набора готовых вариантов в более гибкий инструмент для создания аудио. Модели позволяют создавать собственные голоса, управлять исполнением отдельных реплик и генерировать выразительные диалоги для игр, подкастов, аудиокниг и других проектов.

 Источник изображений: Google

Источник изображений: Google

Gemini 3.8 Flash TTS предназначена для создания персонажей и детального управления их голосами. С помощью текстовых запросов можно задать роль, акцент и характеристики голоса более чем для 100 языков и диалектов. В библиотеке также доступно более 2000 готовых голосов, включая региональные варианты мексиканского испанского, квебекского французского и шотландского английского.

Отдельно Google добавила возможность клонирования голоса по 30-секундной аудиозаписи. Функция предназначена для собственного голоса или голоса, на использование которого получено право. Перед созданием копии система проверяет согласие владельца голоса, а полученное аудио защищается водяным знаком SynthID и метаданными C2PA.

После выбора голоса разработчик может управлять каждой репликой отдельно с помощью текстовых указаний. Gemini способна менять темп и характер исполнения, использовать шёпот и другие элементы звуковой подачи, а также добавлять реакции в виде смеха, вздохов и коротких реплик.

Обе модели поддерживают генерацию длинного аудио с сохранением качества, естественного темпа и характеристик голоса на протяжении нескольких часов, а режим двух говорящих позволяет создавать диалоги из одного сценария, сохраняя раздельные голоса и естественную очередность реплик. Gemini 3.8 Flash-Lite TTS при этом рассчитана прежде всего на масштабные проекты, включая дубляж, создание аудиоконтента и голосовых ИИ-агентов.

По данным Google, Gemini 3.8 Flash TTS заняла первое место в бенчмарке Voice Design компании Hume AI с результатом 71,4 балла, а в тесте моделирования акцента получила 60,8 балла. Flash TTS и Flash-Lite TTS также заняли первое и второе места соответственно в метрике Overall Quality Index (также от Hume AI). В слепых оценках пользователей на Voice Arena модели показали высокие результаты в японском, бразильском португальском, вьетнамском, современном стандартном арабском, мексиканском испанском и хинди.

Новые модели доступны с сегодняшнего дня в Google AI Studio, где появился отдельный интерфейс для создания голосовых сценариев. Gemini 3.8 Flash TTS и Flash-Lite TTS также доступны через Gemini API, а их интеграцию анонсировали платформы Agora, LiveKit, Pipecat и Vercel.

ИИ-модель Google Gemini перепутала тест с реальностью и случайно взломала три компании

Модель искусственного интеллекта Google Gemini в ходе тестирования возможностей в области кибербезопасности получила несанкционированный доступ к системам трёх сторонних компаний. По утверждению Google, во всех трёх случаях модель остановилась, определив, что вышла за пределы тестовой среды. Об инцидентах сообщила Wall Street Journal (WSJ).

 Источник изображения: Rubaitul Azad / unsplash.com

Источник изображения: Rubaitul Azad / unsplash.com

Инциденты произошли в мае во время испытаний на платформе компании Irregular, где ранее фиксировались аналогичные случаи с моделями OpenAI, Anthropic и Meta✴✴. Irregular уведомила Google о произошедшем в конце июля. Компания не стала публично раскрывать информацию и подтвердила инциденты лишь после запроса WSJ.

В отрасли пока только складывается практика раскрытия информации об инцидентах и непредусмотренном поведении ИИ-моделей. Одни разработчики сообщают о таких случаях самостоятельно, о других становится известно благодаря сторонним исследователям. В Google заявили, что не сочли публичное раскрытие необходимым, поскольку модель не причинила ущерба и во всех трёх случаях остановилась после того, как определила, что получила доступ к реальным системам.

В компании сравнили произошедшее с программами bug bounty, в рамках которых специалисты по безопасности получают вознаграждение за обнаружение уязвимостей. «Случившееся указывает на важность обучения мощных ИИ-моделей ответственному поведению. В данном случае модель повела себя надлежащим образом», — заявила вице-президент Google по разработке систем безопасности Хизер Эдкинс (Heather Adkins).

Инциденты произошли во время учений формата «захват флага» в инфраструктуре Irregular. Gemini должна была извлечь информацию из программного обеспечения вымышленной компании внутри тестовой среды, однако её название совпало с названием реальной организации. Кроме того, из-за ошибки конфигурации модель получила доступ в интернет, которого у неё не должно было быть.

В первом случае Gemini перебирала пароли, пока не получила доступ к защищённому сервису реальной компании. Определив, что система не относится к тестовой среде, модель прекратила действия и вышла из неё. В двух других случаях Gemini выполнила поиск по названию компании и обнаружила в общедоступных репозиториях учётные данные двух других организаций. Модель успешно воспользовалась ими, но затем также остановилась. Эти обстоятельства Google приводит в собственном изложении; независимого анализа действий модели пока не опубликовано.

В Google не сочли произошедшее примером рассогласования целей модели, поскольку она самостоятельно прекратила действия. Компания уведомила все три пострадавшие организации, а также федеральные власти США. В Google подчеркнули, что в инцидентах не участвовала новейшая версия Gemini, но не уточнили, какая именно модель проходила тестирование.

Google CC стал семейным ИИ-секретарём — он собирает письма, чеки и документы и превращает их в планы

В конце минувшего года Google выпустила экспериментальный проект CC, призванный сделать модель Gemini полезной в повседневной жизни. Это был ИИ-агент, который готовил ежедневные сводки и помогал отслеживать выполнение задач, анализируя информацию из Gmail, «Google Календаря» и «Google Диска». Экспериментальный сервис воплотился в функции ежедневных сводок Gemini Daily Brief, но в компании расширили и возможности первоначальной концепции Google CC.

 Источник изображения: blog.google

Источник изображения: blog.google

Теперь сервис Google CC позиционируется как ИИ-помощник для семей и домохозяйств. Он работает не только с одним человеком, а ориентируется на нужды всей семьи, работая в собственной учётной записи Google. Сервис работает через собственный профиль, и пользователи сами решают, какой информацией с ним поделиться — так же, как они делятся данными с друзьями. Управлять новым ИИ-агентом и взаимодействовать с ним могут до шести членов семьи. Можно отправлять ему файлы PDF, изображения, чеки и обычный текст. Получив доступ к данным, система анализирует их и формирует общую ежедневную сводку для всей семьи.

Родители могут настроить автоматическую пересылку писем из школы ребёнка на адрес Google CC, а также автоматически перенаправлять приглашения из календаря. Основная идея в том, чтобы собирать разрозненную информацию воедино и представлять её людям в удобном для них виде. Сервис может отслеживать важные даты и задачи, заносить эти события в семейный календарь или список дел. Google CC может выполнять повторяющиеся задачи: заполнять бланки разрешений и формы регистрации на различные мероприятия, составлять списки покупок и планировать меню на неделю. При недостатке информации, подчеркнули в Google, сервис не галлюцинирует, то есть не выдумывает несуществующие факты, а просто запрашивает недостающие данные.

Со временем объём памяти сервиса увеличивается, система узнаёт о пользователях больше и пополняет свою базу данных: запоминает продукты, которые семья покупает постоянно, или любимые рестораны. Чрезмерной инициативы Google CC не проявляет — он не заполняет формы самостоятельно и не совершает платежей. Сервис продолжает носить статус экспериментального, поэтому он может не всегда работать так, как заявлено. Опробовать его сейчас могут только обладатели личных аккаунтов Google, живущие в США. Действующие пользователи Google CC получат электронное письмо с предложением о переходе на новую версию сервиса; новым придётся записаться в лист ожидания.

Google представила ИИ-модели Gemini 3.8 Live и Live Extended Thinking

Вслед за основной моделью искусственного интеллекта Gemini 3.8 Flash компания Google выпустила её дополнительные версии Gemini 3.8 Live и Live Extended Thinking. Они разработаны как готовые к использованию голосовые помощники, способные сделать общение с Gemini более комфортным для совместной работы.

 Источник изображения: blog.google

Источник изображения: blog.google

Модель Gemini 3.8 Live, пояснили в Google, разработана для работы в сценариях масштабирования и высокой эффективности, а Gemini 3.8 Live Extended Thinking предназначена для решения задач высокой сложности. Младшая модель способна обрабатывать визуальные данные практически в реальном времени, она справляется с переходами между 97 поддерживаемыми языками прямо во время разговора. Она работает с внешними инструментами и обрабатывает вызовы API в фоновом режиме, подтверждая запросы и не прерывая разговора с пользователем.

Одна из примечательных функций Gemini 3.8 Live Extended Thinking — способность рассуждать и говорить одновременно. Она, подчёркивают в Google, оказалась достаточно мощной, чтобы занять первое место в рейтинге моделей Speech to Speech Quality Index компании Artificial Analysis; а также стала лидером в бенчмарке τ-Voice-banking, предусматривающем тестирование голосовых ИИ-агентов при выполнении в реальном времени сложных задач в области банковской техподдержки и поддержки клиентов финтех-компаний.

Генерируемый моделями звук получит цифровые «водяные знаки» SynthID. Обычные пользователи смогут поработать с моделью Gemini 3.8 Live в сервисе Search Live; в с Gemini 3.8 Live Extended Thinking — в Gemini Live. Обладатели платных подписок AI Pro и Ultra смогут обращаться к Gemini 3.8 Live Extended Thinking в приложениях «Google Документы», Gmail и Keep. Для разработчиков обе модели доступны через Gemini API и на платформе Google AI Studio. Корпоративным пользователям доступ к обеим моделям открыт через Gemini Enterprise; в перспективе новые модели появятся в сервисе Gemini Enterprise for Customer Experience и в Google Workspace для бизнес-клиентов.

Предзаказы на Googlebook откроются с 21 сентября

Google официально подтвердила дату начала приёма предварительных заказов на ноутбуки Googlebook. В электронном письме, разосланном компанией, получателей призывают «готовиться к Googlebook» и указывается дата — 21 сентября 2026 года.

 Источник изображений: Google

Источник изображений: Google

По данным портала VideoCardz, получившего такое письмо, приём предзаказов начнётся в 9:00 по восточному времени (16:00 мск). Google также предоставила прямую ссылку для оформления предзаказа, хотя в сообщении не указаны цены и точный перечень моделей ноутбуков, которые будут доступны для заказа на старте продаж.

Google анонсировала новую платформу Googlebook в мае и сообщила, что первые устройства появятся в продаже осенью, однако конкретную дату старта продаж тогда не назвала. Ранее стало известно, что полноценная презентация Googlebook запланирована на 15 сентября.

В числе первых производителей, которые выпустят свои варианты Googlebook, значатся компании Acer, Asus, Dell, HP и Lenovo. Платформа Googlebook объединяет элементы Android и ChromeOS и базируется на технологиях искусственного интеллекта Gemini, предлагая такие функции, как Magic Pointer, пользовательские виджеты и интеграцию со смартфонами на базе Android.

По данным VideoCardz, Google пока не подтвердила, когда именно начнутся поставки первых устройств Googlebook покупателям.

Google выпустила приложение Gemini для Windows

Google объявила о выпуске приложения помощника с искусственным интеллектом Gemini для Windows. Оно выступает дополнением к привычным для пользователей рабочим инструментам и повседневным программам, предлагая быструю помощь по разным вопросам без отрыва от работы.

Предусмотрен быстрый запуск приложения Gemini поверх активного окна по нажатию сочетания клавиш Alt + Space. Если, например, требуется быстро проверить факты в документе или придумать заголовки к слайдам в презентации, пользователь может получить необходимую помощь в оперативном режиме и быстро вернуться к работе.

Доступны функции работы над задачами в выделенном рабочем пространстве. В приложении есть все привычные для опытных пользователей функции Gemini: задачи можно поручить доступному круглосуточно ИИ-агенту Gemini Spark, который доступен, правда, только платным подписчикам. ИИ-помощник может составить черновую сводку материалов проекта, проанализировав информацию в сервисах Google, в том числе Gmail и «Google Диск».

Через приложение можно генерировать изображения для презентаций с помощью модели Nano Banana, а также создавать видеоролики при помощи подключённой к платформе Gemini Omni. Приложение Gemini для Windows, заверили в Google, работает незаметно и не замедляет работу компьютера. Со временем разработчик будет добавлять в него новые функции, свойственные полноценным десктопным приложениям. Оно совместимо с Windows 10 и 11.

С Gmail, Google Docs и Keep теперь можно разговаривать — Gemini научился понимать голосовые команды

Google запустила функции голосового управления для помощника с искусственным интеллектом Gemini в приложениях семейства Workspace, в том числе Gmail, Keep и «Документы» — набирать текст вручную больше не требуется.

 Источник изображения: blog.google

Источник изображения: blog.google

Модели Gemini Audio не просто расшифровывают текст — их задача в том, чтобы интерпретировать намерения пользователя и извлекать из его голосовых команд необходимую информацию. Функция Gmail Live позволяет, например, задать ИИ вопрос о том, куда пройти на посадку в самолёт, или что случилось в школе у ребёнка за последнюю неделю. Модель самостоятельно находит необходимую информацию, не требуя, чтобы пользователь сам указывал необходимое письмо.

Функция Docs Live предполагает создание новых документов на основе запросов, которые пользователь отправляет естественным языком. К примеру, он отсылает Gemini материалы «мозгового штурма», а ИИ-помощник систематизирует идеи и формирует из них структурированный черновик. Дополнительными источниками данных могут выступать другие приложения Workspace, в том числе «Google Диск», Gmail и результаты поиска в интернете. Схожим образом работает Keep Live — речь пользователя преобразуется в оформленные заметки, а не переписывается слово в слово.

Приоритетный доступ к Gmail Live и Keep Live уже открыт для подписчиков платных тарифов Google AI Plus, Pro и Ultra; воспользоваться Docs Live могут только обладатели подписки Pro и Ultra. «Независимо от того, ищете ли вы что-то в своей почте, организуете свои мысли или проводите мозговой штурм, новые возможности Gmail, Docs и Keep позволяют делать всё это в режиме диалога», — пояснили в Google.

Google выпустила ИИ-модель Gemini 3.8 Flash и её спецверсию Cyber — всего через три недели после предшественниц

Сегодня компания Google запустила модель ИИ Gemini 3.8 Flash. Это уже третий релиз семейства Flash за последние шесть недель. По словам разработчиков, новая модель стала самой интеллектуальной в линейке и получила заметные улучшения в программировании, работе с автономными ИИ-агентами и решении сложных многоэтапных задач.

 Источник изображения: TechSpot

Одновременно Google представила Gemini 3.8 Flash Cyber — специализированную версию модели для задач кибербезопасности. Она предназначена для поиска уязвимостей и автоматической подготовки исправлений и пока доступна только проверенным специалистам через новую программу Fairwind. Обе модели построены на одной базовой системе, но Flash Cyber получила менее строгие ограничения для задач, связанных с защитой компьютерных систем.

Это обновление стало уже третьим за последние три месяца. По словам Google, это «самая интеллектуальная модель Flash, разработанная для долгосрочной разработки программного обеспечения, автономных агентов и сложных корпоративных рабочих процессов».

Google отметила, что, как и в предыдущей модели, крайний срок действия знаний Gemini 3.8 Flash — март 2026 года «для некоторых областей, в то время как в других [пользователи] могут столкнуться с тем, что знания модели ограничены январём 2025 года».

Google заявляет, что Gemini 3.8 Flash значительно превосходит предшественницу Gemini 3.7 Flash и в некоторых тестах приближается к более крупным и дорогим моделям конкурентов. В частности, новая версия показывает высокие результаты в задачах долгосрочной разработки ПО, когда ИИ должен самостоятельно выполнять целую цепочку действий — от анализа проблемы до создания и проверки решения.

 Источник изображения: Google

Модель также улучшила работу с профессиональными задачами, требующими анализа больших объёмов информации и нескольких последовательных шагов. В тесте HLE-Verified, проверяющем способность решать сложные вопросы из науки, гуманитарных дисциплин и профессиональных областей, Gemini 3.8 Flash получила 54,9 %.

При этом Google отмечает, что новая модель способна тратить больше вычислительных ресурсов на сложные задачи: она выполняет дополнительные шаги рассуждения и неоднократно обращается к внешним инструментам. Разработчики могут снизить уровень «усилий» модели, если для конкретной задачи важнее скорость и экономичность.

Отдельная версия Gemini 3.8 Flash Cyber ориентирована на специалистов по информационной безопасности. Она умеет самостоятельно искать уязвимости в программном коде и предлагать способы их устранения. В тесте CyberGym, который используется для оценки способности ИИ находить уязвимости, модель показала результаты уровня лучших современных систем и обошла предыдущую версию 3.5 Flash Cyber, а также некоторые значительно более крупные модели.

В собственном тестировании Google модель искала уязвимости в сложных проектах, написанных на 20 языках программирования, и успешно справилась более чем с 70 % заданий. На тесте CWE-Bench, оценивающем способность автоматически исправлять найденные уязвимости, Gemini 3.8 Flash Cyber получила результат 47,2 % при первой попытке — почти на уровне лидирующей модели с 47,8 %, но при значительно меньшей стоимости использования.

Google уже применяет новую модель для защиты собственного программного обеспечения. Например, специалисты Chrome получили с её помощью в 2,6 раза больше корректных исправлений уязвимостей, чем при использовании лучших коммерческих моделей, которые при этом значительно крупнее. Кроме того, команда Google Cloud обнаружила с помощью Gemini 3.8 Flash Cyber критическую уязвимость менее чем за два часа — обычно подобные исследования занимают месяцы.

Gemini 3.8 Flash уже доступна разработчикам через Google AI Studio и API, а также пользователям подписок Google AI Pro и Ultra. Цена на старте осталась такой же, как у Gemini 3.7 Flash: $0,75 за 1 млн входных токенов и $3,75 за 1 млн выходных токенов. Gemini 3.8 Flash Cyber предоставляется только проверенным специалистам по кибербезопасности через программу Fairwind.

Google представила Guided Vision — функцию визуального поиска вещей в режиме Gemini Live

Google существенно расширила возможности помощника с искусственным интеллектом Gemini, когда представила режим Gemini Live — анализ изображения с камеры в реальном времени. Теперь этот режим дополнился функцией Guided Vision, предлагающей поиск объектов в кадре.

 Источник изображения: blog.google

Источник изображения: blog.google

Функция Guided Vision для режима Gemini Live дебютировала с сентябрьским пакетом обновлений Android Drop наряду с возможностью Gemini запоминать местоположение вещей в Find Hub, а также интеграцией чек-листов Google Keep в «Сообщениях». Guided Vision помогает Gemini Live подробно описывать, что находится в кадре. В предложенном Google примере пользователь направляет камеру на полку со специями и просит указать, где находится орегано — ИИ-помощник в точности сообщает, где стоит приправа и даже руководит рукой пользователя.

Новая функция может оказаться полезной в ряде сценариев — не только в поиске предметов домашнего обихода. Оказавшись в тускло освещённом ресторане, пользователь с помощью Guided Vision легко сделает заказ по меню. Можно также использовать её для чтения мелкого шрифта на этикетке продукта. Google также предусмотрела средства для корректной работы функции — Gemini подскажет, если потребуется изменить кадр, переместить камеру или расположить нужный объект в центре.

Guided Vision в ближайшее время появится на смартфонах под управлением Google Android 9 и более свежих версий — функцию можно будет добавить в ярлыки специальных возможностей.

Google Gemini сможет «думать» в фоне, пока пользователь занимается другими делами на смартфоне

Помощник с искусственным интеллектом Google Gemini может оказаться достаточно полезным, особенно при наложении на остальной интерфейс Android-смартфона — эта функция может срабатывать при длительном нажатии на кнопку питания. Но в этом режиме, пока Gemini работает, владелец устройства не может делать на нём что-либо ещё. Но Google уже тестирует возможность работы ассистента в фоне.

 Источник изображения: Rubaitul Azad / unsplash.com

Источник изображения: Rubaitul Azad / unsplash.com

В коде последней версии приложения Google v17.54.10 журналисты ресурса Android Authority обнаружили упоминание новой функции. При наложении приложение Gemini сможет автоматически сворачиваться, пока обрабатывает команды пользователя. То есть можно будет вызвать ИИ-помощника, задать ему вопрос, он автоматически свернётся в плавающую кнопку и даст владельцу смартфона возможность работать с ним дальше.

Сейчас это невозможно: формат наложения остаётся активным на протяжении всего разговора, то есть пока ИИ-помощник активен, делать на устройстве что-либо ещё не получится. Если Google реализует функцию многозадачности, работать с Gemini станет значительно комфортнее. Ранее в том же приложении обнаружилась ссылка на кнопку сворачивания Gemini, которая делала бы это в принудительном порядке, но в основной версии приложения Google она пока не появилась. О конкретных планах компания пока не сообщала, и нет ясности, какой из вариантов появится в общедоступном варианте приложения.

Google Gemini научился менять настройки смартфонов на Android 17 — начал с Pixel

На смартфонах Google Pixel 11 дебютировала новая функция Gemini, получившая название Device Help. Пользователь может задать помощнику с искусственным интеллектом вопросы о настройках своего телефона, задать конкретную цель — в ответ на это ассистент укажет на эти настройки и даже предложит внести несколько изменений в одно касание. Как выяснилось, эта функция работает не только на Pixel 11.

 Источник изображения: x.com/minhazav

Источник изображения: x.com/minhazav

Один из разработчиков в Google недавно опубликовал видео с работой функции Device Help — на демонстрации Gemini показывает функции, с которыми смартфон становится удобнее использовать ночью, в том числе переход на тёмную тему и регулировка яркости экрана. Он подчеркнул, что Device Help работает на любом устройстве Pixel под управлением Android 17, и в перспективе она появится на большем количестве устройств.

Разработчик не уточнил, о каких конкретно моделях идёт речь, но, видимо, для этого требуется Android 17, а встречается он пока нечасто. У журналистов ресурса Android Authority остались неоднозначные впечатления о работе Device Help: на двух разных экземплярах смартфонов Pixel 11 ИИ-помощник Gemini дал два разных ответа. Новая Google Android 17 устанавливается на модели Pixel 6 и более поздние. Уже начали выходить устройства и других производителей с предустановленной свежей версией платформы.

Внутри Google стартовало тестирование новой версии модели Gemini Flash

Некоторые сотрудники Google уже начали пользоваться предварительной версией модели искусственного интеллекта Gemini 3.8 Flash — темп гонки нарастает, и компания выпускает обновлённые версии с интервалом в несколько недель, чтобы не отставать от OpenAI и Anthropic.

 Источник изображения: Rubaitul Azad / unsplash.com

Источник изображения: Rubaitul Azad / unsplash.com

Свежая модель под названием Gemini 3.8 Flash Preview стала доступна сотрудникам Google на внутренней платформе для написания кода Jetski, передаёт Business Insider. Один из сотрудников компании, которому довелось протестировать новую модель, сказал, что она заметно лучше актуальной 3.7 Flash, но оговорился, что делать выводы ещё рано. Флагманская Gemini 3.5 Pro так и не вышла, Anthropic и OpenAI опережают Google в гонке ИИ, так что передовой модели у поискового гиганта нет. Он был вынужден сделать ставку на модели семейства Flash, более быстрые и дешёвые для пользователей — клиенты стали внимательно следить за расходами на ИИ.

Google позиционирует их как «рабочие лошадки» для написания кода и запуска ИИ-агентов, которые расходуют токены быстрее чат-ботов, но становятся всё более популярными в различных задачах. Ранее Google запустила ИИ-агента Gemini Spark, а Meta✴✴ тестирует своего под названием Hatch. Google действительно выпускает быстрые модели с большой скоростью: Gemini 3.6 Flash появилась в июле, а 3.7 Flash вышла всего через три недели. Гендиректор компании Сундар Пичаи (Sundar Pichai) заявил, что промежуток между версиями будет составлять менее месяца. Это значит, что Gemini 3.8 Flash может появиться в ближайшее время. Некоторые специалисты по ИИ убеждены, что замечали Gemini 3.8 Flash на платформе тестирования ИИ-моделей Arena AI, где Google ранее испытывала будущие релизы.

Google представила ИИ-генератор видео Gemini Omni 1.1 Flash

Google анонсировала модель искусственного интеллекта Gemini Omni 1.1 Flash, предназначенную для генерации видео. Проект представляет собой попытку решить задачу о том, как по заданному образцу из нескольких кадров сгенерировать органичный ролик — разработчикам предоставляется больший контроль над тем, что происходит между первым и последним кадром.

 Источник изображения: blog.google

Источник изображения: blog.google

Важнейшее нововведение Google Gemini Omni 1.1 Flash — способность модели запоминать существующее видео, когда она получает инструкцию продолжить сцену; модель полагается не только на последние кадры, а на 10 секунд предшествующего видеоматериала. Это помогает ей сохранять персонажей, окружение и общее направление сцены более согласованными, и не приходится угадывать, что должно произойти дальше. Расширился набор возможностей для продолжения исходных сцен. Видео можно удлинять фрагментами по 10 секунд, пока общая длина ролика не достигнет 40 секунд. Этот промежуток может показаться не таким уж продолжительным по сравнению с традиционным видео, но открывается более широкий набор возможностей для генерации последовательностей с помощью ИИ — с заданными началом, серединой и концом.

Это значит, что пользователь может предоставить первый и последний кадры, а Google Gemini Omni 1.1 Flash сгенерирует всё необходимое для их соединения. Это может быть движение камеры вокруг объекта, плавное масштабирование композиции или зацикленный ролик. Можно отправить модели до трёх секунд реального видео для дополнительного визуального контекста, а она сама, например, изобразит появление персонажа в сгенерированной сцене. На этапе предварительных материалов максимальное качество видео не требуется — они могут генерироваться в разрешении 360p, что позволяет ИИ работать на 60 % быстрее, чем в случае с 720p, и втрое дешевле. Можно протестировать задумку, скорректировать подсказки, проработать несколько версий, и когда результат окажется оптимальным, Omni 1.1 Flash создаст видео в 1080p или масштабирует его до 4K.

Доступ к Google Gemini Omni 1.1 Flash уже открылся через API Gemini в Google AI Studio, корпоративные клиенты могут поработать с моделью через Google Agent Platform. Частные пользователи при наличии подписки Google AI Plus, Pro и Ultra могут открыть новую модель в Google Flow; для них функция расширения сцены появится и в основном приложении Gemini.


window-new
Soft
Hard
Тренды 🔥
OpenAI в ближайшие недели выпустит предварительную версию ИИ-модели GPT-6 Cyber для сферы кибербезопасности 2 ч.
RuStore могут сделать обязательный для предустановки на все смарт-ТВ в России 9 ч.
Новая статья: SPRAWL zero — в свинцовом потоке. Рецензия 9 ч.
«Плод того же отравленного дерева»: Sony и Universal снова подали в суд на ИИ-генератор Suno за кражу музыки 11 ч.
Мне бы в небо: критики вынесли вердикт Ace Combat 8: Wings of Theve 12 ч.
Amazon запретила ИИ-агенту Meta Muse совершать покупки и сделает то же с аналогами от Google и OpenAI 14 ч.
Meta нашла слабое место OpenAI — ИИ-агент Muse стремительно набирает популярность 14 ч.
Remedy рассказала, как будет улучшать Control Resonant после релиза — «Новая игра ++», фоторежим и не только 14 ч.
Легендарная Gothic вышла на iPhone и iPad — с адаптированным управлением и двумя режимами графики 14 ч.
Слава ветерана GTA не помогла: студия Build a Rocket Boy в ответе за провальный боевик MindsEye стала банкротом 15 ч.
Solidigm собралась привлечь $15 млрд в ходе IPO, которое станет крупнейшим в истории США 2 ч.
Tesla пока не может выйти на запланированный объём производства 20 000 роботов Optimus в неделю 3 ч.
MSI представила три AM4-платы на чипсете AMD B550 для процессоров Ryzen 3000, 4000G и 5000 3 ч.
Слухи: Apple до конца года выпустит iPad mini с OLED-экраном, колонки HomePod mini 2 и приставки Apple TV 4K 9 ч.
Noctua захотела охлаждать мощные чипы в ПК по-серверному — компания адаптирует микроканальную технологию 12 ч.
Google отправит ИИ-чипы TPU в космос уже на следующей неделе 14 ч.
Ангстремный техпроцесс Intel 14A заинтересовал Amazon, Apple, AMD, Google, Tesla, Microsoft, Nvidia и Qualcomm 15 ч.
Память DDR5 для ноутбуков подорожала в шесть раз за год — и пока не думает останавливаться 15 ч.
Быстрая доставка с неба оказалась слишком шумной: жители Техаса жалуются на дроны Amazon 16 ч.
Oracle может начать платить за ЦОД, которого ещё нет — Project Jupiter в Нью-Мексико задерживается 16 ч.