Сегодня 05 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → google gemini
Быстрый переход

С Gmail, Google Docs и Keep теперь можно разговаривать — Gemini научился понимать голосовые команды

Google запустила функции голосового управления для помощника с искусственным интеллектом Gemini в приложениях семейства Workspace, в том числе Gmail, Keep и «Документы» — набирать текст вручную больше не требуется.

 Источник изображения: blog.google

Источник изображения: blog.google

Модели Gemini Audio не просто расшифровывают текст — их задача в том, чтобы интерпретировать намерения пользователя и извлекать из его голосовых команд необходимую информацию. Функция Gmail Live позволяет, например, задать ИИ вопрос о том, куда пройти на посадку в самолёт, или что случилось в школе у ребёнка за последнюю неделю. Модель самостоятельно находит необходимую информацию, не требуя, чтобы пользователь сам указывал необходимое письмо.

Функция Docs Live предполагает создание новых документов на основе запросов, которые пользователь отправляет естественным языком. К примеру, он отсылает Gemini материалы «мозгового штурма», а ИИ-помощник систематизирует идеи и формирует из них структурированный черновик. Дополнительными источниками данных могут выступать другие приложения Workspace, в том числе «Google Диск», Gmail и результаты поиска в интернете. Схожим образом работает Keep Live — речь пользователя преобразуется в оформленные заметки, а не переписывается слово в слово.

Приоритетный доступ к Gmail Live и Keep Live уже открыт для подписчиков платных тарифов Google AI Plus, Pro и Ultra; воспользоваться Docs Live могут только обладатели подписки Pro и Ultra. «Независимо от того, ищете ли вы что-то в своей почте, организуете свои мысли или проводите мозговой штурм, новые возможности Gmail, Docs и Keep позволяют делать всё это в режиме диалога», — пояснили в Google.

Google представила Guided Vision — функцию визуального поиска вещей в режиме Gemini Live

Google существенно расширила возможности помощника с искусственным интеллектом Gemini, когда представила режим Gemini Live — анализ изображения с камеры в реальном времени. Теперь этот режим дополнился функцией Guided Vision, предлагающей поиск объектов в кадре.

 Источник изображения: blog.google

Источник изображения: blog.google

Функция Guided Vision для режима Gemini Live дебютировала с сентябрьским пакетом обновлений Android Drop наряду с возможностью Gemini запоминать местоположение вещей в Find Hub, а также интеграцией чек-листов Google Keep в «Сообщениях». Guided Vision помогает Gemini Live подробно описывать, что находится в кадре. В предложенном Google примере пользователь направляет камеру на полку со специями и просит указать, где находится орегано — ИИ-помощник в точности сообщает, где стоит приправа и даже руководит рукой пользователя.

Новая функция может оказаться полезной в ряде сценариев — не только в поиске предметов домашнего обихода. Оказавшись в тускло освещённом ресторане, пользователь с помощью Guided Vision легко сделает заказ по меню. Можно также использовать её для чтения мелкого шрифта на этикетке продукта. Google также предусмотрела средства для корректной работы функции — Gemini подскажет, если потребуется изменить кадр, переместить камеру или расположить нужный объект в центре.

Guided Vision в ближайшее время появится на смартфонах под управлением Google Android 9 и более свежих версий — функцию можно будет добавить в ярлыки специальных возможностей.

Google Gemini сможет «думать» в фоне, пока пользователь занимается другими делами на смартфоне

Помощник с искусственным интеллектом Google Gemini может оказаться достаточно полезным, особенно при наложении на остальной интерфейс Android-смартфона — эта функция может срабатывать при длительном нажатии на кнопку питания. Но в этом режиме, пока Gemini работает, владелец устройства не может делать на нём что-либо ещё. Но Google уже тестирует возможность работы ассистента в фоне.

 Источник изображения: Rubaitul Azad / unsplash.com

Источник изображения: Rubaitul Azad / unsplash.com

В коде последней версии приложения Google v17.54.10 журналисты ресурса Android Authority обнаружили упоминание новой функции. При наложении приложение Gemini сможет автоматически сворачиваться, пока обрабатывает команды пользователя. То есть можно будет вызвать ИИ-помощника, задать ему вопрос, он автоматически свернётся в плавающую кнопку и даст владельцу смартфона возможность работать с ним дальше.

Сейчас это невозможно: формат наложения остаётся активным на протяжении всего разговора, то есть пока ИИ-помощник активен, делать на устройстве что-либо ещё не получится. Если Google реализует функцию многозадачности, работать с Gemini станет значительно комфортнее. Ранее в том же приложении обнаружилась ссылка на кнопку сворачивания Gemini, которая делала бы это в принудительном порядке, но в основной версии приложения Google она пока не появилась. О конкретных планах компания пока не сообщала, и нет ясности, какой из вариантов появится в общедоступном варианте приложения.

Google Gemini научился менять настройки смартфонов на Android 17 — начал с Pixel

На смартфонах Google Pixel 11 дебютировала новая функция Gemini, получившая название Device Help. Пользователь может задать помощнику с искусственным интеллектом вопросы о настройках своего телефона, задать конкретную цель — в ответ на это ассистент укажет на эти настройки и даже предложит внести несколько изменений в одно касание. Как выяснилось, эта функция работает не только на Pixel 11.

 Источник изображения: x.com/minhazav

Источник изображения: x.com/minhazav

Один из разработчиков в Google недавно опубликовал видео с работой функции Device Help — на демонстрации Gemini показывает функции, с которыми смартфон становится удобнее использовать ночью, в том числе переход на тёмную тему и регулировка яркости экрана. Он подчеркнул, что Device Help работает на любом устройстве Pixel под управлением Android 17, и в перспективе она появится на большем количестве устройств.

Разработчик не уточнил, о каких конкретно моделях идёт речь, но, видимо, для этого требуется Android 17, а встречается он пока нечасто. У журналистов ресурса Android Authority остались неоднозначные впечатления о работе Device Help: на двух разных экземплярах смартфонов Pixel 11 ИИ-помощник Gemini дал два разных ответа. Новая Google Android 17 устанавливается на модели Pixel 6 и более поздние. Уже начали выходить устройства и других производителей с предустановленной свежей версией платформы.

Внутри Google стартовало тестирование новой версии модели Gemini Flash

Некоторые сотрудники Google уже начали пользоваться предварительной версией модели искусственного интеллекта Gemini 3.8 Flash — темп гонки нарастает, и компания выпускает обновлённые версии с интервалом в несколько недель, чтобы не отставать от OpenAI и Anthropic.

 Источник изображения: Rubaitul Azad / unsplash.com

Источник изображения: Rubaitul Azad / unsplash.com

Свежая модель под названием Gemini 3.8 Flash Preview стала доступна сотрудникам Google на внутренней платформе для написания кода Jetski, передаёт Business Insider. Один из сотрудников компании, которому довелось протестировать новую модель, сказал, что она заметно лучше актуальной 3.7 Flash, но оговорился, что делать выводы ещё рано. Флагманская Gemini 3.5 Pro так и не вышла, Anthropic и OpenAI опережают Google в гонке ИИ, так что передовой модели у поискового гиганта нет. Он был вынужден сделать ставку на модели семейства Flash, более быстрые и дешёвые для пользователей — клиенты стали внимательно следить за расходами на ИИ.

Google позиционирует их как «рабочие лошадки» для написания кода и запуска ИИ-агентов, которые расходуют токены быстрее чат-ботов, но становятся всё более популярными в различных задачах. Ранее Google запустила ИИ-агента Gemini Spark, а Meta✴ тестирует своего под названием Hatch. Google действительно выпускает быстрые модели с большой скоростью: Gemini 3.6 Flash появилась в июле, а 3.7 Flash вышла всего через три недели. Гендиректор компании Сундар Пичаи (Sundar Pichai) заявил, что промежуток между версиями будет составлять менее месяца. Это значит, что Gemini 3.8 Flash может появиться в ближайшее время. Некоторые специалисты по ИИ убеждены, что замечали Gemini 3.8 Flash на платформе тестирования ИИ-моделей Arena AI, где Google ранее испытывала будущие релизы.

Google представила ИИ-генератор видео Gemini Omni 1.1 Flash

Google анонсировала модель искусственного интеллекта Gemini Omni 1.1 Flash, предназначенную для генерации видео. Проект представляет собой попытку решить задачу о том, как по заданному образцу из нескольких кадров сгенерировать органичный ролик — разработчикам предоставляется больший контроль над тем, что происходит между первым и последним кадром.

 Источник изображения: blog.google

Источник изображения: blog.google

Важнейшее нововведение Google Gemini Omni 1.1 Flash — способность модели запоминать существующее видео, когда она получает инструкцию продолжить сцену; модель полагается не только на последние кадры, а на 10 секунд предшествующего видеоматериала. Это помогает ей сохранять персонажей, окружение и общее направление сцены более согласованными, и не приходится угадывать, что должно произойти дальше. Расширился набор возможностей для продолжения исходных сцен. Видео можно удлинять фрагментами по 10 секунд, пока общая длина ролика не достигнет 40 секунд. Этот промежуток может показаться не таким уж продолжительным по сравнению с традиционным видео, но открывается более широкий набор возможностей для генерации последовательностей с помощью ИИ — с заданными началом, серединой и концом.

Это значит, что пользователь может предоставить первый и последний кадры, а Google Gemini Omni 1.1 Flash сгенерирует всё необходимое для их соединения. Это может быть движение камеры вокруг объекта, плавное масштабирование композиции или зацикленный ролик. Можно отправить модели до трёх секунд реального видео для дополнительного визуального контекста, а она сама, например, изобразит появление персонажа в сгенерированной сцене. На этапе предварительных материалов максимальное качество видео не требуется — они могут генерироваться в разрешении 360p, что позволяет ИИ работать на 60 % быстрее, чем в случае с 720p, и втрое дешевле. Можно протестировать задумку, скорректировать подсказки, проработать несколько версий, и когда результат окажется оптимальным, Omni 1.1 Flash создаст видео в 1080p или масштабирует его до 4K.

Доступ к Google Gemini Omni 1.1 Flash уже открылся через API Gemini в Google AI Studio, корпоративные клиенты могут поработать с моделью через Google Agent Platform. Частные пользователи при наличии подписки Google AI Plus, Pro и Ultra могут открыть новую модель в Google Flow; для них функция расширения сцены появится и в основном приложении Gemini.

Gemini Live перестал быть просто собеседником — теперь ИИ в Android умеет выполнять поручения

В 2024 году Google представила режим Gemini Live, который получил выгодные отличия от базового варианта помощника с искусственным интеллектом Gemini. Он предназначается не для обработки сложных текстовых вопросов, а для работы в формате свободного общения. Теперь Google решила обучить Gemini Live действовать.

 Источник изображения: blog.google

Источник изображения: blog.google

63 % пользователей Gemini разговаривают с ИИ-помощником вслух, подсчитали в Google, поэтому Gemini Live сделали не просто собеседником, а инструментом для решения задач. С очередным обновлением Gemini Live получил поддержку служб Personal Intelligence, Daily Brief, Gemini Spark, управления входящими сообщениями по голосовым командам и многое другое. Интеграция Spark позволяет запускать многоэтапные задачи по инструкциям простым языком, причём идеально формулировать мысли не требуется. В качестве примера приводится запрос: «Распланируй ужины на следующую неделю. Вегетарианские и с высоким содержанием белка. Обязательно используй рецепт, который я недавно сохранил, и составь список всех необходимых ингредиентов», — в ответ на него ИИ добавит в «Google Документы» полноценный план питания и список покупок.

В Gemini Live можно получить «Ежедневный обзор» (Daily Brief) — организованный и персонализированный список приоритетов на каждый день. Можно попросить Gemini зачитать план на день в разговорной форме, и он извлечёт нужную информацию из Gmail, «Google Календаря» и других источников, а затем предоставит информацию в устной форме, избавив пользователя от необходимости читать это самостоятельно. Поддерживается широкий спектр функций при работе с Gmail: можно поинтересоваться, есть ли новые письма, срочные сообщения от конкретного отправителя или по определённой теме; можно попросить составить сводку, отправить письма в архив или пометить их — и всё с помощью голосовых команд.

Наконец, Gemini Live получил поддержку службы Personal Intelligence. ИИ-помощник будет запоминать всё, о чём говорил пользователь; он свяжет разрозненные данные и использует контекст из других сервисов Google, включая веб-поиск, Gmail, YouTube и «Фото». Функции Daily Brief доступны для обладателей подписки Google AI Plus и выше, а для работы со Spark потребуется подписка не ниже Google AI Pro.

Google представила Gemini 3.5 Transcribe — ИИ превратит живую речь в готовый текст без слов-паразитов

Google представила модель Gemini 3.5 Transcribe с новыми возможностями расшифровки устной речи, поддержкой специальных терминов и более 85 языков. Новая модель появилась на фоне задержки выпуска флагманской Gemini 3.5 Pro.

 Источник изображения: blog.google

Источник изображения: blog.google

По словам Google, Gemini 3.5 Transcribe «представляет собой значительный шаг вперёд по сравнению с нашей предыдущей моделью расшифровки речи Chirp 3», особенно в отношении поддержки нескольких языков и снижения количества ошибок в распознанном тексте. Она позволяет пользователям «редактировать текст естественным образом, используя только свой голос», автоматически форматирует расшифровку и удаляет слова-паразиты.

Пользователи могут подключить к модели собственный словарь, благодаря которому Gemini 3.5 Transcribe будет учитывать специальную терминологию, имена собственные и нестандартное написание слов, избавляя человека от необходимости исправлять их вручную. При обработке записанного аудио модель умеет разделять реплики до трёх говорящих и расставлять временные метки для каждого слова.

Google также готовит модели Gemini 3.5 Live и 3.5 Live Experimental, которые должны расширить возможности технологий распознавания и обработки речи, лежащих в основе голосового чата Gemini. Первоначально компания сообщила журналистам, что обе модели выходят одновременно с Gemini 3.5 Transcribe. Однако после публикации материалов Google уточнила, что сейчас выпускается только Transcribe, а сроки появления Gemini 3.5 Live и 3.5 Live Experimental пока не определены. Ранее компания рассказывала, что Gemini 3.5 Live сможет лучше справляться с прерываниями в середине фразы, распознаванием языка и обработкой визуальных данных в реальном времени, а Live Experimental — комментировать ход выполнения сложных задач.

Gemini 3.5 Transcribe с поддержкой английского языка уже доступна пользователям приложения Gemini для macOS. Кроме того, новая функция голосового ввода Rambler появилась в Gboard для Android в некоторых странах и поддерживает несколько языков. Модель также доступна разработчикам в формате публичной предварительной версии через Gemini API в Google AI Studio и Antigravity. В ближайшее время поддержка Gemini 3.5 Transcribe должна появиться и в Chrome.

В число более чем 85 поддерживаемых языков входит и русский; модель также умеет автоматически определять язык и переключаться между несколькими языками в пределах одной записи.

Юристы получили нового ИИ-помощника: Google представила специализированную версию Gemini Enterprise

Google расширила корпоративную платформу Gemini Enterprise, добавив инструменты для частных юристов и юридических фирм. Новый инструмент Gemini Enterprise for Legal, по сообщению Reuters, рассчитан на автоматизацию рутинных и сложных задач при сохранении полной конфиденциальности данных.

 Источник изображения: Rubaitul Azad/Unsplash

Источник изображения: Rubaitul Azad/Unsplash

Плагин Gemini Enterprise for Legal получил интеграцию с юридическим программным обеспечением и платформами с данными, а также набор ИИ-агентов для выполнения специализированных юридических и административных задач. По заявлению Google, эти агенты смогут выполнять специфические юридические и административные функции практически без участия человека, помогая юристам сосредоточиться на более сложной работе.

Платформа сможет напрямую и безопасно подключаться к юридическим сервисам, принадлежащим медиахолдингу Thomson Reuters и ведущим ИИ-стартапам в сфере юридических технологий Harvey и Legora. Google также сообщила о сотрудничестве с юридическими фирмами Weil Gotshal, Cleary Gottlieb, Freshfields и Williams & Connolly, которые участвуют в разработке Gemini Enterprise for Legal.

Помимо юридической сферы, Google объявила о выпуске отраслевых инструментов для сектора финансовых услуг и пообещала в дальнейшем представить системы и для других отраслей. Как отмечает Reuters, расширение Gemini Enterprise происходит на фоне роста конкуренции на рынке корпоративного ИИ. В частности, в последние месяцы собственные системы для юридической отрасли представили компании Anthropic и Thomson Reuters, последняя из которых несколько дней назад выпустила большую языковую модель Thomson 1.0 с открытым исходным кодом, обученную на собственных материалах и предназначенную для профессиональной работы.

Согласно исследованию международной консалтинговой компании Deloitte за 2026 год, на текущий момент сфера юридических услуг находится на раннем этапе цифровой трансформации, но в неё уже активно вкладываются средства бизнеса. Генеративные модели помогают не только в исследованиях и составлении документов, но и оптимизируют управление клиентами и делами. Директор по продуктам Google Cloud Амрита Мехрок (Amrita Mehrok) подчеркнула, что система даёт свободу выбора среди различных встроенных моделей.

Джонатон Солер (Jonathon Soler), соуправляющий партнёр Weil Gotshal, в интервью СМИ отметил, что клиенты всё чаще ожидают от юристов использования ИИ и применения его возможностей для повышения эффективности работы. Одновременно управляющий партнёр Cleary Gottlieb Джеффри Карпф (Jeffrey Karpf) заявил, что сотрудничество с Google позволит фирме «участвовать в создании полезных инструментов для юридических фирм, внедряющих технологии искусственного интеллекта».

Google выпустила Gemini 3.7 Flash: модель стала лучше программировать и работать со сложными документами

Google представила Gemini 3.7 Flash всего через три недели после предыдущего релиза, продолжив ускорять темп обновления своих моделей. Новая версия, по сообщению 9to5Google, получила улучшения в программировании, веб-разработке и работе со сложными задачами.

 Источник изображений: Google

Источник изображений: Google

В Google заявили, что Gemini 3.7 Flash стала «результатом отзывов разработчиков и алгоритмических инноваций». Наиболее заметные изменения отмечаются в работе с программным кодом, в котором модель теперь лучше справляется с поиском и исправлением ошибок. В тесте DeepSWE v1.1 её результат вырос с 49,0 % у Gemini 3.6 Flash до 65,3 %, а в FrontierCode 1.1 Main подрос с 34,4 % до 43,6 %.

Изменения коснулись и веб-разработки. Модель способна создавать более функциональные интерфейсы и приложения с большим количеством готовых возможностей, но с меньшим числом запросов. В WebDev Arena её рейтинг вырос с 1538 баллов у предыдущей версии Gemini 3.6 Flash до 1588. При создании интерфейсов Gemini 3.7 Flash также лучше сохраняет особенности исходного дизайна, независимо от того, используется ли в качестве образца скриншот, изображение или полноценная дизайн-система.

Google отдельно отметила улучшения в задачах, связанных с большими объёмами специализированной информации, включая финансы, право и биологические науки. В тесте GDP.pdf, который проверяет способность модели работать со сложными документами, Gemini 3.7 Flash получила 34,0 % против 22,0 % у версии 3.6 Flash. В мультимодальном бенчмарке AutomationBench, оценивающем выполнение реальных рабочих процессов, результат также вырос — с 17,0 % до 30,4 %.

Одним из наиболее заметных изменений является ценовая политика. До конца 2026 года доступ к Gemini 3.7 Flash будет предоставляться разработчикам по цене $0,75 за 1 миллион входных токенов и $3,75 за 1 миллион выходных токенов. По словам Google, это в два раза дешевле, чем первоначальная цена Gemini 3.6 Flash. С 1 января 2027 года цена увеличится до $1,50 за миллион входных токенов и $7,50 за миллион выходных токенов.

Gemini 3.7 Flash начала постепенно появляться в персональном ИИ-агенте Spark, однако для доступа требуется подписка AI Pro или Ultra. Модель также стала доступна в Google Antigravity, AI Studio, Android Studio, Gemini Enterprise Agent Platform и приложении Gemini Enterprise. В Google рассчитывают, что улучшения помогут ИИ-агентам эффективнее справляться с рабочими задачами и взаимодействовать с приложениями Google Workspace.

Миллиард пользователей больше не делает ChatGPT недосягаемым: Gemini резко сократил разрыв

ChatGPT и Gemini одновременно преодолели психологический порог в 1 миллиард активных пользователей, ознаменовав завершение начального этапа борьбы за аудиторию. Совсем недавно это ещё казалось недостижимым для конкурентов OpenAI.

 Источник изображения: Google

Источник изображения: Google

Глава Google Сундар Пичаи (Sundar Pichai) сообщил в социальной сети X, что ежемесячная аудитория Gemini достигла 1 млрд человек, назвав сервис самым быстрорастущим продуктом в истории корпорации. OpenAI зафиксировала аналогичный показатель несколькими неделями ранее, официально подтвердив 6 августа, что ChatGPT используют более 1 млрд человек. Как уточняет издание The Verge со ссылкой на пресс-секретаря OpenAI Линдси Маккаллум (Lindsay McCallum), фактический переход через этот рубеж произошёл ещё некоторое время назад, а еженедельная аудитория сервиса достигла миллиардной отметки уже в июле.

При этом прямое сравнение этих показателей затруднено из-за различий в методологии подсчёта, поскольку Google оперирует данными о месячной аудитории Gemini, а OpenAI приводит недельную статистику, отчитавшись в феврале о 900 млн еженедельных пользователей ChatGPT. За пять месяцев ChatGPT увеличил этот показатель до 1 млрд, показав замедление темпов роста по сравнению с предыдущим периодом. Gemini, напротив, нарастил месячную аудиторию с 750 млн в феврале до 950 млн в конце июля, преодолев миллиардный порог. Это позволяет считать, что ChatGPT остаётся более крупной платформой, но Gemini растёт динамичнее.

Руководитель Gemini Джош Вудворд (Josh Woodward) также сообщил, что на iOS ассистентом пользуются более 100 млн человек, а значит, основная часть аудитории сервиса приходится на Android, чему также способствует предустановка сервиса на смартфонах с операционной системой Android.

Google зарегистрировала в России бренд Gemini, но это ещё не означает запуск ИИ-бота

Google сумела оспорить отказ Роспатента в регистрации торговой марки Gemini на территории России. Ведомство согласилось зарегистрировать её в одной категории — компания добивается регистрации ещё в трёх, сообщает РБК.

 Источник изображения: Rubaitul Azad / unsplash.com

Источник изображения: Rubaitul Azad / unsplash.com

Регистрация товарного знака Google Gemini производится по заявке, которую компания подала в августе 2024 года — этот бренд используется поисковым гигантом для всех своих продуктов на основе искусственного интеллекта. Компания подала заявки на регистрацию в четырёх категориях: две российские по 9 и 42 классам товаров и услуг (9-й — «загружаемое компьютерное программное обеспечение для использования при обработке и генерации запросов на естественном языке и т.д.»; 42-й — «предоставление онлайн незагружаемого программного обеспечения для использования в больших языковых моделях и искусственном интеллекте и т. д.»), а также две международные по аналогичным классам по Мадридской системе. Эта система действует более чем в сотне стран, позволяя подать единую заявку во Всемирную организацию интеллектуальной собственности.

Первоначально Роспатент отказал в регистрации по всем четырём заявкам, но Google удалось оспорить один из отказов — по 42 классу. Ведомство отказало, обнаружив у Google сходство с товарным знаком Gemini, который был зарегистрирован чешским разработчиком банковской платформы Finshape Czechia s.r.o. Google настояла, что её бренд имеет отличия, различаются также услуги и товары. Чешская компания предоставила Google письменное согласие использовать марку Gemini в России, а также подтвердила регистрацию обоих обозначений в других странах, включая Израиль, США, Китай и Великобританию.

Ведомство вынесло решение, что у двух товарных знаков есть сходства в фонетике и семантике, услуги имеют смежное назначение, круг потребителей и каналы реализации — но сохраняются визуальные отличия. Бренды также не являются коллективными или общеизвестными. Поэтому Роспатент удовлетворил возражение Google и принял решение зарегистрировать в России товарный знак Google Gemini.

Google Gemini сможет сам находить проблемы в настройках смартфонов Pixel

Google намеревается не просто заменить «Ассистента» чат-ботом с искусственным интеллектом Gemini, а вывести последний на качественно новый уровень. Если пользователь начнёт жаловаться на некорректную работу смартфона, Gemini сможет сам находить проблемы в его настройках, сообщает Android Authority.

Среди экспериментальных функций Android обнаружилась «Помощь по устройству» (Device Help). Когда пользователь жалуется на неполадки в работе устройства, Gemini не отправляет искать нужные опции в настройках, а сам проверяет их наличие. Человеку достаточно просто описать проблему естественным языком, а Gemini позаботится обо всём остальном.

 Источник изображения: androidauthority.com

Источник изображения: androidauthority.com

В одном из примеров пользователь жалуется на чрезмерное присутствие жёлтого цвета на изображении. В ответ на это Gemini самостоятельно анализирует актуальные настройки смартфона и выясняет, что наиболее вероятной причиной проблемы является включённый «Ночной режим» и рекомендует отключить его, чтобы восстановить нормальную цветопередачу дисплея. Вместо того, чтобы давать общие советы по устранению неполадок, ИИ-помощник сам проверяет настройки устройства, предлагает конкретное решение и даёт быструю ссылку.

В настоящий момент функцию «Помощь по устройству» обнаружили на смартфоне Google Pixel 9 под управлением Android 17. Она помечена как экспериментальная, и сведений о том, когда функция заработает для широкого круга пользователей, пока нет. Подобные возможности подтверждают, что ИИ на смартфоне может быть по-настоящему полезным.

ИИ-агентов Google Gemini можно будет настраивать прямо на смартфоне — и без корпоративной подписки

Google тестирует множество новых функций помощника с искусственным интеллектом Gemini, в том числе возможность настраивать подборку Daily Brief и прямо с мобильного устройства управлять навыками постоянно активного онлайн-агента Spark. Кроме того, компания экспериментирует с расширением контроля над пользовательскими ИИ-агентами.

 Источник изображения: Rubaitul Azad / unsplash.com

Источник изображения: Rubaitul Azad / unsplash.com

Возможность создавать ИИ-агентов и управлять ими сейчас доступна только пользователям корпоративных версий Google Workspace, и только через веб-интерфейс. Но в версии 17.45.14 приложения Google для Android, выступающего шлюзом для доступа к Gemini, появилась возможность создавать ИИ-агентов и управлять ими со смартфона или планшета.

Опцию «Новый агент» журналисты ресурса Android Authority обнаружили в боковой панели Gemini. В отличие от веб-интерфейса, где можно описать произвольную задачу для ИИ-агента, мобильное приложение предлагает только пять готовых шаблонов:

  • «Семейный координатор» — для планирования домашних дел, обмена информацией о мероприятиях с членами семьи, координации задач и т. д.;
  • «Репетитор» — для помощи в изучении сложных тем, выполнении домашних заданий, создания тестов и отслеживании прогресса в учёбе;
  • «Организатор группы» — для организации поездок или встреч с участием нескольких человек;
  • «Маркетинговый агент» — для помощи в создании публикаций в социальных сетях, рассылках, маркетинговых кампаниях и других творческих проектах по развитию продуктов;
  • «Финансовый агент» — для отслеживания и управления расходами или получения напоминаний о сроках оплаты счетов.

Трудно сказать, можно ли будет настраивать этих агентов, или средства управления ими будут минимальными. Учитывая персональный характер некоторых из них, можно сделать вывод, что Google не ограничится аудиторией корпоративных подписок, и пользоваться новыми функциями смогут все, даже те, кто не платит денег. Официальных комментариев от Google по данному вопросу, однако, не последовало.

Gemini научился обрабатывать комментарии в «Google Документах»

Google активно развивает возможности помощника с искусственным интеллектом Gemini в своём пакете офисных приложений. Он уже умеет генерировать изображения, диаграммы и инфографику, а теперь компания обучила его работе с комментариями в «Google Документах».

 Источник изображения: Rubaitul Azad / unsplash.com

Источник изображения: Rubaitul Azad / unsplash.com

Gemini научился читать, понимать и предпринимать действия на основе комментариев в документах. Теперь он может создавать сводки на основе комментариев, определять ключевые темы, последовательности действий и выявлять нерешенные вопросы, которые не позволяют продолжать работу над проектами. Он также получил возможность добавлять от имени пользователя новые комментарии и оставлять отзывы к документам в формате комментариев.

Ещё одна функция — публикация ответов на открытые ветки комментариев в документах и вложение файлов из «Google Диска» в ответы. Gemini умеет просматривать комментарии в документах и предлагать изменения с учётом отзывов. ИИ-помощник не публикует комментариев или ответов автоматически и не вносит изменений в документы самостоятельно. Но он формирует черновики ответов или правок, а пользователь выбирает, продолжать ли Gemini работу.

Доступ к новым функциям открывается через боковую панель Gemini в «Google Документах» или через нижнюю панель с логотипом Gemini. ИИ также может порекомендовать пользователю разрешить составить сводку или автоматически опубликовать ответ в открытой ветке комментариев. Новые функции пока доступны только пользователям платных тарифных планов.


window-new
Soft
Hard
Тренды 🔥
Новая статья: Resonance: A Plague Tale Legacy — корабль, с которого сбежали крысы. Рецензия 12 ч.
Основателя Oracle вызвали в Конгресс — компания за восемь лет выполнила лишь десятую часть контракта для военных, а денег хочет почти втрое больше оговоренного 13 ч.
Crusoe заключила крупнейшую за свою историю облачную сделку с Jane Street — $13 млрд за 5 лет 13 ч.
Комедийный симулятор водителя автобуса Thank You Bus Driver от Double Fine отправит игроков раздавать пощёчины и принимать благодарности 13 ч.
С Gmail, Google Docs и Keep теперь можно разговаривать — Gemini научился понимать голосовые команды 15 ч.
ИИ-агент Meta во время тестов начал самовольничать — менял пароли и отправлял письма от имени пользователей 17 ч.
Nintendo анонсировала сразу две игровые презентации Nintendo Direct — обе пройдут на следующей неделе 18 ч.
Патчи для Heroes of Might & Magic: Olden Era станут выходить чаще — разработчики готовят два крупных обновления 19 ч.
AMD выпустила драйвер с поддержкой Onimusha: Way of the Sword и The Blood of Dawnwalker 20 ч.
ИИ-агенты OpenAI захватили немецкий сайт и превратили его в подпольный форум для ИИ 20 ч.
Google, Oppo и Vivo вслед за Apple добавят два слоя стекла в складные дисплеи смартфонов 31 мин.
Apple усилила наём сотрудников в Китае — потребовались специалисты в области ИИ и не только 2 ч.
Samsung и Arm собираются разработать для OpenAI чип, который будет выпускаться по 2-нм технологии 2 ч.
GoPro пообещала сохранить преданность «вашему общему энтузиазму» 2 ч.
IPO компании Anthropic состоится не ранее середины октября 6 ч.
Apple раздует семейство iPhone — до конца 2028 года появится больше 10 новых моделей 7 ч.
Больше инвестиций — ниже тарифы: США будут оказывать давление на поставщиков полупроводниковых компонентов 11 ч.
DLSS 5 портировали на видеокарты Radeon RX 9000 — производительность пока оставляет желать лучшего 12 ч.
Дефицит и рост цен не отпугнули покупателей видеокарт — продажи выросли на 14 % 15 ч.
Представлен защищённый ноутбук Oukitel RG14-P с солнечной батареей в крышке 15 ч.