Сегодня 10 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → gemini 3
Быстрый переход

Google тестирует новую Gemini 4 Carbon — сотрудники сравнивают её с Claude Opus 5.5

Пока Google готовится к публичному запуску новой ИИ-модели Gemini 4, которая разрабатывается под кодовым названием Argon, сотрудники компании тестируют более совершенные версии нейросети. По данным Business Insider, сотрудникам Google доступна более продвинутая версия Gemini 4, известная под именем Carbon, которая должна помочь компании сократить отставание от конкурентов в сфере ИИ.

 Источник изображения: Igor Omilaev / unsplash.com

Источник изображения: Igor Omilaev / unsplash.com

Как утверждает источник, новая версия Gemini 4 несколько дней назад стала доступна сотрудникам Google на внутренней платформе Jetski, которую в компании используют для генерации программного кода. По словам одного из сотрудников Google, ИИ-модель Carbon «по ощущениям похожа на Opus 5.5» в задачах программирования. Речь идёт о наиболее производительной модели Anthropic для агентного программирования. При этом он добавил, что ИИ-модель нужно тестировать более продолжительное время.

Внутреннее тестирование Google показывает, что компания быстро продвигается на пути создания ИИ-моделей нового поколения Gemini 4, о чём было объявлено в конце прошлого месяца. Это также подчёркивает, насколько активно Google участвует в гонке за лидерство в сфере ИИ-агентов для программирования. Anthropic и OpenAI в настоящее время являются лидерами в этом направлении благодаря своим моделям, предназначенным для сложной инженерной работы.

Ранние версии Argon, протестированные внутри компании, в целом были хорошо приняты сотрудниками. При этом некоторые из них отметили, что ранние версии ИИ-модели отставали в некоторых задачах по написанию программного кода от передовых нейросетей конкурентов. Более совершенные версии Gemini 4 могут сократить это отставание, но нет гарантии, что Google выпустит их. По данным источника, компания протестировала несколько версий Gemini 4, которые разрабатывались под кодовыми именами Argon, Barium и Carbon.

 Источник изображения: BoliviaInteligente/unsplash.com

Источник изображения: BoliviaInteligente/unsplash.com

Внутренние кодовые имена в Google обычно не совпадают с публичными названиями. Например, в одном из документов указано, что модель Barium-B была выбрана в качестве той, которая станет публично известна под именем Argon. На данный момент неизвестно, будет ли Carbon очередным обновлением нейросети под именем Argon или это отдельная ИИ-модель в семействе Gemini.

В прошлом месяце Google заявила, что ИИ-модель Argon демонстрирует результаты на уровне передовых нейросетей в бенчмарках в программировании и профессиональных задачах, включая юридические и финансовые. В компании отметили, что в Argon разработчики сделали особый акцент на кибербезопасности. На начальном этапе модель станет доступна партнёрам Google в рамках программы Fairwind — инициативы для поиска уязвимостей в новых моделях. Позднее модель станет доступна для широкой публики.

В последнее время на Google растёт давление и компании нужно показать, что она по-прежнему способна конкурировать с ведущими игроками в сфере ИИ. На этой неделе Google анонсировала нового универсального ИИ-агента на базе Gemini для выполнения рабочих задач. В целом же гонка за лидерство в сегменте агентных ИИ-помощников между крупнейшими компаниями становится всё более жаркой.

Google представила ИИ-сотрудника — Gemini agent сможет самостоятельно выполнять задачи от начала до конца

Подразделение Google Cloud представило на конференции Gemini at Work 2026 новый продукт под названием Gemini agent — это агент с искусственным интеллектом, предназначенный для корпоративных пользователей. Он доступен в приложении Gemini Enterprise, пакете Workspace и в ряде других сервисов. Ему достаточно «ставить цели, а не давать пошаговые инструкции» — Gemini agent может отвечать на вопросы, выполнять интеллектуальную работу, создавать медиаконтент, писать и запускать код.

 Источник изображений: Google

Источник изображений: Google

«Если руководитель присылает вам письмо с просьбой подготовить презентацию с последними данными по проекту, Workspace Intelligence идентифицирует это как задачу, которую можно делегировать, и предлагает одним нажатием кнопки передать её Gemini-агенту», — приводит пример Google. ИИ-агент может также организовать мероприятие с коллегами, самостоятельно определив их состав по предыдущим мероприятиям, проверив их календари и инициировав переписку для согласования удобного времени.

Gemini agent способен выступать в роли сотрудника компании и выполнять функции, предусмотренные конкретной должностью. Он выполняет задачи, подбирая наиболее подходящие модели — помимо семейства Google Gemini, это также модели Anthropic Claude; в перспективе появятся и другие, проприетарные и открытые. Для решения многоэтапных задач подключаются субагенты; поддерживается работа с различными сторонними инструментами. Задачи могут быть долгосрочными и занимать несколько часов и даже дней.

ИИ-агент работает в облаке, обращаясь к «единому набору данных памяти, контекста и общему графу персонализации». Доступны четыре типа памяти:

  • сессионная память — ориентирована на текущую задачу, даже если она выполняется несколько дней;
  • семантическая память — «структурированная база знаний, формируемая в процессе чтения документов, общения с людьми и взаимодействия с другими агентами»;
  • процедурная память — «информация, как выполняется работа, в том числе навыки, которые агент вырабатывает сам для себя»;
  • эпизодическая память — «всё, что было сделано ранее».

Чтобы вызвать Gemini agent, его необходимо упомянуть как «@Gemini» в Gmail, «Google Документах», «Таблицах», «Презентациях» и «Чате». Он доступен на любых устройствах через различные каналы, включая командную строку, Google Workspace, Slack и Microsoft 365; при помощи API можно подключать сторонние приложения, в том числе без графического интерфейса. Сейчас Gemini agent находится на стадии закрытого предварительного тестирования, в перспективе он появится у корпоративных клиентов Google Workspace на некоторых тарифных планах семейств Business и Enterprise.

Google лишит бесплатных пользователей Gemini продвинутых моделей — зато Deep Think придёт в подписку за $20

Google пересмотрела условия доступа к моделям искусственного интеллекта в приложении Gemini для бесплатных пользователей и подписчиков тарифа AI Plus. С 9 октября использование некоторых ранее доступных моделей будет прекращено.

 Источник изображения: Google

Источник изображений: Google

Согласно официальному сообщению, владельцы бесплатных аккаунтов смогут использовать только модель Flash-Lite (3.5), лишившись доступа к версиям Flash (3.6) и Flash Pro (3.1). Пользователи подписки AI Plus также потеряют возможность работать с моделью Pro, сохранив доступ лишь к Flash-Lite и Flash за $5.

Одновременно подписчики уровня AI Pro, оплачивающие сервис по цене $20 в месяц, получат доступ к инструменту Deep Think, который ранее был доступен только на самых дорогих планах стоимостью $100 и $200 в месяц. Как отмечает Google в своём сообщении, «Deep Think позволит использовать возможности параллельного рассуждения по максимуму».

Также в этом месяце в Gemini планируется добавить новые уровни сложности: «низкий», «средний» и «высокий» для каждой доступной для соответствующего тарифа модели. Это повысит способность ИИ предоставлять более полные ответы на запросы, но также приведёт и к более быстрому исчерпанию лимитов использования.

Судьба новой модели Gemini 4 Argon остаётся неопределенной. Ранее Google сообщила, что модель будет доступна для подписчиков AI Ultra, но не уточнила, будет ли она относиться к уровню Pro или станет частью отдельного нового тарифа.

Gemini 4 хороша в тестах, но буксует в работе — пожаловались сотрудники Google

Google начала развёртывать долгожданную флагманскую модель искусственного интеллекта Gemini 4 Argon, но внутри компании нарастают сомнения относительно качества её работы в ключевых областях, в том числе в написании программного кода. В руководстве Google, однако, настроены оптимистично.

 Источник изображений: blog.google

Источник изображений: blog.google

Google представила модель Gemini 4 Argon узкому кругу партнёров в области кибербезопасности, пообещала после дополнительного тестирования расширить к ней доступ и начать с подписчиков платных тарифов. По официальной версии, Gemini 4 в ряде бенчмарков показала лучшие результаты, а в области безопасности обошла OpenAI Astra. Но эти показатели не отражают всей картины, утверждают источники Bloomberg — на практике она показывает более скромные результаты и испытывает трудности с некоторыми задачами из области программирования.

Поисковый гигант активно разрабатывает ИИ-модели, способные конкурировать с продуктами OpenAI и Anthropic; в июне компания намеревалась выпустить Gemini 3.5 Pro, но впоследствии отказалась от этого. Официальные представители Google заявили, что утверждения о низкой эффективности Gemini 4 в области программирования не соответствуют действительности, и сослались на слова руководителя DeepMind Корая Кавукчуоглу (Koray Kavukcuoglu): «Команде я доверяю всецело. Уверен, что мы всегда будем на переднем крае технологий».

Мнения сотрудников Google разделились. Одни говорят, что Anthropic Fable и OpenAI Astra развиваются быстрее, чем Gemini; и Gemini 4 даже при максимальных усилиях всё равно будет уступать в ряде аспектов. Другие полагают, что готовящаяся к выпуску версия по своим возможностям сравнялась с продуктами ведущих ИИ-лабораторий. Один из знакомых с процессом разработки модели сотрудников Google заверил, что внутри компании установился «широкий консенсус», что компания тщательно протестировала модели, и отверг утверждения, что они слабо справляются со сложными практическими задачами в области программирования.

Google необходимо, чтобы Gemini 4 стала успешной. Различные варианты Gemini используются практически во всех продуктах компании, включая ИИ-ответы в поиске, «Карты», Gmail и браузер Chrome. Этими сервисами пользуются миллиарды человек — таким охватом аудитории некоторые конкуренты Google похвастаться не могут. OpenAI и Anthropic уже недостаточно просто продавать доступ к моделям — они выпускают полноценные продукты, в том числе ИИ-агентов для написания кода. И если Google не ответит передовой моделью, у конкурентов будет время убедить клиентов, что будущее поиска и ПО — за их платформами.

В Google признали, что последняя модель уровня Pro вышла ещё в феврале, но с тех пор компания зафиксировала рост показателей своих продуктов с ИИ: корпоративной версии Gemini, чат-бота для массового пользователя и функции ИИ-обзоров в поиске — аудитория последних двух сервисов превысила 1 млрд пользователей. В ноябре минувшего года модель Gemini 3 выступила сильнее всех конкурентов; в мае этого года дебютировало семейство Gemini 3.5, компания пообещала в июне выпустить флагманскую Gemini 3.5 Pro, но, по неофициальной информации, отменила проект.

Решение нанесло урон позициям компании на рынке ИИ и, вероятно, обошлось компании недёшево с точки зрения времени и затрат. Только обучение подобной системы эксперты оценивают в $400 млн, и это без учёта оплаты труда инженеров, получающих очень высокую зарплату. Некоторые проблемы у Gemini 4 всё-таки есть, настаивают отдельные сотрудники. Её навыки в области написания кода неоднородны: модели, например, с трудом даётся фронтенд — направление, отвечающее за внешний вид и удобство использования приложений и сайтов. Кроме того, эта модель очень крупная, и её эксплуатация будет обходиться дорого, что может плохо сказаться на рентабельности Google.

Google, предполагают эксперты, могла чрезмерно увлечься «бенчмаксингом» — так называют популярное в отрасли явление, при котором инженеры оптимизируют ИИ-модели для получения высоких баллов в тестах, уделяя меньше внимания созданию продукта, который качественно выполняет свою задачу. Gemini 4 действительно не избежала этой тенденции, подтвердили знакомые с разработкой модели источники.

Среди сильных сторон модели отмечается способность обрабатывать отличную от текстовой информацию, например, извлекать метаданные из видео. Gemini 4 отличается высокими уровнями безопасности и киберзащищённости, а также умеет вести общение в ясной и естественной форме, говорит информированный источник.

Внутри Google ощущается явное недовольство ситуацией: исследователи указывают на раздутую бюрократию, которая стремится внедрить ИИ во все продукты компании; последовательной стратегии вредит постоянная смена задач и приоритетов. Компания потеряла ряд ведущих исследователей в области ИИ: легендарного инженера Джеффа Дина (Jeff Dean), нобелевского лауреата Джона Джампера (John Jumper), одного из руководителей направления Gemini Ноама Шазира (Noam Shazeer), а глава DeepMind Демис Хассабис (Demis Hassabis) уступил своё место более практичному Кораю Кавукчуоглу (Koray Kavukcuoglu).

Gemini 4, по официальной версии, разработана для выполнения длительных и сложных задач в сфере разработки ПО, в области финансов, юриспруденции и кибербезопасности. За один раз она способна генерировать до 1 млн токенов — это примерно 750 тыс. слов. Конкуренты Google тем временем стремительно движутся вперёд, хотя и призывают замедлить темпы разработки; среди потребителей наиболее популярен сейчас сервис ИИ-агента Meta✴✴ Muse — он умеет выполнять повседневные задачи, в том числе совершать покупки онлайн и записывать пользователей на приём.

Google начала платить сайтам за контент для ИИ-ответов — но большинству достаются копейки

Google начала эксперимент с выплатами издателям за материалы, которые используются при формировании ИИ-ответов в поиске. Однако первые результаты программы вызвали скептицизм: небольшие и средние сайты получают настолько мало денег, что это не компенсирует падение их поискового трафика из-за ИИ.

 Источник изображения: AI

Источник изображения: AI

По данным Ars Technica со ссылкой на The Information, к программе под названием AI contribution pilot компания Google подключила около 100 издателей. Участникам платят, если их материалы существенно влияют на ответы Gemini в ИИ-обзорах (AI Overview). При этом ранее Google не рассматривала возможность прямых выплат за использование контента, утверждая, что сайты получают взамен трафик из поисковой системы.

Несколько небольших и средних издателей рассказали The Information, что выплаты составляют примерно 0,1 % от их рекламной выручки, а некоторые крупные издатели вообще отказались от участия, рассчитывая таким образом добиться от Google более выгодных условий. При этом суммы заметно различаются. Например, один из участников программы по прогнозам может получать более $1 млн в год, тогда как недавно подключившийся сайт заработал около $60 000, что составляет лишь малую долю его доходов. Небольшие сайты получили менее $1000 за несколько месяцев.

Участники эксперимента отмечают, что материалы по нишевой тематике (аниме и игры) с меньшим количестве публикаций зарабатывают больше в виду высокого интереса у узкой аудитории. Одновременно статистика в консоли Google Search остаётся непрозрачной и издатели не всегда могут определить, почему получили ту или иную сумму. Компания также не объясняет достаточно подробно, что именно считается существенным вкладом в ИИ-ответ, поэтому сайтам сложно прогнозировать будущие выплаты.

Для Google проблема выходит за рамки отдельного эксперимента, так как ИИ-модели получают знания из большого массива интернет-данных, а поисковым системам по-прежнему необходим новый и актуальный веб-контент. Если сайты перестанут публиковать материалы или начнут блокировать доступ поисковым ботам Google, это может повлиять и на качество ИИ-поиска. При этом некоторые издатели уже активно начали противостоять переходу Google к поиску на базе ИИ. В частности, The New York Times подала иск из-за незаконного использования своих материалов для обучения моделей, а компания Penske Media, владеющая изданиями Variety и Rolling Stone, обвинила Google в несправедливом объединении обычной поисковой индексации со сбором данных для ИИ.

На ситуацию обращают внимание и регуляторы. В Великобритании Google ранее обязали предоставить издателям возможность отказаться от использования материалов в ИИ-поиске без потери присутствия в обычной выдаче, а Европейская комиссия проводит антимонопольное расследование, связанное с компенсацией издателям за использование их контента в ИИ-ответах.

Google вернулась в гонку ИИ с Gemini 4 Argon, которая слишком опасна для публики

Google представила Gemini 4 Argon — флагманскую модель искусственного интеллекта, ориентированную на сложные многошаговые задачи в программировании, анализе данных, юридической и финансовой работе, а также кибербезопасности. Но что важнее, новая модель — это попытка Google вернуться в гонку ИИ, где она в последнее время заметно отстала от OpenAI и Anthropic.

Gemini 4 вышла спустя почти целый год после Gemini 3 Pro, которая за это время была лишь обновлена до Gemini 3.1 Pro в феврале. Так что Google серьёзно отстала от конкурентов: OpenAI представила GPT-6 Astra, а Anthropic вывела на рынок Claude Fable 5 и Mythos 5, а потом и 5.1. Теперь в арсенале Google есть ответ в лице Gemini 4 Argon, которую сама компания позиционирует на уровне передовых моделей конкурентов.

Gemini 4 Argon получила лимит вывода до 1 млн токенов — в Google называют его отраслевым рекордом. Для сравнения, у предшествующих моделей компании максимальный объём генерируемого ответа составлял 64 тыс. токенов. Такой запас позволяет модели выполнять значительно более длинные цепочки рассуждений и генерировать сотни тысяч токенов в рамках одного рабочего процесса.

В Google описывают Gemini 4 Argon как систему, которая не просто отвечает на вопрос или генерирует фрагмент кода, а изучает исходные файлы, составляет план, запускает нужные инструменты, проверяет промежуточный результат и исправляет собственные ошибки.

Основными областями применения Gemini 4 Argon названы разработка ПО, финансовая и юридическая работа, а также кибербезопасность. Google уже использует Argon внутри компании. В частности, агенты на базе модели помогали оптимизировать алгоритмы для квантовых вычислений, анализировали телеметрию дата-центров и автоматически находили способы сократить потребление памяти. После внедрения предложенных оптимизаций компания рассчитывает освободить более 300 тебибайт памяти, а потенциальный суммарный эффект оценивает в 500 ТиБ — 1 ПиБ.

Ещё одно направление — масштабная миграция программного кода с C и C++ на Rust. Argon используется для работы с кодовыми базами объёмом от десятков тысяч строк до более чем 800 тыс. строк в ядре Fuchsia OS. В одном из экспериментов агенты модели переработали 32 тыс. строк SIMD-кода в библиотеке декодирования видео libgav1. Получившаяся реализация на Rust работает в 2,7 раза быстрее предыдущего Rust-порта при идентичных результатах декодирования.

В собственных тестах Google Gemini 4 Argon показала результат 77,9 % в бенчмарке DeepSWE v1.1, оценивающем способность ИИ решать реальные длительные задачи разработки ПО. Это выше показателей GPT-6 Astra (74,1 %) и Claude Fable 5.1 (67,4 %). В AutomationBench, который проверяет, правильно ли агенты выполняют многоэтапные бизнес-процессы, новинка получила 51,3 % против 41,4 и 31,4 % у Astra и Fable соответственно. Также Argon опередила флагманские GPT-6 Astra и Claude Fable 5.1 в Vals Index. В тесте понимания длинных видеозаписей LVBench результат составил 91,7 %.

Отдельное внимание Google уделила возможностям Argon в области кибербезопасности. Модель способна самостоятельно искать, проверять и исправлять уязвимости в программном обеспечении. В тесте CWE-bench v1 она получила 68 %, разделив первое место с флагманскими GPT-6 Astra и Grok 4.7. Google также заявляет о значительном превосходстве Argon над Gemini 3.8 Flash Cyber в ряде внутренних тестов по поиску уязвимостей и анализу веб-систем.

Google не собирается сразу делать Gemini 4 Argon общедоступной. Сначала её протестируют в рамках программы Fairwind вместе с доверенными экспертами по кибербезопасности. Google дополнительно проверяет Gemini 4 Argon на устойчивость к вредоносным инструкциям, попыткам обмануть ИИ и выходу агента за поставленные рамки.

После завершения тестирования Google планирует предоставить Argon разработчикам, корпоративным клиентам и обычным пользователям — первоначально платным клиентам API и подписчикам Google AI Ultra. На старте использование модели будет стоить $2 за 1 млн входных токенов и $10 за 1 млн выходных; после вводного периода тарифы вырастут до $4 и $20 соответственно. Кэшированные входные токены будут стоить на 95 % дешевле стандартной цены.

Gemini полностью заменил «Google Ассистента» на Android

В начале сентября Google инициировала процесс отключения помощника с искусственным интеллектом «Google Ассистент» на мобильных устройствах. Сейчас это происходит повсеместно — на устройствах большинства типов.

 Источник изображения: Rubaitul Azad / unsplash.com

Источник изображения: Rubaitul Azad / unsplash.com

Процесс перевода пользователей «Google Ассистента» на актуальный Gemini идёт уже несколько недель. Первоначально компания планировала завершить этот переход в 2025 году, затем срок перенесли на 2026 год, и в начале августа Google назвала конкретные сроки — с 4 сентября. Судя по многочисленным сообщениям пользователей Android, процесс миграции разворачивается полным ходом. На всех проверенных журналистами ресурса 9to5Google устройствах и во всех учётных записях в США и Европе «Google Ассистент» больше не доступен.

Из приложения Gemini исчезла настройка «Переключиться на Google Ассистента». Она перестала отображаться в нижней части меню учётной записи как в стабильной версии приложения 17.60, так и в бета-версии за номером 17.62. Пользователи экосистемы Android, таким образом, лишились возможности переключаться на «Google Ассистент» на смартфонах планшетах и сопряжённых устройствах, а также не могут использовать устаревший сервис. Это касается умных часов с Google Wear OS, наушников и автомобильных систем Android Auto.

Изменения пока не затронули умные колонки и умные дисплеи Google Nest и Google Home, а также аналогичные им устройства с поддержкой «Google Ассистента». Основным голосовым помощником на устройствах под Android теперь выступает Gemini — он может вызываться долгим нажатием кнопки питания и жестовой командой от углов сенсорного экрана.

Google заменит ИИ-ботов Gem в приложении Gemini на «навыки», но вряд ли это поможет конкуренции с Muse

На фоне роста популярности универсальных ИИ-агентов, таких как Muse от Meta✴✴ и Instinct, компания Google объявила о закрытии функции Gem в сервисе Gemini, которая позволяла пользователям создавать собственных ИИ-помощников для выполнения конкретных задач. Созданные пользователями ИИ-боты Gem не пропадут: эти инструменты будут автоматически преобразованы в «навыки» (skills), применимые для решения самых разных задач с использованием ИИ.

 Источник изображений: Google

Источник изображений: Google

Подробности изменений сообщаются непосредственно в приложении Gemini: пользователей предупреждают, что с 17 ноября 2026 года Gem трансформируются в «навыки». Компания берёт на себя процесс переноса данных в новый формат, поэтому пользователям не придётся предпринимать никаких действий для перехода. До указанной даты функциональность Gem сохранится в прежнем виде.

Функция ИИ-ботов Gem, запущенная в 2024 году, была призвана помочь пользователям обучать ИИ выполнению определенных задач, избавляя от необходимости каждый раз повторять инструкции. Среди готовых вариантов от Google были, например, наставник по обучению, помощник для мозгового штурма, консультант по карьере, помощник по написанию кода и редактор текстов. Пользователи также могли создавать собственные версии ИИ-ботов Gem. Например, можно было создать ИИ-тренера по бегу, диетолога или планировщика для отпуска. Такими помощниками можно было делиться с другими людьми. В Google рассчитывали, что это повысит популярность приложения Gemini.

Как отмечает портал TechCrunch, несмотря на смену формата «навыки» остаются менее удобными для рядового пользователя, чем простой ввод текстового запроса в чат-бот, как это реализовано у Meta✴✴ для Muse.

Для выбора нужного «навыка» в ветке обсуждения задачи придётся вводить косую черту («/») — такой интерфейс обычно предпочитают инженеры, а не рядовые пользователи.

С обновлением Gemini 3.8 Live у ИИ-моделей Google появилось лицо

Очередное обновление ИИ-модели Google Gemini 3.8 Live позволит пользователям вести беседу с ботом и одновременно наблюдать, как анимированный аватар реагирует на разные реплики в режиме онлайн. Новая функция Live Avatar используется для синхронизации движения губ виртуального аватара с репликами ИИ-бота, а также изменения выражения лица во время диалогов с пользователями.

 Источник изображения: Google

Источник изображения: Google

В сообщении Google сказано, что виртуальный аватар может переключаться между 97 поддерживаемыми языками «без потери качества изображения или появления визуальных искажений». В одном из демонстрационных видео Live Avatar общается на английском и японском языках, при этом анимация рта аватара точно совпадает с тем, что ИИ-бот произносит на обоих языках. В дополнение к этому во время разговора аватар может параллельно выводить информацию на экран.

Запуск Live Avatar состоялся примерно через неделю после того, как Google представила ИИ-модель Gemini 3.8 Live, которая, по заявлению компании, «обрабатывает визуальные данные практически в режиме реального времени». Помимо выбора из библиотеки уже готовых аватаров, пользователи смогут создавать собственные варианты внешнего облика Live Avatar. Отмечается, что генерируемые алгоритмом данные помечаются невидимым для человека водяным знаком SynthID. В дополнение к этому предусмотрены защитные меры для «соблюдения правил использования образов». На данном этапе это нововведение доступно только подписчикам Gemini Enterprise.

Google выпустит флагманскую ИИ-модель Gemini 4 до конца года и сократит отставание от конкурентов

Компания Google вскоре выпустит ИИ-модель Gemini 4. Как сообщил ресурсу The Information руководитель подразделения DeepMind Корай Кавукчуоглу (Koray Kavukcuoglu), в настоящий момент Gemini 4 находится на стадии доработки, так что её выпуск состоится до конца текущего года.

 Источник изображения: MARCO/unsplash.com

Источник изображения: MARCO/unsplash.com

«Мы хотим как можно скорее выпустить предварительную версию после обучения, потому что мы видим результаты и воодушевлены ими», — заявил Кавукчуоглу, добавив, что Google продолжит быстрые итерации в дальнейшем. Это, как полагает ресурс The Verge, означает, что Google возвращается к более стабильному графику выпуска новых моделей искусственного интеллекта, поскольку при прежнем руководстве было допущено серьёзное отставание от конкурентов по срокам выпуска флагманских ИИ-решений.

Google не выпускала новые флагманские ИИ-модели с ноября 2025 года, когда вышла серия Gemini 3. С тех пор были выпущены модели GPT-6 компанией OpenAI и Mythos ИИ-стартапом Anthropic. Обе модели превосходят Gemini 3, обеспечивая конкурирующим разработчикам значительное преимущество перед Google в гонке ИИ. В мае на конференции I/O генеральный директор Google Сундар Пичаи (Sundar Pichai) заявил, что в июне выйдет Gemini 3.5 Pro, которая поможет сократить отставание от конкурентов, но модель так и не была выпущена.

Кавукчуоглу пояснил, что компания сделала небольшой шаг назад, чтобы быстрее запустить менее мощные модели Flash вместо Gemini 3.5 Pro. На вопрос о том, беспокоит ли его отставание Google от конкурентов в области разработки искусственного интеллекта, он ответил: «Я уверен, что мы всегда будем на передовой».

Google выпустила ИИ-модели для синтеза речи Gemini 3.8 Flash TTS, которые умеют клонировать голос

Google представила Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS — две новые модели синтеза речи, которые превращают генерацию голоса из набора готовых вариантов в более гибкий инструмент для создания аудио. Модели позволяют создавать собственные голоса, управлять исполнением отдельных реплик и генерировать выразительные диалоги для игр, подкастов, аудиокниг и других проектов.

 Источник изображений: Google

Источник изображений: Google

Gemini 3.8 Flash TTS предназначена для создания персонажей и детального управления их голосами. С помощью текстовых запросов можно задать роль, акцент и характеристики голоса более чем для 100 языков и диалектов. В библиотеке также доступно более 2000 готовых голосов, включая региональные варианты мексиканского испанского, квебекского французского и шотландского английского.

Отдельно Google добавила возможность клонирования голоса по 30-секундной аудиозаписи. Функция предназначена для собственного голоса или голоса, на использование которого получено право. Перед созданием копии система проверяет согласие владельца голоса, а полученное аудио защищается водяным знаком SynthID и метаданными C2PA.

После выбора голоса разработчик может управлять каждой репликой отдельно с помощью текстовых указаний. Gemini способна менять темп и характер исполнения, использовать шёпот и другие элементы звуковой подачи, а также добавлять реакции в виде смеха, вздохов и коротких реплик.

Обе модели поддерживают генерацию длинного аудио с сохранением качества, естественного темпа и характеристик голоса на протяжении нескольких часов, а режим двух говорящих позволяет создавать диалоги из одного сценария, сохраняя раздельные голоса и естественную очередность реплик. Gemini 3.8 Flash-Lite TTS при этом рассчитана прежде всего на масштабные проекты, включая дубляж, создание аудиоконтента и голосовых ИИ-агентов.

По данным Google, Gemini 3.8 Flash TTS заняла первое место в бенчмарке Voice Design компании Hume AI с результатом 71,4 балла, а в тесте моделирования акцента получила 60,8 балла. Flash TTS и Flash-Lite TTS также заняли первое и второе места соответственно в метрике Overall Quality Index (также от Hume AI). В слепых оценках пользователей на Voice Arena модели показали высокие результаты в японском, бразильском португальском, вьетнамском, современном стандартном арабском, мексиканском испанском и хинди.

Новые модели доступны с сегодняшнего дня в Google AI Studio, где появился отдельный интерфейс для создания голосовых сценариев. Gemini 3.8 Flash TTS и Flash-Lite TTS также доступны через Gemini API, а их интеграцию анонсировали платформы Agora, LiveKit, Pipecat и Vercel.

ИИ-модель Google Gemini перепутала тест с реальностью и случайно взломала три компании

Модель искусственного интеллекта Google Gemini в ходе тестирования возможностей в области кибербезопасности получила несанкционированный доступ к системам трёх сторонних компаний. По утверждению Google, во всех трёх случаях модель остановилась, определив, что вышла за пределы тестовой среды. Об инцидентах сообщила Wall Street Journal (WSJ).

 Источник изображения: Rubaitul Azad / unsplash.com

Источник изображения: Rubaitul Azad / unsplash.com

Инциденты произошли в мае во время испытаний на платформе компании Irregular, где ранее фиксировались аналогичные случаи с моделями OpenAI, Anthropic и Meta✴✴. Irregular уведомила Google о произошедшем в конце июля. Компания не стала публично раскрывать информацию и подтвердила инциденты лишь после запроса WSJ.

В отрасли пока только складывается практика раскрытия информации об инцидентах и непредусмотренном поведении ИИ-моделей. Одни разработчики сообщают о таких случаях самостоятельно, о других становится известно благодаря сторонним исследователям. В Google заявили, что не сочли публичное раскрытие необходимым, поскольку модель не причинила ущерба и во всех трёх случаях остановилась после того, как определила, что получила доступ к реальным системам.

В компании сравнили произошедшее с программами bug bounty, в рамках которых специалисты по безопасности получают вознаграждение за обнаружение уязвимостей. «Случившееся указывает на важность обучения мощных ИИ-моделей ответственному поведению. В данном случае модель повела себя надлежащим образом», — заявила вице-президент Google по разработке систем безопасности Хизер Эдкинс (Heather Adkins).

Инциденты произошли во время учений формата «захват флага» в инфраструктуре Irregular. Gemini должна была извлечь информацию из программного обеспечения вымышленной компании внутри тестовой среды, однако её название совпало с названием реальной организации. Кроме того, из-за ошибки конфигурации модель получила доступ в интернет, которого у неё не должно было быть.

В первом случае Gemini перебирала пароли, пока не получила доступ к защищённому сервису реальной компании. Определив, что система не относится к тестовой среде, модель прекратила действия и вышла из неё. В двух других случаях Gemini выполнила поиск по названию компании и обнаружила в общедоступных репозиториях учётные данные двух других организаций. Модель успешно воспользовалась ими, но затем также остановилась. Эти обстоятельства Google приводит в собственном изложении; независимого анализа действий модели пока не опубликовано.

В Google не сочли произошедшее примером рассогласования целей модели, поскольку она самостоятельно прекратила действия. Компания уведомила все три пострадавшие организации, а также федеральные власти США. В Google подчеркнули, что в инцидентах не участвовала новейшая версия Gemini, но не уточнили, какая именно модель проходила тестирование.

Google CC стал семейным ИИ-секретарём — он собирает письма, чеки и документы и превращает их в планы

В конце минувшего года Google выпустила экспериментальный проект CC, призванный сделать модель Gemini полезной в повседневной жизни. Это был ИИ-агент, который готовил ежедневные сводки и помогал отслеживать выполнение задач, анализируя информацию из Gmail, «Google Календаря» и «Google Диска». Экспериментальный сервис воплотился в функции ежедневных сводок Gemini Daily Brief, но в компании расширили и возможности первоначальной концепции Google CC.

 Источник изображения: blog.google

Источник изображения: blog.google

Теперь сервис Google CC позиционируется как ИИ-помощник для семей и домохозяйств. Он работает не только с одним человеком, а ориентируется на нужды всей семьи, работая в собственной учётной записи Google. Сервис работает через собственный профиль, и пользователи сами решают, какой информацией с ним поделиться — так же, как они делятся данными с друзьями. Управлять новым ИИ-агентом и взаимодействовать с ним могут до шести членов семьи. Можно отправлять ему файлы PDF, изображения, чеки и обычный текст. Получив доступ к данным, система анализирует их и формирует общую ежедневную сводку для всей семьи.

Родители могут настроить автоматическую пересылку писем из школы ребёнка на адрес Google CC, а также автоматически перенаправлять приглашения из календаря. Основная идея в том, чтобы собирать разрозненную информацию воедино и представлять её людям в удобном для них виде. Сервис может отслеживать важные даты и задачи, заносить эти события в семейный календарь или список дел. Google CC может выполнять повторяющиеся задачи: заполнять бланки разрешений и формы регистрации на различные мероприятия, составлять списки покупок и планировать меню на неделю. При недостатке информации, подчеркнули в Google, сервис не галлюцинирует, то есть не выдумывает несуществующие факты, а просто запрашивает недостающие данные.

Со временем объём памяти сервиса увеличивается, система узнаёт о пользователях больше и пополняет свою базу данных: запоминает продукты, которые семья покупает постоянно, или любимые рестораны. Чрезмерной инициативы Google CC не проявляет — он не заполняет формы самостоятельно и не совершает платежей. Сервис продолжает носить статус экспериментального, поэтому он может не всегда работать так, как заявлено. Опробовать его сейчас могут только обладатели личных аккаунтов Google, живущие в США. Действующие пользователи Google CC получат электронное письмо с предложением о переходе на новую версию сервиса; новым придётся записаться в лист ожидания.

Google представила ИИ-модели Gemini 3.8 Live и Live Extended Thinking

Вслед за основной моделью искусственного интеллекта Gemini 3.8 Flash компания Google выпустила её дополнительные версии Gemini 3.8 Live и Live Extended Thinking. Они разработаны как готовые к использованию голосовые помощники, способные сделать общение с Gemini более комфортным для совместной работы.

 Источник изображения: blog.google

Источник изображения: blog.google

Модель Gemini 3.8 Live, пояснили в Google, разработана для работы в сценариях масштабирования и высокой эффективности, а Gemini 3.8 Live Extended Thinking предназначена для решения задач высокой сложности. Младшая модель способна обрабатывать визуальные данные практически в реальном времени, она справляется с переходами между 97 поддерживаемыми языками прямо во время разговора. Она работает с внешними инструментами и обрабатывает вызовы API в фоновом режиме, подтверждая запросы и не прерывая разговора с пользователем.

Одна из примечательных функций Gemini 3.8 Live Extended Thinking — способность рассуждать и говорить одновременно. Она, подчёркивают в Google, оказалась достаточно мощной, чтобы занять первое место в рейтинге моделей Speech to Speech Quality Index компании Artificial Analysis; а также стала лидером в бенчмарке τ-Voice-banking, предусматривающем тестирование голосовых ИИ-агентов при выполнении в реальном времени сложных задач в области банковской техподдержки и поддержки клиентов финтех-компаний.

Генерируемый моделями звук получит цифровые «водяные знаки» SynthID. Обычные пользователи смогут поработать с моделью Gemini 3.8 Live в сервисе Search Live; в с Gemini 3.8 Live Extended Thinking — в Gemini Live. Обладатели платных подписок AI Pro и Ultra смогут обращаться к Gemini 3.8 Live Extended Thinking в приложениях «Google Документы», Gmail и Keep. Для разработчиков обе модели доступны через Gemini API и на платформе Google AI Studio. Корпоративным пользователям доступ к обеим моделям открыт через Gemini Enterprise; в перспективе новые модели появятся в сервисе Gemini Enterprise for Customer Experience и в Google Workspace для бизнес-клиентов.

Предзаказы на Googlebook откроются с 21 сентября

Google официально подтвердила дату начала приёма предварительных заказов на ноутбуки Googlebook. В электронном письме, разосланном компанией, получателей призывают «готовиться к Googlebook» и указывается дата — 21 сентября 2026 года.

 Источник изображений: Google

Источник изображений: Google

По данным портала VideoCardz, получившего такое письмо, приём предзаказов начнётся в 9:00 по восточному времени (16:00 мск). Google также предоставила прямую ссылку для оформления предзаказа, хотя в сообщении не указаны цены и точный перечень моделей ноутбуков, которые будут доступны для заказа на старте продаж.

Google анонсировала новую платформу Googlebook в мае и сообщила, что первые устройства появятся в продаже осенью, однако конкретную дату старта продаж тогда не назвала. Ранее стало известно, что полноценная презентация Googlebook запланирована на 15 сентября.

В числе первых производителей, которые выпустят свои варианты Googlebook, значатся компании Acer, Asus, Dell, HP и Lenovo. Платформа Googlebook объединяет элементы Android и ChromeOS и базируется на технологиях искусственного интеллекта Gemini, предлагая такие функции, как Magic Pointer, пользовательские виджеты и интеграцию со смартфонами на базе Android.

По данным VideoCardz, Google пока не подтвердила, когда именно начнутся поставки первых устройств Googlebook покупателям.


window-new
Soft
Hard
Тренды 🔥
Google тестирует новую Gemini 4 Carbon — сотрудники сравнивают её с Claude Opus 5.5 41 мин.
Anthropic и OpenAI готовятся к первой крупной катастрофе по вине ИИ 50 мин.
Официально: продажи тактической стратегии Star Wars Zero Company от ветеранов XCOM превысили миллион копий 2 ч.
Белый дом отныне будет требовать от разработчиков ИИ обязательного предоставления отчётов об инцидентах с моделями 4 ч.
Новая статья: RetroSpace — осторожно, уборщик галактику спасает. Рецензия 12 ч.
Девять из десяти клиентов VMware задумались об уходе из-за высоких цен 12 ч.
Apple Hills Digital: предобученные модели и интеграция с данными для заказчиков важнее стоимости ИИ-нагрузки 14 ч.
OpenAI уволила трёх исследователей безопасности ИИ — они опасаются, что компания заставит сотрудников молчать о рисках 15 ч.
Пошаговая ролевая игра Shadow of the Road не выйдет за неделю до GTA VI — Owlcat объявила новую дату релиза 15 ч.
Китайские ИИ-компании скрывают, насколько опасны их модели — публичных тестов почти нет 15 ч.
GlobalFoundries возвращается в гонку: компания обещает чипы 7-нм класса в 2028 году 55 мин.
В России заметно сократился ассортимент ноутбуков Apple, Dell, HP и других ушедших брендов 2 ч.
Несмотря на задержки, Amazon обещает запустить спутниковый интернет-сервис в ближайшее время 3 ч.
Президент Трамп объявил врагами всех, кто не готов использовать термин «сверхинтеллект» 5 ч.
Тим Кук заявил, что не вмешивается в работу нового генерального директора Apple 6 ч.
Frore Systems анонсировала СЖО LiquidJet Diamond с алмазными пластинами 13 ч.
Google «выжмет» из АЭС Constellation ещё 890 МВт для своих ИИ ЦОД 14 ч.
«Это игра вдолгую»: капитализация SpaceX отыграла $750 млрд после обвала акций в августе 15 ч.
Понаехали: власти США обвинили Microsoft в замене американцев мигрантами и отстранили её от программы грин-карт 15 ч.
Volkswagen закончила эпоху ID.4 — представлен электрический кроссовер ID. Tiguan с запасом хода до 600 км 16 ч.