Сегодня 15 апреля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Google научила Gemini 2.5 понимать и передавать эмоции в диалогах

На конференции Google I/O 2025 компания анонсировала новую версию своей мультимодальной модели Gemini 2.5, которая теперь поддерживает генерацию аудио и диалогов в реальном времени. Эти возможности доступны в предварительной версии для разработчиков через платформы Google AI Studio и Vertex AI.

 Источник изображения: Google

Источник изображения: Google

Gemini 2.5 Flash Preview обеспечивает реалистичное голосовое взаимодействие с ИИ, включая распознавание эмоциональной окраски речи, адаптацию интонации и акцента, а также возможность переключения между более чем 24 языками. Модель может игнорировать фоновые шумы и использовать внешние инструменты, такие как «Поиск», для получения актуальной информации во время диалога.

Дополнительно, Gemini 2.5 предлагает расширенные функции синтеза речи (TTS), позволяя управлять стилем, темпом и эмоциональной выразительностью озвучивания. Поддерживается генерация диалогов с несколькими голосами, что делает модель подходящей для создания подкастов, аудиокниг и других мультимедийных продуктов.

Для обеспечения прозрачности, все сгенерированные моделью аудио маркируются с помощью технологии SynthID, что позволяет идентифицировать контент, как сгенерированный ИИ. Разработчики могут опробовать новые функции через вкладки Stream и Generate Media в Google AI Studio.

Gemini 2.5 демонстрирует значительный шаг вперёд в области мультимодальных ИИ-систем, объединяя модальности текстов, изображений, аудио и видео в единую платформу. Новые функции открывают широкие перспективы для создания интерактивных приложений, виртуальных ассистентов и инноваций в сфере образования.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Google начала расширять персонализацию Gemini 48 мин.
Марк Цукерберг «перенёс свой рабочий стол» в лабораторию ИИ 50 мин.
Microsoft представила облегчённый ИИ-генератор изображений MAI-Image-2-Efficient 3 ч.
Anthropic готовится выпустить модель Claude Opus 4.7 и ИИ-генератор дизайнерских проектов 3 ч.
Pearl Abyss похвасталась продажами Crimson Desert — более пяти миллионов копий менее чем за месяц 4 ч.
Магазин приложений Aptoide обвинил Google в создании монополии 5 ч.
«Концентрированный кайф»: киберпанковый боевик Replaced стартовал в Steam c «очень положительными» отзывами 5 ч.
OpenAI представила GPT-5.4-Cyber — передовую ИИ-модель для защиты от киберугроз 5 ч.
Американские ведомства стали игнорировать запрет на сотрудничество с Anthropic — модель Mythos оказалась слишком хороша 5 ч.
Бесплатная раздача Graveyard Keeper обернулась для издателя игры выручкой в четверть миллиона долларов 6 ч.
Broadcom поможет Meta в создании нескольких поколений ИИ-ускорителей 24 мин.
MSI представила обновлённые ноутбуки Raider, Crosshair, Titan и Cyborg с новыми чипами Intel и графикой RTX 50-й серии 32 мин.
Жители американского городка выгнали половину муниципального совета, втихую одобрившего строительство крупного ЦОД — на очереди мэр и другие чиновники 48 мин.
В США испытали базовую станцию сотовой связи на дирижабле — она трое суток работала из стратосферы 49 мин.
Дата-центры Oracle получит топливные элементы Bloom Energy на 2,8 ГВт 2 ч.
За последние десять дней акции Nvidia взлетели в цене на 18 % 3 ч.
Xiaomi представила бюджетные Redmi R70 и R70m с процессорами Unisoc T8300, 13-Мп камерами и ёмкими батареями 3 ч.
Власти Китая планируют запретить поставки в США оборудования для производства солнечных панелей 3 ч.
Xiaomi выпустила Redmi G Pro 32U 2026 — 31,5-дюймовый игровой двухрежимный QD-Mini-LED-монитор за $470 3 ч.
Суперкомпьютеры с ИИ проиграли простым квантовым компьютерам из Китая в предсказании погоды 3 ч.