К содержанию
Выпуск №3 · 11 июня 2026 / Новости

Google показала аудиомодель Gemini 3.5 Live Translate для почти синхронного перевода речи на более чем 70 языков

Google объявила о запуске Gemini 3.5 Live Translate, аудиомодели для почти непрерывного перевода речи в потоковом режиме speech-to-speech.

Редакция 10 июня 2026 г., 01:02 MSK

В Telegram

Google объявила о запуске Gemini 3.5 Live Translate, аудиомодели для почти непрерывного перевода речи в потоковом режиме (speech-to-speech). Система распознаёт более 70 языков и сразу генерирует перевод вслух, стараясь сохранить интонацию, темп и высоту голоса говорящего. Речь обрабатывается по мере поступления аудиосигнала, а перевод появляется через несколько секунд, поэтому паузы и разрывы в разговоре заметно сокращаются.

По данным Google, система умеет работать с многоязычным вводом без ручной настройки языка и остаётся стабильной даже в шумной или непредсказуемой акустической среде. Это открывает возможность использовать её для синхронного перевода звонков, онлайн‑встреч, лекций, трансляций и других форм живого общения.

Технологию постепенно добавляют в продукты компании. В Google Translate функция Live Translate станет глобально доступна на Android и iOS при использовании наушников. На Android также появится «режим прослушивания»: перевод будет выводиться прямо через динамик телефона. В Google Meet планируют интегрировать Gemini 3.5 Live Translate для пользователей Google Workspace. Сначала начнётся закрытое тестирование для бизнес‑клиентов, более широкое распространение ожидается позже в течение года.

Доступ к модели открывают и сторонним разработчикам через Gemini Live API. Среди партнёров названы Agora, Fishjam, LiveKit, Pipecat и Vision Agents. Компания также сообщает о тестах с участием партнёров, включая Grab. Там технологию используют для голосового общения между водителями и пассажирами в реальном времени в многоязычной среде с миллионами звонков в месяц. В аудиовыход модели встроен водяной знак SynthID, который позволяет распознавать синтетически сгенерированную речь.

Ключевые факты

  • Google представила аудиомодель Gemini 3.5 Live Translate для потокового перевода речи (speech-to-speech) с задержкой в несколько секунд и сохранением интонации, темпа и высоты голоса говорящего.

  • Система автоматически распознаёт более 70 языков и может работать с многоязычным вводом без ручной настройки языка.

  • Функция Live Translate начинает внедряться в Google Translate на Android и iOS при использовании наушников; на Android также добавлен «режим прослушивания» с выводом перевода через динамик телефона.

  • Google продвигает модель через Gemini Live API для сторонних разработчиков; среди партнёров названы Agora, Fishjam, LiveKit, Pipecat и Vision Agents, а тесты с Grab используют технологию для голосового общения между водителями и пассажирами.

Как процитировать

«Google показала аудиомодель Gemini 3.5 Live Translate для почти синхронного перевода речи на более чем 70 языков». hegai.media, 10 июня 2026 г.. https://hegai.media/novosti/google-pokazala-audiomodel-gemini-3-5-live-translate-dlya-pochti-sinhr--b1e07f33-e83d-4887-9b2a-05a67dd25f82

так материал выглядит в мессенджере