несколько секунд. Модель начинает внедряться с сегодняшнего дня в продуктах Google: для разработчиков через Gemini Live API и Google AI Studio в публичной предварительной версии; для предприятий в частной предварительной версии в этом месяце в Google Meet; а для потребителей — через Google Translate на Android и iOS. Она обрабатывает многоязычные входные данные без ручной настройки и устойчива к шуму. Платформы для разработчиков, такие как Agora, Fishjam, LiveKit, Pipecat и Vision Agents, интегрировались с Gemini Live API, чтобы упростить создание приложений голосового перевода. Партнёр Grab тестирует модель для многоязычного общения между водителями и путешественниками. Такие компании, как CJ ENM и LiveKit, дали положительные отзывы о качестве перевода и низкой задержке. В Google Meet перевод речи будет расширен с 5 до более чем 70 языков, что обеспечит более 2000 языковых комбинаций. Приложение Google Translate вводит на Android «режим прослушивания», который воспроизводит перевод через наушник телефона. Весь генерируемый аудиоконтент маркируется водяными знаками SynthID для предотвращения дезинформации.