Google представила обновлённую модель для голосовой коммуникации в реальном времени — Gemini 3.8 Live.
В пресс-релизе компания сообщила, что нейросеть стала эффективнее и быстрее. Одно из главных нововведений — асинхронный вызов функций, который позволяет Gemini 3.8 Live анализировать запросы даже во время ответов на вопросы пользователя. Это должно сделать модель существенно быстрее.
Появилась функция Proactive audio — она позволяет поддерживать диалог с ИИ-моделью с постоянно включенным микрофоном. ИИ-модель будет отвечать на запросы лишь в те моменты, когда её напрямую об этом попросят. Таким образом, у нейросети будет больше контекстной информации, что должно сделать ответы эффективнее.
Помимо этого, Google объявила о нескольких инкрементальных улучшениях модели — теперь она поддерживает более 97 языков, лучше справляется с числами и эффективнее анализирует визуальную информацию с фотографий и видео.
Gemini 3.8 Live уже доступна в Live API и Google AI Studio. Стоимость: 0,005 доллара (~0,4 рубля) за минуту входного аудио и 0,018 доллара (~1,5 рубля) за минуту речи на выходе.