Google запустила Gemini Live в Gmail, Docs и Keep: теперь можно управлять голосом
Google официально запустила три голосовые функции на базе аудиомоделей Gemini в сервисах Workspace — Gmail, Docs и Keep. Об этом сообщила Юли Квон Ким, вице-президент Google Workspace по продукту. Компания впервые показала эту технологию на конференции Google I/O ещё весной, а теперь доработала её до релиза под общим названием Live.
Голосовые функции будут внедряться поэтапно в течение этой недели. Gmail Live и Keep Live станут доступны подписчикам тарифных планов Google AI Plus, Pro и Ultra, а Docs Live — — только пользователям Pro и Ultra. Корпоративным клиентам Google Workspace обещают следующие возможности «в ближайшее время», но точных дат компания пока не называет. Пользователям бесплатных аккаунтов Google доступ пока не предусмотрен — Live-функции доступны исключительно в рамках платных подписок на ИИ.
Gmail Live: почтовый ящик, который отвечает на вопросы
Вместо того чтобы вручную пролистывать десятки писем, пользователь просто озвучивает запрос —, и Gmail Live сканирует почтовый ящик и формулирует ответ. В Google приводят примеры фраз вроде «В каком выходе отправляется мой рейс» или «Что на этой неделе происходит в школе моего ребенка». Фактически это превращает поиск по почте из ручной фильтрации в диалог с помощником.
Docs Live: соавтор, который слушает, а не печатает
Вторая функция превращает Google Docs в голосового помощника при написании текстов. Docs Live структурирует спонтанную речь — даже хаотичный «поток сознания» — в черновой документ: сама выстраивает логику изложения, подбирает тон и, с разрешения пользователя, подтягивает факты из Gmail, Google Drive, Chat и открытого интернета. Идея заключается в том, чтобы первый черновой вариант появлялся быстрее, чем человек успел бы его напечатать.
Keep Live: заметки с голосового «бренд-дампа»
Третья новинка касается Google Keep — приложения для быстрых заметок. Keep Live позволяет озвучить любой поток мыслей, а система в фоновом режиме преобразует его в структурированные списки и конкретные задачи — без нажатия клавиш.
Технологическая основа: Gemini Audio и версия 3.5
В основе всех трех функций — аудиомодели Gemini, которые, по описанию самой компании, делают больше, чем просто преобразуют речь в текст: они интерпретируют намерение пользователя и самостоятельно извлекают нужные данные. Некоторые уточняют, что речь идет о модели Gemini 3.5 Live — именно это название указано на стартовой странице. По оценке исследователей рынка, главная задача теперь заключается не в том, распознает ли система голос, а в том, насколько точно она находит нужную информацию и сохраняет исходный смысл сказанного.
Обозреватели Digital Trends обращают внимание: раньше голосовой ввод в Google сводился к банальной диктовке текста, который потом приходилось исправлять вручную. Live-функции выводят процесс на принципиально другой уровень: система ведет диалог, понимает контекст и самостоятельно выполняет рутинную работу по организации информации. Таким образом, Google продвигает Workspace к модели, в которой взаимодействие с приложениями напоминает разговор с помощником, а не работу с программным
интерфейсом.
Источник: Google

