Google запустила Gemini Live у Gmail, Docs та Keep: тепер можна керувати голосом
/https%3A%2F%2Fs3.eu-central-1.amazonaws.com%2Fmedia.my.ua%2Ffeed%2F137%2F9c981a202d54091c15d149732772bb65.jpg)
Google офіційно запустила три голосові функції на базі аудіомоделей Gemini у сервісах Workspace — Gmail, Docs та Keep. Про це повідомила Юлі Квон Кім, віцепрезидентка Google Workspace з продукту. Компанія вперше показала цю технологію на конференції Google I/O ще навесні, а тепер довела її до релізу під спільною назвою Live.
Голосові функції розгортаються поетапно протягом цього тижня. Gmail Live та Keep Live отримають передплатники тарифів Google AI Plus, Pro та Ultra, а Docs Live — лише користувачі Pro та Ultra. Корпоративним клієнтам Google Workspace ці можливості обіцяють “незабаром”, але точних дат компанія поки не називає. Користувачам безкоштовних акаунтів Google доступ поки не передбачений — Live-функції прив’язані виключно до платних ШІ-передплат.
Gmail Live: інбокс, який відповідає на запитання
Замість того щоб вручну гортати десятки листів, користувач просто озвучує запит — і Gmail Live сканує поштову скриньку та формулює відповідь. У Google наводять приклади фраз на кшталт “який ворота виходу мого рейсу” або “що цього тижня відбувається в школі моєї дитини”. Фактично це перетворює пошук по пошті з ручного фільтрування на діалог з асистентом.
Docs Live: співавтор, що слухає, а не друкує
Друга функція перетворює Google Docs на голосового партнера з написання текстів. Docs Live структурує спонтанне мовлення — навіть хаотичний “потік свідомості” — у чорновий документ: сама вибудовує логіку викладу, підбирає тон і, за дозволом користувача, підтягує факти з Gmail, Google Drive, Chat та відкритого вебу. Ідея в тому, щоб перший чернетковий варіант з’являвся швидше, ніж людина встигла б його надрукувати.
Keep Live: нотатки з голосового “бренд-дампу”
Третя новинка стосується Google Keep — застосунку для швидких нотаток. Keep Live дозволяє наговорити довільний потік думок, а система у фоновому режимі перетворює його на структуровані списки та конкретні завдання — без жодного натискання клавіш.
Технологічна основа: Gemini Audio та версія 3.5
В основі всіх трьох функцій — аудіомоделі Gemini, які, за описом самої компанії, роблять більше, ніж просте перетворення мовлення на текст: вони інтерпретують намір користувача й самостійно витягують потрібні дані. Деякі уточнюють, що йдеться про модель Gemini 3.5 Live — саме ця назва фігурує на сторінці запуску. За оцінкою дослідників ринку, головний виклик тепер не в тому, чи розпізнає система голос, а в тому, наскільки точно вона знаходить потрібну інформацію та зберігає початковий сенс сказаного.
Оглядачі Digital Trends звертають увагу: раніше голосовий ввід у Google зводився до банальної диктовки тексту, який потім доводилося виправляти вручну. Live-функції виводять процес на принципово інший рівень: система веде діалог, розуміє контекст і сама виконує рутинну роботу з організації інформації. Google таким чином рухає Workspace до моделі, де взаємодія з застосунками нагадує розмову з асистентом, а не роботу з програмним інтерфейсом.
Джерело: Google