На ежегодной конференции Google I/O технологический гигант представил масштабное обновление для своей офисной экосистемы. В приложениях Google Документы, Keep и Gmail появятся функции на основе голосовых команд, которые позволят пользователям создавать черновики, систематизировать заметки и находить важную информацию в переписке без использования клавиатуры.
Интеллектуальное создание документов
В Google Документах теперь можно формировать полноценные текстовые файлы с помощью голоса. Система способна собирать данные из различных источников в рамках экосистемы пользователя. Например, в ходе демонстрации алгоритм извлек информацию из резюме, хранящегося на Google Диске, объединил её с деталями мероприятия из электронной почты и дополнил текст комментариями.
В отличие от обычного набора текста, голосовой интерфейс поддерживает длинные и сложные инструкции. Искусственный интеллект понимает контекст и способен обрабатывать несколько задач одновременно. Ключевой особенностью стала гибкость системы: если пользователь передумает или захочет изменить деталь прямо в процессе диктовки, алгоритм распознает корректировку и мгновенно внесет правку в итоговый результат.
Автоматизация заметок и поиск в Gmail
Обновление для сервиса Google Keep позволяет превращать поток мыслей в структурированные записи. Пользователь может надиктовать идеи в свободном стиле, а приложение самостоятельно преобразует аудиозапись в логически выстроенный список или заметку. Ранее подобные функции предлагали только специализированные сторонние сервисы, однако Google встраивает этот функционал на уровне всей системы через виртуальную клавиатуру Gboard и продукт Rambler.
В почтовом сервисе Gmail голосовое управление обеспечивается через взаимодействие с Gemini — мультимодальным помощником на базе искусственного интеллекта. С его помощью можно быстро находить специфические данные в архивах сообщений:
- Информация о деталях ближайшего авиарейса.
- Коды доступа к забронированному жилью.
- Время записи на прием к врачу.
Тренды взаимодействия с технологиями
По мнению экспертов, массовое внедрение ИИ меняет привычки пользователей: запросы становятся более длинными и детализированными. Голосовой ввод признается наиболее удобным методом для передачи сложных многоступенчатых инструкций, которые было бы долго вводить вручную. Современные языковые модели достигли уровня, когда они способны безошибочно распознавать естественную речь со всеми её нюансами и сменой намерений говорящего, что делает голосовой интерфейс полноценным инструментом для продуктивной работы.