Google додає в Gemini для macOS розумну диктовку та аналіз екрана

Оновлений застосунок Gemini для macOS отримав дві нові функції: інтелектуальну диктовку, що автоматично очищає текст від слів-паразитів, та аналіз вмісту екрана для виконання складних голосових команд. Це крок Google до глибшої інтеграції ШІ-асистента в операційну систему.
Компанія Google випустила оновлення для застосунку Gemini на macOS, яке додає можливість голосового керування. Ключова новинка — «розумна диктовка» (intelligent dictation), яка активується довгим натисканням клавіші Fn або через іконку Speak to Window. Користувачі можуть налаштувати власне поєднання клавіш та керувати голосом з будь-якого вікна, не перемикаючись у сам застосунок.
Функція працює за замовчуванням: усне мовлення перетворюється на чистий, відформатований текст, автоматично прибираючи слова-паразити на кшталт «еее» та «нуу». Система враховує виправлення «на льоту» посеред речення і одразу вставляє результат у місце курсора. Для тривалої диктовки передбачено подвійне натискання Fn.
Друга функція — «розумний аналіз екрана» (screen-aware reasoning) — не активна автоматично, її потрібно вмикати в налаштуваннях. Вона дозволяє Gemini аналізувати вміст відкритих вікон і виконувати складніші сценарії. Наприклад, виділивши локальні файли, зображення чи документи, можна голосом дати команду: «Прочитай ці файли від ветеринара і склади резюме історії хвороби собаки для листа в розплідник». Також можна миттєво переписати виділений текст, змінити тон командою «Перетвори ці нотатки на резюме керівника з коротким висновком на початку» або згенерувати нові зображення та редагувати наявні, наприклад: «Зроби на основі цієї ілюстрації версію в темному режимі».
Оновлення вже поширюється на всіх користувачів застосунку для macOS, але поки що лише англійською мовою. Інші мови Google обіцяє додати пізніше. Завантажити застосунок можна на сайті gemini.google/mac.
Це оновлення продовжує стратегію Google з інтеграції Gemini безпосередньо в операційну систему, а не лише в окремий чат-застосунок. Раніше компанія додала можливості аналізу вмісту екрана в Chrome через функцію Select from screen, яка дозволяє виділяти фрагменти сторінки й одразу відправляти їх у чат-бот. Також нещодавно Google представила спеціальну версію Gemini for Science для науковців.
Читайте також
Ще в розділі «Софт»
- МОЗ оновило Національний каталог цін на ліки: нові граничні рівні та іноземні препарати
- МОЗ оновило вимоги до фармаконагляду та звітності про безпеку ліків
- Apple Watch Series 12 і Ultra 4 не отримають редизайн у 2026 році
- Amazfit Active Max перевершує Pixel Watch 3 за зручністю інтерфейсу
- Google Play пускає сторонні магазини додатків — що зміниться


