Déployée après un aperçu à l’I/O 2026, la version 1.88 de Gemini pour macOS ajoute deux fonctions vocales clés : dictée intelligente et commandes contextuelles à l’écran. Google promet une saisie plus fluide, capable aussi de résumer, réécrire ou retoucher du contenu à la voix.
Google déploie enfin la voix avancée dans Gemini sur Mac
Google active le déploiement des nouvelles fonctions vocales de Gemini pour macOS, après une première présentation à la Google I/O 2026. Le principe est simple sur le papier : parler dans n’importe quelle fenêtre du bureau, dicter du texte plus propre qu’une retranscription brute, puis aller plus loin avec des commandes vocales capables d’exploiter le contexte affiché à l’écran, selon Google. La nouveauté vise clairement la productivité desktop, pas seulement la conversation avec un assistant.
La fonction la plus concrète est une dictée dite intelligente. Google explique que Gemini nettoie la parole à la volée, supprime les hésitations du type “euh” ou “hum”, prend en compte les corrections faites en cours de phrase et insère un texte reformulé à l’emplacement exact du curseur. C’est une promesse plus ambitieuse qu’une simple transcription mot à mot : ici, l’outil cherche à restituer l’intention, pas chaque syllabe.
L’autre brique est plus sensible, mais aussi plus utile. En activant le raisonnement de Gemini dans les réglages de l’application, l’assistant peut comprendre le contenu de l’écran partagé pour exécuter des tâches complexes. Google cite trois familles d’usages : résumer des fichiers ou documents locaux, réécrire du texte sélectionné avec une consigne de ton ou de format, et générer ou modifier des images par commande vocale. Le tout se lance via un appui long sur la touche Fn ou via un bouton de partage d’écran dans la zone “Ask Gemini”, avec une pastille flottante affichée en bas de l’écran.
Ce que la source d’origine ne disait pas sur l’application macOS
Le point le plus utile à ajouter tient aux prérequis. Selon l’aide officielle de Google, l’application Gemini sur Mac exige macOS Sequoia 15.0 ou version ultérieure, une puce Apple Silicon, 8 Go de RAM minimum et 200 Mo d’espace disque disponible. Autrement dit, cette mise à jour vocale ne cible pas les anciens Mac Intel et ne s’adresse pas non plus aux configurations d’entrée de gamme trop limitées en mémoire. C’est une borne technique claire, absente du texte de départ.
Autre point concret : l’application desktop n’est pas un service premium isolé. Google indique que l’app Mac est disponible sans coût supplémentaire pour les utilisateurs de Gemini, tandis que ses abonnements Google AI Pro et Google AI Ultra servent surtout à relever les limites d’usage et à débloquer davantage de fonctions dans l’écosystème. Selon la page d’abonnement officielle, Google AI Pro est facturé 19,99 $ par mois, soit 18 € au taux de référence de la BCE du 27 juillet 2026 (1 € = 1,1389 $). Google AI Ultra démarre à 99,99 $ par mois, soit 88 € avec le même taux. Ces montants donnent un ordre d’idée du positionnement commercial autour de l’app, même si la fonction de base sur Mac reste annoncée comme gratuite selon Google.
Deux métriques dérivées permettent d’évaluer ce positionnement. Premièrement, la conversion du tarif Google AI Pro aboutit à 17,55 €, arrondis à 18 €. Deuxièmement, l’écart tarifaire facial avec ChatGPT Plus, lui aussi affiché à 20 $ par mois selon OpenAI, n’est que de -0,05 % en faveur de Google AI Pro. En clair, sur le prix seul, il n’y a quasiment pas de match : les deux offres se font face au centime près en dollars, et à l’euro près après conversion.
Une vraie différence face aux outils natifs de macOS
Mon avis est simple : la nouveauté de Google n’écrase pas macOS sur la transcription brute, mais elle se distingue sur l’édition contextuelle. Apple propose déjà plusieurs briques vocales sur Mac. La dictée système permet d’entrer du texte partout où l’on peut taper, selon l’assistance officielle d’Apple. Apple précise aussi que certaines saisies et transcriptions peuvent être traitées sur l’appareil, selon le type d’usage et les réglages activés. Sur les Mac Apple Silicon, Live Captions peut transcrire en temps réel l’audio du micro et celui de l’ordinateur. Enfin, l’app Dictaphone peut transcrire les enregistrements vocaux avec macOS 15 ou plus récent sur machine Apple Silicon.
Le problème d’Apple, c’est la fragmentation. La dictée sert à écrire. Live Captions sert à afficher du texte. Voice Control sert à piloter le Mac. Gemini, lui, tente de fusionner ces usages : écouter, reformuler, comprendre ce qui est affiché, puis agir dans le flux de travail. C’est plus ambitieux. Et c’est aussi plus intrusif, car cela suppose souvent un partage d’écran et une analyse de contexte que les outils natifs cloisonnent davantage.
Il existe aussi une différence de seuil matériel. Selon Google, Gemini pour Mac demande macOS 15 et 8 Go de RAM. Du côté d’OpenAI, l’application ChatGPT pour macOS demande macOS 14 et une puce Apple Silicon. La métrique dérivée la plus simple est donc un écart d’une version majeure de macOS en défaveur de Google. Pour les parcs installés en entreprise, ce détail compte : un Mac bloqué sur macOS 14 pourra lancer ChatGPT, mais pas l’app Gemini selon les fiches officielles.
Le vrai concurrent n’est pas Apple, c’est ChatGPT sur Mac
Le concurrent frontal de cette mise à jour, ce n’est pas la dictée native d’Apple. C’est l’application desktop de ChatGPT. OpenAI propose déjà sur macOS plusieurs fonctions qui recoupent une partie du terrain de Gemini : un raccourci global Option + Espace pour ouvrir l’interface, un outil de capture d’écran, le travail avec des apps ouvertes, et surtout ChatGPT Record, capable de transcrire et résumer des réunions ou notes vocales dans l’app Mac.
Selon OpenAI, ChatGPT Record est actuellement réservé aux espaces de travail Plus, Enterprise, Edu, Business et Pro, uniquement dans l’application macOS. L’outil peut générer une transcription et un résumé, puis les réutiliser pour créer un plan, un e-mail ou d’autres livrables. L’approche diffère donc de celle de Google. Gemini insiste sur la dictée propre directement au curseur et sur la manipulation contextuelle de ce qui est à l’écran. ChatGPT met davantage l’accent sur l’enregistrement structuré, le résumé de réunion et l’exploitation d’un transcript dans l’historique.
Sur le terrain, les deux visions ne répondent pas exactement au même besoin. Pour écrire un e-mail, reformuler un paragraphe ou résumer un PDF affiché à l’écran sans quitter sa fenêtre, Gemini semble mieux placé. Pour capter une réunion entière, produire un compte rendu, puis s’appuyer dessus dans des conversations ultérieures, ChatGPT Record garde un angle plus net. Je vois donc moins une guerre de la voix qu’une bataille du flux de travail : Google veut injecter l’IA dans le champ de saisie, OpenAI veut l’installer dans la mémoire de travail.
Cinq apports nouveaux à retenir
1. Des exigences matérielles et logicielles précises
Selon l’aide officielle de Google, Gemini pour Mac impose macOS 15, un Mac Apple Silicon, 8 Go de RAM et 200 Mo d’espace libre. La source d’origine parlait de la version 1.88 de l’app, mais ne détaillait pas les prérequis matériels.
2. Une disponibilité gratuite, mais insérée dans une gamme payante
Selon Google, l’application Mac est disponible sans surcoût pour les utilisateurs de Gemini. En parallèle, Google AI Pro coûte 19,99 $, soit 18 €, et Google AI Ultra commence à 99,99 $, soit 88 €, d’après les pages officielles de Google et le taux de la BCE.
3. Une comparaison prix quasi nulle avec ChatGPT Plus
Selon OpenAI, ChatGPT Plus est facturé 20 $ par mois, soit 18 € au même taux. L’écart de prix avec Google AI Pro est donc de seulement 0,01 $, soit -0,05 % pour Google. L’argument tarifaire ne départage pas les deux écosystèmes.
4. Une concurrence plus sévère sur la productivité que sur la simple transcription
Selon l’aide officielle d’OpenAI, ChatGPT sur macOS peut déjà prendre des captures d’écran, travailler avec des apps et utiliser la voix avec certains flux. Selon Apple, macOS dispose déjà de dictée, de contrôle vocal et de transcription temps réel. Google n’arrive donc pas sur un terrain vide. Sa différence tient à la fusion de ces fonctions dans une seule interface.
5. Une portée linguistique encore limitée au lancement
Le déploiement de la nouvelle voix sur Mac commence en anglais, avec d’autres langues annoncées “prochainement” par Google. Ce point reste stratégique pour le marché français : l’intérêt pratique existe dès aujourd’hui, mais l’adoption large dépendra de la qualité du français dans la dictée intelligente et la réécriture au curseur. À ce stade, la disponibilité précise en français n’est pas communiquée.
Pourquoi cette mise à jour compte pour les usages pro
Mon avis ici est tranché : la vraie valeur de cette mise à jour n’est pas vocale, elle est éditoriale. Dicter un texte propre dans Mail, Docs, un CMS ou un champ de ticketing sans récupérer les hésitations ni les faux départs, c’est déjà utile. Mais la bascule se fait quand l’outil lit un document local, résume un dossier, reformate des notes en synthèse exécutive ou retouche une image en langage naturel, sans ouvrir un navigateur.
Pour un rédacteur, un chef de produit ou un commercial, le cas d’usage est évident : sélectionner un bloc de notes, demander une synthèse avec un TL;DR, puis réinjecter le résultat au curseur. Pour un support client, on peut imaginer la dictée d’une réponse plus formelle à partir d’un brouillon parlé. Pour un indépendant, l’intérêt est aussi dans la réduction des changements de contexte. Selon Google, l’application Mac a précisément été pensée pour rester dans le flux de travail depuis n’importe quel écran.
Il reste toutefois une zone de vigilance : plus l’outil comprend l’écran, plus la question des permissions et des données remonte. La source d’origine mentionne bien un mode optionnel pour les tâches contextuelles et l’activation du raisonnement dans les réglages. C’est un bon garde-fou, mais ce n’est pas une réponse complète sur la gouvernance des données en entreprise. Sur ce point précis, si l’information manque, il faut écrire les choses clairement : non communiqué.
Ce que les utilisateurs Mac doivent surveiller maintenant
À court terme, trois critères feront la différence. D’abord, la qualité réelle de la dictée en français, encore non communiquée pour ce lancement. Ensuite, la rapidité de l’insertion au curseur dans les apps tierces, car une bonne voix devient vite pénible si l’intégration est instable. Enfin, la capacité de Google à clarifier la frontière entre transcription simple, réécriture assistée et analyse contextuelle de l’écran.
Sur le fond, Gemini sur Mac prend une direction logique : transformer la voix en interface de production, pas seulement en interface de dialogue. Apple garde des briques natives solides. OpenAI avance déjà sur la capture, le résumé et le travail avec les apps. Mais Google essaye ici quelque chose de plus direct : parler, corriger à la volée, faire comprendre le contexte, puis déposer le bon texte au bon endroit. Si l’exécution suit, cette couche peut devenir plus utile qu’un chatbot de bureau classique.
Pour télécharger l’application et vérifier sa disponibilité, la référence la plus directe reste la page officielle de Google : https://gemini.google/mac/.
Mon avis :
Sur macOS, Gemini marque des points avec une dictée réellement utile: il nettoie les hésitations, reformule à la volée et injecte le texte au curseur, ce qui accélère mails et notes. Ma réserve est nette: les fonctions avancées dépendent du contexte écran, du raisonnement activé et d’un déploiement encore partiel, donc fiabilité et disponibilité restent à prouver.





