Google met à jour Gemini pour macOS avec dictée vocale système et perception de l’écran
2026-07-31 09:37
Favoris

fr.wedoany.com Rapport : Google a mis à jour son application Gemini pour macOS, ajoutant des commandes de dictée vocale au niveau système et de perception de l’écran, permettant aux utilisateurs d’invoquer l’assistant IA à travers les applications sans quitter leur flux de travail actuel. En maintenant la touche Fn enfoncée, le mode vocal s’active, permettant aux utilisateurs de dicter dans presque tous les champs de texte. Google indique que, par rapport aux outils traditionnels de conversion voix-texte, Gemini est capable de supprimer automatiquement les mots de remplissage, de reconnaître les corrections vocales et de générer un texte plus clair. Cette fonctionnalité est actuellement déployée en anglais pour les utilisateurs mondiaux de Gemini sur macOS, avec la prise en charge d’autres langues à venir.

Cette mise à jour introduit également un mode de raisonnement avec perception de l’écran, optionnel, qui étend les capacités de Gemini au-delà de la simple dictée. Si les utilisateurs activent cette fonctionnalité, ils peuvent permettre à Gemini de comprendre le contenu sélectionné, les fichiers, les images et les documents affichés à l’écran de leur Mac. Les utilisateurs peuvent exécuter des tâches telles que la réécriture de texte, la synthèse d’informations ou la création directe de contenu dans l’application en cours d’utilisation, via des commandes vocales. Cette fonctionnalité vise à réduire les inconvénients liés au transfert d’informations entre applications, évitant aux utilisateurs de copier du texte dans un chatbot pour le modifier, puis de coller le résultat ; Gemini peut directement placer la sortie à l’endroit souhaité par l’utilisateur.

Cette mise à jour montre que Google pousse Gemini à passer d’un chatbot autonome à un assistant intégré aux flux de travail informatiques quotidiens, le rapprochant ainsi de la direction d’Apple Intelligence, où les fonctionnalités d’IA sont de plus en plus intégrées à l’écriture, à la productivité et aux opérations au niveau système. L’approche de Google repose sur des raccourcis clavier et des interactions vocales, offrant aux utilisateurs un moyen unifié d’invoquer l’aide de l’IA pendant leur travail. Les nouvelles fonctionnalités nécessitent l’autorisation d’accéder au contenu de l’écran, ce qui soulève des préoccupations en matière de confidentialité pour les utilisateurs traitant des informations sensibles ; les utilisateurs doivent vérifier les résumés et les contenus réécrits générés par l’IA avant de les utiliser pour des communications professionnelles ou avec des clients. Cette mise à jour s’inscrit dans la continuité des efforts de Google pour faire de Gemini un assistant de productivité intégré à l’expérience de bureau, plutôt qu’un chatbot autonome.

Ce texte est rédigé, traduit et republié à partir des informations de l'Internet mondial et de partenaires stratégiques, uniquement pour la communication entre lecteurs. En cas d'infraction au droit d'auteur ou d'autres problèmes, veuillez nous en informer à temps pour la modification ou la suppression. La reproduction de cet article est strictement interdite sans autorisation formelle. Mail : news@wedoany.com
Produits Associés