Une question à voix haute, une photo, une carte : pendant mes vacances, l’IA m’a aidé à comprendre plusieurs situations ordinaires. Avec des appareils capables de recevoir plus directement ce que nous voyons et faisons, ces petits usages pourraient devenir une autre façon d’accéder à l’information.

Dans la voiture de location, Waze nous cassait les oreilles.

J’avais cherché dans l’application, baissé le volume de mon iPhone, essayé celui de la voiture. Impossible de trouver comment régler cette voix qui passait par CarPlay. J’ai donc expliqué le problème à mon IA.

Elle m’a indiqué qu’il fallait baisser le volume au moment précis où Waze parlait. À l’annonce suivante, j’ai essayé. Ça a parfaitement fonctionné, sans modifier celui de la musique.

Cet été, je lui ai posé plusieurs questions de cet ordre. Comment utiliser la machine à café de l’appartement ? Quels étaient les sommets devant nous ? Comment retrouver, sur une carte IGN pleine de sentiers, le parcours sommairement dessiné par l’office du tourisme ?

Aucun de ces usages n’était spectaculaire. Ils donnent pourtant une idée assez concrète de ce que nous pourrions attendre des prochains appareils conçus autour de l’IA.

L’information était là. Il fallait réussir à s’en servir.

Pour la machine à café, une photo de la façade a suffi. L’IA m’a expliqué les commandes, les réglages de longueur et d’intensité. J’ai pu faire mon café directement.

Face aux montagnes, j’ai envoyé des photos du panorama et une capture de la boussole de mon iPhone. Elle m’a donné les noms des sommets et des villages de gauche à droite. Je les ai vérifiés sur IGN : ils étaient bien indiqués, mais la carte était tellement chargée que leur correspondance avec le paysage n’était pas immédiatement lisible.

Pour la randonnée, j’avais préparé un tracé selon ce qui me semblait juste. En comparant la carte papier de l’office du tourisme et mes captures d’IGN, l’IA m’a indiqué quelques corrections : à certains endroits, prendre le sentier d’à côté. Sur place, j’ai pu vérifier qu’elles étaient bonnes. Le suivi GPS restait indispensable, notamment là où le chemin avait presque disparu.

Dans ces situations, l’assistant m’a aidé à franchir une petite distance entre une information disponible et son utilisation. Celle qui sépare les symboles d’une machine du bouton sur lequel appuyer, ou les noms sur une carte des montagnes que l’on regarde.

Une même question, moins de contexte à fournir

Je parle toujours à mon IA. C’est devenu une habitude, que j’avais racontée dans « À qui tu parles ? ». Pendant ces vacances, j’ajoutais simplement les images nécessaires à mes questions.

Cela ne m’a pas paru fastidieux. J’aurais peut-être même pu montrer certaines choses en direct plutôt que prendre des photos. Mais cette manière de faire laisse entrevoir une évolution.

Devant la machine à café, je dois encore choisir ce que je photographie. Face au paysage, je pense à transmettre une orientation. Pour la randonnée, je rassemble les deux cartes et mon tracé. Je prépare moi-même les éléments qui permettront à l’assistant de comprendre.

Des appareils adaptés pourraient prendre en charge une partie de cette préparation. Une caméra fournirait la scène, un capteur l’orientation, la localisation préciserait où je suis. Ma question resterait aussi simple : « C’est quoi, ce sommet ? »

Dans mes usages de vacances, une grande partie de l’aide venait du rapprochement entre une information et une situation. Des capteurs mieux intégrés pourraient rendre ce rapprochement plus immédiat, en réduisant le contexte que je dois transmettre moi-même.

C’est une autre étape de ce que j’explorais dans « Do you speak IA ? ». La conversation apporte déjà beaucoup de contexte. Demain, une partie pourrait aussi venir de l’environnement dans lequel elle a lieu.

Ce que Meta et Android XR commencent à rendre possible

Les premières briques existent déjà.

Dans sa présentation du 19 mai 2026, Google décrit des lunettes associant Android XR et Gemini, avec une assistance audio et des modèles avec affichage. Parmi les usages annoncés : poser des questions sur ce que l’on voit et recevoir des indications de navigation tenant compte de sa position et de son orientation.

Ces fonctions font directement écho à mes photos de montagne et à ma capture de boussole. Les éléments que j’avais assemblés manuellement pourraient être réunis par le dispositif.

Meta explore aussi d’autres moyens d’interagir. Les Meta Ray-Ban Display, présentées en septembre 2025, associent un affichage dans les lunettes à un bracelet EMG. Celui-ci transforme les signaux électriques liés à l’activité musculaire en commandes, à partir notamment de petits mouvements des doigts.

Cela permet d’imaginer une interaction répartie entre plusieurs équipements : parler pour demander, recevoir une réponse dans l’oreille, consulter une indication visuelle, confirmer d’un geste.

Les fabricants documentent ici leurs produits et leurs annonces. Les scènes futures que j’en tire sont des hypothèses d’usage.

Comprendre ce qui se passe pendant que nous agissons

Avec des appareils plus appropriés, l’assistant pourrait aussi suivre l’évolution d’une situation.

Devant une machine inconnue, il pourrait accompagner les étapes plutôt que donner toute l’explication d’un coup. Je montre une commande, je pose une question, je fais un geste, puis je demande la suite.

En randonnée, il pourrait rapprocher le parcours préparé de ma progression et m’avertir avant une bifurcation. Dans mon expérience, certaines portions du sentier étaient presque invisibles. Une indication donnée au bon moment aurait pu compléter utilement la carte.

Pour y parvenir, plusieurs difficultés restent à résoudre. Un appareil peut filmer plusieurs boutons sans savoir lequel je désigne. Il peut connaître ma position sans connaître mon intention. Et s’il répond après que j’ai dépassé l’intersection, son explication arrive trop tard.

Les progrès devront donc concerner à la fois la compréhension, le temps de réponse et la coordination entre les capteurs, les applications et les services.

Le système d’exploitation joue ici un rôle concret. Android XR prévoit par exemple des autorisations propres à la caméra et au microphone des lunettes, même lorsqu’une application possède déjà les permissions correspondantes sur le téléphone. L’accès au contexte doit être organisé, appareil par appareil.

Il faudra également régler la place que l’assistant prend dans l’expérience. Je pourrais apprécier qu’il me signale spontanément un écart de parcours. Mais si je lui demande d’arrêter ses interventions, j’attends qu’il arrête. Cette capacité à suivre mes instructions compte autant que son initiative.

Concevoir une aide qui arrive au bon moment

Pour les équipes qui conçoivent des produits et des services, ces scènes offrent des points de départ précis.

La question pourrait devenir : de quoi cette personne a-t-elle besoin pour continuer ce qu’elle est en train de faire ? Une phrase, un repère visuel, une confirmation ? Quelles informations faut-il réunir pour répondre correctement ? À quel moment l’intervention sera-t-elle utile ?

Ces choix se travaillent en passant de l’usage au prototype, puis aux tests sur le terrain. Il faudrait essayer l’explication devant la machine, la commande vocale dans le bruit de la voiture et l’indication à une bifurcation difficile à reconnaître. C’est là que l’on pourrait vérifier si l’assistance arrive assez vite, si elle est compréhensible et si elle aide réellement à poursuivre.

Mes demandes de vacances étaient simples et ont bien fonctionné. J’ai aussi conservé mes moyens de vérification : la carte, le GPS, ce que je constatais sur place.

Demain, devant le même paysage, je pourrais poser une question sur un sommet, demander ensuite quel village se trouve à son pied, puis où passe le sentier que nous avons prévu de suivre. L’assistant disposerait déjà de ma position, de l’orientation de l’appareil et du sujet de notre échange.

Je pourrais continuer à marcher et lui demander : « Et de l’autre côté, qu’est-ce qu’on voit ? » La conversation suivrait mon déplacement.

Sources

- Google — 19 mai 2026 : Intelligent eyewear is coming this fall. Android XR, Gemini et usages annoncés pour les lunettes.

- Meta — 17 septembre 2025, actualisé le 30 septembre : Meta Ray-Ban Display: AI Glasses With an EMG Wristband. Affichage et commandes musculaires.

- Android Developers — mise à jour le 22 septembre 2026 : Request hardware permissions for audio glasses and display glasses. Permissions d’accès aux capteurs.

Les scènes de vacances proviennent du témoignage de Philippe. Sources consultées le 9 octobre 2026.