À retenir : – SceneScout aide les personnes malvoyantes grâce à l’intelligence artificielle. – Le système fournit des descriptions interactives des images de rue. – Deux modes d’interaction : aperçu d’itinéraire et exploration virtuelle. – Les utilisateurs peuvent anticiper ce qu’ils rencontreront lors de leurs déplacements. – Des améliorations sont nécessaires pour optimiser la précision et le langage.
Apple, en collaboration avec l’université de Columbia, a récemment présenté SceneScout, un prototype innovant qui pourrait changer la manière dont les personnes aveugles et malvoyantes se déplacent dans leur environnement. Cette solution tire parti de l’intelligence artificielle pour fournir des descriptions interactives des images de rues, offrant ainsi une aide précieuse avant même d’entreprendre un trajet.
Un besoin crucial en matière d’accessibilité demeure encore trop souvent négligé. Les personnes malvoyantes hésitent fréquemment à voyager seules dans des lieux qu’elles ne connaissent pas, principalement en raison de l’incertitude concernant ce qu’elles vont rencontrer sur leur chemin. La majorité des outils disponibles se concentrent sur la navigation en temps réel et le peu qui existe pour accompagner les utilisateurs avant le voyage se limite habituellement aux points de repère et à des instructions détaillées. En revanche, les images de rue, qui pourraient fournir une mine d’informations sur l’environnement, sont largement inaccessibles aux personnes concernées. C’est précisément ce que SceneScout vise à corriger.
Ce système novateur allie les API d’Apple Plans à un modèle linguistique multimodal avancé. Grâce à cette combinaison, il est capable d’offrir des descriptions personnalisées et interactives basées sur les clichés de rue. Plutôt que simplement donner des directions ou indiquer quelques repères visuels, les utilisateurs peuvent découvrir intégralement un itinéraire ou explorer virtuellement un quartier bloc après bloc. Les informations fournies sont adaptées aux besoins spécifiques de chaque utilisateur.
SceneScout inclut deux modes principaux :
1. **Aperçu dit itinéraire** : Ce mode permet aux utilisateurs d’anticiper ce qu’ils pourront rencontrer tout au long d’un parcours particulier. Le système décrit divers aspects tels que la qualité des trottoirs, la configuration des intersections ou l’apparence des arrêts de bus.
2. **Exploration virtuelle** : Avec cette fonction plus interactive, les utilisateurs peuvent exprimer ce qu’ils recherchent – par exemple un quartier calme proche de parcs – et l’IA guide ensuite leur navigation dans toutes les directions selon ces indications.
Derrière cette technologie sophistiquée se cache une application reposant sur GPT-4o qui s’appuie sur des données cartographiques réelles ainsi que sur des images panoramiques issues d’Apple Plans. Elle simule la perspective d’un piéton tout en traitant ce qui est visible pour produire du texte structuré sous forme concise ou élaborée selon les besoins.
Une étude menée auprès de dix utilisateurs aveugles ou malvoyants ayant déjà utilisé des lecteurs d’écran a démontré que ceux-ci ont grandement apprécié leur expérience avec le dispositif tant au niveau utilitaire qu’en pertinence ; le mode exploration a été particulièrement valorisé car il offre accès à des informations difficiles à obtenir autrement.
Cependant, certaines limites demeurent malgré ces retours positifs. Environ 72 % seulement des descriptions étaient jugées précises ; certaines comprenaient effectivement quelques erreurs subtiles comme affirmer qu’un passage piéton était équipé de signaux audio inexistants ou confondre certains panneaux signalétiques. Bien que beaucoup d’informations soient stables temporellement parlant, quelques descriptions renvoyaient vers du contenu dépassé tel que travaux éventuels ou véhicules stationnés non présents au moment du test.
Les participants ont également noté que le système faisait parfois preuve de suppositions quant aux capacités physiques souhaitées par l’utilisateur et son environnement immédiat – soulignant ainsi la nécessité pour une approche langagière plus objective afin d’améliorer la précision navigatrice jusqu’à destination finale.
Bien qu’il ne s’agisse pas encore d’un produit commercialisé courant mais plutôt une phase exploratoire intégrant langage multimodal avec Apple Plans API , SceneScout pourrait potentiellement évoluer vers davantage grâce notamment aux retours favorables reçus lors du développement initial sur ses applications potentielles permettant éventuellement aussi diffusée à travers écouteurs particuliers lorsqu’on marche au quotidien .
Comme évoqué par certains participants : « Pourquoi ne pas intégrer directement cette capacité afin offrir davantage détails justement pendant déplacements ? » Ils suggèrent également déployer infos succinctes complémentaires lors marches courtes mais critiques tandis qu’en cas besoin accru s’arrêterait pour avoir compléments descriptifs approfondis autour bifurcations principales rencontrés . Une autre idée innovante consisterait faire pointer appareil vers direction souhaiter directement afin recevoir rapidité retour contextuel sans nécessité aligne caméra façon précise ! Cela ouvrirait voie dynamique assurément enrichissante faciliter intelligent usagers interagir activement lieu naviguer même instantanément rendant parcours spécialement réactif plus immersif
Grand maitre Goa'uld des dessins animés, j'ai beaucoup aidé sur l'ancienne version du site de 2002 et je reviens filer un coup de main quand j'ai du temps.
11 commentaires sur “Apple crée une ia pour aider les malvoyants à naviguer”
L’idée est séduisante, mais il faut vraiment régler les problèmes de précision avant de lancer ça sur le marché. J’espère qu’ils vont bosser là-dessus!
Vous voulez dire qu’il y a encore des trous dans leur technologie ? Comme si c’était pas évident qu’on doit perfectionner tout ça avant d’y mettre une étiquette ‘fini
Franchement, je ne comprends pas pourquoi on investit autant dans des gadgets inutiles. Les gens devraient plutôt apprendre à se débrouiller sans ces trucs
L’idée est séduisante, mais il faut vraiment régler les problèmes de précision avant de lancer ça sur le marché. J’espère qu’ils vont bosser là-dessus!
Je suis sûr que ce système va juste créer encore plus de confusion… Qui sait si un piéton risque pas de lire une description qui n’a rien à voir!
Honnêtement, qui a besoin d’une IA pour guider les gens ? On devrait privilégier le bon vieux sens commun au lieu de dépendre toujours du numérique
Vous voulez dire qu’il y a encore des trous dans leur technologie ? Comme si c’était pas évident qu’on doit perfectionner tout ça avant d’y mettre une étiquette ‘fini
C’est super marrant quand même, Apple nous fait croire qu’ils vont sauver le monde alors qu’ils essaient juste de vendre plus de produits!
Mais wow, on dirait que ce truc a du potentiel! Ça pourrait vachement aider les gens à mieux s’orienter dans la ville
La navigation devient enfin accessible pour tous! En tant que personne malvoyante, je ne pouvais espérer mieux
Franchement, je ne comprends pas pourquoi on investit autant dans des gadgets inutiles. Les gens devraient plutôt apprendre à se débrouiller sans ces trucs
Je trouve ça trop cool! Imaginez-vous vous balader sans craindre de tomber sur quelque chose ! Bravo à Apple et Columbia !
Sérieusement? Vous croyez que vous allez faire marcher des aveugles avec vos histoires d’IA? C’est complètement fou! N’importe quoi
C’est génial d’avoir un outil comme ça pour aider les malvoyants! Je suis vraiment impressionné par cette avancée technologique!