HyperAIHyperAI

Command Palette

Search for a command to run...

Transformer l'environnement en écran virtuel pour la 3D

Une équipe de chercheurs de l'Université de l'Arizona a développé une nouvelle technologie de vision tridimensionnelle capable de surmonter un défi majeur : la détection précise des objets aux surfaces réfléchissantes au sein d'environnements complexes. Publiée dans Nature Communications, cette avancée vise à doter les machines d'une perception 3D supérieure à celle des êtres humains, une capacité cruciale pour les véhicules autonomes, la robotique chirurgicale et l'inspection industrielle. La difficulté fondamentale réside dans la nature du monde réel, qui combine des surfaces diffuses (mate) comme les murs ou les tissus et des surfaces spéculaires (réfléchissantes) comme le verre, le métal poli ou les liquides brillants. Les capteurs 3D traditionnels sont généralement optimisés pour l'un ou l'autre de ces types de surfaces et échouent dès qu'ils sont confrontés à un mélange des deux. Cela pose des problèmes critiques, par exemple pour une voiture autonome tentant de distinguer une vitre réfléchissante d'un mur sombre, ou pour un robot chirurgical naviguant entre des tissus mous et des instruments métalliques humides. Pour contourner ce problème, les chercheurs ont imaginé une approche novatrice consistant à transformer l'environnement entier en un grand écran virtuel. La méthode repose sur une extension de la déflexométrie, une technique existante qui mesure la forme des surfaces réfléchissantes en observant la déformation d'un motif projeté sur un écran. Traditionnellement, cette technique nécessite de grands écrans physiques ou des tunnels coûteux pour couvrir un large éventail d'orientations de surface. L'équipe de l'Université de l'Arizona, dirigée par le professeur Florian Willomitzer, a éliminé le besoin de ces équipements encombrants. Le système utilise un scanner laser pour capturer l'ensemble de la scène, incluant tous les objets à la fois mats et brillants. Des algorithmes avancés séparent ensuite les parties diffuses des parties spéculaires. Une fois séparées, les surfaces mates sont évaluées directement pour leur forme 3D, tandis que les surfaces réfléchissantes sont analysées en utilisant le signal de réflexion provenant des surfaces mates voisines. Ainsi, chaque surface diffuse mesurée agit comme un pixel d'un immense écran virtuel, permettant de mesurer avec précision les objets brillants qui y réfléchissent. L'innovation s'appuie également sur l'utilisation de caméras d'événements neuromorphiques, plutôt que de caméras conventionnelles. Contrairement à ces dernières qui capturent des images complètes à intervalles réguliers, les caméras d'événements n'enregistrent que les changements lumineux significatifs avec une résolution temporelle extrême. Cela permet de filmer en 3D des scènes contenant des objets en mouvement à très haut débit, tout en gérant des écarts lumineux colossaux, allant de l'obscurité totale à une brillance intense. Cette caractéristique garantit une mesure précise de toutes les surfaces, indépendamment de leur niveau de réflexion. Cette technologie a été démontrée avec succès dans un cadre de laboratoire à échelle réduite. Cependant, les chercheurs affirment qu'elle est hautement évolutible. Elle pourrait être adaptée pour mesurer des objets microscopiques comme de minuscules vaisseaux sanguins brillants lors d'opérations chirurgicales, ou pour numériser l'intégralité d'une pièce ou d'un bâtiment. Cette capacité à transformer n'importe quel environnement en écran de mesure virtuel marque un pas décisif vers la réalisation d'une vision 3D superhumaine pour les machines, ouvrant la voie à des applications plus fiables et précises dans des domaines exigeants.

Liens associés