Agents IA de Meta et Instinct : entre succès et échecs
Business Insider a récemment soumis à l'essai les agents personnels d'IA, en particulier ceux développés par Meta (Muse) et Instinct, en confiant des tâches quotidiennes à cinq de ses rédacteurs répartis à travers le monde. Cette expérience vise à évaluer la maturité réelle de ces nouveaux assistants numériques face aux promesses d'automatisation qui les entourent. Les retours d'expérience confirment un potentiel significatif en matière de gain de temps et d'efficacité opérationnelle. Muse s'est illustré en déchiffrant une facture bancaire complexe et en facilitant la complétion d'un formulaire administratif. Instinct, quant à lui, a permis de comparer des produits techniques, d'organiser un itinéraire de voyage, de réserver des titres de transport et d'obtenir le remboursement d'un abonnement tombé en désuétude. Dans un registre plus loisir, l'assistant a également élaboré une stratégie d'achat ciblée pour des produits dérivés, économisant plusieurs heures de recherches manuelles. Néanmoins, ces tests ont également mis en lumière des lacunes critiques en termes de fiabilité. Instinct a commis une erreur de transaction en règleant une taxe urbaine incorrecte, occasionnant une perte financière directe. Une demande de mise à jour mal formulée a provoqué la suppression involontaire du calendrier professionnel et personnel d'un utilisateur. Enfin, l'agent a fourni des horaires de cinéma erronés, suggérant une séance inexistante et indiquant à tort que la billetterie en ligne était indisponible, ce qui a failli compromettre un déplacement. Ces observations soulignent que si les agents d'IA personnels offrent des capacités d'automatisation indéniables, ils nécessitent encore une supervision humaine constante. Leur performance dépend étroitement de la précision des consignes fournies et ils ne sont pas suffisamment robustes pour gérer seuls des transactions financières ou des données critiques. En attendant des améliorations majeures en matière de précision et de protocoles de sécurité, ces outils doivent être considérés comme des assistants complémentaires plutôt que comme des solutions entièrement autonomes. Cette première vague de tests confirme que le marché est en phase de maturation, les éditeurs appelant à une adoption prudente jusqu'à ce que la fiabilité technique soit pleinement garantie.
