Laya : moteur de décision IA open-source en 33 ms
Un nouveau modèle d'intelligence artificielle baptisé Laya a fait son apparition, proposant une approche radicalement différente des grands modèles génératifs actuels. Développé initialement en 2025, ce système est conçu pour exécuter des décisions structurées en quelques millisecondes sans générer de texte. Cette initiative s'inscrit dans un contexte de montée en puissance des architectures non auto-régressives, notamment après le lancement en septembre 2026 par le laboratoire TypeSafe AI de Jev, un moteur de décision propriétaire basé sur des principes similaires mais aux poids fermés et sans données d'entraînement ouvertes. Laya se présente comme un moteur de type Système 1, s'appuyant sur des encodeurs bidirectionnels modernes pour fournir des probabilités calibrées et instantanées. Au lieu de prédire des tokens séquentiellement, le réseau évalue l'état d'entrée en un seul passage et propose trois primitives fondamentales : le choix d'une option parmi un dictionnaire, l'attribution d'un score sur une échelle ordonnée, et une réponse booléenne directe. Ces sorties numériques éliminent le risque d'hallucination et les erreurs de formatage, tout en fournissant des scores de confiance mathématiquement justes, essentiels pour l'automatisation industrielle. Pour optimiser les performances, le projet regroupe trois checkpoints spécialisés dans un dépôt unique : un modèle pour l'anglais, un autre multilingue couvrant plus de cent langues, et un troisième dédié aux décisions structurées complexes. Un routeur intégré détecte en moins d'une milliseconde le script linguistique du texte entrant et oriente la requête vers le checkpoint approprié. Cette architecture permet de maintenir tous les modèles en mémoire pour éviter les latences de chargement, garantissant ainsi un traitement homogène et ultra-rapide. Les benchmarks publiés démontrent une avance significative par rapport aux solutions concurrentes. Sur des tâches de classification et de détection d'émotion, Laya affiche une précision supérieure et une erreur de calibration trois fois plus faible. La vitesse d'exécution atteint environ 32,8 millisecondes par requête, voire 7,2 millisecondes en mode groupé, le rendant jusqu'à vingt fois plus rapide que l'alternative Jev. Contrairement aux services facturés à la requête, Laya est entièrement open source sous licence Apache 2.0, permettant un déploiement local sans frais d'infrastructure supplémentaire. Les développeurs assument également les limites architecturales du système. La précision diminue lorsque le nombre d'options dépasse une vingtaine, en raison de la contrainte de dimensionnement de la couche de sortie. De plus, les performances optimales nécessitent un affinage sur des données métier, car le modèle de base fonctionne davantage comme une fondation que comme une solution universelle. Malgré ces contraintes, Laya confirme une tendance claire du secteur : pour les tâches de filtrage, de triage ou de routage à haut volume, des modèles rapides et déterministes offrent une efficacité supérieure aux grands réseaux génératifs, tout en garantissant une transparence totale pour la communauté technique.
