HyperAIHyperAI

Command Palette

Search for a command to run...

OpenAI
Agent
LLM

OpenAI lance l'API Décisions pour surveiller les agents IA

OpenAI a présenté en avant-première l’API Decisions lors du Dev Day 2026. Le directeur général Sam Altman a indiqué que les développeurs peuvent fournir un ensemble d’options prédéfinies au modèle Luna pour la classification d’images ou le choix de comportements d’agents différents ; étant donné que le modèle n’a qu’à se concentrer sur un nombre limité d’options, le système peut améliorer la vitesse de réponse tout en conservant les capacités de compréhension d’images, de multilinguisme et de sécurité. Cette conception est similaire à celle de Jev, récemment ouvert en accès anticipé par TypeSafe AI. Jev ne génère pas de texte libre, mais produit des résultats structurés, des probabilités et des niveaux de confiance pour des options prédéfinies. TypeSafe affirme que son modèle « System One » convient à la classification, au routage, à la notation et au branchement de flux de travail, avec une latence et un coût inférieurs à ceux des LLM traditionnels. Ce type de modèle pourrait également être utilisé pour surveiller les agents. La startup de cybersécurité QueryStory a présenté un prototype capable d’évaluer, action par action, si les opérations d’un agent sont conformes à la tâche définie, et de décider de les autoriser, de les bloquer ou de les soumettre à un examen humain en fonction du niveau de confiance. Les développeurs ont indiqué que le coût de surveillance d’une démonstration est passé de 372 dollars avec un LLM de pointe à 2,94 dollars avec Jev, mais ce résultat provient d’une expérience tierce et ne représente pas encore une performance générale. Actuellement, l’API Decisions reste en avant-première limitée, et sa précision, sa capacité de calibration des probabilités ainsi que ses différences réelles par rapport à Jev restent à vérifier.

Liens associés