Search for a command to run...
Les agents LLM peuvent-ils s'en tenir au scénario ? Un benchmark pour la cohérence à long terme dans les récits interactifs