Search for a command to run...
GST-Bench : les modèles vision-langage peuvent-ils acquérir une conscience spatiale globale à partir de vidéos ?