Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

ShotVerse : Faire progresser le contrôle cinématographique de la caméra pour la création de vidéos multi-plans pilotée par le texte

Modélisation de la récompense basée sur la vidéo pour les agents d'utilisation informatique































ShotVerse : Faire progresser le contrôle cinématographique de la caméra pour la création de vidéos multi-plans pilotée par le texte

Modélisation de la récompense basée sur la vidéo pour les agents d'utilisation informatique






























IndexCache : Accélération de l'attention éparses par réutilisation d'index inter-couches
Navigation stratégique ou recherche stochastique ? Comment les agents et les humains raisonnent sur des collections de documents
Spatial-TTT : Intelligence spatiale basée sur le flux visuel avec entraînement au moment du test
Les grands modèles de langage peuvent-ils suivre le rythme ? Évaluation de l'adaptation en ligne aux flux de connaissances continus
ReMix : Routage par renforcement pour les mélanges de LoRAs dans le fine-tuning de LLMs
Apprentissage par renforcement en contexte pour l'utilisation d'outils dans les LLM
MA-EgoQA : Réponses à des questions sur des vidéos égocentriques provenant de multiples agents incarnés
Flash-KMeans : K-Means exact rapide et économe en mémoire
OpenClaw-RL : Entraîner n'importe quel Agent simplement par la conversation
Mettre les VLM sur le terrain : évaluer l'intelligence spatiale dans le sport
InternVL-U : Démocratisation des modèles multimodaux unifiés pour la compréhension, le raisonnement, la génération et l'édition
MM-Zero : Modèles de vision-langage multi-modèles auto-évoluant à partir de zéro donnée
Penser pour Se Souvenir : Comment le Raisonnement Déverrouille les Connaissances Paramétriques dans les LLM
Omni-Diffusion : Compréhension et génération multimodales unifiées par diffusion discrète masquée
Apprentissage par renforcement guidé par la géométrie pour l'édition de scènes 3D cohérente multi-vues
CARE-Edit : Routage des experts sensible aux conditions pour l'édition contextuelle d'images
Fiez-vous à votre modèle : calibration de la confiance guidée par la distribution
LoGeR : Reconstruction géométrique à contexte long avec mémoire hybride
Dans quelle mesure l'apprentissage par renforcement non supervisé avec vérification des résultats (RLVR) peut-il mettre à l'échelle l'entraînement des LLM ?
Holi-Spatial : Faire évoluer les flux vidéo vers une intelligence spatiale 3D holistique
Perdu dans les récits : bugs de cohérence dans la génération de longs récits par les LLMs
DreamCAD : Mise à l'échelle de la génération CAO multimodale à l'aide de surfaces paramétriques différentiables
Économie des services d'IA en temps réel : un cadre pour le calcul agentic à travers le continuum
NOTAI.AI : Détection explicable des textes générés par machine via la courbure et l'attribution des caractéristiques
Traces de raisonnement plus sûres : mesurer et atténuer la fuite de Chain-of-Thought dans les LLMs
RACAS : Pilotage de robots diversifiés au moyen d'un système agentic unique
Biais en entrée, biais en sortie ? Identification de sous-réseaux non biaisés dans des modèles de base
ArtLLM : Génération d'assets articulés via un 3D LLM
Bonjour, je suis prêt à vous aider avec votre demande de traduction. Cependant, il semble y avoir une petite confusion dans votre consigne : vous avez demandé une traduction de l'anglais vers le chinois (en mentionnant des normes de journaux SCI/SSCI et en spécifiant de conserver certains termes techniques en anglais), mais vous avez également indiqué à la fin d'utiliser le français pour la réponse. Pour clarifier :
RoboPocket : Améliorez instantanément les politiques de robotique à l'aide de votre téléphone
IndexCache : Accélération de l'attention éparses par réutilisation d'index inter-couches
Navigation stratégique ou recherche stochastique ? Comment les agents et les humains raisonnent sur des collections de documents
Spatial-TTT : Intelligence spatiale basée sur le flux visuel avec entraînement au moment du test
Les grands modèles de langage peuvent-ils suivre le rythme ? Évaluation de l'adaptation en ligne aux flux de connaissances continus
ReMix : Routage par renforcement pour les mélanges de LoRAs dans le fine-tuning de LLMs
Apprentissage par renforcement en contexte pour l'utilisation d'outils dans les LLM
MA-EgoQA : Réponses à des questions sur des vidéos égocentriques provenant de multiples agents incarnés
Flash-KMeans : K-Means exact rapide et économe en mémoire
OpenClaw-RL : Entraîner n'importe quel Agent simplement par la conversation
Mettre les VLM sur le terrain : évaluer l'intelligence spatiale dans le sport
InternVL-U : Démocratisation des modèles multimodaux unifiés pour la compréhension, le raisonnement, la génération et l'édition
MM-Zero : Modèles de vision-langage multi-modèles auto-évoluant à partir de zéro donnée
Penser pour Se Souvenir : Comment le Raisonnement Déverrouille les Connaissances Paramétriques dans les LLM
Omni-Diffusion : Compréhension et génération multimodales unifiées par diffusion discrète masquée
Apprentissage par renforcement guidé par la géométrie pour l'édition de scènes 3D cohérente multi-vues
CARE-Edit : Routage des experts sensible aux conditions pour l'édition contextuelle d'images
Fiez-vous à votre modèle : calibration de la confiance guidée par la distribution
LoGeR : Reconstruction géométrique à contexte long avec mémoire hybride
Dans quelle mesure l'apprentissage par renforcement non supervisé avec vérification des résultats (RLVR) peut-il mettre à l'échelle l'entraînement des LLM ?
Holi-Spatial : Faire évoluer les flux vidéo vers une intelligence spatiale 3D holistique
Perdu dans les récits : bugs de cohérence dans la génération de longs récits par les LLMs
DreamCAD : Mise à l'échelle de la génération CAO multimodale à l'aide de surfaces paramétriques différentiables
Économie des services d'IA en temps réel : un cadre pour le calcul agentic à travers le continuum
NOTAI.AI : Détection explicable des textes générés par machine via la courbure et l'attribution des caractéristiques
Traces de raisonnement plus sûres : mesurer et atténuer la fuite de Chain-of-Thought dans les LLMs
RACAS : Pilotage de robots diversifiés au moyen d'un système agentic unique
Biais en entrée, biais en sortie ? Identification de sous-réseaux non biaisés dans des modèles de base
ArtLLM : Génération d'assets articulés via un 3D LLM
Bonjour, je suis prêt à vous aider avec votre demande de traduction. Cependant, il semble y avoir une petite confusion dans votre consigne : vous avez demandé une traduction de l'anglais vers le chinois (en mentionnant des normes de journaux SCI/SSCI et en spécifiant de conserver certains termes techniques en anglais), mais vous avez également indiqué à la fin d'utiliser le français pour la réponse. Pour clarifier :
RoboPocket : Améliorez instantanément les politiques de robotique à l'aide de votre téléphone