Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

Ordinateurs neuronaux

ASGuard : Activation-Scaling Guard pour atténuer les attaques de Targeted Jailbreaking































Ordinateurs neuronaux

ASGuard : Activation-Scaling Guard pour atténuer les attaques de Targeted Jailbreaking






























GlobalSplat : Un processus de 3D Gaussian Splatting efficient par Feed-Forward via des Global Scene Tokens
Comment fine-tuner un modèle de raisonnement ? Un cadre de coopération Teacher-Student pour synthétiser des données SFT cohérentes avec l'étudiant.
RAD-2 : Mise à l'échelle du Reinforcement Learning dans un framework Générateur-Discriminateur
DR3-Eval : Vers une évaluation réaliste et reproductible de la recherche approfondie (Deep Research).
HY-World 2.0 : Un Modèle de Monde Multi-Modal pour la Reconstruction, la Génération et la Simulation de Mondes 3D
pi0.7 : un modèle de fondation robotique généraliste et pilotable présentant des capacités émergentes
GTR : Le renforcement par la pensée guidée (Guided Thought Reinforcement) prévient l'effondrement de la pensée dans l'entraînement d'un Agent VLM basé sur le RL
Compétences des Agent pour les Large Language Models : Architecture, Acquisition, Sécurité et Perspectives d'Avenir
Théorie de l'espace : les Foundation Models peuvent-ils construire des croyances spatiales par l'exploration active ?
Apprentissage par transfert de mémoire : comment les mémoires sont transférées entre les domaines dans les Coding Agents
OccuBench : Évaluation des AI Agents sur des tâches professionnelles du monde réel via des Language World Models
SpatialEvo : Intelligence spatiale auto-évolutive via des environnements géométriques déterministes
RationalRewards : Utiliser les Reasoning Rewards pour mettre à l'échelle la génération visuelle au moment de l'entraînement et de l'inférence.
Seedance 2.0 : Faire progresser la génération de vidéo pour la complexité du monde.
GameWorld : Vers une évaluation standardisée et vérifiable des agents de jeux multimodaux
Pansharpening multi-échelle via ScaleFormer et le benchmark PanScale
ParseBench : un benchmark de parsing de documents pour les AI Agents
Agent d'Intelligence Mémoire
PROPELLA-1 : ANNOTATION DE DOCUMENTS MULTI-PROPRIÉTÉS POUR LA CURATION DE DONNÉES LLM À GRANDE ÉCHELLE
Raisonnement internalisé pour la compréhension de documents visuels à long contexte
TurboQuant : Vector Quantization en ligne avec un taux de distorsion quasi optimal
BERT-as-a-Judge : Une alternative robuste aux méthodes lexicales pour une évaluation efficace des LLM basée sur des références.
SPPO : PPO au niveau de la séquence pour les tâches de raisonnement à long horizon (Long-Horizon Reasoning)
Le test de Turing à l'écran : Un benchmark pour l'humanisation des Mobile GUI Agent.
Audio-Omni : Étendre la compréhension multi-modale vers la génération et l'édition audio polyvalentes
Repenser la Distillation On-Policy des Large Language Models : Phénoménologie, Mécanisme et Recette
KnowRL : Améliorer le raisonnement des LLM via l'apprentissage par renforcement avec un guidage de connaissances minimal-suffisant
Uni-ViGU : Vers une génération et une compréhension vidéo unifiées via un générateur vidéo basé sur la Diffusion.
ClawGUI : Un framework unifié pour le training, l'évaluation et le déploiement des GUI Agents.
Attention Sink dans les Transformers : une étude sur l'utilisation, l'interprétation et l'atténuation
GlobalSplat : Un processus de 3D Gaussian Splatting efficient par Feed-Forward via des Global Scene Tokens
Comment fine-tuner un modèle de raisonnement ? Un cadre de coopération Teacher-Student pour synthétiser des données SFT cohérentes avec l'étudiant.
RAD-2 : Mise à l'échelle du Reinforcement Learning dans un framework Générateur-Discriminateur
DR3-Eval : Vers une évaluation réaliste et reproductible de la recherche approfondie (Deep Research).
HY-World 2.0 : Un Modèle de Monde Multi-Modal pour la Reconstruction, la Génération et la Simulation de Mondes 3D
pi0.7 : un modèle de fondation robotique généraliste et pilotable présentant des capacités émergentes
GTR : Le renforcement par la pensée guidée (Guided Thought Reinforcement) prévient l'effondrement de la pensée dans l'entraînement d'un Agent VLM basé sur le RL
Compétences des Agent pour les Large Language Models : Architecture, Acquisition, Sécurité et Perspectives d'Avenir
Théorie de l'espace : les Foundation Models peuvent-ils construire des croyances spatiales par l'exploration active ?
Apprentissage par transfert de mémoire : comment les mémoires sont transférées entre les domaines dans les Coding Agents
OccuBench : Évaluation des AI Agents sur des tâches professionnelles du monde réel via des Language World Models
SpatialEvo : Intelligence spatiale auto-évolutive via des environnements géométriques déterministes
RationalRewards : Utiliser les Reasoning Rewards pour mettre à l'échelle la génération visuelle au moment de l'entraînement et de l'inférence.
Seedance 2.0 : Faire progresser la génération de vidéo pour la complexité du monde.
GameWorld : Vers une évaluation standardisée et vérifiable des agents de jeux multimodaux
Pansharpening multi-échelle via ScaleFormer et le benchmark PanScale
ParseBench : un benchmark de parsing de documents pour les AI Agents
Agent d'Intelligence Mémoire
PROPELLA-1 : ANNOTATION DE DOCUMENTS MULTI-PROPRIÉTÉS POUR LA CURATION DE DONNÉES LLM À GRANDE ÉCHELLE
Raisonnement internalisé pour la compréhension de documents visuels à long contexte
TurboQuant : Vector Quantization en ligne avec un taux de distorsion quasi optimal
BERT-as-a-Judge : Une alternative robuste aux méthodes lexicales pour une évaluation efficace des LLM basée sur des références.
SPPO : PPO au niveau de la séquence pour les tâches de raisonnement à long horizon (Long-Horizon Reasoning)
Le test de Turing à l'écran : Un benchmark pour l'humanisation des Mobile GUI Agent.
Audio-Omni : Étendre la compréhension multi-modale vers la génération et l'édition audio polyvalentes
Repenser la Distillation On-Policy des Large Language Models : Phénoménologie, Mécanisme et Recette
KnowRL : Améliorer le raisonnement des LLM via l'apprentissage par renforcement avec un guidage de connaissances minimal-suffisant
Uni-ViGU : Vers une génération et une compréhension vidéo unifiées via un générateur vidéo basé sur la Diffusion.
ClawGUI : Un framework unifié pour le training, l'évaluation et le déploiement des GUI Agents.
Attention Sink dans les Transformers : une étude sur l'utilisation, l'interprétation et l'atténuation