Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

ReinFlow : Affinement de la politique d'ajustement de flux par apprentissage par renforcement en ligne

Évaluation vocale de la capacité de raisonnement : diagnostic de l'écart de performance induit par le mode































ReinFlow : Affinement de la politique d'ajustement de flux par apprentissage par renforcement en ligne

Évaluation vocale de la capacité de raisonnement : diagnostic de l'écart de performance induit par le mode






























MarsRL : Progresser vers un système de raisonnement multi-agents grâce à l'apprentissage par renforcement avec parallélisme de pipeline agencent
Réseaux à largeur virtuelle
AIonopedia : un agent LLM orchestrant l'apprentissage multimodal pour la découverte des liquides ioniques
UI2CodeextN : un Modèle de Langage Visuel pour la Génération Interactive de Code à Partir d'Interfaces Utilisateur Évolutif en Temps de Test
GGBench : Un benchmark de raisonnement génératif géométrique pour les modèles multimodaux unifiés
WEAVE : Libérer et évaluer la compréhension et la génération imbriquées dans le contexte
DoPE : Embedding de position rotatif avec débruitage
BRFL : un modèle d'apprentissage fédéré résistant aux attaques byzantines basé sur la blockchain
Modélisation de la distribution à plusieurs granularités pour la prédiction de la durée de visionnage vidéo via un réseau à mélange exponentiel-gaussien
SAC Flow : Apprentissage par renforcement efficace en échantillons de politiques basées sur les flux par modélisation séquentielle réparamétrée par vitesse
Attaques adversariales contre les MLLMs à source fermée par alignement optimal des caractéristiques
Hail to the Thief : Exploration des attaques et des défenses dans le GRPO décentralisé
Distillation en politique noire de grands modèles linguistiques
UniVA : Agent Vidéo Universel vers un Généraliste Vidéo de Prochaine Génération Open-Source
PAN : Un Modèle Mondial pour la Simulation Mondiale Générale, Interagissable et à Long Terme
Un petit pas dans l’espace latent, un grand bond pour les pixels : un adaptateur d’agrandissement latent rapide pour vos modèles de diffusion
YOLOv13 : Détection d'objets en temps réel avec une perception visuelle adaptative améliorée par hypergraphe
MonkeyOCR : Analyse de documents par un paradigme à triplet reconnaissance de structure-relation
Échantillonnage par consensus pour une intelligence artificielle générative plus sûre
Argus : Cadre d'assurance de la sécurité orienté vers la résilience pour les systèmes ADS bout-en-bout
WMPO : Optimisation de politique fondée sur un modèle mondial pour les modèles vision-langage-action
LoopTool : Clôture de la boucle données-formation pour des appels d'outils robustes des LLM
Au-delà de la récupération de faits : la mémoire épisodique pour RAG avec des espaces sémantiques génératifs
TiDAR : Pensez par diffusion, parlez par auto-régression
Time-to-Move : Génération de vidéos contrôlées par le mouvement sans entraînement via le débruitage à horloge double
Lumine : Une Recette Ouverte pour Construire des Agents Généralistes dans les Mondes Ouverts 3D
Générer une image à partir de 1 000 mots : améliorer la génération d'images à partir de textes grâce à des légendes structurées
KLASS : Inférence rapide guidée par KL dans les modèles de diffusion masqués
Fonder des agents d'utilisation des ordinateurs sur des démonstrations humaines
Wasm : Un pipeline pour la construction de corpus multimodaux arabe structurés et entrelacés
MarsRL : Progresser vers un système de raisonnement multi-agents grâce à l'apprentissage par renforcement avec parallélisme de pipeline agencent
Réseaux à largeur virtuelle
AIonopedia : un agent LLM orchestrant l'apprentissage multimodal pour la découverte des liquides ioniques
UI2CodeextN : un Modèle de Langage Visuel pour la Génération Interactive de Code à Partir d'Interfaces Utilisateur Évolutif en Temps de Test
GGBench : Un benchmark de raisonnement génératif géométrique pour les modèles multimodaux unifiés
WEAVE : Libérer et évaluer la compréhension et la génération imbriquées dans le contexte
DoPE : Embedding de position rotatif avec débruitage
BRFL : un modèle d'apprentissage fédéré résistant aux attaques byzantines basé sur la blockchain
Modélisation de la distribution à plusieurs granularités pour la prédiction de la durée de visionnage vidéo via un réseau à mélange exponentiel-gaussien
SAC Flow : Apprentissage par renforcement efficace en échantillons de politiques basées sur les flux par modélisation séquentielle réparamétrée par vitesse
Attaques adversariales contre les MLLMs à source fermée par alignement optimal des caractéristiques
Hail to the Thief : Exploration des attaques et des défenses dans le GRPO décentralisé
Distillation en politique noire de grands modèles linguistiques
UniVA : Agent Vidéo Universel vers un Généraliste Vidéo de Prochaine Génération Open-Source
PAN : Un Modèle Mondial pour la Simulation Mondiale Générale, Interagissable et à Long Terme
Un petit pas dans l’espace latent, un grand bond pour les pixels : un adaptateur d’agrandissement latent rapide pour vos modèles de diffusion
YOLOv13 : Détection d'objets en temps réel avec une perception visuelle adaptative améliorée par hypergraphe
MonkeyOCR : Analyse de documents par un paradigme à triplet reconnaissance de structure-relation
Échantillonnage par consensus pour une intelligence artificielle générative plus sûre
Argus : Cadre d'assurance de la sécurité orienté vers la résilience pour les systèmes ADS bout-en-bout
WMPO : Optimisation de politique fondée sur un modèle mondial pour les modèles vision-langage-action
LoopTool : Clôture de la boucle données-formation pour des appels d'outils robustes des LLM
Au-delà de la récupération de faits : la mémoire épisodique pour RAG avec des espaces sémantiques génératifs
TiDAR : Pensez par diffusion, parlez par auto-régression
Time-to-Move : Génération de vidéos contrôlées par le mouvement sans entraînement via le débruitage à horloge double
Lumine : Une Recette Ouverte pour Construire des Agents Généralistes dans les Mondes Ouverts 3D
Générer une image à partir de 1 000 mots : améliorer la génération d'images à partir de textes grâce à des légendes structurées
KLASS : Inférence rapide guidée par KL dans les modèles de diffusion masqués
Fonder des agents d'utilisation des ordinateurs sur des démonstrations humaines
Wasm : Un pipeline pour la construction de corpus multimodaux arabe structurés et entrelacés