Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

DuetGraph : Raisonnement dans les graphes de connaissances de manière grossière à fine avec une fusion globale-locale à double voie

CogDDN : Une Navigation Guidée par la Demande Cognitive avec Optimisation de la Décision et Pensée à Deux Processus































DuetGraph : Raisonnement dans les graphes de connaissances de manière grossière à fine avec une fusion globale-locale à double voie

CogDDN : Une Navigation Guidée par la Demande Cognitive avec Optimisation de la Décision et Pensée à Deux Processus






























LayerCake : Décodage contrastif sensible aux jetons au sein des couches de grands modèles linguistiques
Mélange-de-Récursions : Apprentissage de Profondeurs Récursives Dynamiques pour le Calcul Adaptatif au Niveau des Tokens
REST : Test de stress des grands modèles de raisonnement en posant plusieurs problèmes à la fois
EmbRACE-3K : Raisonnement et Action Corporels dans des Environnements Complexes
Raisonnement ou Mémorisation ? Résultats Non Fiables de l'Apprentissage par Renforcement En raison de la Contamination des Données
SpeakerVid-5M : Un grand ensemble de données de haute qualité pour la génération d'interactions dyadiques audiovisuelles humaines
VerifyBench : Un Benchmark Systématique pour Évaluer les Vérificateurs de Raisonnement dans Différents Domaines
Conditionnement et modélisation des chaînes latérales pour la conception de séquences protéiques à atomes complets avec FAMPNN
Un Jeton pour Tromper les LLM en tant que Juge
De l’un à plusieurs : Latents partiels contextuels pour la génération 3D
Open Vision Reasoner : Transfert du Comportement Cognitif Linguistique pour la Raisonnement Visuel
Lumos-1 : Sur la Génération Vidéo Autoregressive à Partir d'une Perspective de Modèle Unifié
Édition d'images pilotée par les neurones
CLiFT : Tokens de Champ Lumineux Compressés pour un Rendu Neuronal Économique en Calcul et Adaptatif
Modélisation et Optimisation des Systèmes de Systèmes : Un Cadre Intégré pour la Mobilité Intermodale
Transformateurs de diffusion à tous les atomes : Modélisation générative unifiée des molécules et des matériaux
OST-Bench : Évaluation des capacités des MLLMs dans la compréhension en ligne des scènes spatio-temporelles
Évaluation et Méthodologie du Raisonnement Visuel Ancré Basé sur des Preuves Traçables
MIRIX : Système de Mémoire Multi-Agents pour les Agents Basés sur les LLM
Rapport Technique Skywork-R1V3
T-LoRA : Personnalisation d'un modèle de diffusion à partir d'une seule image sans surapprentissage
Étendre l'RL aux Vidéos Longues
Critiques des Modèles du Monde
Est-ce que la diversité suffit pour une manipulation robotique à grande échelle ?
Nile-Chat : Modèles de langage égyptiens pour les scripts arabes et latins
GTA1 : Agent d'Échelle pour les Tests en Temps Réel de l'Interface Utilisateur
MedGen : Déverrouiller la Génération de Vidéos Médicales par le Scalage de Vidéos Médicales Annotées de Façon Granulaire
RLVER : Apprentissage par renforcement avec des récompenses émotionnelles vérifiables pour les agents empathiques
L'Expérience Géo-Centrique de l'Utilisateur : Un Cadre Propulsé par les MLL pour une Planification Améliorée, une Navigation Optimisée et une Adaptation Dynamique
PLAME : Utilisation des Modèles de Langue Préentraînés pour Générer des Alignements Multiples de Protéines Améliorés
LayerCake : Décodage contrastif sensible aux jetons au sein des couches de grands modèles linguistiques
Mélange-de-Récursions : Apprentissage de Profondeurs Récursives Dynamiques pour le Calcul Adaptatif au Niveau des Tokens
REST : Test de stress des grands modèles de raisonnement en posant plusieurs problèmes à la fois
EmbRACE-3K : Raisonnement et Action Corporels dans des Environnements Complexes
Raisonnement ou Mémorisation ? Résultats Non Fiables de l'Apprentissage par Renforcement En raison de la Contamination des Données
SpeakerVid-5M : Un grand ensemble de données de haute qualité pour la génération d'interactions dyadiques audiovisuelles humaines
VerifyBench : Un Benchmark Systématique pour Évaluer les Vérificateurs de Raisonnement dans Différents Domaines
Conditionnement et modélisation des chaînes latérales pour la conception de séquences protéiques à atomes complets avec FAMPNN
Un Jeton pour Tromper les LLM en tant que Juge
De l’un à plusieurs : Latents partiels contextuels pour la génération 3D
Open Vision Reasoner : Transfert du Comportement Cognitif Linguistique pour la Raisonnement Visuel
Lumos-1 : Sur la Génération Vidéo Autoregressive à Partir d'une Perspective de Modèle Unifié
Édition d'images pilotée par les neurones
CLiFT : Tokens de Champ Lumineux Compressés pour un Rendu Neuronal Économique en Calcul et Adaptatif
Modélisation et Optimisation des Systèmes de Systèmes : Un Cadre Intégré pour la Mobilité Intermodale
Transformateurs de diffusion à tous les atomes : Modélisation générative unifiée des molécules et des matériaux
OST-Bench : Évaluation des capacités des MLLMs dans la compréhension en ligne des scènes spatio-temporelles
Évaluation et Méthodologie du Raisonnement Visuel Ancré Basé sur des Preuves Traçables
MIRIX : Système de Mémoire Multi-Agents pour les Agents Basés sur les LLM
Rapport Technique Skywork-R1V3
T-LoRA : Personnalisation d'un modèle de diffusion à partir d'une seule image sans surapprentissage
Étendre l'RL aux Vidéos Longues
Critiques des Modèles du Monde
Est-ce que la diversité suffit pour une manipulation robotique à grande échelle ?
Nile-Chat : Modèles de langage égyptiens pour les scripts arabes et latins
GTA1 : Agent d'Échelle pour les Tests en Temps Réel de l'Interface Utilisateur
MedGen : Déverrouiller la Génération de Vidéos Médicales par le Scalage de Vidéos Médicales Annotées de Façon Granulaire
RLVER : Apprentissage par renforcement avec des récompenses émotionnelles vérifiables pour les agents empathiques
L'Expérience Géo-Centrique de l'Utilisateur : Un Cadre Propulsé par les MLL pour une Planification Améliorée, une Navigation Optimisée et une Adaptation Dynamique
PLAME : Utilisation des Modèles de Langue Préentraînés pour Générer des Alignements Multiples de Protéines Améliorés