Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

MiA-Signature : Approcher l'activation globale pour la compréhension du contexte long

Modèle de langage à diffusion latente continue































MiA-Signature : Approcher l'activation globale pour la compréhension du contexte long

Modèle de langage à diffusion latente continue






























Compétence 1 : Évolution unifiée des agents augmentés par compétences via l’apprentissage par renforcement
Au-delà de la similarité sémantique : repenser l’interrogation pour la recherche agentic via l’interaction directe avec le corpus
MathNet : une évaluation multimodale mondiale pour le raisonnement mathématique et la récupération d’informations
D-OPSD : Auto-distillation sur politique pour le réglage continu des modèles de diffusion distillés par étapes
Rapport technique sur ZAYA1-8B
PhysForge : Génération d’actifs 3D ancrés dans la physique pour les mondes virtuels interactifs
HERMES++ : Vers un modèle unifié du monde de la conduite pour la compréhension et la génération de scènes 3D
OpenSearch-VL : Une recette ouverte pour des agents de recherche multimodale de pointe
Rapport technique RLDX-1
Stream-T1 : Mise à l'échelle au moment du test pour la génération de vidéos en streaming
Stream-R1 : Distillation de Récompense Aware Perplexité-Fiabilité pour la Génération de Vidéos en Flux
Uni-OPD : Unification de la distillation On-Policy avec une recette à double perspective
AGENTIC-IMODELS : Évolution des outils d'interprétabilité agents via l'auto-recherche
HEAVYSKILL : La réflexion profonde comme compétence interne dans le système de pilotage des agents
WindowsWorld : Une évaluation centrée sur le processus des agents autonomes d'interface graphique dans des environnements professionnels interapplications
Les hallucinations minent la confiance ; la métacognition est une voie à suivre
X2SAM : toute segmentation dans les images et vidéos
OpenSeeker-v2 : repousser les limites des agents de recherche avec des trajectoires informatives et de haute difficulté
PRISM : Pré-alignement par distillation on-policy en boîte noire pour l'apprentissage par renforcement multimodal
ARIS : Recherche autonome par collaboration multi-agents adversariale
ProgramBench : Les modèles de langage peuvent-ils reconstruire des programmes à partir de zéro ?
Calcul efficace et accéléré de la distance d'édition de graphe sur GPU
Évaluation de l'incertitude des signaux situationnels des médias sociaux pour la couverture d'actualité en situation de crise à l'aide de LLM
LST Canonique : Une solution de liquid staking native au protocole pour Tezos
Séparer l’intelligence de l’exécution : un moteur de flux de travail pour le Modèle Contextuel de Protocol
Comprendre le plateau de performance dans la récupération de vidéos à partir de texte : Une analyse empirique et linguistique complète
La mémoire visuelle persistante : Maintien de la perception pour la génération profonde dans les LVLMs
EnergAIzer : Un cadre d'estimation rapide et précise de la puissance GPU pour les charges de travail IA
Exploiter l'apprentissage par renforcement basé sur les vérificateurs dans l'édition d'images
Entraînement efficace sur plusieurs GPU grand public avec RoundPipe
Compétence 1 : Évolution unifiée des agents augmentés par compétences via l’apprentissage par renforcement
Au-delà de la similarité sémantique : repenser l’interrogation pour la recherche agentic via l’interaction directe avec le corpus
MathNet : une évaluation multimodale mondiale pour le raisonnement mathématique et la récupération d’informations
D-OPSD : Auto-distillation sur politique pour le réglage continu des modèles de diffusion distillés par étapes
Rapport technique sur ZAYA1-8B
PhysForge : Génération d’actifs 3D ancrés dans la physique pour les mondes virtuels interactifs
HERMES++ : Vers un modèle unifié du monde de la conduite pour la compréhension et la génération de scènes 3D
OpenSearch-VL : Une recette ouverte pour des agents de recherche multimodale de pointe
Rapport technique RLDX-1
Stream-T1 : Mise à l'échelle au moment du test pour la génération de vidéos en streaming
Stream-R1 : Distillation de Récompense Aware Perplexité-Fiabilité pour la Génération de Vidéos en Flux
Uni-OPD : Unification de la distillation On-Policy avec une recette à double perspective
AGENTIC-IMODELS : Évolution des outils d'interprétabilité agents via l'auto-recherche
HEAVYSKILL : La réflexion profonde comme compétence interne dans le système de pilotage des agents
WindowsWorld : Une évaluation centrée sur le processus des agents autonomes d'interface graphique dans des environnements professionnels interapplications
Les hallucinations minent la confiance ; la métacognition est une voie à suivre
X2SAM : toute segmentation dans les images et vidéos
OpenSeeker-v2 : repousser les limites des agents de recherche avec des trajectoires informatives et de haute difficulté
PRISM : Pré-alignement par distillation on-policy en boîte noire pour l'apprentissage par renforcement multimodal
ARIS : Recherche autonome par collaboration multi-agents adversariale
ProgramBench : Les modèles de langage peuvent-ils reconstruire des programmes à partir de zéro ?
Calcul efficace et accéléré de la distance d'édition de graphe sur GPU
Évaluation de l'incertitude des signaux situationnels des médias sociaux pour la couverture d'actualité en situation de crise à l'aide de LLM
LST Canonique : Une solution de liquid staking native au protocole pour Tezos
Séparer l’intelligence de l’exécution : un moteur de flux de travail pour le Modèle Contextuel de Protocol
Comprendre le plateau de performance dans la récupération de vidéos à partir de texte : Une analyse empirique et linguistique complète
La mémoire visuelle persistante : Maintien de la perception pour la génération profonde dans les LVLMs
EnergAIzer : Un cadre d'estimation rapide et précise de la puissance GPU pour les charges de travail IA
Exploiter l'apprentissage par renforcement basé sur les vérificateurs dans l'édition d'images
Entraînement efficace sur plusieurs GPU grand public avec RoundPipe