Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

AOrchestra : Automatisation de la création de sous-agents pour l'orchestration agente

Pas de plan global dans la chaîne de raisonnement : mettre au jour l’horizon planifié latent des LLM































AOrchestra : Automatisation de la création de sous-agents pour l'orchestration agente

Pas de plan global dans la chaîne de raisonnement : mettre au jour l’horizon planifié latent des LLM






























CodeOCR : Sur l'efficacité des modèles vision-langage dans la compréhension du code
DeepPlanning : Évaluation de la planification agente à horizon long avec des contraintes vérifiables
CL-bench : un benchmark pour l'apprentissage du contexte
Apprentissage par renforcement par auto-distillation
Les chatbots comme compagnons sociaux : comment les individus perçoivent la conscience, la ressemblance humaine et les bénéfices pour la santé sociale dans les machines
POPE : Apprendre à raisonner sur des problèmes difficiles grâce à une exploration sur politique privilégiée
UniReason 1.0 : Un cadre de raisonnement unifié pour la génération et la modification d’images alignées avec les connaissances mondiales
Fermer la boucle : Représentation universelle du dépôt avec RPG-Encoder
Vision-DeepResearch Benchmark : Repenser la recherche visuelle et textuelle pour les grands modèles linguistiques multimodaux
Vision-DeepResearch : Inciter la capacité de DeepResearch dans les modèles linguistiques à grande échelle multimodaux
Kimi K2.5 : Intelligence agente visuelle
Green-VLA : Modèle vision-langage-action progressif pour des robots généralistes
PaperBanana : Automatisation de la réalisation d'illustrations académiques pour les scientifiques en intelligence artificielle
Découverte mathématique semi-autonome avec Gemini : une étude de cas sur les problèmes d'Erdős
Chaîne latente de pensée comme planification : désaccouplement du raisonnement de la verbalisation
Modèle de récompense aligné en temps réel au-delà de la sémantique
DenseGRPO : Du récompense épars à dense pour l’alignement des modèles de correspondance de flux
DreamActor-M2 : Animation universelle d'images de personnages par apprentissage in-context spatio-temporel
TTCS : Synthèse de programme d'apprentissage en temps de test pour l'évolution autonome
ASTRA : Synthèse automatisée de trajectoires agentic et d'arenas de renforcement
L'auto-distillation permet l'apprentissage continu
Vers une recherche en intelligence artificielle automatisée ancrée dans l'exécution
DynamicVLA : un modèle Vision-Langage-Action pour la manipulation d'objets dynamiques
MMFineReason : Réduire l'écart de raisonnement multimodal grâce à des méthodes centrées sur les données ouvertes
OCRVerse : Vers une reconnaissance optique de caractères holistique dans les modèles vision-langage end-to-end
L’agrandissement des embeddings dépasse l’agrandissement des experts dans les modèles linguistiques
Idea2Story : Une pipeline automatisée pour transformer des concepts de recherche en récits scientifiques complets
Tout à sa place : Évaluation de l'intelligence spatiale des modèles texte-à-image
Rapport technique Qwen3-ASR
Agents d'Insight : un système multi-agents basé sur un modèle de langage pour des analyses de données
CodeOCR : Sur l'efficacité des modèles vision-langage dans la compréhension du code
DeepPlanning : Évaluation de la planification agente à horizon long avec des contraintes vérifiables
CL-bench : un benchmark pour l'apprentissage du contexte
Apprentissage par renforcement par auto-distillation
Les chatbots comme compagnons sociaux : comment les individus perçoivent la conscience, la ressemblance humaine et les bénéfices pour la santé sociale dans les machines
POPE : Apprendre à raisonner sur des problèmes difficiles grâce à une exploration sur politique privilégiée
UniReason 1.0 : Un cadre de raisonnement unifié pour la génération et la modification d’images alignées avec les connaissances mondiales
Fermer la boucle : Représentation universelle du dépôt avec RPG-Encoder
Vision-DeepResearch Benchmark : Repenser la recherche visuelle et textuelle pour les grands modèles linguistiques multimodaux
Vision-DeepResearch : Inciter la capacité de DeepResearch dans les modèles linguistiques à grande échelle multimodaux
Kimi K2.5 : Intelligence agente visuelle
Green-VLA : Modèle vision-langage-action progressif pour des robots généralistes
PaperBanana : Automatisation de la réalisation d'illustrations académiques pour les scientifiques en intelligence artificielle
Découverte mathématique semi-autonome avec Gemini : une étude de cas sur les problèmes d'Erdős
Chaîne latente de pensée comme planification : désaccouplement du raisonnement de la verbalisation
Modèle de récompense aligné en temps réel au-delà de la sémantique
DenseGRPO : Du récompense épars à dense pour l’alignement des modèles de correspondance de flux
DreamActor-M2 : Animation universelle d'images de personnages par apprentissage in-context spatio-temporel
TTCS : Synthèse de programme d'apprentissage en temps de test pour l'évolution autonome
ASTRA : Synthèse automatisée de trajectoires agentic et d'arenas de renforcement
L'auto-distillation permet l'apprentissage continu
Vers une recherche en intelligence artificielle automatisée ancrée dans l'exécution
DynamicVLA : un modèle Vision-Langage-Action pour la manipulation d'objets dynamiques
MMFineReason : Réduire l'écart de raisonnement multimodal grâce à des méthodes centrées sur les données ouvertes
OCRVerse : Vers une reconnaissance optique de caractères holistique dans les modèles vision-langage end-to-end
L’agrandissement des embeddings dépasse l’agrandissement des experts dans les modèles linguistiques
Idea2Story : Une pipeline automatisée pour transformer des concepts de recherche en récits scientifiques complets
Tout à sa place : Évaluation de l'intelligence spatiale des modèles texte-à-image
Rapport technique Qwen3-ASR
Agents d'Insight : un système multi-agents basé sur un modèle de langage pour des analyses de données