Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA
articles

DeepPlanning : Évaluation de la planification agente à horizon long avec des contraintes vérifiables

CL-bench : un benchmark pour l'apprentissage du contexte






























Apprentissage par renforcement par auto-distillation
Les chatbots comme compagnons sociaux : comment les individus perçoivent la conscience, la ressemblance humaine et les bénéfices pour la santé sociale dans les machines
POPE : Apprendre à raisonner sur des problèmes difficiles grâce à une exploration sur politique privilégiée
UniReason 1.0 : Un cadre de raisonnement unifié pour la génération et la modification d’images alignées avec les connaissances mondiales
Fermer la boucle : Représentation universelle du dépôt avec RPG-Encoder
Vision-DeepResearch Benchmark : Repenser la recherche visuelle et textuelle pour les grands modèles linguistiques multimodaux
Vision-DeepResearch : Inciter la capacité de DeepResearch dans les modèles linguistiques à grande échelle multimodaux
Kimi K2.5 : Intelligence agente visuelle
Green-VLA : Modèle vision-langage-action progressif pour des robots généralistes
PaperBanana : Automatisation de la réalisation d'illustrations académiques pour les scientifiques en intelligence artificielle
Découverte mathématique semi-autonome avec Gemini : une étude de cas sur les problèmes d'Erdős
Chaîne latente de pensée comme planification : désaccouplement du raisonnement de la verbalisation
Modèle de récompense aligné en temps réel au-delà de la sémantique
DenseGRPO : Du récompense épars à dense pour l’alignement des modèles de correspondance de flux
DreamActor-M2 : Animation universelle d'images de personnages par apprentissage in-context spatio-temporel
TTCS : Synthèse de programme d'apprentissage en temps de test pour l'évolution autonome
ASTRA : Synthèse automatisée de trajectoires agentic et d'arenas de renforcement
L'auto-distillation permet l'apprentissage continu
Vers une recherche en intelligence artificielle automatisée ancrée dans l'exécution
DynamicVLA : un modèle Vision-Langage-Action pour la manipulation d'objets dynamiques
MMFineReason : Réduire l'écart de raisonnement multimodal grâce à des méthodes centrées sur les données ouvertes
OCRVerse : Vers une reconnaissance optique de caractères holistique dans les modèles vision-langage end-to-end
L’agrandissement des embeddings dépasse l’agrandissement des experts dans les modèles linguistiques
Idea2Story : Une pipeline automatisée pour transformer des concepts de recherche en récits scientifiques complets
Tout à sa place : Évaluation de l'intelligence spatiale des modèles texte-à-image
Rapport technique Qwen3-ASR
Agents d'Insight : un système multi-agents basé sur un modèle de langage pour des analyses de données
Vers une Perception VLM au Niveau de Pixél par Prédiction Simple de Points
Youtu-VL : Libérer le potentiel visuel grâce à une supervision unifiée vision-langage
Innovator-VL : un grand modèle linguistique multimodal pour la découverte scientifique