Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA
articles

EdgeBench : Dévoiler les lois d'échelle de l'apprentissage à partir d'environnements réels

ASPIRE : Découverte agentique de compétences pour la robotique






























AUTOMEM : Apprentissage automatisé de la mémoire en tant que compétence cognitive
La loi du travail de décodage : jointures spatiales exactes et prouvables, régies par la marge, sur géométrie compressée
Tarification neuronale de certificats pour les problèmes d'optimisation combinatoire
Utilisation optimale des ressources pour les orchestrateurs de laboratoires autonomes
TERA : Un cadre unifié d'analyse d'atteignabilité fondé sur les modèles de Taylor
Perceive-to-Reason : Découpler la perception et le raisonnement pour le raisonnement visuel fin
Plans d'expériences basés sur des tries pour une évaluation efficace des pipelines de recherche d'information
Sur la non-linéarité de la loi d'échelle du taux d'apprentissage pour l'entraînement des LLM
Les scènes comme objets, non comme primitives : tokenisation 3D structurée par instances à partir de vues non recalées
BlockPilot : apprentissage de politique adaptative par instance pour le décodage spéculatif basé sur la diffusion
DOPD : Distillation double en politique
Dockerless : Vérificateur de programmes sans environnement pour agents de codage
Orca : Le monde est dans votre esprit
MegaTrain : Entraînement en pleine précision de grands modèles de langage de plus de 100 milliards de paramètres sur un seul GPU
Trouver le temps de réfléchir : apprentissage des budgets de planification en RL temps réel
À quoi ressemblent les courbes de taux d'apprentissage quasi optimales ?
Au-delà de l'IID : Dans quelle mesure les modèles tabulaires fondamentaux sont-ils vraiment généraux ?
ReFreeKV : Vers une compression de cache KV sans seuil
TUA-Bench : Un banc d'essai pour les agents généralistes en environnement terminal
Élargir l'horizon, pas les paramètres : atteindre des performances de niveau billion de paramètres avec un agent de 35B
LiveEdit : Vers l'édition vidéo en continu basée sur la diffusion en temps réel
Abstention agentique : les agents savent-ils quand s’arrêter au lieu d’agir ?
EVA-Bench : un nouveau cadre d'évaluation de bout en bout pour les agents vocaux
SingGuard : un garde-fou pour LLM multimodal, adaptatif aux politiques et avec raisonnement dynamique
Formalisation des pensées latentes : quatre axiomes de la représentation de la pensée dans les LLM
MultiHashFormer : Modèles de langage génératifs basés sur le hachage
Rapport technique de Qwen-Image-2.0-RL
La translation comme action de pontage : Transfert de compétences de manipulation des humains vers les robots
PhysisForcing : Simulateur de monde renforcé par la physique pour la manipulation robotique
OpenTME : un jeu de données ouvert de profils du microenvironnement tumoral H&E alimentés par l'IA, issus de TCGA