Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

Contrôle prédictif piloté par les données et à déclenchement d'événement, amélioré par l'apprentissage par renforcement profond, pour un bras robotique souple actionné par câbles 3D

Ungrokking naturel : Contrôle asymétrique des règles qui survivent au pré-entraînement































Contrôle prédictif piloté par les données et à déclenchement d'événement, amélioré par l'apprentissage par renforcement profond, pour un bras robotique souple actionné par câbles 3D

Ungrokking naturel : Contrôle asymétrique des règles qui survivent au pré-entraînement






























Tout entier non négatif est la somme d'un nombre triangulaire, d'un nombre pentagonal et d'un nombre heptagonal
Ingénierie de boucle : Le manuel Anthropic pour concevoir des systèmes qui interrogent vos agents
Petits LLM : Élagage vs Apprentissage à partir de zéro
OpenThoughts-Agent : Recettes de données pour les modèles agents
LingxiDiagBench : Un cadre Multi-Agent pour le benchmarking de LLM dans la consultation et le diagnostic psychiatriques en chinois
AOHP : Un environnement open source de niveau OS pour Agent, Interaction personnalisée, efficace et sécurisée
MemGUI-Agent : Un Agent GUI Mobile de bout en bout à long horizon avec une gestion proactive du contexte
MobileForge : Adaptation sans annotation pour les agents GUI mobiles avec une optimisation de politique guidée par les retours hiérarchiques
NatureBench : Les Agents de codage peuvent-ils égaler le SOTA publié des articles de la famille Nature ?
Qwen-AgentWorld : Modèles de monde linguistiques pour agents généraux
Repenser les cibles d’entraînement, les architectures et la qualité des données pour l’amélioration universelle de la parole
Des Gaussiennes 3D génératives avec un contrôle appris de la densité
TADA : Un cadre génératif pour la modélisation de la parole par double alignement texte-acoustique
Au-delà des mots isolés : Diffusion Brush pour la génération de lignes de texte manuscrites
gsplat : une bibliothèque open source pour le Gaussian Splatting
OmniVideo-100K : Un ensemble de données pour le raisonnement audiovisuel à travers des scripts structurés et des chaînes de preuve
OPEN-SWE-TRACES : Améliorer la distillation bilingue multilingue pour les Agents d’ingénierie logicielle
Attribution de crédit avec réinitialisations dans le raisonnement des modèles de langage
OCR à l'infini : Bienvenue dans l'ère de l'analyse à court terme avec un seul exemple
PlanBench-XL : Évaluation de la planification à long horizon des agents d'utilisation d'outils LLM dans des écosystèmes d'outils à grande échelle
OpenRath : État d'exécution centré sur la session pour les Systèmes Agent
EvoEmbedding : Représentations Évoluables pour la Récupération de Contexte Long et la Mémoire Agentic
Apprendre de ses propres erreurs : Construire des trajectoires micro-réflexives apprenables pour l'auto-distillation
Modèles d'Action du Monde : Une Revue de Littérature
KaLM-Reranker-V1 : Rapide mais sans interaction tardive pour le réordonnancement de documents compressés
Repenser le biais de rétrécissement dans le pré-entraînement LLM en FP4 : origine géométrique, impact systémique et recette UFP4
HydraHead : De l'hétérogénéité fonctionnelle de niveau tête à l'hybridation spécialisée de l'attention
3DCodeBench : Évaluation des agents de modélisation 3D procédurale via le code
RadImageNet-VQA : Un grand ensemble de données CT et IRM pour la réponse visuelle à des questions en imagerie radiologique
Entraînement des agents et des vérificateurs en génie logiciel avec SWE-Gym
Tout entier non négatif est la somme d'un nombre triangulaire, d'un nombre pentagonal et d'un nombre heptagonal
Ingénierie de boucle : Le manuel Anthropic pour concevoir des systèmes qui interrogent vos agents
Petits LLM : Élagage vs Apprentissage à partir de zéro
OpenThoughts-Agent : Recettes de données pour les modèles agents
LingxiDiagBench : Un cadre Multi-Agent pour le benchmarking de LLM dans la consultation et le diagnostic psychiatriques en chinois
AOHP : Un environnement open source de niveau OS pour Agent, Interaction personnalisée, efficace et sécurisée
MemGUI-Agent : Un Agent GUI Mobile de bout en bout à long horizon avec une gestion proactive du contexte
MobileForge : Adaptation sans annotation pour les agents GUI mobiles avec une optimisation de politique guidée par les retours hiérarchiques
NatureBench : Les Agents de codage peuvent-ils égaler le SOTA publié des articles de la famille Nature ?
Qwen-AgentWorld : Modèles de monde linguistiques pour agents généraux
Repenser les cibles d’entraînement, les architectures et la qualité des données pour l’amélioration universelle de la parole
Des Gaussiennes 3D génératives avec un contrôle appris de la densité
TADA : Un cadre génératif pour la modélisation de la parole par double alignement texte-acoustique
Au-delà des mots isolés : Diffusion Brush pour la génération de lignes de texte manuscrites
gsplat : une bibliothèque open source pour le Gaussian Splatting
OmniVideo-100K : Un ensemble de données pour le raisonnement audiovisuel à travers des scripts structurés et des chaînes de preuve
OPEN-SWE-TRACES : Améliorer la distillation bilingue multilingue pour les Agents d’ingénierie logicielle
Attribution de crédit avec réinitialisations dans le raisonnement des modèles de langage
OCR à l'infini : Bienvenue dans l'ère de l'analyse à court terme avec un seul exemple
PlanBench-XL : Évaluation de la planification à long horizon des agents d'utilisation d'outils LLM dans des écosystèmes d'outils à grande échelle
OpenRath : État d'exécution centré sur la session pour les Systèmes Agent
EvoEmbedding : Représentations Évoluables pour la Récupération de Contexte Long et la Mémoire Agentic
Apprendre de ses propres erreurs : Construire des trajectoires micro-réflexives apprenables pour l'auto-distillation
Modèles d'Action du Monde : Une Revue de Littérature
KaLM-Reranker-V1 : Rapide mais sans interaction tardive pour le réordonnancement de documents compressés
Repenser le biais de rétrécissement dans le pré-entraînement LLM en FP4 : origine géométrique, impact systémique et recette UFP4
HydraHead : De l'hétérogénéité fonctionnelle de niveau tête à l'hybridation spécialisée de l'attention
3DCodeBench : Évaluation des agents de modélisation 3D procédurale via le code
RadImageNet-VQA : Un grand ensemble de données CT et IRM pour la réponse visuelle à des questions en imagerie radiologique
Entraînement des agents et des vérificateurs en génie logiciel avec SWE-Gym