Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

Claw-Eval : Vers une évaluation fiable des Autonomous Agents

Video-MME-v2 : Vers la prochaine étape des benchmarks pour la compréhension vidéo exhaustive































Claw-Eval : Vers une évaluation fiable des Autonomous Agents

Video-MME-v2 : Vers la prochaine étape des benchmarks pour la compréhension vidéo exhaustive






























GrandCode : Atteindre le niveau Grandmaster en programmation compétitive via l'Agentic Reinforcement Learning
LIBERO-Para : Un benchmark et des métriques de diagnostic pour la robustesse à la paraphrase dans les modèles VLA.
TriAttention : une compression KV trigonométrique pour un long raisonnement efficace
MinerU2.5-Pro : Repousser les limites de l'analyse de documents axée sur les données à grande échelle.
La loi d'Adam : La loi de fréquence textuelle sur les Large Language Models
OpenWorldLib : Une base de code unifiée et une définition des World Models avancés
WAXAL : UN CORPUS DE PAROLE MULTILINGUE À GRANDE ÉCHELLE POUR LES LANGUES AFRICAINES
DRACO : une référence interdomaine pour l'exactitude, l'exhaustivité et l'objectivité de la recherche approfondie
HuatuoGPT-o1 : Vers un raisonnement médical complexe avec les LLMs
AgentSocialBench : Évaluation des risques liés à la vie privée dans les réseaux sociaux agents centrés sur l'humain
InCoder-32B-Thinking : Modèle de monde industriel pour le code destiné à la réflexion
Agentic-MME : Ce que la capacité agentic apporte réellement à l'intelligence multimodale ?
La déformation des tokens aide les MLLMs à observer depuis des points de vue rapprochés.
Auto-distillation par RLVR
Une référence simple pour la compréhension de flux vidéo
CORAL : Vers une évolution autonome multi-agent pour une découverte ouverte
Représentations visuelles pilotables
Compétence 0 : Apprentissage par renforcement agentic en contexte pour l'intériorisation des compétences
Rendu de monde génératif
L'Espace Latent : Fondements, Évolution, Mécanismes, Capacités et Perspectives
DataFlex : Un cadre unifié pour l'entraînement dynamique centré sur les données des grands modèles de langage (LLM)
QuitoBench : une référence ouverte de haute qualité pour la prévision de séries temporelles
Vision2Web : une évaluation hiérarchisée pour le développement visuel de sites web avec vérification par Agent
ViGoR-Bench : À quel point les modèles génératifs visuels sont-ils éloignés des raisonneurs visuels en zero-shot ?
MiroEval : Évaluation des Agents de Recherche Profonde Multimodaux selon le Processus et le Résultat
Les agents terminaux suffisent pour l'automatisation d'entreprise.
ClawKeeper : Protection de sécurité complète pour les agents OpenClaw grâce aux Skills, Plugins et Watchers
Bootstrap bon marché pour une quantification rapide de l'incertitude dans la descente de gradient stochastique
L'IA générative permet la construction de réseaux cérébraux structuraux à partir de l'IRMf grâce à l'apprentissage par Diffusion symétrique.
Réseaux de neurones à codage prédictif avec sortie anticipée pour l'IA de périphérie
GrandCode : Atteindre le niveau Grandmaster en programmation compétitive via l'Agentic Reinforcement Learning
LIBERO-Para : Un benchmark et des métriques de diagnostic pour la robustesse à la paraphrase dans les modèles VLA.
TriAttention : une compression KV trigonométrique pour un long raisonnement efficace
MinerU2.5-Pro : Repousser les limites de l'analyse de documents axée sur les données à grande échelle.
La loi d'Adam : La loi de fréquence textuelle sur les Large Language Models
OpenWorldLib : Une base de code unifiée et une définition des World Models avancés
WAXAL : UN CORPUS DE PAROLE MULTILINGUE À GRANDE ÉCHELLE POUR LES LANGUES AFRICAINES
DRACO : une référence interdomaine pour l'exactitude, l'exhaustivité et l'objectivité de la recherche approfondie
HuatuoGPT-o1 : Vers un raisonnement médical complexe avec les LLMs
AgentSocialBench : Évaluation des risques liés à la vie privée dans les réseaux sociaux agents centrés sur l'humain
InCoder-32B-Thinking : Modèle de monde industriel pour le code destiné à la réflexion
Agentic-MME : Ce que la capacité agentic apporte réellement à l'intelligence multimodale ?
La déformation des tokens aide les MLLMs à observer depuis des points de vue rapprochés.
Auto-distillation par RLVR
Une référence simple pour la compréhension de flux vidéo
CORAL : Vers une évolution autonome multi-agent pour une découverte ouverte
Représentations visuelles pilotables
Compétence 0 : Apprentissage par renforcement agentic en contexte pour l'intériorisation des compétences
Rendu de monde génératif
L'Espace Latent : Fondements, Évolution, Mécanismes, Capacités et Perspectives
DataFlex : Un cadre unifié pour l'entraînement dynamique centré sur les données des grands modèles de langage (LLM)
QuitoBench : une référence ouverte de haute qualité pour la prévision de séries temporelles
Vision2Web : une évaluation hiérarchisée pour le développement visuel de sites web avec vérification par Agent
ViGoR-Bench : À quel point les modèles génératifs visuels sont-ils éloignés des raisonneurs visuels en zero-shot ?
MiroEval : Évaluation des Agents de Recherche Profonde Multimodaux selon le Processus et le Résultat
Les agents terminaux suffisent pour l'automatisation d'entreprise.
ClawKeeper : Protection de sécurité complète pour les agents OpenClaw grâce aux Skills, Plugins et Watchers
Bootstrap bon marché pour une quantification rapide de l'incertitude dans la descente de gradient stochastique
L'IA générative permet la construction de réseaux cérébraux structuraux à partir de l'IRMf grâce à l'apprentissage par Diffusion symétrique.
Réseaux de neurones à codage prédictif avec sortie anticipée pour l'IA de périphérie