Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA
articles

Fara-1.5 : environnements d'apprentissage évolutifs pour agents d'utilisation d'ordinateur

Rapport technique Docling






























De l’évaluation à haut débit aux études en laboratoire humide : faire progresser la prédiction des effets mutationnels avec un modèle enrichi par récupération
Modèle ou harnais ? Une taxonomie centrée sur les interactions pour localiser les défaillances des agents
Amener les modèles de langage à affirmer leur propre conscience restaure les croyances et les valeurs humaines
Diamond : un modèle séquence-à-séquence pour la restauration de la parole via un RQ-Transformer autorégressif sur des jetons de codec audio neuronal
N0-TWAM : Mise à l'échelle d'un modèle monde-action natif tactile pour la manipulation riche en contacts
AISPA : Audit centré sur l'utilisateur des invites système pour les applications de grands modèles de langage
Modélisation du monde mental
Meshy T2 : Génération rapide de maillages natifs par flux continu
N0-VTLA : Mise à l'échelle d'un modèle vision–tactile–langage–action avec des jetons tactiles latents
De RLVR à RLSVR : la transformation de tâche induit des récompenses auto-vérifiables pour l'auto-amélioration ouverte des grands modèles de langue
BEACON : SAVOIR QUAND ET COMMENT EFFECTUER UN RAISONNEMENT VISUEL AGENTIQUE
SkillSmith : Apprendre à composer des compétences paramétriques et des connaissances textuelles
VideoCoCo : le code comme chaîne de pensée pour la génération vidéo physiquement cohérente via un système agentique à double moteur
PHIZERO : UN MODÈLE DU MONDE CONSTRUIT AUTOUR DU LANGAGE PHYSIQUE
Frontis-MA1 : Entraînement d’un modèle d’IA pour l’IA en vue de l’auto-amélioration récursive en ingénierie de l’apprentissage automatique
Metis : un modèle de fondation à mémoire native
Rapport technique Qwen-UI-Agent : vers une nouvelle génération d'agents fondamentaux d'interface graphique centrés sur le monde réel
AskChem : une infrastructure centrée sur les affirmations pour la synthèse de la littérature en chimie
Ce qui fait d’un harnais un harnais : conditions nécessaires et suffisantes pour un harnais d’agent
OPENFORGE RL : ENTRAÎNER DES AGENTS NATIFS DE HARNESS DANS N’IMPORTE QUEL ENVIRONNEMENT
Spéculer tout en raisonnant : apprendre aux agents à prédire leur prochain appel d’outil par apprentissage par renforcement conjoint agent–spéculateur
Rapport technique sur Pangram 4
Les agents IA peuvent-ils mener une recherche en IA ouverte ? Premiers résultats issus de deux études de cas
Code as Agent Harness : vers des systèmes d'agents exécutables, vérifiables et à état
CAST : des solveurs de jeux comme enseignants au niveau des tours pour les agents LLM
CLBench-V : Évaluation de l'apprentissage multimodal en contexte, de l'ancrage à l'acquisition de connaissances
DecoEvo : Co-évolution découplée des compétences de résolution et de génération de grille d'évaluation dans l'espace textuel
HumanCLAW : Les modèles vision-langage peuvent-ils agir à travers un corps ?
CoRT : Rejeu contrefactuel pour l'optimisation de politique guidée par rubrique au niveau du jeton
TURBOVLA : UN MODÈLE VISION-LANGAGE-ACTION EN TEMPS RÉEL À 32 HZ SUR UNE RTX 4090 AVEC MOINS DE 1 GO DE VRAM