Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA
articles

TOOLACE : MAÎTRISER LES ENJEUX DE L'APPEL DE FONCTIONS PAR LES LLM

LightMover : Génération de mouvements lumineux avec contrôles de couleur et d'intensité






























Optimisation de trajectoire de dépassement autonome par apprentissage par renforcement et estimation de la pose de l'adversaire
Créez-le : Images factices, gains réels en segmentation sémantique few-shot généralisée
Adaptation acoustique en deux étapes avec des adaptateurs à attention croisée à portes pour la reconnaissance de la parole multi-locuteurs basée sur des LLM
Étude comparative en chirurgie assistée par l'IA : jeux de données, modèles de fondation et obstacles à l'AGI médicale
Intégration des données textuelles
Génération unifiée de texte vers mouvement sans nombre via l'appariement de flux
SEAR : Évaluation et routage basés sur le schéma pour les passerelles LLM
Répulsion en temps réel dans l'espace contextuel pour une diversité accrue dans les Diffusion Transformers
EpochX : Construire l'infrastructure d'une civilisation d'agents émergente
TAPS : Distributions de propositions conscientes de la tâche pour l'échantillonnage spéculatif
Scénarios de conduite à longue traîne avec traces de raisonnement : le jeu de données KITScenes LongTail
RealChart2Code : Faire progresser la génération de code à partir de graphiques grâce à des données réelles et une évaluation multi-tâches
Trace2Skill : Distiller des leçons locales aux trajectoires en compétences d'Agent transférables
PackForcing : Un entraînement sur des vidéos courtes suffit pour l'échantillonnage de vidéos longues et l'inférence en contexte long
ShotStream : Génération vidéo multi-shot en flux continu pour la narration interactive
Hors de vue mais pas hors de l'esprit : une mémoire hybride pour les modèles de monde vidéo dynamiques
BeSafe-Bench : Mise en lumière des risques de sécurité comportementale des Agents situés dans des environnements fonctionnels
Arène de Raisonnement du Monde (World Reasoning Arena)
MSA : Mécanisme d'attention parcimonieuse en mémoire pour une mise à l'échelle efficace de modèles de mémoire de bout en bout jusqu'à 100M tokens
Voxtral TTS
RealRestorer : Vers une restauration d'images réalistes généralisable grâce à des modèles d'édition d'images à grande échelle
Calibri : Amélioration des Diffusion Transformers par un étalonnage efficace en paramètres
Intern-S1-Pro : Modèle fondation multimodal scientifique à l'échelle du trillion
PixelSmile : Vers une édition fine des expressions faciales
Claudini : AutoResearch découvre des algorithmes d'attaque adversaire de pointe pour les LLM
AutoHarness : Améliorer les LLM Agents par la synthèse automatique d'un Code Harness
GameplayQA : Un cadre d'évaluation pour la compréhension multimédia synchronisée à la perspective subjective de vidéos multiples, dense en décisions, appliquée aux agents virtuels 3D.
Pourquoi l'auto-distillation (parfois) dégrade-t-elle les capacités de raisonnement des LLMs ?
UI-Voyager : Un agent GUI auto-évoluant apprenant à partir d'expériences échouées
T-MAP : Red-Teaming des agents LLM par une recherche évolutive consciente des trajectoires