Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA
articles

Wan-Streamer v0.2 : Résolution Supérieure, Même Latence

EVA-Client : un cadre unifié pour le déploiement, l'évaluation et la collecte de données sur des robots réels






























GigaWorld-1 : Une feuille de route pour construire des modèles du monde pour l'évaluation de politiques robotiques
ResearchStudio-Idea : Une suite de compétences pour l'idéation de recherche fondée sur des preuves à partir des résultats de conférences en apprentissage automatique
ResearchStudio-Reel : Automatiser le dernier kilomètre de la recherche, de l'article à l'affiche, la vidéo et le blog
FINAL Bench : Mesurer le raisonnement métacognitif fonctionnel dans les grands modèles de langage
SceneFun3D : Compréhension fine des fonctionnalités et des affordances dans les scènes 3D
TheoremGraph : relier les mathématiques formelles et informelles
Agents perpétuellement actifs : un état de l’art sur la mémoire persistante, l’état et la gouvernance dans les agents LLM
Sécuriser l’agent IA : un cadre unifié pour l’évaluation offensive multi-couche des agents
DataComp-VLM : Jeux de données ouverts améliorés pour les modèles vision-langage
OrbitQuant : Quantification indépendante des données pour les transformeurs de diffusion d’images et de vidéos
VLA-Corrector : Inférence légère de détection et correction pour un horizon d’action adaptatif
Embodied.cpp : un moteur d'exécution portable pour modèles d'IA incarnée sur des robots hétérogènes
Le mirage de l’optimisation des politiques d’entraînement : les politiques d’inférence monotones comme véritable objectif pour l’apprentissage par renforcement des grands modèles de langage
GeneBench-Pro : Évaluation du raisonnement statistique multi-étapes en génomique, biologie quantitative et biomédecine translationnelle
Position : La recherche sur les deepfakes en IA/ML est mal alignée avec l’imagerie intime non consensuelle générée par IA (AIG-NCII)
Comprendre le grokking : Preuves de grokking en régression ridge
Une perspective de théorie des matrices aléatoires sur la cohérence des modèles de diffusion
Combien les modèles de langage mémorisent-ils ?
L'Atlas de l'obscurcissement : Cartographier là où l'honnêteté émerge dans le RLVR à l'aide de sondes de tromperie
Position : La communauté de l’alignement construit involontairement une boîte à outils pour censeurs
Échantillonnage de haute précision pour les modèles de diffusion et les distributions log-concaves
AgenticDataBench : un banc d'essai complet pour les agents de données
FLUX DE CORRESPONDANCE MULTIRÉSOLUTION : ACCÉLÉRATION DE DIFFUSION SANS ENTRAÎNEMENT PAR ÉCHANTILLONNAGE ÉTAGÉ
Se transformer en modèles d'attention hybrides
EvoPolicyGym : Évaluation de l'évolution autonome des politiques dans des environnements interactifs
AgenticSTS : un banc d’essai à mémoire bornée pour agents LLM à long horizon
Program-as-Weights : un paradigme de programmation pour les fonctions floues
MatAnyone 2 : Passage à l'échelle du matage vidéo via un évaluateur de qualité appris
EdgeTAM : un modèle « Segment Anything » sur appareil
PixelRefer : Un cadre unifié pour la référence spatio-temporelle d'objets à granularité arbitraire