Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

MAI-Thinking-1 : Concevoir une machine de type Hill-Climbing

VLM3 : Les modèles de langage visuels sont des apprenants natifs en 3D































MAI-Thinking-1 : Concevoir une machine de type Hill-Climbing

VLM3 : Les modèles de langage visuels sont des apprenants natifs en 3D






























Harness-1 : Apprentissage par renforcement pour les agents de recherche avec des harnais externalisant l’état
DeepCrack : Une architecture d’apprentissage hiérarchique de caractéristiques profondes pour la segmentation des fissures
VideoMLA : Cache KV latent de bas rang pour la diffusion vidéo autoregressive à l'échelle de la minute
Draft-OPD : Distillation sur politique pour modèles de brouillon spéculatifs
K-BrowseComp : Un benchmark d'Agent de navigation web ancré dans des contextes coréens
Une question de TASTE : Améliorer la couverture et la difficulté des Agent Benchmarks
Sur le passage à l'échelle de PEFT : Vers des modèles personnels de millions de paramètres de mille milliards de paramètres
Crafter : Un Cadre Multi-Agent pour la Génération de Figures Scientifiques Modifiables à partir de Diverses Entrées
TACK : Évaluation statistique de l'activité de dégradation sur un nouvel ensemble de connaissances TArgeting Chimeras
Narrative Weaver : Vers une cohérence visuelle à longue portée contrôlable grâce à un conditionnement multimodal
Le mise à jour du harnais n'est pas un bénéfice du harnais : dissocier les capacités d'évolution dans les Agents LLM auto-évoluants
LongTraceRL : Apprentissage du raisonnement sur de longs contextes à partir de trajectoires d'Agents de recherche avec des récompenses par grille
Mélange de comportements de région de confiance pour la distillation sur politique
SwanVoice : Synthèse vocale expressive zéro-shot de longue durée pour le monologue et le dialogue
Forçage de Représentation pour des modèles multimodaux unifiés sans goulot d'étranglement
GrepSeek : Entraînement d'Agents de recherche pour une interaction directe avec le corpus
COLLEAGUE.SKILL : Génération automatisée de compétences d'IA via la distillation des connaissances d'expert
Les systèmes agissants comme moyen d’amélioration des modèles de raisonnement faibles
YoCausal : À quelle distance la génération de vidéos se trouve-t-elle du modèle du monde ? Une perspective causale
minWM : Un framework full-stack open-source pour des modèles du monde vidéo interactifs en temps réel
CollectionLoRA : Collecter 50 effets dans 1 LoRA via la distillation on-policy multi-enseignant
OmniRetrieval : Récupération unifiée à travers des sources de connaissances hétérogènes
Qwen-VLA : Unification de la modélisation vision-langage-action à travers les tâches, les environnements et les incarnations robotiques
AgentDoG 1.5 : Un cadre d'alignement léger et évolutif pour la sécurité et la sûreté des Agent IA
Modèles d'action mondiaux : La prochaine frontière en IA incarnée
Les modèles d'action mondiaux sont des politiques zéro-shot
ResearchMath-14K : Mise à l'échelle des mathématiques de niveau recherche via Agents
Modèles de Langage Auto-Améliorants avec Recherche Évolutionnaire Bidirectionnelle
Des Pixels aux Mots -- Vers des Modèles Natifs One-Vision à Grande Échelle
Optimisation de la politique exploratoire d'Agent pour le raisonnement agentique multimodal
Harness-1 : Apprentissage par renforcement pour les agents de recherche avec des harnais externalisant l’état
DeepCrack : Une architecture d’apprentissage hiérarchique de caractéristiques profondes pour la segmentation des fissures
VideoMLA : Cache KV latent de bas rang pour la diffusion vidéo autoregressive à l'échelle de la minute
Draft-OPD : Distillation sur politique pour modèles de brouillon spéculatifs
K-BrowseComp : Un benchmark d'Agent de navigation web ancré dans des contextes coréens
Une question de TASTE : Améliorer la couverture et la difficulté des Agent Benchmarks
Sur le passage à l'échelle de PEFT : Vers des modèles personnels de millions de paramètres de mille milliards de paramètres
Crafter : Un Cadre Multi-Agent pour la Génération de Figures Scientifiques Modifiables à partir de Diverses Entrées
TACK : Évaluation statistique de l'activité de dégradation sur un nouvel ensemble de connaissances TArgeting Chimeras
Narrative Weaver : Vers une cohérence visuelle à longue portée contrôlable grâce à un conditionnement multimodal
Le mise à jour du harnais n'est pas un bénéfice du harnais : dissocier les capacités d'évolution dans les Agents LLM auto-évoluants
LongTraceRL : Apprentissage du raisonnement sur de longs contextes à partir de trajectoires d'Agents de recherche avec des récompenses par grille
Mélange de comportements de région de confiance pour la distillation sur politique
SwanVoice : Synthèse vocale expressive zéro-shot de longue durée pour le monologue et le dialogue
Forçage de Représentation pour des modèles multimodaux unifiés sans goulot d'étranglement
GrepSeek : Entraînement d'Agents de recherche pour une interaction directe avec le corpus
COLLEAGUE.SKILL : Génération automatisée de compétences d'IA via la distillation des connaissances d'expert
Les systèmes agissants comme moyen d’amélioration des modèles de raisonnement faibles
YoCausal : À quelle distance la génération de vidéos se trouve-t-elle du modèle du monde ? Une perspective causale
minWM : Un framework full-stack open-source pour des modèles du monde vidéo interactifs en temps réel
CollectionLoRA : Collecter 50 effets dans 1 LoRA via la distillation on-policy multi-enseignant
OmniRetrieval : Récupération unifiée à travers des sources de connaissances hétérogènes
Qwen-VLA : Unification de la modélisation vision-langage-action à travers les tâches, les environnements et les incarnations robotiques
AgentDoG 1.5 : Un cadre d'alignement léger et évolutif pour la sécurité et la sûreté des Agent IA
Modèles d'action mondiaux : La prochaine frontière en IA incarnée
Les modèles d'action mondiaux sont des politiques zéro-shot
ResearchMath-14K : Mise à l'échelle des mathématiques de niveau recherche via Agents
Modèles de Langage Auto-Améliorants avec Recherche Évolutionnaire Bidirectionnelle
Des Pixels aux Mots -- Vers des Modèles Natifs One-Vision à Grande Échelle
Optimisation de la politique exploratoire d'Agent pour le raisonnement agentique multimodal