Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA
articles

Système BUT pour le Défi MLC-SLM

GenRecal : Génération après recalage des modèles langage-vision de grande à petite taille






























ProtoRaisonnement : Les prototypes comme fondement du raisonnement généralisable dans les LLMs
Sekai : Un Jeu de Données Vidéo pour l'Exploration du Monde
QFFT, Ajustement fin sans question pour un raisonnement adaptatif
Les modèles de langage à grande échelle (LLMs) peuvent-ils générer des cas de test de haute qualité pour les problèmes d'algorithmes ? TestCase-Eval : Une évaluation systématique de la couverture et de l'exposition aux défauts
AceReason-Nemotron 1.1 : Avancées en raisonnement mathématique et en raisonnement de code grâce à la synergie entre les transferts de connaissances (SFT) et l'apprentissage par renforcement (RL)
Stream-Omni : Interactions multimodales simultanées avec un grand modèle de langage-vision-parole
Efficient Medical VIE via Reinforcement Learning Amélioration de la VIE médicale par l'apprentissage par renforcement
Échelonnement du calcul en temps de test pour les agents de grands modèles linguistiques (LLM)
TaskCraft : Génération Automatisée de Tâches Agentiques
Attendez, Nous N'avons Pas Besoin de « Attendre » ! La Suppression des Jetons de Pensée Améliore l'Efficacité du Raisonnement
Ego-R1 : Chaîne de pensée outil pour la raisonnement sur les vidéos égocentriques ultra-longues
DeepResearch Bench : Un Benchmark Complet pour les Agents de Recherche Approfondie
Premier Examen des Scientifiques : Étude des Capacités Cognitives des MLLM par le Biais de la Perception, de la Compréhension et du Raisonnement
MiniMax-M1 : Échelonner l'efficacité du calcul en temps de test avec l'Attention Rapide
Au-delà de l'attention homogène : des LLMs à faible consommation mémoire grâce au cache KV approximé par Fourier
Un Jeu de Données de Haute Qualité et une Évaluation Fiable pour la Génération Interlancée d'Images et de Texte
SwS : Synthèse de Problèmes Guidée par les Faiblesses et la Conscience de Soi dans l'Apprentissage par Renforcement pour le Raisonnement des LLM
LiveCodeBench Pro : Comment les médaillés olympiques évaluent-ils les LLMs en programmation compétitive ?
La Dualité de la Diffusion
Équipe Rouge Efficace d'Agents Conformes aux Politiques
Synthèse d'images et de géométrie sous un angle de vue nouveau alignées par l'instillation d'attention intermodale
VRBench : Un benchmark pour le raisonnement en plusieurs étapes dans les vidéos narratives longues
AniMaker : Narration animée multi-agents automatisée avec génération de clips pilotée par MCTS
Restauration d'images text-aware avec des modèles de diffusion
Magistral
SWE-Factory : Votre usine automatisée pour les données d'entraînement de résolution des problèmes et les benchmarks d'évaluation
ReasonMed : Un Jeu de Données Généré par 370 000 Agents Multiples pour l’Avancement du Raisonnement Médical
Sapiens : Fondation pour les modèles de vision humaine
LongVILA : Extension des modèles linguistiques visuels à longue portée pour les vidéos longues
SAM 2 : Segmenter n'importe quoi dans les images et les vidéos