Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA
articles

Entropie-adaptative Fine-Tuning : Résolution des conflits confiants pour atténuer l'oubli

Diversité ou précision ? Une analyse approfondie de la prédiction du prochain jeton






























Agent de code de Confucius : un ossature d'agent évolutif pour des bases de code du monde réel
DreamStyle : Un cadre unifié pour la stylisation vidéo
UniCorn : Vers des modèles multimodaux unifiés auto-améliorants grâce à une supervision générée de manière autonome
LTX-2 : Modèle fondamental audiovisuel efficace en conjonction
SciEvalKit : un kit d'évaluation open-source pour l'intelligence générale scientifique
MOSS Transcrire Diariser : Transcription précise avec diarisation des locuteurs
InfiniDepth : Estimation de profondeur à résolution arbitraire et granularité fine à l’aide de champs implicites neuronaux
Adaptation de l'intelligence artificielle agente
Plannificateur vidéo à grande échelle permettant un contrôle robotique généralisable
InfiniteVGGT : Transformateur fondé sur la géométrie visuelle pour des flux infinis
GARDO : Renforcer les modèles de diffusion sans piratage de récompense
VAR RL Fait Correctement : Affronter les Conflits de Politiques Asynchrones dans la Génération Autoregressive Visuelle
DreamID-V : Comblant l'écart entre image et vidéo pour un remplacement facial de haute fidélité via un transformateur à diffusion
NextFlow : Modélisation séquentielle unifiée activant la compréhension et la génération multimodales
Rapport technique K-EXAONE
Le débat du Jeu de la faim : Émergence de la sur-competition dans les systèmes multi-agents
Entraînement d'IA Co-scientifiques à l'aide de récompenses basées sur des grilles d'évaluation
AdaGaR : Représentation de Gabor adaptative pour la reconstruction de scènes dynamiques
Maîtrise des hallucinations : Amélioration de la compréhension vidéo des MLLM par génération de vidéos contre-factuelles
SenseNova-MARS : Accroître le raisonnement agencé multimodal et la recherche grâce à l'apprentissage par renforcement
Avatar Forcing : Génération en temps réel d'avatar de tête pour des conversations naturelles
NeoVerse : Amélioration du modèle monodimensionnel du monde 4D à l’aide de vidéos monoculaires en situation réelle
Youtu-Agent : Augmenter la productivité des agents par génération automatisée et optimisation hybride des politiques
Rapport technique d'IQuest-Coder-V1
Modèles de langage récursifs
FlowBlending : Échantillonnage multi-modèle conscient des étapes pour une génération vidéo rapide et à haute fidélité
Dream2Flow : Vers une génération vidéo et une manipulation en monde ouvert grâce au flux d'objets 3D
Sur le rôle de la discrétisation dans les LLM de diffusion
DiffThinker : Vers un raisonnement multimodal génératif basé sur les modèles de diffusion
Modèles de grands concepts dynamiques : raisonnement latent dans un espace sémantique adaptatif