Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

Atlas : Orchestration de modèles hétérogènes et d'outils pour un raisonnement complexe multi-domaines

Benchmark^2 : Évaluation systématique des benchmarks pour les LLM































Atlas : Orchestration de modèles hétérogènes et d'outils pour un raisonnement complexe multi-domaines

Benchmark^2 : Évaluation systématique des benchmarks pour les LLM






























MindWatcher : Vers un raisonnement multimodal intégrant des outils plus intelligent
Entropie-adaptative Fine-Tuning : Résolution des conflits confiants pour atténuer l'oubli
Diversité ou précision ? Une analyse approfondie de la prédiction du prochain jeton
Agent de code de Confucius : un ossature d'agent évolutif pour des bases de code du monde réel
DreamStyle : Un cadre unifié pour la stylisation vidéo
UniCorn : Vers des modèles multimodaux unifiés auto-améliorants grâce à une supervision générée de manière autonome
LTX-2 : Modèle fondamental audiovisuel efficace en conjonction
SciEvalKit : un kit d'évaluation open-source pour l'intelligence générale scientifique
MOSS Transcrire Diariser : Transcription précise avec diarisation des locuteurs
InfiniDepth : Estimation de profondeur à résolution arbitraire et granularité fine à l’aide de champs implicites neuronaux
Adaptation de l'intelligence artificielle agente
Plannificateur vidéo à grande échelle permettant un contrôle robotique généralisable
InfiniteVGGT : Transformateur fondé sur la géométrie visuelle pour des flux infinis
GARDO : Renforcer les modèles de diffusion sans piratage de récompense
VAR RL Fait Correctement : Affronter les Conflits de Politiques Asynchrones dans la Génération Autoregressive Visuelle
DreamID-V : Comblant l'écart entre image et vidéo pour un remplacement facial de haute fidélité via un transformateur à diffusion
NextFlow : Modélisation séquentielle unifiée activant la compréhension et la génération multimodales
Rapport technique K-EXAONE
Le débat du Jeu de la faim : Émergence de la sur-competition dans les systèmes multi-agents
Entraînement d'IA Co-scientifiques à l'aide de récompenses basées sur des grilles d'évaluation
AdaGaR : Représentation de Gabor adaptative pour la reconstruction de scènes dynamiques
Maîtrise des hallucinations : Amélioration de la compréhension vidéo des MLLM par génération de vidéos contre-factuelles
SenseNova-MARS : Accroître le raisonnement agencé multimodal et la recherche grâce à l'apprentissage par renforcement
Avatar Forcing : Génération en temps réel d'avatar de tête pour des conversations naturelles
NeoVerse : Amélioration du modèle monodimensionnel du monde 4D à l’aide de vidéos monoculaires en situation réelle
Youtu-Agent : Augmenter la productivité des agents par génération automatisée et optimisation hybride des politiques
Rapport technique d'IQuest-Coder-V1
Modèles de langage récursifs
FlowBlending : Échantillonnage multi-modèle conscient des étapes pour une génération vidéo rapide et à haute fidélité
Dream2Flow : Vers une génération vidéo et une manipulation en monde ouvert grâce au flux d'objets 3D
MindWatcher : Vers un raisonnement multimodal intégrant des outils plus intelligent
Entropie-adaptative Fine-Tuning : Résolution des conflits confiants pour atténuer l'oubli
Diversité ou précision ? Une analyse approfondie de la prédiction du prochain jeton
Agent de code de Confucius : un ossature d'agent évolutif pour des bases de code du monde réel
DreamStyle : Un cadre unifié pour la stylisation vidéo
UniCorn : Vers des modèles multimodaux unifiés auto-améliorants grâce à une supervision générée de manière autonome
LTX-2 : Modèle fondamental audiovisuel efficace en conjonction
SciEvalKit : un kit d'évaluation open-source pour l'intelligence générale scientifique
MOSS Transcrire Diariser : Transcription précise avec diarisation des locuteurs
InfiniDepth : Estimation de profondeur à résolution arbitraire et granularité fine à l’aide de champs implicites neuronaux
Adaptation de l'intelligence artificielle agente
Plannificateur vidéo à grande échelle permettant un contrôle robotique généralisable
InfiniteVGGT : Transformateur fondé sur la géométrie visuelle pour des flux infinis
GARDO : Renforcer les modèles de diffusion sans piratage de récompense
VAR RL Fait Correctement : Affronter les Conflits de Politiques Asynchrones dans la Génération Autoregressive Visuelle
DreamID-V : Comblant l'écart entre image et vidéo pour un remplacement facial de haute fidélité via un transformateur à diffusion
NextFlow : Modélisation séquentielle unifiée activant la compréhension et la génération multimodales
Rapport technique K-EXAONE
Le débat du Jeu de la faim : Émergence de la sur-competition dans les systèmes multi-agents
Entraînement d'IA Co-scientifiques à l'aide de récompenses basées sur des grilles d'évaluation
AdaGaR : Représentation de Gabor adaptative pour la reconstruction de scènes dynamiques
Maîtrise des hallucinations : Amélioration de la compréhension vidéo des MLLM par génération de vidéos contre-factuelles
SenseNova-MARS : Accroître le raisonnement agencé multimodal et la recherche grâce à l'apprentissage par renforcement
Avatar Forcing : Génération en temps réel d'avatar de tête pour des conversations naturelles
NeoVerse : Amélioration du modèle monodimensionnel du monde 4D à l’aide de vidéos monoculaires en situation réelle
Youtu-Agent : Augmenter la productivité des agents par génération automatisée et optimisation hybride des politiques
Rapport technique d'IQuest-Coder-V1
Modèles de langage récursifs
FlowBlending : Échantillonnage multi-modèle conscient des étapes pour une génération vidéo rapide et à haute fidélité
Dream2Flow : Vers une génération vidéo et une manipulation en monde ouvert grâce au flux d'objets 3D