Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

Communication sémantique directe entre modèles de langage massifs par échange de cache

Ming-UniVision : Compréhension et génération d'images conjointes à l'aide d'un tokeniseur continu unifié































Communication sémantique directe entre modèles de langage massifs par échange de cache

Ming-UniVision : Compréhension et génération d'images conjointes à l'aide d'un tokeniseur continu unifié






























Rapport technique Phi-3 : un modèle linguistique hautement performant fonctionnant localement sur votre téléphone
Rapport technique Qwen2.5
Découverte d'algorithmes scientifiques par l'augmentation d'AlphaEvolve avec une recherche approfondie
ConstraintLLM : un cadre neuro-symbolique pour la programmation par contraintes à l'échelle industrielle
Scaling des chaînes de raisonnement assistées par le code et des instructions pour le raisonnement des modèles
CoDA : Codage des ML par adaptation par diffusion
Fast-dLLM v2 : Modèle LLM à diffusion par blocs efficace
Moins, c'est mieux : un raisonnement récursif avec des réseaux réduits
Fathom-DeepResearch : Déverrouiller la recherche d'information et la synthèse à long terme pour les SLM
TaTToo : PRM fondé sur un outil pour le raisonnement à temps de test dans le raisonnement tabulaire
Architectures hybrides pour les modèles linguistiques : analyse systématique et insights sur la conception
MITS : Amélioration du raisonnement par recherche arborescente pour les LSM grâce à l'information mutuelle ponctuelle
Évasion imperceptible des grands modèles linguistiques
VChain : Chaîne de raisonnement visuel pour le raisonnement dans la génération vidéo
Post-entraînement des modèles multimodaux grands pour vidéos : une analyse approfondie du raisonnement vidéo à l’aide de modèles multimodaux grands
Paper2Video : génération automatique de vidéos à partir d'articles scientifiques
Ponctuer l'écart entre l'engagement et les performances pour la quantification FP4 en microéchelle
Amélioration autonome des grands modèles linguistiques multimodaux : une revue
Composez vos politiques ! Amélioration des politiques robotiques basées sur la diffusion ou sur les flux par composition au niveau de la distribution à l'heure du test
Les grands modèles de raisonnement apprennent une meilleure alignement à partir d'une pensée défectueuse
Modèles linguistiques massifs multi-modaux efficaces par distillation progressive de cohérence
Apriel-1.5-15b-Thinker
StockBench : Les agents basés sur les modèles linguistiques peuvent-ils trader des actions avec profit sur les marchés réels ?
Formation interactive : optimisation des réseaux de neurones pilotée par les retours
StealthAttack : Empoisonnement par projection de nuages de points 3D robuste basé sur des illusions guidées par la densité
ExGRPO : Apprendre à raisonner à partir de l'expérience
Self-Forcing++ : Vers une génération vidéo de haute qualité à l'échelle de la minute
LongCodeZip : Compression du contexte long pour les modèles linguistiques de code
PIPer : Configuration d'environnement sur dispositif par apprentissage par renforcement en ligne
Repenser les modèles de récompense pour le scaling à temps de test multi-domaines
Rapport technique Phi-3 : un modèle linguistique hautement performant fonctionnant localement sur votre téléphone
Rapport technique Qwen2.5
Découverte d'algorithmes scientifiques par l'augmentation d'AlphaEvolve avec une recherche approfondie
ConstraintLLM : un cadre neuro-symbolique pour la programmation par contraintes à l'échelle industrielle
Scaling des chaînes de raisonnement assistées par le code et des instructions pour le raisonnement des modèles
CoDA : Codage des ML par adaptation par diffusion
Fast-dLLM v2 : Modèle LLM à diffusion par blocs efficace
Moins, c'est mieux : un raisonnement récursif avec des réseaux réduits
Fathom-DeepResearch : Déverrouiller la recherche d'information et la synthèse à long terme pour les SLM
TaTToo : PRM fondé sur un outil pour le raisonnement à temps de test dans le raisonnement tabulaire
Architectures hybrides pour les modèles linguistiques : analyse systématique et insights sur la conception
MITS : Amélioration du raisonnement par recherche arborescente pour les LSM grâce à l'information mutuelle ponctuelle
Évasion imperceptible des grands modèles linguistiques
VChain : Chaîne de raisonnement visuel pour le raisonnement dans la génération vidéo
Post-entraînement des modèles multimodaux grands pour vidéos : une analyse approfondie du raisonnement vidéo à l’aide de modèles multimodaux grands
Paper2Video : génération automatique de vidéos à partir d'articles scientifiques
Ponctuer l'écart entre l'engagement et les performances pour la quantification FP4 en microéchelle
Amélioration autonome des grands modèles linguistiques multimodaux : une revue
Composez vos politiques ! Amélioration des politiques robotiques basées sur la diffusion ou sur les flux par composition au niveau de la distribution à l'heure du test
Les grands modèles de raisonnement apprennent une meilleure alignement à partir d'une pensée défectueuse
Modèles linguistiques massifs multi-modaux efficaces par distillation progressive de cohérence
Apriel-1.5-15b-Thinker
StockBench : Les agents basés sur les modèles linguistiques peuvent-ils trader des actions avec profit sur les marchés réels ?
Formation interactive : optimisation des réseaux de neurones pilotée par les retours
StealthAttack : Empoisonnement par projection de nuages de points 3D robuste basé sur des illusions guidées par la densité
ExGRPO : Apprendre à raisonner à partir de l'expérience
Self-Forcing++ : Vers une génération vidéo de haute qualité à l'échelle de la minute
LongCodeZip : Compression du contexte long pour les modèles linguistiques de code
PIPer : Configuration d'environnement sur dispositif par apprentissage par renforcement en ligne
Repenser les modèles de récompense pour le scaling à temps de test multi-domaines