Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

FIFO-Diffusion : Génération de vidéos infinies à partir de texte sans entraînement

À quel point sommes-nous de GPT-4V ? Réduire l'écart avec les modèles multimodaux commerciaux grâce à des suites open source































FIFO-Diffusion : Génération de vidéos infinies à partir de texte sans entraînement

À quel point sommes-nous de GPT-4V ? Réduire l'écart avec les modèles multimodaux commerciaux grâce à des suites open source






























Vers une amélioration autonome des modèles linguistiques massifs grâce à l'imagination, la recherche et la critique
Rapport technique OmniFusion
Les erreurs de prédiction des modèles d'apprentissage automatique sont inférieures à la précision de la DFT
SEAgent : Agent d'utilisation informatique auto-évolutive avec apprentissage autonome à partir de l'expérience
AMix-1 : Une voie vers un modèle fondamental de protéine évolutif à l'heure du test
CRINN : apprentissage par renforcement contrastif pour la recherche de voisins les plus proches approchés
Décalage de représentation : unifier la compression de jetons avec FlashAttention
CompassVerifier : un vérificateur unifié et robuste pour l'évaluation des LLM et la récompense des résultats
LongVie : Génération contrôlable d'images vidéo ultra-longues guidée par multimodalité
Skywork UniPic : Modélisation autoregressive unifiée pour la compréhension visuelle et la génération
Seed Diffusion : un modèle linguistique de diffusion à grande échelle avec inférence à haute vitesse
Agent Lightning : Former N'IMPORTE QUELLE IA avec l'apprentissage par renforcement
Découverte algorithmique automatisée pour la détection des ondes gravitationnelles guidée par une recherche arborescente de Monte Carlo évolutionnaire informée par des modèles linguistiques
Au-delà du compromis : apprentissage par renforcement auto-supervisé pour la suivie d'instructions par les modèles de raisonnement
Rapport technique Llama-3.1-FoundationAI-SecurityLLM-8B-Instruct
CellForge : conception agente de modèles cellulaires virtuels
SitEmb-v1.5 : Récupération dense consciente du contexte améliorée pour l'association sémantique et la compréhension des longs récits
RL-PLUS : Contrer la collapse de la frontière des capacités des MLG en apprentissage par renforcement par une optimisation hybride des politiques
GS-Occ3D : Reprojection de l'occupation uniquement visuelle à grande échelle avec le splatting gaussien
SWE-Debate : Débat multi-agents compétitif pour la résolution des problèmes logiciels
Segmentation de référence multimodale : une revue
3D-R1 : Amélioration du raisonnement dans les VLM 3D pour une compréhension unifiée des scènes
SWE-Exp : Résolution de problèmes logiciels pilotée par l'expérience
PixNerd : Diffusion des champs neuronaux de pixels
Au-delà du fixe : débruitage à longueur variable pour les grands modèles linguistiques à diffusion
Cognitive Kernel-Pro : un cadre pour les agents de recherche approfondie et l'entraînement des modèles fondamentaux d'agents
Co-production de l’IA : vers un cycle de vie augmenté et participatif
iLRM : un modèle itératif de reconstruction 3D de grande taille
villa-X : Amélioration de la modélisation des actions latentes dans les modèles vision-langage-action
C3 : Une base de données bilingue pour les modèles de dialogue parlé explorant les défis posés par les conversations complexes
Vers une amélioration autonome des modèles linguistiques massifs grâce à l'imagination, la recherche et la critique
Rapport technique OmniFusion
Les erreurs de prédiction des modèles d'apprentissage automatique sont inférieures à la précision de la DFT
SEAgent : Agent d'utilisation informatique auto-évolutive avec apprentissage autonome à partir de l'expérience
AMix-1 : Une voie vers un modèle fondamental de protéine évolutif à l'heure du test
CRINN : apprentissage par renforcement contrastif pour la recherche de voisins les plus proches approchés
Décalage de représentation : unifier la compression de jetons avec FlashAttention
CompassVerifier : un vérificateur unifié et robuste pour l'évaluation des LLM et la récompense des résultats
LongVie : Génération contrôlable d'images vidéo ultra-longues guidée par multimodalité
Skywork UniPic : Modélisation autoregressive unifiée pour la compréhension visuelle et la génération
Seed Diffusion : un modèle linguistique de diffusion à grande échelle avec inférence à haute vitesse
Agent Lightning : Former N'IMPORTE QUELLE IA avec l'apprentissage par renforcement
Découverte algorithmique automatisée pour la détection des ondes gravitationnelles guidée par une recherche arborescente de Monte Carlo évolutionnaire informée par des modèles linguistiques
Au-delà du compromis : apprentissage par renforcement auto-supervisé pour la suivie d'instructions par les modèles de raisonnement
Rapport technique Llama-3.1-FoundationAI-SecurityLLM-8B-Instruct
CellForge : conception agente de modèles cellulaires virtuels
SitEmb-v1.5 : Récupération dense consciente du contexte améliorée pour l'association sémantique et la compréhension des longs récits
RL-PLUS : Contrer la collapse de la frontière des capacités des MLG en apprentissage par renforcement par une optimisation hybride des politiques
GS-Occ3D : Reprojection de l'occupation uniquement visuelle à grande échelle avec le splatting gaussien
SWE-Debate : Débat multi-agents compétitif pour la résolution des problèmes logiciels
Segmentation de référence multimodale : une revue
3D-R1 : Amélioration du raisonnement dans les VLM 3D pour une compréhension unifiée des scènes
SWE-Exp : Résolution de problèmes logiciels pilotée par l'expérience
PixNerd : Diffusion des champs neuronaux de pixels
Au-delà du fixe : débruitage à longueur variable pour les grands modèles linguistiques à diffusion
Cognitive Kernel-Pro : un cadre pour les agents de recherche approfondie et l'entraînement des modèles fondamentaux d'agents
Co-production de l’IA : vers un cycle de vie augmenté et participatif
iLRM : un modèle itératif de reconstruction 3D de grande taille
villa-X : Amélioration de la modélisation des actions latentes dans les modèles vision-langage-action
C3 : Une base de données bilingue pour les modèles de dialogue parlé explorant les défis posés par les conversations complexes