Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

AutoGLM : Agents fondamentaux autonomes pour les interfaces graphiques utilisateur

OpenGU : Une benchmark complète pour l'oubli de graphes































AutoGLM : Agents fondamentaux autonomes pour les interfaces graphiques utilisateur

OpenGU : Une benchmark complète pour l'oubli de graphes






























Sur l’interaction entre le préentraînement, l’entraînement intermédiaire et la RL dans les modèles linguistiques de raisonnement
DeepCode : codage agissant ouvert
InfiniteVL : Synergie entre l'attention linéaire et l'attention creuse pour des modèles vision-langage à entrée illimitée et très efficaces
OmniPSD : Génération de PSD en couches avec Transformer à diffusion
HiF-VLA : Aperçu rétrospectif, aperçu prospectif et aperçu anticipé grâce à la représentation du mouvement pour les modèles vision-langage-action
Arbitrage : Raisonnement efficace par spéculation consciente de l'avantage
Composition de concepts à partir d'images et de vidéos par liaison concept-prompt
StereoWorld : Génération de vidéos stéréo à partir d'images monoculaires sensible à la géométrie
Urania : Des aperçus confidentiels sur l'utilisation de l'intelligence artificielle par apprentissage différentiel
Entraînement des grands modèles linguistiques à l'honnêteté par les aveux
Mesure des agents dans la production
PolyMath : Évaluation du raisonnement mathématique dans des contextes multilingues
ThreadWeaver : threadage adaptatif pour un raisonnement parallèle efficace dans les modèles de langage
SPARK : Récompenses conscientes des étapes et du processus pour l'apprentissage par renforcement sans référence
OneStory : Génération cohérente de vidéos multi-tirages avec mémoire adaptative
Préservation de la réalisme vidéo source : remplacement de visage haute fidélité pour une qualité cinématographique
Visionnaire : le porteur de modèle monde construit sur la plateforme de splatting gaussien alimentée par WebGPU
Wan-Move : Génération vidéo contrôlable en mouvement par guidance de trajectoire latente
Optimisation de politique douce adaptative
Échelle de la génération zéro-shot de référence vidéo
Voxify3D : L'art pixelisé s'unit au rendu volumétrique
DoVer : Débogage Automatique Piloté par l'Intervention pour les Systèmes Multi-Agents à LLM
Édition vidéo unifiée avec raisonneur temporel
Au-delà du réel : extension imaginaire des embeddings de position rotatifs pour les LLM à contexte long
Raisonnement parallèle natif : Raisonnement parallèle via l'apprentissage par renforcement auto-distillé
iSeal : Empreintage chiffré pour une vérification fiable de la propriété des LLM
DAVSP : Alignement de la sécurité pour les grands modèles vision-langage par une invitation visuelle d'alignement profond
WorldGen : du texte à des mondes 3D parcourables et interactifs
Souper-Model : comment l'arithmétique simple débloque des performances de pointe pour les grands modèles linguistiques
DTS : Amélioration des grands modèles de raisonnement par esquissage d'arbre de décodage
Sur l’interaction entre le préentraînement, l’entraînement intermédiaire et la RL dans les modèles linguistiques de raisonnement
DeepCode : codage agissant ouvert
InfiniteVL : Synergie entre l'attention linéaire et l'attention creuse pour des modèles vision-langage à entrée illimitée et très efficaces
OmniPSD : Génération de PSD en couches avec Transformer à diffusion
HiF-VLA : Aperçu rétrospectif, aperçu prospectif et aperçu anticipé grâce à la représentation du mouvement pour les modèles vision-langage-action
Arbitrage : Raisonnement efficace par spéculation consciente de l'avantage
Composition de concepts à partir d'images et de vidéos par liaison concept-prompt
StereoWorld : Génération de vidéos stéréo à partir d'images monoculaires sensible à la géométrie
Urania : Des aperçus confidentiels sur l'utilisation de l'intelligence artificielle par apprentissage différentiel
Entraînement des grands modèles linguistiques à l'honnêteté par les aveux
Mesure des agents dans la production
PolyMath : Évaluation du raisonnement mathématique dans des contextes multilingues
ThreadWeaver : threadage adaptatif pour un raisonnement parallèle efficace dans les modèles de langage
SPARK : Récompenses conscientes des étapes et du processus pour l'apprentissage par renforcement sans référence
OneStory : Génération cohérente de vidéos multi-tirages avec mémoire adaptative
Préservation de la réalisme vidéo source : remplacement de visage haute fidélité pour une qualité cinématographique
Visionnaire : le porteur de modèle monde construit sur la plateforme de splatting gaussien alimentée par WebGPU
Wan-Move : Génération vidéo contrôlable en mouvement par guidance de trajectoire latente
Optimisation de politique douce adaptative
Échelle de la génération zéro-shot de référence vidéo
Voxify3D : L'art pixelisé s'unit au rendu volumétrique
DoVer : Débogage Automatique Piloté par l'Intervention pour les Systèmes Multi-Agents à LLM
Édition vidéo unifiée avec raisonneur temporel
Au-delà du réel : extension imaginaire des embeddings de position rotatifs pour les LLM à contexte long
Raisonnement parallèle natif : Raisonnement parallèle via l'apprentissage par renforcement auto-distillé
iSeal : Empreintage chiffré pour une vérification fiable de la propriété des LLM
DAVSP : Alignement de la sécurité pour les grands modèles vision-langage par une invitation visuelle d'alignement profond
WorldGen : du texte à des mondes 3D parcourables et interactifs
Souper-Model : comment l'arithmétique simple débloque des performances de pointe pour les grands modèles linguistiques
DTS : Amélioration des grands modèles de raisonnement par esquissage d'arbre de décodage