Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

Le Diable derrière Moltbook : la sécurité d'Anthropic disparaît toujours dans les sociétés d'IA auto-évoluantes

Vers une recherche mathématique autonome































Le Diable derrière Moltbook : la sécurité d'Anthropic disparaît toujours dans les sociétés d'IA auto-évoluantes

Vers une recherche mathématique autonome






























Quand mémoriser et quand s’arrêter : une mémoire récurrente à grille pour le raisonnement à longue portée
ASA : Pilotage de l'activation pour l'adaptation de domaine de appel d'outils
PhyCritic : Modèles critiques multimodaux pour l'intelligence artificielle physique
GENIUS : Suite d'évaluation de l'intelligence fluide générative
Étape 3,5 Flash : Ouvrir l'intelligence de niveau frontière avec 11 milliards de paramètres actifs
World-VLA-Loop : Apprentissage en boucle fermée du modèle mondial vidéo et de la politique VLA
Vers une recherche mathématique autonome
Modèle mondial d'Agent : environnements synthétiques infinis pour l'apprentissage par renforcement agencé
P1-VL : Surmonter le fossé entre la perception visuelle et le raisonnement scientifique dans les Olympiades de physique
Chaîne de Mentalité : Raisonnement avec des Modes Cognitifs Adaptatifs
Rapport technique UI-Venus-1.5
Code2World : un modèle de monde GUI basé sur la génération de code rendu
OPUS : Vers une sélection de données efficace et fondée sur des principes lors de l'entraînement préalable des grands modèles linguistiques à chaque itération
BagelVLA : Amélioration de la manipulation à horizon long grâce à la génération imbriquée vision-langage-action
THINGS-data : une collection multimodale de jeux de données à grande échelle pour l'étude des représentations d'objets dans le cerveau et le comportement humains
Prédictions précises de nouvelles interactions biomoléculaires avec IsoDDE
SKILLRL : faire évoluer des Agents via un Reinforcement Learning récursif augmenté par des Skills
LLaDA2.1 : Accélération de la diffusion de texte par édition de tokens
Atténuation des récompenses rares par modélisation des effets d’échantillonnage étape-par-étape et à long terme dans le GRPO fondé sur les flux
Recurrent-Depth VLA : Échelle implicite du calcul en temps de test des modèles vision-langage-action par raisonnement itératif latent
QuantaAlpha : Un cadre évolutif pour l’extraction d’alpha pilotée par LLM
Paradigme d'entraînement par alignement de sous-espaces piloté par l'écart de modalité pour les modèles linguistiques à grande échelle multimodaux
MOVA : Vers une génération vidéo-audio évolutif et synchronisé
MemoryLLM : Mémoire à alimentation directe interprétable plug-and-play pour les transformateurs
DreamDojo : un modèle mondial robotique généraliste issu de vidéos humaines à grande échelle
F-GRPO : Ne laissez pas votre politique apprendre ce qui est évident et oublier le rare
MSign : Un optimiseur prévenant l’instabilité d’entraînement dans les grands modèles linguistiques grâce à la restauration du rang stable
AudioSAE : Vers une compréhension des modèles de traitement audio à l’aide d’auto-encodeurs creux
Sur la dynamique de l'entropie dans le fine-tuning par renforcement des grands modèles linguistiques
OdysseyArena : Évaluation des grands modèles linguistiques pour des interactions longue portée, actives et inductives
Quand mémoriser et quand s’arrêter : une mémoire récurrente à grille pour le raisonnement à longue portée
ASA : Pilotage de l'activation pour l'adaptation de domaine de appel d'outils
PhyCritic : Modèles critiques multimodaux pour l'intelligence artificielle physique
GENIUS : Suite d'évaluation de l'intelligence fluide générative
Étape 3,5 Flash : Ouvrir l'intelligence de niveau frontière avec 11 milliards de paramètres actifs
World-VLA-Loop : Apprentissage en boucle fermée du modèle mondial vidéo et de la politique VLA
Vers une recherche mathématique autonome
Modèle mondial d'Agent : environnements synthétiques infinis pour l'apprentissage par renforcement agencé
P1-VL : Surmonter le fossé entre la perception visuelle et le raisonnement scientifique dans les Olympiades de physique
Chaîne de Mentalité : Raisonnement avec des Modes Cognitifs Adaptatifs
Rapport technique UI-Venus-1.5
Code2World : un modèle de monde GUI basé sur la génération de code rendu
OPUS : Vers une sélection de données efficace et fondée sur des principes lors de l'entraînement préalable des grands modèles linguistiques à chaque itération
BagelVLA : Amélioration de la manipulation à horizon long grâce à la génération imbriquée vision-langage-action
THINGS-data : une collection multimodale de jeux de données à grande échelle pour l'étude des représentations d'objets dans le cerveau et le comportement humains
Prédictions précises de nouvelles interactions biomoléculaires avec IsoDDE
SKILLRL : faire évoluer des Agents via un Reinforcement Learning récursif augmenté par des Skills
LLaDA2.1 : Accélération de la diffusion de texte par édition de tokens
Atténuation des récompenses rares par modélisation des effets d’échantillonnage étape-par-étape et à long terme dans le GRPO fondé sur les flux
Recurrent-Depth VLA : Échelle implicite du calcul en temps de test des modèles vision-langage-action par raisonnement itératif latent
QuantaAlpha : Un cadre évolutif pour l’extraction d’alpha pilotée par LLM
Paradigme d'entraînement par alignement de sous-espaces piloté par l'écart de modalité pour les modèles linguistiques à grande échelle multimodaux
MOVA : Vers une génération vidéo-audio évolutif et synchronisé
MemoryLLM : Mémoire à alimentation directe interprétable plug-and-play pour les transformateurs
DreamDojo : un modèle mondial robotique généraliste issu de vidéos humaines à grande échelle
F-GRPO : Ne laissez pas votre politique apprendre ce qui est évident et oublier le rare
MSign : Un optimiseur prévenant l’instabilité d’entraînement dans les grands modèles linguistiques grâce à la restauration du rang stable
AudioSAE : Vers une compréhension des modèles de traitement audio à l’aide d’auto-encodeurs creux
Sur la dynamique de l'entropie dans le fine-tuning par renforcement des grands modèles linguistiques
OdysseyArena : Évaluation des grands modèles linguistiques pour des interactions longue portée, actives et inductives