Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

MedIQA : Un modèle fondamental évolutif pour l'évaluation de la qualité des images médicales basée sur les prompts

OS-MAP : Jusqu'où peuvent aller les agents utilisant l'ordinateur en termes de largeur et de profondeur ?































MedIQA : Un modèle fondamental évolutif pour l'évaluation de la qualité des images médicales basée sur les prompts

OS-MAP : Jusqu'où peuvent aller les agents utilisant l'ordinateur en termes de largeur et de profondeur ?






























Optimisation de la politique budgétaire hiérarchique pour le raisonnement adaptatif
Captain Cinema : Vers la génération de courts métrages
LAPO : L'optimisation adaptative de la politique par l'intégration de l'efficacité du raisonnement
MUR : Raisonnement guidé par l'incertitude de la quantité de mouvement pour les grands modèles linguistiques
∇NABLA : Attention Adaptative par Bloc aux Voisinages
Optimisation de la politique des séquences de groupe
SafeWork-R1 : Coévolution de la sécurité et de l'intelligence en vertu de la loi AI-45
Découpler la connaissance et le raisonnement dans les LLM : Une exploration basée sur la théorie des deux systèmes cognitifs
Réf. : Form -- Réduction des prioris humains dans la vérification formelle logicielle évitable avec le renforcement par apprentissage dans les modèles de langage à grande échelle : Une étude préliminaire sur Dafny
RAVine : Évaluation alignée sur la réalité pour la recherche agente
Peut un domaine aider les autres ? Une étude centrée sur les données sur le raisonnement multi-domaines par apprentissage par renforcement
DesignLab : Conception de diapositives par détection et correction itératives
Yume : Un modèle de génération de monde interactif
Pixels, Motifs, mais pas de Poésie : Voir le Monde comme les Humains
Construction d'un MLLM ophtalmique pour la collaboration diagnostic-positionnelle par le raisonnement en chaîne cognitive clinique
HySafe-AI : Cadre d'analyse architectural de sécurité hybride pour les systèmes d'intelligence artificielle : Une étude de cas
Zebra-CoT : Un jeu de données pour le raisonnement multimodal vision-langage intercalé
Apprentissage par renforcement semi-off-policy pour le raisonnement lent vision-langage
Suréchantillonner ce qui compte : un échantillonnage latent adaptatif par région pour des transformateurs de diffusion accélérés
MegaScience : Pousser les limites des jeux de données post-entraînement pour le raisonnement scientifique
Rapport technique Step-Audio 2
Au-delà des limites du contexte : Fils subconscients pour un raisonnement à long terme
Cadre de gestion des risques liés à l'intelligence artificielle de pointe en pratique : Rapport technique d'analyse des risques
Transformateurs de connaissances conscients de l'incertitude pour le commerce d'énergie pair à pair avec l'apprentissage par renforcement multi-agents
Pas d'humains nécessaires : Recherche de triplets d'édition d'images autonome de haute qualité
Édition de niveau de pièce 3D robuste dans le recouvrement 3D Gaussien avec l'échantillonnage distillé des scores régularisés
WebShaper : Synthèse de données agissante par formalisation de la recherche d'information
L'Attelage invisible : pourquoi le RLVR ne peut-il pas s'échapper de son origine
GUI-G^2 : Modélisation de récompense gaussienne pour l'ancrage de l'interface graphique utilisateur
MiroMind-M1 : Une avancée en raisonnement mathématique via l'optimisation multi-étapes de politique contextuelle
Optimisation de la politique budgétaire hiérarchique pour le raisonnement adaptatif
Captain Cinema : Vers la génération de courts métrages
LAPO : L'optimisation adaptative de la politique par l'intégration de l'efficacité du raisonnement
MUR : Raisonnement guidé par l'incertitude de la quantité de mouvement pour les grands modèles linguistiques
∇NABLA : Attention Adaptative par Bloc aux Voisinages
Optimisation de la politique des séquences de groupe
SafeWork-R1 : Coévolution de la sécurité et de l'intelligence en vertu de la loi AI-45
Découpler la connaissance et le raisonnement dans les LLM : Une exploration basée sur la théorie des deux systèmes cognitifs
Réf. : Form -- Réduction des prioris humains dans la vérification formelle logicielle évitable avec le renforcement par apprentissage dans les modèles de langage à grande échelle : Une étude préliminaire sur Dafny
RAVine : Évaluation alignée sur la réalité pour la recherche agente
Peut un domaine aider les autres ? Une étude centrée sur les données sur le raisonnement multi-domaines par apprentissage par renforcement
DesignLab : Conception de diapositives par détection et correction itératives
Yume : Un modèle de génération de monde interactif
Pixels, Motifs, mais pas de Poésie : Voir le Monde comme les Humains
Construction d'un MLLM ophtalmique pour la collaboration diagnostic-positionnelle par le raisonnement en chaîne cognitive clinique
HySafe-AI : Cadre d'analyse architectural de sécurité hybride pour les systèmes d'intelligence artificielle : Une étude de cas
Zebra-CoT : Un jeu de données pour le raisonnement multimodal vision-langage intercalé
Apprentissage par renforcement semi-off-policy pour le raisonnement lent vision-langage
Suréchantillonner ce qui compte : un échantillonnage latent adaptatif par région pour des transformateurs de diffusion accélérés
MegaScience : Pousser les limites des jeux de données post-entraînement pour le raisonnement scientifique
Rapport technique Step-Audio 2
Au-delà des limites du contexte : Fils subconscients pour un raisonnement à long terme
Cadre de gestion des risques liés à l'intelligence artificielle de pointe en pratique : Rapport technique d'analyse des risques
Transformateurs de connaissances conscients de l'incertitude pour le commerce d'énergie pair à pair avec l'apprentissage par renforcement multi-agents
Pas d'humains nécessaires : Recherche de triplets d'édition d'images autonome de haute qualité
Édition de niveau de pièce 3D robuste dans le recouvrement 3D Gaussien avec l'échantillonnage distillé des scores régularisés
WebShaper : Synthèse de données agissante par formalisation de la recherche d'information
L'Attelage invisible : pourquoi le RLVR ne peut-il pas s'échapper de son origine
GUI-G^2 : Modélisation de récompense gaussienne pour l'ancrage de l'interface graphique utilisateur
MiroMind-M1 : Une avancée en raisonnement mathématique via l'optimisation multi-étapes de politique contextuelle