Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

Time-to-Move : Génération de vidéos contrôlées par le mouvement sans entraînement via le débruitage à horloge double

Lumine : Une Recette Ouverte pour Construire des Agents Généralistes dans les Mondes Ouverts 3D































Time-to-Move : Génération de vidéos contrôlées par le mouvement sans entraînement via le débruitage à horloge double

Lumine : Une Recette Ouverte pour Construire des Agents Généralistes dans les Mondes Ouverts 3D






























Générer une image à partir de 1 000 mots : améliorer la génération d'images à partir de textes grâce à des légendes structurées
KLASS : Inférence rapide guidée par KL dans les modèles de diffusion masqués
Fonder des agents d'utilisation des ordinateurs sur des démonstrations humaines
Wasm : Un pipeline pour la construction de corpus multimodaux arabe structurés et entrelacés
Amélioration adaptative de la réponse multi-agent dans les systèmes conversationnels
SPAN : Alignement par projection spatiale pour la détection 3D monoculaire d'objets
Approximation efficace des séries de Volterra pour les systèmes à hautes dimensions
SofT-GRPO : Dépasser l'apprentissage par renforcement des modèles linguistiques à tokens discrets grâce à l'optimisation de politique à pensée douce réparamétrée par Gumbel
RedOne 2.0 : Repenser l'entraînement postérieur des grands modèles linguistiques spécifiques à un domaine dans les services de réseaux sociaux
La Station : Un environnement ouvert pour l'exploration guidée par l'intelligence artificielle
DRIVE : Meilleures pratiques de curatation de données pour l'apprentissage par renforcement avec récompense vérifiable dans la génération de code compétitive
IterResearch : Repenser les agents à horizon long par reconstruction d'état markovienne
HaluMem : Évaluation des hallucinations dans les systèmes de mémoire des agents
GVPO : Optimisation de la politique par variance de groupe pour le post-entraînement des grands modèles linguistiques
ReCA : Accélération Intégrée pour des Agents Autonomes Embodiment Coopératifs en Temps Réel et Économiques
DexFlyWheel : un cadre évolutif et auto-améliorant pour la génération de données en manipulation habile
NovaFlow : Manipulation zéro-shot à l'aide d'un flux actionnable issu de vidéos générées
TreeSynth : Synthèse de données diverses à partir de zéro par partitionnement de sous-espace guidé par arbre
GTA : apprentissage par renforcement guidé par supervision pour la classification de texte avec des modèles de langage à grande échelle
Modélisation des ensembles conformationnels de protéines avec des petites molécules par PLACER
Ingénierie agente de contexte : Évolution des contextes pour des modèles linguistiques à amélioration autonome
DiaMoE-TTS : un cadre unifié de synthèse vocale de dialectes basé sur l'ALI avec mélange d'experts et adaptation zéro-shot à faible consommation de paramètres
Assemblage assisté par AR avec l'aide de l'IA : reconnaissance d'objets et vision par ordinateur pour l'assemblage assisté par réalité augmentée
Jailbreaking dans la meule de foin
CritiCal : La critique peut-elle aider à calibrer l’incertitude ou la confiance des grands modèles linguistiques ?
Vers une réduction des hallucinations dans les grands modèles vision-langage par le raffinement des embeddings textuels
Affinage spatial visuel
Trop bon pour être mauvais : À propos de l'échec des modèles linguistiques massifs à incarner des méchants
DeepEyesV2 : Vers un modèle multimodal agissant
Utilisation de la surveillance continue de la glycémie associée à l'apprentissage automatique pour identifier des sous-phénotypes métaboliques et guider des modifications du mode de vie personnalisées
Générer une image à partir de 1 000 mots : améliorer la génération d'images à partir de textes grâce à des légendes structurées
KLASS : Inférence rapide guidée par KL dans les modèles de diffusion masqués
Fonder des agents d'utilisation des ordinateurs sur des démonstrations humaines
Wasm : Un pipeline pour la construction de corpus multimodaux arabe structurés et entrelacés
Amélioration adaptative de la réponse multi-agent dans les systèmes conversationnels
SPAN : Alignement par projection spatiale pour la détection 3D monoculaire d'objets
Approximation efficace des séries de Volterra pour les systèmes à hautes dimensions
SofT-GRPO : Dépasser l'apprentissage par renforcement des modèles linguistiques à tokens discrets grâce à l'optimisation de politique à pensée douce réparamétrée par Gumbel
RedOne 2.0 : Repenser l'entraînement postérieur des grands modèles linguistiques spécifiques à un domaine dans les services de réseaux sociaux
La Station : Un environnement ouvert pour l'exploration guidée par l'intelligence artificielle
DRIVE : Meilleures pratiques de curatation de données pour l'apprentissage par renforcement avec récompense vérifiable dans la génération de code compétitive
IterResearch : Repenser les agents à horizon long par reconstruction d'état markovienne
HaluMem : Évaluation des hallucinations dans les systèmes de mémoire des agents
GVPO : Optimisation de la politique par variance de groupe pour le post-entraînement des grands modèles linguistiques
ReCA : Accélération Intégrée pour des Agents Autonomes Embodiment Coopératifs en Temps Réel et Économiques
DexFlyWheel : un cadre évolutif et auto-améliorant pour la génération de données en manipulation habile
NovaFlow : Manipulation zéro-shot à l'aide d'un flux actionnable issu de vidéos générées
TreeSynth : Synthèse de données diverses à partir de zéro par partitionnement de sous-espace guidé par arbre
GTA : apprentissage par renforcement guidé par supervision pour la classification de texte avec des modèles de langage à grande échelle
Modélisation des ensembles conformationnels de protéines avec des petites molécules par PLACER
Ingénierie agente de contexte : Évolution des contextes pour des modèles linguistiques à amélioration autonome
DiaMoE-TTS : un cadre unifié de synthèse vocale de dialectes basé sur l'ALI avec mélange d'experts et adaptation zéro-shot à faible consommation de paramètres
Assemblage assisté par AR avec l'aide de l'IA : reconnaissance d'objets et vision par ordinateur pour l'assemblage assisté par réalité augmentée
Jailbreaking dans la meule de foin
CritiCal : La critique peut-elle aider à calibrer l’incertitude ou la confiance des grands modèles linguistiques ?
Vers une réduction des hallucinations dans les grands modèles vision-langage par le raffinement des embeddings textuels
Affinage spatial visuel
Trop bon pour être mauvais : À propos de l'échec des modèles linguistiques massifs à incarner des méchants
DeepEyesV2 : Vers un modèle multimodal agissant
Utilisation de la surveillance continue de la glycémie associée à l'apprentissage automatique pour identifier des sous-phénotypes métaboliques et guider des modifications du mode de vie personnalisées