Command Palette
Search for a command to run...
Papers
Articles de recherche en IA de pointe mis à jour quotidiennement pour vous aider à suivre les dernières tendances en IA

Baichuan-M3 : Modélisation de l'interrogatoire clinique pour une prise de décision médicale fiable

Modélisation générative par dérive































Baichuan-M3 : Modélisation de l'interrogatoire clinique pour une prise de décision médicale fiable

Modélisation générative par dérive






























AlphaEdit : Édition de connaissances contrainte par espace nul pour les modèles de langage
Apprendre à raisonner en 13 paramètres
DFlash : Diffusion par blocs pour le décodage spéculatif Flash
Forçage de contexte : génération vidéo autoregressive cohérente avec un long contexte
MemSkill : Apprentissage et évolution de compétences mémoire pour des agents auto-évoluant
Optimisation de politique de séquence sans biais de longueur : Révélation et contrôle de la variation de longueur des réponses dans le cadre du RLVR
Spider-Sense : Détection intrinsèque des risques pour une défense d'Agent efficace basée sur un tri hiérarchique adaptatif
CAR-bench : Évaluation de la cohérence et de la prise en compte des limites des agents LLM face à l'incertitude du monde réel
Apprentissage de séquences de bout en bout en streaming avec modélisation de flux retardés
Kiss3DGen : Réutilisation des modèles de diffusion d'images pour la génération d'assets 3D
Conformer à état (Stateful Conformer) avec inférence basée sur le cache pour la reconnaissance automatique de la parole en flux (Streaming Automatic Speech Recognition)
Latents structurés natifs et compacts pour la génération 3D
Modèles de Langage Audio Continus
Évolution d'Agents de Diagnostic Interactifs dans un Environnement Clinique Virtuel
WeDLM : Réconcilier les modèles de langage par diffusion avec l'attention causale standard pour une inférence rapide
TurboDiffusion : accélérer les modèles de diffusion vidéo de 100 à 200 fois
HunyuanVideo-Foley : diffusion multimodale avec alignement de représentation pour la génération d'audio Foley de haute fidélité
Fara-7B : un modèle agissant efficace pour l'utilisation informatique
Rapport technique Fun-ASR
Accélération de la recherche scientifique avec Gemini : études de cas et techniques courantes
Faire croître de petits agents par le biais d'enchères stratégiques
Vibe AIGC : Un nouveau paradigme pour la génération de contenu par orchestration agente
PaperSearchQA : Apprendre à rechercher et à raisonner sur les articles scientifiques avec RLVR
EgoActor : Intégrer la planification de tâches dans des actions egocentriques conscientes de l'espace pour les robots humanoïdes via des modèles visuels-langagiers
A-RAG : Extension de la génération augmentée par récupération agente grâce à des interfaces de récupération hiérarchiques
Quant VideoGen : Génération vidéo longue auto-régressive via une quantification de cache KV à 2 bits
SoMA : Un simulateur neuronal de réalité à simulation pour la manipulation de corps souples robotiques
Contrôle implicite du mouvement 3D-conscient pour la génération de vidéos humaines adaptatives aux vues
daVinci-Agency : Déverrouiller les données d'agence à horizon long de manière efficace en termes de données
La recherche sur les modèles mondiaux n'est pas simplement une injection de connaissances mondiales dans des tâches spécifiques.
AlphaEdit : Édition de connaissances contrainte par espace nul pour les modèles de langage
Apprendre à raisonner en 13 paramètres
DFlash : Diffusion par blocs pour le décodage spéculatif Flash
Forçage de contexte : génération vidéo autoregressive cohérente avec un long contexte
MemSkill : Apprentissage et évolution de compétences mémoire pour des agents auto-évoluant
Optimisation de politique de séquence sans biais de longueur : Révélation et contrôle de la variation de longueur des réponses dans le cadre du RLVR
Spider-Sense : Détection intrinsèque des risques pour une défense d'Agent efficace basée sur un tri hiérarchique adaptatif
CAR-bench : Évaluation de la cohérence et de la prise en compte des limites des agents LLM face à l'incertitude du monde réel
Apprentissage de séquences de bout en bout en streaming avec modélisation de flux retardés
Kiss3DGen : Réutilisation des modèles de diffusion d'images pour la génération d'assets 3D
Conformer à état (Stateful Conformer) avec inférence basée sur le cache pour la reconnaissance automatique de la parole en flux (Streaming Automatic Speech Recognition)
Latents structurés natifs et compacts pour la génération 3D
Modèles de Langage Audio Continus
Évolution d'Agents de Diagnostic Interactifs dans un Environnement Clinique Virtuel
WeDLM : Réconcilier les modèles de langage par diffusion avec l'attention causale standard pour une inférence rapide
TurboDiffusion : accélérer les modèles de diffusion vidéo de 100 à 200 fois
HunyuanVideo-Foley : diffusion multimodale avec alignement de représentation pour la génération d'audio Foley de haute fidélité
Fara-7B : un modèle agissant efficace pour l'utilisation informatique
Rapport technique Fun-ASR
Accélération de la recherche scientifique avec Gemini : études de cas et techniques courantes
Faire croître de petits agents par le biais d'enchères stratégiques
Vibe AIGC : Un nouveau paradigme pour la génération de contenu par orchestration agente
PaperSearchQA : Apprendre à rechercher et à raisonner sur les articles scientifiques avec RLVR
EgoActor : Intégrer la planification de tâches dans des actions egocentriques conscientes de l'espace pour les robots humanoïdes via des modèles visuels-langagiers
A-RAG : Extension de la génération augmentée par récupération agente grâce à des interfaces de récupération hiérarchiques
Quant VideoGen : Génération vidéo longue auto-régressive via une quantification de cache KV à 2 bits
SoMA : Un simulateur neuronal de réalité à simulation pour la manipulation de corps souples robotiques
Contrôle implicite du mouvement 3D-conscient pour la génération de vidéos humaines adaptatives aux vues
daVinci-Agency : Déverrouiller les données d'agence à horizon long de manière efficace en termes de données
La recherche sur les modèles mondiaux n'est pas simplement une injection de connaissances mondiales dans des tâches spécifiques.