L'Académie d'intelligence artificielle de Pékin et d'autres universités et institutions ont conjointement proposé un cadre pour la génération de vidéos synchronisées audio-visuelles basé sur l'audio démixé, et ont vérifié l'efficacité du démixage audio et du contrôle multi-flux dans les tâches complexes de génération vidéo.
HyperAI a compilé une série de tutoriels et d'ensembles de données très précieux et largement applicables, du 15 au 19 décembre, couvrant de multiples domaines tels que la vision 3D, l'intelligence incarnée et la reconnaissance optique de caractères (OCR).
Le tutoriel « Sapin de Noël 3D basé sur la reconnaissance gestuelle » est désormais disponible sur le site web d'HyperAI (hyper.ai). Noël approche à grands pas ! Créez votre propre sapin !
Le professeur Yong Li et son équipe du département de génie électronique de l'université Tsinghua ont proposé une méthode de régression symbolique neuronale, ND², qui dérive automatiquement des formules mathématiques à partir de données pour caractériser la dynamique du système.
Le 16 décembre 2025, OpenAI a lancé FrontierScience, un test de référence conçu pour mesurer les capacités scientifiques de niveau expert, avec des scores GPT-5.2 surpassant ceux d'autres modèles de pointe.
À l'heure où la course mondiale à l'IA s'accélère, Dario Amodei, avec sa position minoritaire en faveur d'une « réglementation précoce », est devenu une force incontournable de la Silicon Valley.
En décembre 2025, NVIDIA a lancé un nouveau point d'entrée de programmation GPU appelé « cuTile », qui reconstruit le noyau GPU à travers un modèle de programmation basé sur des tuiles, permettant aux développeurs d'écrire des noyaux efficacement sans avoir à se plonger dans CUDA C++.
VibeVoice, le logiciel libre de Microsoft, peut synthétiser jusqu'à 90 minutes de parole avec jusqu'à quatre locuteurs dans une fenêtre contextuelle de 64 Ko, offrant un timbre plus riche, une intonation plus naturelle et capturant l'atmosphère d'une véritable conversation.
HyperAI a compilé une série de tutoriels et d'ensembles de données très précieux et largement applicables, du 8 au 12 décembre, couvrant de multiples domaines tels que les agents intelligents, la vision par ordinateur et la synthèse vocale.
Le modèle PET-MAD, proposé par l'École polytechnique fédérale de Lausanne (EPFL), atteint une précision comparable à celle des modèles dédiés tout en utilisant un nombre d'échantillons d'entraînement beaucoup plus faible que les modèles traditionnels.
HyperAI, en tant que communauté co-organisatrice de COSCon'25, a accueilli le « Forum de collaboration open source industrie-recherche » le 7 décembre. Cet article résume les points clés des présentations approfondies de quatre intervenants.
HyperAI a compilé une série de tutoriels et d'ensembles de données très précieux et largement applicables, du 17 au 21 novembre, couvrant de multiples domaines tels que la génération vidéo, l'édition d'images et la reconnaissance optique de caractères (OCR).
Meituan a publié en open source son dernier modèle de génération vidéo, LongCat-Video, qui vise à gérer diverses tâches de génération vidéo grâce à une architecture unifiée, notamment la conversion de texte en vidéo, d'image en vidéo et la continuation vidéo.
Une équipe interdisciplinaire, comprenant la Carnegie Institution for Science aux États-Unis, a mis au point une solution de « fusion technologique » combinant la pyrolyse, la chromatographie en phase gazeuse, la spectrométrie de masse et l'apprentissage automatique supervisé, capable de capturer d'anciennes traces de vie dans des fragments moléculaires chaotiques.
Le modèle de segmentation visuelle « SAM3 » est désormais disponible sur le site web d'HyperAI (hyper.ai) dans la section « Tutoriels ». Déployez-le et testez-le en un clic !
HyperAI a compilé une série de tutoriels et d'ensembles de données très précieux et largement applicables, du 17 au 21 novembre, couvrant de multiples domaines tels que la vision par ordinateur, la biologie et l'informatique multimodale.
En 2025, xAI a bénéficié d'un élan capitalistique sans précédent grâce à la forte impulsion de Musk, mais sa commercialisation dépendait encore fortement des écosystèmes X et Tesla, et les flux de trésorerie et la pression réglementaire ont augmenté simultanément.
À une époque où il est difficile de distinguer entre l'IA authentique et l'IA factice, Sam Altman et Alex Blania développent un système mondial de « vérification humaine » utilisant la reconnaissance de l'iris, mais l'expansion de Tools for Humanity est confrontée à de fortes pressions.
Une équipe composée de chercheurs de l'université de Stanford et d'autres institutions a développé un flux de travail basé sur les données pour identifier les quasars qui agissent comme de forts objets de lentille gravitationnelle dans les données spectrales de DESI DR1.
Le modèle « FLUX.2-dev : Génération et édition d’images » est désormais disponible dans la section tutoriels du site web HyperAI (hyper.ai). Lancez-vous dans l’aventure créative !
HyperAI a compilé une série de tutoriels et d'ensembles de données très précieux et largement applicables, du 24 au 28 novembre, couvrant de multiples domaines tels que les modèles 3D, la biomédecine et le raisonnement visuel.
Une équipe composée de Peptone, une société britannique de développement de technologies d'analyse des protéines, de NVIDIA, du MIT et d'autres partenaires, a réalisé deux avancées majeures. La première est le cadre d'évaluation des systèmes PeptoneBench, et la seconde est le modèle génératif PepTron.
À la lecture du CV de Hock Tan, les fusions-acquisitions sont un sujet incontournable. Chaque décision qu'il prend, au-delà du simple calcul des profits et du chiffre d'affaires, contribue à consolider progressivement la position de son entreprise sur le marché.