Command Palette
Search for a command to run...
Ensemble De Données Textuelles Synthétiques En Updesh Indic
Updesh est un ensemble de données de texte synthétique en langue indienne publié par Microsoft en 2025 pour faciliter la post-formation des grands modèles linguistiques (LLM) pour les langues indiennes. L'ensemble de données contient 6 800 000 données d'inférence et 2 100 000 données générées dans les langues suivantes : assamais, bengali, gujarati, hindi, kannada, malayalam, marathi, népalais, odia, punjabi, tamoul, télougou et ourdou.
Citation
@misc{chitale2026updeshsynthesizinggroundedinstruction, titre={MISE À JOUR : Synthèse des données de réglage des instructions mises à la terre pour 13 Indic}, author={Pranjal A. Chitale et Varun Gumma et Sanchit Ahuja et Prashant Kodali et Manan Uppadhyay et Deepthi Sudharsan et Sunayana Sitaram}, année={2026}, eprint={2509.21294}, préfixe d'archive={arXiv}, primaryClass={cs.CL}, url={https://arxiv.org/abs/2509.21294}, }
Créer de l'IA avec l'IA
De l'idée au lancement — accélérez votre développement IA avec le co-codage IA gratuit, un environnement prêt à l'emploi et le meilleur prix pour les GPU.