HyperAIHyperAI

Command Palette

Search for a command to run...

Updesh インド語合成テキストデータセット

日付

1年前

サイズ

16.09 GB

データセット構成

Microsoft

Updesh は、インド言語の大規模言語モデル (LLM) の事後トレーニングを容易にするために、2025 年に Microsoft によってリリースされたインド言語の合成テキスト データセットです。 データセットには、アッサム語、ベンガル語、グジャラート語、ヒンディー語、カンナダ語、マラヤーラム語、マラーティー語、ネパール語、オディア語、パンジャブ語、タミル語、テルグ語、ウルドゥー語の 6,800,000 件の推論データと 2,100,000 件の生成データが含まれています。

引用

@misc{chitale2026updeshsynthesizinggroundedinstruction、 title={UPDESH: 13 インド語のための接地された命令チューニングデータの合成}, author={プランジャール・A・チタレー、ヴァルン・グンマ、サンチット・アフージャ、プラシャント・コダリ、マナン・ウパディヤイ、ディープティ・スダルサン、スナヤナ・シタラム}、 年={2026}、 eprint={2509.21294}、 archivePrefix={arXiv}、 primaryClass={cs.CL}、 url={https://arxiv.org/abs/2509.21294}、 }

Updesh_beta.torrent
Seeding 2Downloading 0Completed 97Total Downloads 153
  • Updesh_beta/
    • README.md
      1.2 KB
    • README.txt
      2.4 KB
      • data/
        • Updesh_beta.zip
          16.09 GB

AIでAIを構築

アイデアからローンチまで — 無料のAIコーディング支援、すぐに使える環境、最高のGPU価格でAI開発を加速。

AI コーディング補助
すぐに使える GPU
最適な料金体系

HyperAI Newsletters

最新情報を購読する
北京時間 毎週月曜日の午前9時 に、その週の最新情報をメールでお届けします
メール配信サービスは MailChimp によって提供されています
Updesh インド語合成テキストデータセット | データセット | HyperAI超神経