Command Palette
Search for a command to run...
Nemotron-Personas-Brazil ブラジル合成文字データセット
Nemotron-Personas-Brazilは、NVIDIAがWideLabsと共同で2026年にリリースしたブラジルの合成キャラクターデータセットです。このデータセットは、ブラジルの人口の多様性と豊かさを示すことで、地域(北部、北東部、中西部など)、民族的背景、教育レベル、職業分布など、多次元的な潜在的な人口分布をより包括的に反映することを目的としています。 このデータセットには1,000,000件のレコードが含まれており、各レコードには6つの複合文字が含まれています。各レコードには6つの文字フィールドと14のコンテキストフィールドが含まれており、これらはブラジルの公式人口構造と労働市場分布に基づいて統計的に構築されています。このデータは、ブラジル全26州と連邦直轄領の地理的および人口統計的分布を網羅しています。
データフィールド:
- UUID:グローバル一意識別子
- プロフェッショナルなペルソナ:プロフェッショナルな役割の説明
- スポーツパーソナ:スポーツパーソナの説明
- arts_persona: 芸術家としてのペルソナの説明
- travel_persona: 旅行者のキャラクター説明
- 料理キャラクター:食べ物キャラクターの説明
- ペルソナ:一般的な役割の説明
- 文化的背景: 文化的背景の説明
- スキルと専門知識:スキルと専門知識の説明
- 趣味と興味:趣味と興味の説明
- スキルと専門知識のリスト: スキルと専門知識のリスト
- 趣味と興味のリスト: 趣味と興味のリスト
- キャリア目標と抱負:
- 性別:生物学的性別
- 年齢: 年齢
- marital_status: 婚姻状況
- 教育レベル: 教育レベル
- 職業:専門職
- 自治体: 市
- 状態: 状態
- 国: 国
引用
@software{nvidia/Nemotron-Personas-Brazil,
author = {Malossi, Rodrigo and Machado Jorge, Vitor Augusto and Behenck, Everton and Acharya, Evan and Prayaga, Shyamala and Manoel, Andre and Corneil, Dane and Meyer, Yev},
title = {{Nemotron-Personas-Brazil}: Synthetic Personas Aligned to Real-World Distributions},
month = {January},
year = {2026},
url = {https://huggingface.co/datasets/nvidia/Nemotron-Personas-Brazil}
}