Command Palette
Search for a command to run...
Nemotron-Personas-Brazil 브라질 합성 캐릭터 데이터셋
Nemotron-Personas-Brazil은 NVIDIA가 WideLabs와 협력하여 2026년에 공개한 브라질 인구를 위한 합성 캐릭터 데이터셋입니다. 이 데이터셋은 브라질 인구의 다양성과 풍부함을 보여줌으로써 지역적 다양성(북부, 북동부, 중서부 등), 민족적 배경, 교육 수준, 직업 분포 등 다차원적인 잠재적 인구 분포를 보다 포괄적으로 반영하는 것을 목표로 합니다. 이 데이터 세트는 각각 6개의 복합 문자를 포함하는 100만 개의 레코드로 구성됩니다. 각 레코드는 6개의 문자 필드와 14개의 컨텍스트 필드로 이루어져 있으며, 컨텍스트 필드는 브라질의 공식 인구 구조 및 노동 시장 분포를 기반으로 통계적으로 구성되었습니다. 이 데이터는 브라질의 26개 주와 연방 직할구의 지리적 및 인구 통계학적 분포를 포괄합니다.
데이터 필드:
- UUID: 전역 고유 식별자
- professional_persona: 전문가 역할 설명
- sports_persona: 스포츠 페르소나 설명
- arts_persona: 예술가 페르소나에 대한 설명
- travel_persona: 여행자 캐릭터 설명
- 요리 캐릭터: 음식 캐릭터에 대한 설명
- 페르소나: 일반적인 역할 설명
- 문화적 배경: 문화적 배경에 대한 설명
- 기술 및 전문 지식: 기술 및 전문 지식에 대한 설명
- 취미 및 관심사: 취미 및 관심사에 대한 설명
- 기술 및 전문 지식 목록: 보유 기술 및 전문 지식 목록
- 취미 및 관심사 목록: 취미와 관심사 목록
- 직업 목표 및 포부:
- 성별: 생물학적 성별
- 나이: 나이
- marital_status: 결혼 여부
- education_level: 교육 수준
- 직업: 직종
- 자치단체: 시
- 상태: 상태
- 국가: 국가
소환
@software{nvidia/Nemotron-Personas-Brazil,
author = {Malossi, Rodrigo and Machado Jorge, Vitor Augusto and Behenck, Everton and Acharya, Evan and Prayaga, Shyamala and Manoel, Andre and Corneil, Dane and Meyer, Yev},
title = {{Nemotron-Personas-Brazil}: Synthetic Personas Aligned to Real-World Distributions},
month = {January},
year = {2026},
url = {https://huggingface.co/datasets/nvidia/Nemotron-Personas-Brazil}
}