HyperAI
Command Palette
Search for a command to run...
Quora 중복 질문 텍스트 분류 연구 데이터 세트
Quora 중복 질문 데이터 세트는 텍스트의 질문 쌍이 중복되는지 여부를 확인하는 데 사용되는 데이터 세트입니다. 이는 텍스트 분류 연구에 사용되며, 누구에게나 의미적으로 동등한 모델을 훈련하고 테스트할 수 있는 기회를 제공하는 것을 목표로 합니다. 이 데이터 세트는 잠재적인 질문-중복 쌍의 40만 개 이상의 행으로 구성되어 있으며, 각 행에는 질문 ID, 질문의 전체 텍스트, 행에 중복 쌍이 포함되어 있는지 여부를 나타내는 이진 값이 포함되어 있습니다. 이 데이터 세트는 2017년에 Quora 팀에서 공개했으며, 주요 게시자는 Shankar Iyer, Nikhil Dandekar, Kornél Csernai입니다.
quora_duplicate_questions.torrent
시딩 중 3다운로드 중 0완료됨 844총 다운로드 1,525
이 데이터셋은 커뮤니티 사용자가 기여한 것이며 교육 및 정보 제공 목적으로만 사용됩니다. 저작권 침해와 관련된 콘텐츠가 있는 경우 [email protected]로 문의하시면 신속하게 검토 및 삭제 처리하겠습니다.