HyperAI
Command Palette
Search for a command to run...
MeetingBank-QA-Summary
MeetingBank-QA-Summary は、Microsoft が 2024 年に公開した、会議の文字起こしテキストの質問応答と要約生成に特化したデータセットです。関連する論文成果は「LLMLingua-2: Data Distillation for Efficient and Faithful Task-Agnostic Prompt Compression」であり、圧縮された会議の文字起こしテキストが下流タスクでどのような性能を発揮するかを評価することを目的としています。
このデータセットには、MeetingBank テストセットからの 862 件の会議の文字起こしテキストが含まれており、データサイズは約 13.4 MB で、GPT-4 によって生成された要約と高品質な質問応答ペアが付属しています。
データセットの構成
このデータセットには、以下の主要なフィールドと構造が含まれています:
- idx : サンプルインデックス。
- prompt: 会議の文字起こしテキスト。コンテキスト入力として使用されます。
- QA_pairs : 質問応答ペアのリストが含まれており、各質問応答ペアには以下が含まれます:
- answer : 質問の回答。
- question: 文字起こしテキストに基づいて生成された質問。
- summary : 生成された要約。
- gpt4_summary: GPT-4 によって生成された要約。
Citation
@inproceedings{pan2024llmlingua2,
title={LLMLingua-2: Data Distillation for Efficient and Faithful Task-Agnostic Prompt Compression},
author={Zhuoshi Pan and Qianhui Wu and Huiqiang Jiang and Menglin Xia and Xufang Luo and Jue Zhang and Qingwei Lin and Victor Rühle and Yuqing Yang and Chin-Yew Lin and H. Vicky Zhao and Lili Qiu and Dongmei Zhang},
year={2024},
booktitle = {Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics},
publisher = {Association for Computational Linguistics}
}
このデータセットはコミュニティユーザーによって提供されており、教育および情報提供のみを目的としています。著作権侵害に関わるコンテンツがある場合は、[email protected]までご連絡ください。速やかに確認し、削除いたします。