Command Palette
Search for a command to run...
مجموعة بيانات مايكروسوفت للأبحاث حول الإجابة التسلسلية على الأسئلة
Microsoft Research Sequential Question Answering هو مجموعة بيانات أصدرتها Microsoft Research في عام 2017 لمهام الإجابة على الأسئلة التسلسلية، وتهدف إلى استكشاف سيناريوهات الحوار الطبيعية الأكثر واقعية، وحل مشكلة الأسئلة الطويلة المعقدة وغير الطبيعية في التحليل الدلالي التقليدي.
تحتوي مجموعة البيانات هذه على 17,553 سؤالًا، مقسمة إلى 6,066 تسلسلًا، ويرتبط كل سؤال بمواقع الخلايا في الجدول كإجابة. تستند البيانات إلى مجموعة بيانات WikiTableQuestions، وتم إنشاؤها بواسطة عمال التعهيد الجماعي عن طريق تحليل الأسئلة الأصلية.
مكونات مجموعة البيانات
تنقسم مجموعة البيانات إلى الأجزاء الثلاثة التالية:
- مجموعة التدريب (train): 12,276 عينة.
- مجموعة التحقق (validation): 2,265 عينة.
- مجموعة الاختبار (test): 3,012 عينة.
تحتوي كل عينة بشكل أساسي على الحقول التالية:
- id: المعرّف الفريد لتسلسل الأسئلة.
- annotator: معرّف المُعلِّق.
- position: موضع السؤال في التسلسل.
- question: نص السؤال.
- table_file: ملف الجدول المرتبط.
- table_header: أسماء أعمدة الجدول.
- table_data: بيانات الجدول، مخزنة كمصفوفة ثنائية الأبعاد.
- answer_coordinates: إحداثيات الصف والعمود للخلية التي تحتوي الإجابة.
- answer_text: محتوى نص الإجابة.
Citation```bibtex
@inproceedings{iyyer-etal-2017-search, title = "Search-based Neural Structured Learning for Sequential Question Answering", author = "Iyyer, Mohit and Yih, Wen-tau and Chang, Ming-Wei", booktitle = "Proceedings of the 55th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)", month = jul, year = "2017", address = "Vancouver, Canada", publisher = "Association for Computational Linguistics", url = "https://aclanthology.org/P17-1167", doi = "10.18653/v1/P17-1167", pages = "1821--1831", }
بناء الذكاء الاصطناعي بالذكاء الاصطناعي
من الفكرة إلى الإطلاق — سرّع تطوير الذكاء الاصطناعي الخاص بك مع المساعدة البرمجية المجانية بالذكاء الاصطناعي، وبيئة جاهزة للاستخدام، وأفضل أسعار لوحدات معالجة الرسومات.