لدي سؤال؟ تواصل مع المجتمع في منتدى زيارة منتدى TensorFlow

clinc_oos

  • الوصف :

تحتاج أنظمة الحوار الموجهة نحو المهام إلى معرفة متى يقع الاستعلام خارج نطاق المقاصد المدعومة ، لكن هيئة تصنيف النص الحالية تحدد فقط مجموعات الملصقات التي تغطي كل مثال. نقدم مجموعة بيانات جديدة تتضمن استعلامات خارج النطاق (OOS) ، أي الاستعلامات التي لا تندرج في أي من أهداف النظام المدعومة. يمثل هذا تحديًا جديدًا لأن النماذج لا يمكنها افتراض أن كل استعلام في وقت الاستدلال ينتمي إلى فئة الهدف المدعومة من النظام. تغطي مجموعة البيانات الخاصة بنا أيضًا 150 فئة نوايا في أكثر من 10 نطاقات ، حيث تلتقط النطاق الذي يجب أن يتعامل معه وكيل مهام الإنتاج. إنه يوفر طريقة لمقارنة تصنيف النص بشكل أكثر صرامة وواقعية في أنظمة الحوار التي تعتمد على المهام.

  • الصفحة الرئيسية : https://github.com/clinc/oos-eval/

  • كود المصدر : tfds.text.ClincOOS

  • إصدارات :

    • 0.1.0 (افتراضي): لا توجد ملاحظات حول الإصدار.
  • حجم التحميل : 256.01 KiB

  • حجم مجموعة البيانات : 3.40 MiB

  • التخزين المؤقت التلقائي ( الوثائق ): نعم

  • الانقسامات :

انشق، مزق أمثلة
'test' 4500
'test_oos' 1،000
'train' 15000
'train_oos' 100
'validation' 3000
'validation_oos' 100
  • الميزات :
FeaturesDict({
    'domain': tf.int32,
    'domain_name': Text(shape=(), dtype=tf.string),
    'intent': tf.int32,
    'intent_name': Text(shape=(), dtype=tf.string),
    'text': Text(shape=(), dtype=tf.string),
})
  • الاقتباس :
@inproceedings{larson-etal-2019-evaluation,
    title = "An Evaluation Dataset for Intent Classification and Out-of-Scope Prediction",
    author = "Larson, Stefan  and
      Mahendran, Anish  and
      Peper, Joseph J.  and
      Clarke, Christopher  and
      Lee, Andrew  and
      Hill, Parker  and
      Kummerfeld, Jonathan K.  and
      Leach, Kevin  and
      Laurenzano, Michael A.  and
      Tang, Lingjia  and
      Mars, Jason",
    booktitle = "Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing and the 9th International Joint Conference on Natural Language Processing (EMNLP-IJCNLP)",
    month = nov,
    year = "2019",
    address = "Hong Kong, China",
    publisher = "Association for Computational Linguistics",
    url = "https://www.aclweb.org/anthology/D19-1131",
    doi = "10.18653/v1/D19-1131",
    pages = "1311--1316",
}