• English
    • العربية
  • English
  • تسجيل الدخول
  • جامعة قطر
  • مكتبة جامعة قطر
  •  الصفحة الرئيسية
  • الوحدات والمجموعات
  • المساعدة
    • إرسال الأعمال الأكاديمية
    • سياسات الناشر
    • أدلة المستخدم
    • الأسئلة الأكثر تكراراً
  • عن المستودع الرقمي
    • الرؤية والرسالة
عرض التسجيلة 
  •   مركز المجموعات الرقمية لجامعة قطر
  • المستودع الرقمي لجامعة قطر
  • أكاديمية
  • رسائل الماجستير وأطروحات الدكتوراه
  • كلية الهندسة
  • الحوسبة
  • عرض التسجيلة
  • مركز المجموعات الرقمية لجامعة قطر
  • المستودع الرقمي لجامعة قطر
  • أكاديمية
  • رسائل الماجستير وأطروحات الدكتوراه
  • كلية الهندسة
  • الحوسبة
  • عرض التسجيلة
  •      
  •  
    JavaScript is disabled for your browser. Some features of this site may not work without it.

    USING EMBEDDED MACHINE LEARNING IN THE PHYSICAL WORLD TO DETECT TOXICITY IN SPOKEN LANGUAGE

    عرض / فتح
    Ahlam Abu Nada_ OGS Approved Thesis.pdf (1.225Mb)
    التاريخ
    2023-06
    المؤلف
    ABU NADA, AHLAM HUSNI
    البيانات الوصفية
    عرض كامل للتسجيلة
    الملخص
    Toxicity is a prevalent social behavior that involves the use of hate speech, offensive language, bullying, and abusive speech. While text-based approaches for toxicity detection are common, there is limited research on processing speech signals in the physical world. Detecting toxicity in the physical world is challenging due to the difficulty of integrating AI-capable computers into the environment. We propose a lightweight transformer model based on wav2vec2.0 and optimize it using quantization and knowledge distillation techniques. Our model uses multitask learning and achieves an average macro F1-score of 90.3% and a weighted accuracy of 88%, outperforming state-ofthe- art methods on DeToxy-B and the IEMOCAP datasets. In our study, quantization demonstrated a significant reduction in model size by almost fourfold and a 3.3-fold decrease in RAM usage. The marginal average F1 score decrease was limited to only 1%. On the other hand, knowledge distillation resulted in a reduction of model size by 3.7 times, RAM usage by 1.9 times, and inference time by 1.7 times, accompanied by an accuracy decrease of 8%. The combination of both techniques yielded substantial outcomes, including a remarkable model size reduction by a factor of 14.6, approximately 4.3 times lower RAM usage, and a notable 2.4-fold improvement in inference time. Our compact model is the first end-to-end speech-based toxicity detection model based on a lightweight transformer model suitable for deployment in physical spaces. The results show its feasibility for toxicity detection on edge devices in real-world environments.
    DOI/handle
    http://hdl.handle.net/10576/45069
    المجموعات
    • الحوسبة [‎103‎ items ]

    entitlement


    مركز المجموعات الرقمية لجامعة قطر هو مكتبة رقمية تديرها مكتبة جامعة قطر بدعم من إدارة تقنية المعلومات

    اتصل بنا | ارسل ملاحظاتك
    اتصل بنا | ارسل ملاحظاتك | جامعة قطر

     

     

    الصفحة الرئيسية

    أرسل عملك التابع لجامعة قطر

    تصفح

    محتويات مركز المجموعات الرقمية
      الوحدات والمجموعات تاريخ النشر المؤلف العناوين الموضوع النوع اللغة الناشر
    هذه المجموعة
      تاريخ النشر المؤلف العناوين الموضوع النوع اللغة الناشر

    حسابي

    تسجيل الدخول

    إحصائيات

    عرض إحصائيات الاستخدام

    عن المستودع الرقمي

    الرؤية والرسالة

    المساعدة

    إرسال الأعمال الأكاديميةسياسات الناشرأدلة المستخدمالأسئلة الأكثر تكراراً

    مركز المجموعات الرقمية لجامعة قطر هو مكتبة رقمية تديرها مكتبة جامعة قطر بدعم من إدارة تقنية المعلومات

    اتصل بنا | ارسل ملاحظاتك
    اتصل بنا | ارسل ملاحظاتك | جامعة قطر

     

     

    Video