MATNLARDAN TOKSIK (ZARARLI) KONTENTNI ANIQLASH UCHUN SUN'IY INTELLEKT MODELINI YARATISH
Qabul qilingan: 2026-05-30
Nashr etilgan: 2026-06-06
Annotatsiya
Ushbu maqolada matnlardagi toksik va zararli kontentni avtomatik aniqlash muammosi ko'rib chiqiladi. Ijtimoiy tarmoqlar va onlayn platformalarda toksik mazmunning ko'payishi nafaqat foydalanuvchilarga, balki jamiyatga ham salbiy ta'sir ko'rsatmoqda. Tadqiqotda gibrid sun'iy intellekt arxitekturasi taklif etilgan bo'lib, u BERT asosidagi transformerlar va ikki yo'nalishli LSTM tarmoqlarini birlashtirib ishlatadi. Taklif etilgan model O'zbekiston ijtimoiy tarmoqlaridan yig'ilgan o'zbek va rus tillardagi aralash matnlar asosida mashq qildirildi. Tajribalar natijasida model 94,7% aniqlik (accuracy), 93,2% to'liqlik (recall) va 94,0% F1-ko'rsatkich qiymatlariga erishdi. Bundan tashqari, maqolada ma'lumotlar to'plami tayyorlash, modelni baholash mezonlari va real vaqt rejimida qo'llash imkoniyatlari tahlil qilingan.
Kalit so‘zlar
Adabiyotlar ro'yxati
-
Nobata, C., Tetreault, J., Thomas, A., Mehdad, Y., & Chang, Y. (2016). Abusive Language Detection in Online User Content. Proceedings of WWW 2016, 145–153.
-
Davidson, T., Warmsley, D., Macy, M., & Weber, I. (2017). Automated Hate Speech Detection and the Problem of Offensive Language. Proceedings of ICWSM 2017, 512–515.
-
Devlin, J., Chang, M. W., Lee, K., & Toutanova, K. (2019). BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding. Proceedings of NAACL-HLT 2019, 4171–4186.
-
Zhang, Y., Wallace, B. (2018). A Sensitivity Analysis of (and Practitioners' Guide to) Convolutional Neural Networks for Sentence Classification. Proceedings of IJCNLP, 253–263.
-
Zampieri, M., Malmasi, S., Nakov, P., Rosenthal, S. (2019). Predicting the Type and Target of Offensive Posts in Social Media. Proceedings of NAACL-HLT 2019, 1415–1420.
-
Kovačević, A., Dragović, I., Kosmajac, D. (2021). Offensive Language Detection in Serbian Texts Using Fine-Tuned BERT. Applied Sciences, 11(12), 5611.
-
Mulki, H., Zaghouani, W. (2021). HabiRemoved: Hate Speech and Offensive Language Detection for Arabic. ACL Anthology Workshop Proceedings.
-
Mamatov, A., Yusupov, K., Tursunov, O. (2020). Developing Word Embeddings for Uzbek Language Processing. Uzbek Journal of Information Technologies, 4(2), 31–44.
-
Yusupov, B., Khoroshevsky, V. (2022). Social Media Text Analysis for Uzbek Language: Challenges and Opportunities. Proc. TürkLang 2022, 88–97.
-
Shokh, A., Yulchiev, D. (2023). Code-Switching in Uzbek Digital Communication: Linguistic Patterns and Computational Challenges. Central Asian Computational Linguistics Conference, 14–22.
Mualliflar haqida
Litsenziya

This work is licensed under a Creative Commons Attribution 4.0 International License.