{"id":"https://openalex.org/W4417010008","doi":"https://doi.org/10.48550/arxiv.2512.02845","title":"Bangla Hate Speech Classification with Fine-tuned Transformer Models","display_name":"Bangla Hate Speech Classification with Fine-tuned Transformer Models","publication_year":2025,"publication_date":"2025-12-02","ids":{"openalex":"https://openalex.org/W4417010008","doi":"https://doi.org/10.48550/arxiv.2512.02845"},"language":null,"primary_location":{"id":"pmh:oai:arXiv.org:2512.02845","is_oa":true,"landing_page_url":"http://arxiv.org/abs/2512.02845","pdf_url":"https://arxiv.org/pdf/2512.02845","source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":"submittedVersion","is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"text"},"type":"preprint","indexed_in":["arxiv","datacite"],"open_access":{"is_oa":true,"oa_status":"green","oa_url":"https://arxiv.org/pdf/2512.02845","any_repository_has_fulltext":true},"authorships":[{"author_position":"first","author":{"id":"https://openalex.org/A5112103129","display_name":"Y. Jafari","orcid":null},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Jafari, Yalda Keivan","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]},{"author_position":"last","author":{"id":"https://openalex.org/A5063323796","display_name":"Krishno Dey","orcid":"https://orcid.org/0000-0002-3194-5483"},"institutions":[],"countries":[],"is_corresponding":false,"raw_author_name":"Dey, Krishno","raw_affiliation_strings":[],"raw_orcid":null,"affiliations":[]}],"institutions":[],"countries_distinct_count":0,"institutions_distinct_count":0,"corresponding_author_ids":[],"corresponding_institution_ids":[],"apc_list":null,"apc_paid":null,"fwci":null,"has_fulltext":false,"cited_by_count":0,"citation_normalized_percentile":null,"cited_by_percentile_year":null,"biblio":{"volume":null,"issue":null,"first_page":null,"last_page":null},"is_retracted":false,"is_paratext":false,"is_xpac":false,"primary_topic":{"id":"https://openalex.org/T12262","display_name":"Hate Speech and Cyberbullying Detection","score":0.9799000024795532,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},"topics":[{"id":"https://openalex.org/T12262","display_name":"Hate Speech and Cyberbullying Detection","score":0.9799000024795532,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10664","display_name":"Sentiment Analysis and Opinion Mining","score":0.002400000113993883,"subfield":{"id":"https://openalex.org/subfields/1702","display_name":"Artificial Intelligence"},"field":{"id":"https://openalex.org/fields/17","display_name":"Computer Science"},"domain":{"id":"https://openalex.org/domains/3","display_name":"Physical Sciences"}},{"id":"https://openalex.org/T10667","display_name":"Emotion and Mood Recognition","score":0.002300000051036477,"subfield":{"id":"https://openalex.org/subfields/3205","display_name":"Experimental and Cognitive Psychology"},"field":{"id":"https://openalex.org/fields/32","display_name":"Psychology"},"domain":{"id":"https://openalex.org/domains/2","display_name":"Social Sciences"}}],"keywords":[{"id":"https://openalex.org/keywords/bengali","display_name":"Bengali","score":0.9398000240325928},{"id":"https://openalex.org/keywords/baseline","display_name":"Baseline (sea)","score":0.6284999847412109},{"id":"https://openalex.org/keywords/decision-tree","display_name":"Decision tree","score":0.5134999752044678},{"id":"https://openalex.org/keywords/task","display_name":"Task (project management)","score":0.4997999966144562},{"id":"https://openalex.org/keywords/language-model","display_name":"Language model","score":0.4375999867916107},{"id":"https://openalex.org/keywords/transformer","display_name":"Transformer","score":0.4311000108718872},{"id":"https://openalex.org/keywords/support-vector-machine","display_name":"Support vector machine","score":0.42719998955726624},{"id":"https://openalex.org/keywords/random-forest","display_name":"Random forest","score":0.34769999980926514}],"concepts":[{"id":"https://openalex.org/C19235068","wikidata":"https://www.wikidata.org/wiki/Q9610","display_name":"Bengali","level":2,"score":0.9398000240325928},{"id":"https://openalex.org/C41008148","wikidata":"https://www.wikidata.org/wiki/Q21198","display_name":"Computer science","level":0,"score":0.6761000156402588},{"id":"https://openalex.org/C12725497","wikidata":"https://www.wikidata.org/wiki/Q810247","display_name":"Baseline (sea)","level":2,"score":0.6284999847412109},{"id":"https://openalex.org/C154945302","wikidata":"https://www.wikidata.org/wiki/Q11660","display_name":"Artificial intelligence","level":1,"score":0.5511000156402588},{"id":"https://openalex.org/C204321447","wikidata":"https://www.wikidata.org/wiki/Q30642","display_name":"Natural language processing","level":1,"score":0.5356000065803528},{"id":"https://openalex.org/C84525736","wikidata":"https://www.wikidata.org/wiki/Q831366","display_name":"Decision tree","level":2,"score":0.5134999752044678},{"id":"https://openalex.org/C2780451532","wikidata":"https://www.wikidata.org/wiki/Q759676","display_name":"Task (project management)","level":2,"score":0.4997999966144562},{"id":"https://openalex.org/C28490314","wikidata":"https://www.wikidata.org/wiki/Q189436","display_name":"Speech recognition","level":1,"score":0.4900999963283539},{"id":"https://openalex.org/C137293760","wikidata":"https://www.wikidata.org/wiki/Q3621696","display_name":"Language model","level":2,"score":0.4375999867916107},{"id":"https://openalex.org/C66322947","wikidata":"https://www.wikidata.org/wiki/Q11658","display_name":"Transformer","level":3,"score":0.4311000108718872},{"id":"https://openalex.org/C12267149","wikidata":"https://www.wikidata.org/wiki/Q282453","display_name":"Support vector machine","level":2,"score":0.42719998955726624},{"id":"https://openalex.org/C169258074","wikidata":"https://www.wikidata.org/wiki/Q245748","display_name":"Random forest","level":2,"score":0.34769999980926514},{"id":"https://openalex.org/C2776230583","wikidata":"https://www.wikidata.org/wiki/Q1322198","display_name":"Spoken language","level":2,"score":0.3458999991416931},{"id":"https://openalex.org/C119857082","wikidata":"https://www.wikidata.org/wiki/Q2539","display_name":"Machine learning","level":1,"score":0.31189998984336853},{"id":"https://openalex.org/C518677369","wikidata":"https://www.wikidata.org/wiki/Q202833","display_name":"Social media","level":2,"score":0.30660000443458557},{"id":"https://openalex.org/C11693617","wikidata":"https://www.wikidata.org/wiki/Q181839","display_name":"Pragmatics","level":2,"score":0.30160000920295715},{"id":"https://openalex.org/C23224414","wikidata":"https://www.wikidata.org/wiki/Q176769","display_name":"Hidden Markov model","level":2,"score":0.2985999882221222},{"id":"https://openalex.org/C129792486","wikidata":"https://www.wikidata.org/wiki/Q1050419","display_name":"Language identification","level":3,"score":0.29739999771118164},{"id":"https://openalex.org/C155092808","wikidata":"https://www.wikidata.org/wiki/Q182557","display_name":"Computational linguistics","level":2,"score":0.2879999876022339},{"id":"https://openalex.org/C61328038","wikidata":"https://www.wikidata.org/wiki/Q3358061","display_name":"Speech processing","level":2,"score":0.2791000008583069},{"id":"https://openalex.org/C91863865","wikidata":"https://www.wikidata.org/wiki/Q4349497","display_name":"Speech corpus","level":3,"score":0.27889999747276306}],"mesh":[],"locations_count":2,"locations":[{"id":"pmh:oai:arXiv.org:2512.02845","is_oa":true,"landing_page_url":"http://arxiv.org/abs/2512.02845","pdf_url":"https://arxiv.org/pdf/2512.02845","source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":"submittedVersion","is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"text"},{"id":"doi:10.48550/arxiv.2512.02845","is_oa":true,"landing_page_url":"https://doi.org/10.48550/arxiv.2512.02845","pdf_url":null,"source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":"cc-by","license_id":"https://openalex.org/licenses/cc-by","version":null,"is_accepted":false,"is_published":null,"raw_source_name":null,"raw_type":"Preprint"}],"best_oa_location":{"id":"pmh:oai:arXiv.org:2512.02845","is_oa":true,"landing_page_url":"http://arxiv.org/abs/2512.02845","pdf_url":"https://arxiv.org/pdf/2512.02845","source":{"id":"https://openalex.org/S4306400194","display_name":"arXiv (Cornell University)","issn_l":"2331-8422","issn":["2331-8422"],"is_oa":true,"is_in_doaj":false,"is_core":false,"host_organization":"https://openalex.org/I205783295","host_organization_name":"Cornell University","host_organization_lineage":["https://openalex.org/I205783295"],"host_organization_lineage_names":[],"type":"repository"},"license":null,"license_id":null,"version":"submittedVersion","is_accepted":false,"is_published":false,"raw_source_name":null,"raw_type":"text"},"sustainable_development_goals":[],"awards":[],"funders":[],"has_content":{"pdf":false,"grobid_xml":false},"content_urls":null,"referenced_works_count":0,"referenced_works":[],"related_works":[],"abstract_inverted_index":{"Hate":[0],"speech":[1,70,112],"recognition":[2],"in":[3,49,142],"low-resource":[4,170],"languages":[5],"remains":[6],"a":[7],"difficult":[8],"problem":[9],"due":[10],"to":[11],"insufficient":[12],"datasets,":[13],"orthographic":[14],"heterogeneity,":[15],"and":[16,30,59,83,86,92,108,148,162],"linguistic":[17],"variety.":[18],"Bangla":[19,45,171],"is":[20,46,154],"spoken":[21],"by":[22],"more":[23],"than":[24],"230":[25],"million":[26],"people":[27],"of":[28,62],"Bangladesh":[29],"India":[31],"(West":[32],"Bengal).":[33],"Despite":[34,139],"the":[35,63,74,115,122,128,133,160,169],"growing":[36],"need":[37,163],"for":[38,110,121,125,136,164,168],"automated":[39],"moderation":[40],"on":[41,68],"social":[42],"media":[43],"platforms,":[44],"significantly":[47],"under-represented":[48],"computational":[50],"resources.":[51],"In":[52],"this":[53],"work,":[54],"we":[55],"study":[56],"Subtask":[57,60],"1A":[58],"1B":[61],"BLP":[64],"2025":[65],"Shared":[66],"Task":[67],"hate":[69,111],"detection.":[71],"We":[72,98],"reproduce":[73],"official":[75],"baselines":[76],"(e.g.,":[77],"Majority,":[78],"Random,":[79],"Support":[80],"Vector":[81],"Machine)":[82],"also":[84,99],"produce":[85],"consider":[87],"Logistic":[88],"Regression,":[89],"Random":[90],"Forest,":[91],"Decision":[93],"Tree":[94],"as":[95,104],"baseline":[96,119],"methods.":[97],"utilized":[100],"transformer-based":[101,116,129],"models":[102,117,167],"such":[103],"DistilBERT,":[105],"BanglaBERT,":[106],"m-BERT,":[107],"XLM-RoBERTa":[109],"classification.":[113],"All":[114],"outperformed":[118],"methods":[120],"subtasks,":[123],"except":[124],"DistilBERT.":[126],"Among":[127],"models,":[130],"BanglaBERT":[131,144],"produces":[132],"best":[134],"performance":[135],"both":[137,146],"subtasks.":[138],"being":[140],"smaller":[141],"size,":[143],"outperforms":[145],"m-BERT":[147],"XLM-RoBERTa,":[149],"which":[150],"suggests":[151],"language-specific":[152],"pre-training":[153],"very":[155],"important.":[156],"Our":[157],"results":[158],"highlight":[159],"potential":[161],"pre-trained":[165],"language":[166],"language.":[172]},"counts_by_year":[],"updated_date":"2026-08-05T07:39:15.569665","created_date":"2025-12-04T00:00:00"}
