Md. Fahim Shahriar
Papers
2
Total Citations
7
H-Index
2
About
Md. Fahim Shahriar is a researcher specializing in natural language processing (NLP) and data mining, with a focused interest in advancing computational resources for low-resource languages. His major contributions center on the development of "BanglaLM," a data-mined Bangla corpus designed to support language model research for Bengali, one of the most widely spoken yet under-resourced languages in NLP. Through this work, Shahriar addresses critical gaps in linguistic data availability, enabling more robust machine understanding and analysis of Bangla. His most-cited paper, "BanglaLM: Data Mining based Bangla Corpus for Language Model Research" (2021), has garnered 5 citations, reflecting its foundational role in the field. A subsequent related publication has also contributed to this growing body of work. By creating accessible, high-quality datasets, Shahriar empowers researchers to train better language models for Bengali, facilitating applications in AI-driven communication, smart devices, and robotics. His efforts are pivotal in democratizing NLP technology for diverse linguistic communities, making him a notable figure in the push toward inclusive artificial intelligence.
Research Focus
Key Achievements
Top Papers
- 1BanglaLM: Data Mining based Bangla Corpus for Language Model Research5 citations · 2021
- 2BanglaLM: Bangla Corpus for Language Model Research2 citations · 2021