Feature extraction and classification for bilingual script (Gurmukhi and Roman)
Explore this paper's citation graph
Summary
The main purpose of the research will be development of the methodology of a single OCR system, which will process bilingual documents typed in both Gurmukhi (Punjabi) and Roman (English), which will automatically recognize the script of each word of the document and invoke the appropriate recognition engine and recognize that word.
- Type
- article
- Published
- 2007-04-02
- Cited by
- 2
- References
- 6
- OpenAlex
- https://openalex.org/W48402163
- Semantic Scholar
- https://api.semanticscholar.org/CorpusID:59735162
Keywords
Computer science, Natural language processing, Artificial intelligence, Feature (linguistics), Process (computing)
References
- Script line separation from Indian multi-script documents
- A fast parallel algorithm for thinning digital patterns
- Indian script character recognition: a survey
- Automatic separation of words in multi-lingual multi-script Indian documents
- Classification of oriental and European scripts by using characteristic features
- Script identification in printed bilingual documents
Cited by
Related papers
- An Unconstrained and Effective Approach of Script Identification for Online Bilingual Handwritten Text
- Indian and European Script Identification: A Review
- Word Level Script Identification in Bilingual Documents through Discriminating Features
- Gabor Features Based Script Identification of Lines within a Bilingual/Trilingual Document
- Multiple Training - One Test Methodology for Handwritten Word-Script Identification
- Local features-based script recognition from printed bilingual document images