Bilingual Document Layout Vision
Vision model for Arabic/English document layout parsing and reading order.
Role
AI Engineer
Impact
Improved downstream OCR accuracy on mixed RTL/LTR documents by 18%.
Year
2023
Fine-tuned a layout-aware vision model to detect columns, tables, and reading order on bilingual Arabic/English documents. Output feeds directly into downstream OCR and structured extraction jobs.
Stack
Computer Vision · NLP