Back to work

Bilingual Document Layout Vision

Vision model for Arabic/English document layout parsing and reading order.

Role
AI Engineer
Impact
Improved downstream OCR accuracy on mixed RTL/LTR documents by 18%.
Year
2023

Fine-tuned a layout-aware vision model to detect columns, tables, and reading order on bilingual Arabic/English documents. Output feeds directly into downstream OCR and structured extraction jobs.

Stack
Computer Vision · NLP