Presentation
I am a specialist in Web Scraping, Document OCR, and Data Annotation, with a strong background in large-scale data extraction, structuring, and analysis. I help companies, researchers and AI teams transform raw data into actionable, clean and reliable information.
--Web Scraping & Data Extraction
Automated data extraction from simple or protected sites
Technologies: Selenium, BeautifulSoup, Playwright, APIs, Scrapy
--Cleanup, structuring and delivery in CSV, Excel, JSON or SQL base
Data enrichment from multiple sources
--OCR & Document Processing
Extract text from ID cards, administrative documents, invoices, complex PDFs
Technologies: Tesseract, EasyOCR, PaddleOCR, OpenCV
Post-processing: automatic correction, normalization, validation
Clear, actionable output for AI databases or workflows
--Data Annotation & AI Training Support
Annotation of text, image, classification, categorization
Labeling for NLP, OCR, Vision and LLM fine-tuning projects
Quality assured: guideline-driven, multi-pass verification
Experience in AI response evaluation and RAG/LLM tasks
🎯 The goal: to provide you with clean, reliable and perfectly structured data, ready for analysis, machine learning or integration into your systems.
