⚡
Présentation
Je suis ingénieur en IA spécialisé dans les systèmes LLM de qualité production, la génération augmentée par récupération (RAG) et le NLP arabe. J’ai une expérience pratique dans le déploiement de serveurs d’inférence vLLM avec quantification AWQ (en obtenant une réduction de latence de 43x), la construction de pipelines de recherche vectorielle avec pgvector, l’intégration de Whisper STT, et la conception d’architectures d’IA multimodales utilisant Docker et Portainer.
Mon expertise inclut : l’ajustement fin et l’optimisation des LLM, le NLP en dialecte arabe (MARBERT, Llama), les systèmes d’agents vocaux avec latence inférieure à 2, la classification visuelle basée sur CLIP, et les API de streaming SSE.
Je soutiens les clients de la conception architecturale au déploiement complet — que vous ayez besoin d’un assistant IA personnalisé, d’un agent vocal arabe, d’un système de recherche sémantique ou d’un backend IA évolutif. Je fournis des solutions propres, documentées et prêtes à la production, adaptées à vos objectifs.
⭐
Avis
Aucun avis
⚠️
Merci de vous
connecter en tant que client pour pouvoir donner votre avis
💬Aucun avis pour le moment.
Soyez le premier à partager votre expérience avec ce professionnel.