
Jesse Doniel
Jesse Doniel
Je ne me contente pas de construire des prototypes d’IA — je propose des systèmes LLM de qualité production qui servent 300 00+ utilisateurs actifs mensuels, réduisent la latence de près de moitié et réduisent les coûts cloud d’un tiers. L’écart entre « nous avons une clé API » et « l’IA transforme nos opérations » est un problème d’ingénierie. C’est ma spécialité.
Ce que je fais réellement
🧩 Systèmes LLM multi-agents & orchestration
A conçu des plateformes GenAI multi-agents utilisant Claude 3.7 Sonnet, GPT-4o, Gemini 2.0 Flash et LangGraph — incluant des intégrations d’outils MCP desservant 300K+ MAU. Je gère toute la chaîne : ingénierie des prompts, gestion du contexte, analyse syntaxique des sorties, validation structurée et boucles de raisonnement ReAct pour la fiabilité en production.
📚 Pipelines et systèmes de connaissances RAG
J’ai développé et déployé 12+ microservices RAG de production soutenus par la récupération hybride Qdrant, réduisant la latence de réponse de l’IA de 47 %. Je transforme vos documents internes, bases de données et connaissances du domaine en IA précise et consciente de l’entreprise — en utilisant Pinecone, Qdrant, Weaviate, FAISS et Chroma.
🤖 Automatisation des agents et flux de travail IA
Suppression de 41 % du triage manuel pour 200+ membres du personnel des opérations via les flux de travail agents LangChain + LangGraph. Je conçois des pipelines en plusieurs étapes qui gèrent de manière autonome le traitement des documents, l’enrichissement, les rapports et les mises à jour CRM — de manière fiable, en production.
⚙️ Affinage et optimisation du modèle
Mise en œuvre d’un ajustement fin LoRA/QLoRA sur Hugging Face Transformers pour le NLP financier spécifique à un domaine, obtenant une amélioration de précision de 33 % par rapport aux modèles de base. J’apporte une observabilité complète des LLM avec LangSmith et Weights & Biases sur tous les terminaux d’IA de production.
🔌 Backend natif cloud évolutif
Conception et mise à l’échelle des services backend gérant 5M+ requêtes API quotidiennes à 99,95 % de disponibilité sur AWS ECS et Lambda en utilisant Celery et Redis pour les charges de travail asynchrones des LLM. Expérience approfondie avec Docker, Kubernetes, Terraform et AWS Bedrock en auto-scaling.
🚀 Livraison d’applications IA full-stack
A construit des tableaux de bord de production avec Next.js streaming de routeurs d’applications 15 et une sortie de modèles en temps réel basée sur WebSocket — augmentant ainsi les performances de l’interface utilisateur GenAI de 38 %. Propriété de bout en bout : backends FastAPI/Node.js, frontends React 19, déploiements Docker, CI/CD GitHub Actions.
Ma pile
IA / LLM : Claude 3.7 Sonnet · GPT-4o · Gemini 2.0 Flash · LLaMA · Mistral · Visage de câlin
Orchestration : LangChain · LangGraph · LlamaIndex · MCP
Vecteur & RAG : Pinecone · Qdrant · FAISS · Tisser · Chroma
Langages : Python 3.12 · TypeScript 5 · Rouille · SQL · Bash
Frontend : React 19 · 15 Next.js · Tailwind CSS v4 · Zustand · Vercel AI SDK · WebSockets
Backend : FastAPI · 22 Node.js · tRPC · GraphQL · gRPC · Céleri · Redis
Cloud & DevOps : AWS Bedrock · ECS · Lambda · SageMaker · Docker · Kubernetes · Terraform · GitHub Actions
ML / Évaluations : PyTorch 2 · LoRA/QLoRA · LangSmith · Poids et biais · pandas · NumPy
Pourquoi les clients m’embauchent-ils
✅ Spécialiste de la production — pas de recherche, pas de théorie. Je propose des systèmes d’IA qui servent de manière fiable des centaines de milliers d’utilisateurs.
✅ J’ai rédigé 60+ RFC et documents de conception asynchrones d’architecture, communiquant clairement entre 4 équipes distantes distribuées.
✅ Je documente tout. Tu posséderas ce que je construirai et tu sauras comment l’entretenir.
✅ Honnêtement, je fais la visualisation dès le départ — pas de pivots surprises, pas de glissement silencieux de lunette.
✅ Je bouge vite sans couper sur l’architecture : de zéro à douze microservices en production.
Pas adapté si
❌ Il faut un data scientist pour entraîner les modèles à partir de zéro
❌ Vous voulez de l'« IA magique » sans d’abord comprendre vos propres flux de travail
❌ Vous n’êtes pas prêt à itérer — les vrais projets d’intégration nécessitent des boucles de rétroaction
💬 Travaillons ensemble
Envoyez-moi un message avec :
1. Les outils et systèmes que vous utilisez actuellement
2. Le processus que vous souhaitez que l’IA améliore ou automatise
3. Votre calendrier
Je répondrai dans quelques heures avec un plan clair — et je te dirai honnêtement si je suis la bonne personne.
Horaires de travail
- Lundi:08h00 à 18h00
- Mardi:08h00 à 18h00
- Mercredi:08h00 à 18h00
- Jeudi:08h00 à 18h00
- Vendredi:08h00 à 18h00
- Samedi:Non disponible
- Dimanche:Non disponible
- 🇬🇧 Anglais




