Expertises
il y a 2 jours
Candidature rapide
Partagez cette opportunité
Partagez cette opportunité à quelqu’un de votre réseau :
✓ Offrez-lui un boost de visibilité auprès du client.
✓ Aidez vos contacts à trouver leur prochain job.
Information importante
Type de contrat:
Freelance / Contrat
Taux journalier :
Salaire selon profil
Localisation :
Paris, France
Mode de travail :
Hybride, Sur site
Publié le :
6 octobre 2026
Le besoin
Contexte
Vous concevez et déployez la plateforme stratégique d'IA qui alimente l'ensemble des produits du groupe utilisés quotidiennement par les professionnels. Votre rôle ne consiste pas à rédiger des scripts ou des démonstrateurs isolés, mais à concevoir, industrialiser et scaler des architectures d'APIs résilientes : orchestration d'appels LLM, pipelines RAG haute performance, traitement massif de données éditoriales et moteurs de recherche vectoriels. Vous intervenez sur une solution multi-tenant à l'échelle européenne, intégrant de fortes exigences de souveraineté des données, d'isolation sécurisée et de très faible latence (streaming temps réel).
Missions
Architecture & Ingénierie des Services IA
- Définir l'architecture des APIs et des workers asynchrones : mise en place de stratégies de cache avancées, circuit breakers, politiques de retries et bascules (fallbacks) multi-modèles.
- Concevoir et industrialiser les chaînes d’inférence LLM (RAG avancé, embeddings, function calling, agents autonomes).
- Piloter la performance et l'efficience : optimiser en continu le compromis débit / latence / coût d'inférence sous fortes charges de production.
- Réaliser des benchmarks comparatifs et challenger les choix technologiques et modèles (propriétaires et open-source).
Développement Backend & Performance Web
- Développer et maintenir des APIs haute performance via FastAPI et Pydantic (contrats stricts, validation, typage, gestion des contextes pays et multi-tenant).
- Exploiter la programmation asynchrone (asyncio, httpx, multiprocessing/threading) pour maximiser le débit et la réactivité des services.
- Implémenter le streaming fluide des réponses LLM (Server-Sent Events / WebSockets), la gestion du backpressure, des timeouts et de l'annulation de requêtes.
- Intégrer nativement la sécurité et l'observabilité (OpenTelemetry, traçabilité des inférences, isolation des tokens, approche Zero Trust).
Leadership Technique & Rayonnement
- Animer la gouvernance technique et promouvoir une culture Inner-Source (composants réutilisables, bibliothèques partagées inter-équipes).
- Accompagner les différentes squads produits (Search, Assistant IA, Édition) pour faciliter l'adoption et l'intégration des briques d'IA.
- Inculquer les standards de Craftsmanship (Clean Code, architecture hexagonale / SOLID, revues de code exigeantes, couverture de tests automatisés).
- Maintenir une veille constante sur l'écosystème IA et porter le rayonnement technique de l'organisation.
Outils & Environnement
- Backend Python : Python 3.11+, FastAPI, Starlette, Uvicorn, Pydantic
- Programmation asynchrone : asyncio, httpx, multiprocessing/threading
- Streaming : Server-Sent Events, WebSockets
- Observabilité et sécurité : OpenTelemetry, Zero Trust
- Bases de données et moteurs de recherche : OpenSearch / Elasticsearch, bases vectorielles (Weaviate, Qdrant ou équivalent), PostgreSQL, Redis
- Cloud & Conteneurisation : Docker, CI/CD, déploiement sur clouds publics (AWS ou Azure / Azure OpenAI)
- Tests : pytest, pytest-asyncio
Conditions de travail
- Localisation : Île-de-France (télétravail partiel / hybride)
- Contexte linguistique : Anglais professionnel quotidien (équipe et périmètre européens)
- Niveau d'études : Bac+5 (Diplôme d'ingénieur, Master informatique ou Ph.D)
- Expérience : 7 ans et plus en ingénierie logicielle backend, avec expérience avérée en Lead technique et intégration GenAI en production
Pourquoi rejoindre ce projet ?
- Un défi d'ingénierie rare : réconcilier la complexité des modèles de langage de pointe avec les contraintes strictes de fiabilité, de latence et de souveraineté d'un grand groupe.
- Une vision long terme : poser les fondations du socle technique européen pour les années à venir.
Profil recherché
- Bac+5 (Diplôme d'ingénieur, Master informatique ou Ph.D)
- 7 ans et plus d'expérience en ingénierie logicielle backend, avec expérience avérée en Lead technique et intégration GenAI en production
- Maîtrise experte de Python (3.11+) et de son écosystème web moderne (FastAPI, Starlette, Uvicorn, Pydantic)
- Connaissance approfondie d'asyncio, de la concurrence, des files de messages et des flux streaming
- Expérience concrète de mise en production d'architectures RAG, d'orchestrateurs IA et de moteurs vectoriels
- Pratique d'OpenSearch / Elasticsearch, de bases vectorielles (ex. Weaviate, Qdrant ou équivalent), de PostgreSQL et de Redis
- Solides bases en Docker, CI/CD, et déploiement sur les clouds publics (AWS ou Azure / Azure OpenAI)
- Maîtrise des tests unitaires et d'intégration asynchrones (pytest, pytest-asyncio)
- Anglais courant (environnement de travail international au quotidien)
- Connaissance opérationnelle d'un autre langage backend (Go ou Java / Spring Boot) appréciée
- Expérience sur des problématiques d'IA souveraine (modèles hébergés, vLLM, Ollama, respect strict RGPD / AI Act) appréciée
- Expérience de mise à l'échelle de plateformes multi-tenant à fort volume appréciée
- Vision Produit & Client interne : considérer les APIs comme des produits et les ingénieurs des squads produits comme utilisateurs
- Capacité à fédérer, transmettre, vulgariser et guider les développeurs juniors comme seniors
- Sensibilité aiguë aux enjeux de criticité et d'intégrité de la donnée juridique
D'autres offres idéales pour vous !
Ces entreprises cherchent également d'excellents profils
Unitech Solutions
Tech Lead Python - CDD
500€/jour
Freelance
Paris, France
Hybride
Expertises
il y a 4 jours
Candidature rapide
Salutech
Consultant Expert Intelligence Artificielle - IT
Freelance
Paris, France
Sur site, Hybride
Expertises
il y a 2 jours
Candidature rapide
LittleBig Connection (part of Mantu)
Développeur / Back End PHP
460€/jour
Freelance
Lille, France
Hybride, Sur site
Expertises
il y a 5 heures
Candidature rapide