Trouver une offreRecruteurs

Tech Lead LLM Python APIs RAG Web - pré embauche client final possible

Opportunité exclusive

Hybride

Tech Lead LLM Python APIs RAG Web - pré embauche client final possible

Naxo

Tech Lead LLM Python APIs RAG Web - pré embauche client final possible

Expertises

PythonAWSFastAPILLM integrationRAGAPI development

il y a 9 jours

Candidature rapide

Partagez cette opportunité

Partagez cette opportunité à quelqu’un de votre réseau :
✓ Offrez-lui un boost de visibilité auprès du client.
✓ Aidez vos contacts à trouver leur prochain job.

Information importante


Type de contrat:

Freelance / Contrat

Taux journalier :

Salaire selon profil

Localisation :

Paris, France

Mode de travail :

Hybride

Publié le :

25 septembre 2026

Le besoin


Contexte

PRE EMBAUCHE - 6 mois de mission maximum
Vous rejoignez l’équipe AI Service responsable d’une brique technologique stratégique de la plateforme du groupe. Mission internationale visant à fournir des capabilities IA aux produits utilisés par des professionnels du droit. En tant que Techlead, vous concevez des APIs robustes orchestrant des appels LLM, des pipelines RAG et des traitements massifs, avec contraintes de streaming, faible latence, concurrence, parallélisme, montée en charge, fiabilité et architecture multi-tenant (plusieurs pays).

Missions

  • Conception et développement des services de consommation d’indexation et de restitution de données éditoriales :

    • Architecture des APIs et workers, stratégie de cache, mécanismes de résilience (retries, circuit breakers, fallback modèles).

    • Intégration LLM : chaînes d'inférence (prompting, function calling, RAG, embeddings, agents), industrialisation via POCs et benchmarks.

    • Performance et scalabilité : arbitrage débit, latence et coût (synchrone/asynchrone).

  • APIs Web et performance (synchrone / asynchrone) :

    • Définition d’APIs (FastAPI) robustes et documentées : contrats, validation (Pydantic), authentification unifiée et propagation du contexte pays.

    • Maîtrise asyncio, concurrence, parallélisme ; implémentation du streaming LLM, gestion des timeouts, backpressure et annulation.

    • Observability et sécurité : télémétrie (logs, métriques, traces), gestion des secrets, Zero Trust, isolation des tokens.

  • Leadership technique et gouvernance :

    • Gouvernance Inner Source, accompagnement des squads, promotion des pratiques Clean Code, SOLID, tests automatisés, veille et rayonnement technique.

Stack technique

  • Langages : Python 3.11+ (maîtrise requise), Go, Java / Spring Boot

  • Web / APIs : FastAPI, Starlette, Pydantic, Uvicorn (ASGI)

  • Asynchrone : asyncio, httpx, concurrence et parallélisme (threads, process, workers)

  • LLM : OpenAI / Azure OpenAI, LangChain, Mistral, Bedrock, etc.

  • Cloud : AWS, Azure

  • Données & infra : OpenSearch, Weaviate, PostgreSQL, Redis, Celery, Kafka, Docker, CI/CD

  • Tests : Pytest, pytest-asyncio

Conditions de travail

  • Contrat : pré embauche, mission de 6 mois maximum

  • Environnement international, contexte européen quotidien

  • Rémunération : fourchette à définir

Informations complémentaires

Abonnez-vous à la page NaxoTech sur LinkedIn pour découvrir nos offres régulières :
👉 https://www.linkedin.com/company/naxotech

Profil recherché


  1. Diplôme : Master/Ingénieur/Ph.D
  2. Maîtrise requise de Python 3.11+
  3. Connaissance des langages : Go, Java / Spring Boot
  4. Expérience avec les frameworks Web / APIs : FastAPI, Starlette, Pydantic, Uvicorn (ASGI)
  5. Maîtrise de la programmation asynchrone : asyncio, httpx, gestion de la concurrence et du parallélisme (threads, process, workers)
  6. Expérience en intégration de modèles de langage (LLM) en production : OpenAI / Azure OpenAI, LangChain, Mistral, Bedrock, etc.
  7. Connaissance des environnements Cloud : AWS, Azure
  8. Compétences en données et infrastructure : OpenSearch, Weaviate, PostgreSQL, Redis, Celery, Kafka, Docker, CI/CD
  9. Maîtrise des tests : Pytest, pytest-asyncio
  10. Expérience en développement Python backend à grande échelle
  11. Maîtrise des contrats d'API, versioning, gestion des dépendances et des tokens
  12. Capacité à arbitrer entre synchrone et asynchrone tout en garantissant performance et sécurité
  13. Anglais fluide (contexte européen quotidien)

D'autres offres idéales pour vous !

Ces entreprises cherchent également d'excellents profils

Groupbees

Architecte Solution - Pré Embauche

Freelance

92400 Courbevoie, France

Hybride

Top Recruteur

Expertises

ZAPService-oriented architectureN-tier architectureUMLAPI architectureIdentity and Access ManagementCloud computingApplication integration

il y a 11 jours

Candidature rapide

Nexoris

Tech Lead IA générative – Agents, RAG et LLMOps

700

Freelance

Paris, France

Sur site, Hybride

Expertises

- Ingénierie logicielle : développement PythonAPI avec FastAPIDockerrevue de code et qualité logicielle. La connaissance du fine-tuning est attendue.Leadership technique sur des projets d’IA générativeavec une expérience concrète d’encadrement d’équipe. - LLMagents et orchestration multi-agents : conception de workflows fiables et maîtrise d’un ou plusieurs frameworks tels que LangChainLangGraphLlamaIndex ou AutoGen. - RAG et Context Engineering : bases vectoriellesingestion documentairerecherche et construction du contexte transmis aux modèles. - Évaluation et LLMOps : mesure de la qualité des réponsesitérationsmonitoring et observabilitéavec des outils tels que Langfuse ou équivalent.

il y a 9 jours

Candidature rapide

Veilos

Tech Lead IA générative (RAG, agents, MCP) - Banque

600

Freelance

Paris, France

Hybride

Expertises

LLMs / Large language models

il y a 3 jours

Candidature rapide

Le meilleur endroit pour trouver votre prochaine opportunité

© 2026. Tous droits réservés.

Talents

Trouver un job

Créer un profil

Solutions et outils