Trouver une offreRecruteurs

Expert Data & Retrieval - Legaltech

Opportunité exclusive

2 à 4 semaines

Sur site, Hybride

Expert Data & Retrieval - Legaltech

Salutech

Expert Data & Retrieval - Legaltech

Expertises

Data EngineeringPythonNLP / Natural Language ProcessingInformation RetrievalVector DatabasesRAG

il y a 3 jours

Opportunité exclusive

Partagez cette opportunité

Partagez cette opportunité à quelqu’un de votre réseau :
✓ Offrez-lui un boost de visibilité auprès du client.
✓ Aidez vos contacts à trouver leur prochain job.

Information importante


Type de contrat:

Freelance

Taux journalier :

Salaire selon profil

Localisation :

Paris, France

Date de démarrage :

2 à 4 semaines

Mode de travail :

Sur site, Hybride

Publié le :

27 août 2026

Le besoin


Contexte

Aux côtés d’une équipe d’experts passionnés au sein de l’équipe “AI Service”, vous relèverez les plus hauts défis techniques de la société, et du marché de l’édition juridique. En tant qu’Expert Data & Retrieval, vous êtes le garant de la matière première de notre IA : la collecte, l’ingestion, l’indexation et la recherche de pertinence sur des volumes juridiques massifs, le socle qui alimente nos modèles de langage et nos produits. Votre terrain de jeu : transformer la manière dont tout un secteur, le droit, travaille au quotidien.

Missions

Votre mission n'est pas d'écrire un simple script, mais de concevoir des pipelines de données robustes capables d'ingérer, de nettoyer et d'indexer d'énormes corpus juridiques, puis d'exposer une recherche rapide et pertinente (sémantique et hybride) au service de plusieurs équipes à travers l'Europe. Vous garantirez la fraîcheur des index et la qualité du retrieval tout en gérant une complexité technique de haut vol (volumétrie, hétérogénéité des sources, évaluation de la pertinence, scalabilité…).

Vos missions principales : bâtir, outiller, transmettre

  1. Collecte, ingestion & indexation

    • Pipelines d'ingestion : concevoir la collecte et le traitement de sources hétérogènes (édition, open data, bases juridiques), le parsing, le nettoyage, le chunking et la normalisation des documents.
    • Indexation & embeddings : choisir et industrialiser les modèles d'embeddings, alimenter et maintenir les bases vectorielles, gérer la fraîcheur et la reconstruction des index.
      • Qualité & volumétrie : garantir la scalabilité de l'indexation sur des corpus massifs et la traçabilité des données (lignage, versioning des index).
  2. Recherche & pertinence (Retrieval)

    • Stratégie de retrieval : combiner recherche lexicale et sémantique (BM25 + embeddings) avec reranking et filtrage par métadonnées pour maximiser la pertinence.
    • Évaluation continue : mettre en place des jeux de tests et des métriques de pertinence (recall, precision, nDCG, MRR) pour mesurer et améliorer le retrieval.
    • RAG : structurer la phase de récupération qui alimente les LLM (contexte, citations, dé-duplication, gestion des fenêtres de contexte).
    • Observability & Security : instrumenter les pipelines (logs, métriques, traces de qualité) et garantir la sécurité et la conformité des données juridiques (RGPD, cloisonnement par pays).
  3. Leadership Technique & Gouvernance

    • Culture Craftsmanship : promouvoir les pratiques de Clean Code, SOLID, et tests automatisés.
    • Rayonnement : assurer une veille constante et contribuer au rayonnement technique du groupe (articles, meetups, open-source).

Stack technique

  • Langages : Python 3.11+ (maîtrise requise), Go.
  • Indexation : bases vectorielles (pgvector, Weaviate, Qdrant, OpenSearch), recherche hybride / BM25.
  • Embeddings & NLP : sentence-transformers, modèles d'embeddings, tokenisation, parsing de documents.
  • RAG & LLM : LangChain, RAG, reranking, OpenAI, Mistral, Bedrock.
  • Data & infra : PostgreSQL, Airflow / Spark (ou équivalent), Kefka, Redis, Docker, CI/CD, K8S.
  • Tests : Pytest ; évaluation de la pertinence (recall, nDCG, MRR).

Fourchette de rémunération

[Information non communiquée]

Profil

  • Diplôme : Master, PhD, ou équivalent.

Profil recherché


  1. Diplôme : Master, PhD, ou équivalent
  2. Maîtrise requise de Python 3.11+
  3. Connaissance de Go
  4. Expérience avec bases vectorielles (pgvector, Weaviate, Qdrant, OpenSearch) et recherche hybride / BM25
  5. Compétences en embeddings & NLP : sentence-transformers, modèles d'embeddings, tokenisation, parsing de documents
  6. Expérience avec RAG & LLM : LangChain, RAG, reranking, OpenAI, Mistral, Bedrock
  7. Connaissances en data & infra : PostgreSQL, Airflow / Spark (ou équivalent), Kefka, Redis, Docker, CI/CD, K8S
  8. Maîtrise des tests : Pytest ; évaluation de la pertinence (recall, nDCG, MRR)
  9. Expérience avérée en data engineering / information retrieval sur des volumes massifs en production
  10. Expertise Retrieval : maîtrise de l'indexation, des embeddings et de la recherche hybride, capacité à mesurer et améliorer la pertinence
  11. Culture Data : pipelines reproductibles, qualité et lignage des données, versioning des datasets et des index
  12. Solide culture IA / ML : embeddings, NLP et bonne compréhension des LLM
  13. Polyvalence appréciée, notamment une appétence pour Java
  14. Anglais fluide (contexte européen quotidien)
  15. Vision Produit : compréhension des enjeux métiers du droit pour prioriser les fonctionnalités
  16. Leadership Technique & pédagogie : capacité à évangéliser les bonnes pratiques data, retrieval et IA
  17. Obsession de la Qualité : rigueur sur la sécurité des données et la fiabilité des services
  18. Esprit d'innovation : curiosité pour les avancées de l'écosystème IA, NLP et data
  19. Communication : savoir vulgariser des concepts complexes

D'autres offres idéales pour vous !

Ces entreprises cherchent également d'excellents profils

Raedy

Expert Data & Retrieval

Freelance

Dans 4 à 8 semaines

Paris, France

Hybride

Expertises

LLMs / Large language modelsPythonIArag

il y a 1 mois

Opportunité exclusive

LittleBig Connection (part of Mantu)

PRE EMBAUCHE - Tech lead Expert Data Retrieval RAG

Freelance

Urgent

92400 Courbevoie, France

Hybride

Expertises

Data engineering et information retrieval appliqués à l'IA

il y a 5 jours

Opportunité exclusive

Naxo

Tech Lead Expert Data Retrieval & RAG LegalTech - Pré embauche - client final

800

Freelance

Dans 2 à 4 semaines

Paris, France

Hybride

Expertises

Data EngineeringPythonInformation RetrievalRAGVector DatabasesEmbeddings

il y a 3 jours

Opportunité exclusive

Réseau professionnel conçu pour les talents

© 2026. Tous droits réservés.

Freelancers

Créer un profil

Rejoindre un collectif

Solutions et outils