Trouver une offreRecruteurs

Senior AI/LLM Engineer – IA Générative & Agentique (RAG, Fine-tuning, Inférence)

Opportunité exclusive

2 à 4 semaines

Hybride

Senior AI/LLM Engineer – IA Générative & Agentique (RAG, Fine-tuning, Inférence)

Prad Conseil

Senior AI/LLM Engineer – IA Générative & Agentique (RAG, Fine-tuning, Inférence)

Expertises

LLMs / Large language modelsPythonRAGFine-tuningMLOps

il y a 12 jours

Opportunité exclusive

Partagez cette opportunité

Partagez cette opportunité à quelqu’un de votre réseau :
✓ Offrez-lui un boost de visibilité auprès du client.
✓ Aidez vos contacts à trouver leur prochain job.

Information importante


Type de contrat:

Freelance

Taux journalier :

Salaire selon profil

Localisation :

Paris, France

Date de démarrage :

2 à 4 semaines

Mode de travail :

Hybride

Publié le :

18 août 2026

Le besoin


CONTEXTE

Vous rejoignez la division IA d'une grande banque d'investissement européenne, au sein de la plateforme CIB. L'équipe Data Science conçoit et délivre des produits IA déjà en production : extraction automatisée de données à partir de documents financiers, chatbot agentique et génération de données. Ces produits sont utilisés au quotidien par les équipes métiers — vos améliorations ont un impact direct et mesurable.

VOS MISSIONS

• Concevoir, fine-tuner et améliorer des pipelines RAG et agentiques en production

• Travailler sur l'inférence de modèles : déploiement de LLMs sur GPU (vLLM), optimisation latence / débit / coûts

• Mettre en place l'évaluation et l'observabilité des pipelines IA (Phoenix/Arize, DSPy) : datasets d'évaluation, métriques de qualité, boucles d'amélioration continue

• Améliorer en continu la qualité d'extraction et les performances des agents

• Partager vos connaissances et coacher les profils moins expérimentés

POURQUOI CETTE MISSION

• Des produits GenAI réellement en production, dans un environnement exigeant et à fort impact

• Une stack à l'état de l'art : vLLM, LangGraph, Google ADK, DSPy, Phoenix (Arize)

• Un vrai mandat technique : du delivery, pas des slides

• L'opportunité d'apporter un regard neuf à une équipe qui investit sérieusement dans l'IA

STACK : Python, vLLM, LangGraph, Google ADK, DSPy, Phoenix (Arize), FastAPI, Kubernetes

PROCESSUS DE RECRUTEMENT

Entretien en présentiel (Paris), incluant des tests de mathématiques et de Python. Références techniques vérifiées.

Profil recherché


1) 5 ans d'expérience minimum, dont au moins 3 ans en entreprise sur des sujets agentique, RAG, IA générative

2) Compréhension profonde du fonctionnement des LLMs (architecture transformer, attention, tokenisation, décodage, quantization) — capable de l'expliquer et de le démontrer

3) Expérience concrète de l'inférence en production : vLLM, GPU, optimisation de performances

4) Pratique du fine-tuning (SFT, LoRA/QLoRA) et de l'amélioration de systèmes RAG en production

5) Solides bases en mathématiques et Python (testées en entretien présentiel)

6) Références techniques vérifiables

D'autres offres idéales pour vous !

Ces entreprises cherchent également d'excellents profils

Humancraft

Product Owner IA Générative & Agentique

600

Freelance

Dans 2 à 4 semaines

Paris, France

Hybride

Expertises

IAProduct OwnerAgentic

il y a 3 mois

Opportunité exclusive

Mon Consultant Indépendant

Ingénieur IA générative & IA agentique

TJM HT max 654 € (hors éventuels frais de mission, à discuter avec le client)

Freelance

Urgent

Paris, France

Hybride

Expertises

Intelligence artificielle

il y a 1 mois

Opportunité exclusive

Equancy

Senior Consultant(e) Gouvernance IA & IA Agentique - CDI

CDI

Urgent

Paris, France

Hybride

Expertises

gouvernance IA

il y a 2 jours

Opportunité exclusive

Réseau professionnel conçu pour les talents

© 2026. Tous droits réservés.

Freelancers

Créer un profil

Rejoindre un collectif

Solutions et outils