← Toutes les offres
IA / ML

LLM Research Engineer

Paris Hybride 5 ans+ CDI
MISSIONS
  • Concevoir, entraîner et évaluer des modèles de langage (LLMs) pour des tâches spécifiques (résumé, extraction, génération, dialogue)
  • Mettre en œuvre des techniques de fine-tuning supervisé (SFT), RLHF et instruction-tuning sur des modèles open-source (LLaMA, Mistral, Falcon)
  • Développer des pipelines de données : collecte, nettoyage, déduplication, annotation et formatage des datasets d'entraînement
  • Évaluer les modèles via des benchmarks standards (MMLU, HellaSwag, TruthfulQA) et des évaluations humaines
  • Collaborer avec les équipes ingénierie pour l'optimisation (quantization, distillation, ONNX) et le déploiement en production
  • Assurer une veille scientifique active et contribuer à des publications ou rapports techniques internes
STACK TECHNIQUE
  • Langages : Python (maîtrise avancée)
  • Frameworks ML : PyTorch, HuggingFace Transformers, PEFT / LoRA, DeepSpeed, vLLM
  • Outils MLOps : Weights & Biases, MLflow, DVC
  • Infrastructure : GPU clusters (A100 / H100), SLURM ou Kubernetes, AWS / GCP
  • Données : Datasets HuggingFace, Apache Spark, dbt (un plus)
PROFIL RECHERCHÉ
  • Master ou PhD en Machine Learning, NLP, Informatique ou domaine connexe
  • 3 ans d'expérience minimum en recherche ou ingénierie ML appliquée aux LLMs
  • Solide compréhension des architectures Transformer, de l'attention et des mécanismes d'entraînement à grande échelle
  • Expérience pratique avec le fine-tuning de modèles pré-entraînés (open-source ou propriétaires)
  • Capacité à lire et implémenter des papiers de recherche récents
  • Publications dans des conférences IA reconnues : un atout majeur
  • Anglais courant requis (littérature et équipe internationales)
Retour en haut