anakine
Candidature spontanée
IA & ML CDIFrance métropolitaineTélétravail 100 % ou Paris 70 – 80 K€

Machine Learning Engineer / Scientist

Postuler

Vous prenez en charge la partie apprentissage automatique d'un moteur de recherche documentaire déjà en service : choix des modèles, entraînement sur les données maison, mesure de la qualité, passage en production.

L'entreprise

Éditeur de logiciel qui construit une plateforme IA destinée aux entreprises. Vous rejoignez l'équipe en charge de la chaîne d'ingestion documentaire et de la recherche, aux côtés d'ingénieurs expérimentés qui déploient des systèmes de recherche de premier plan. Vous y tenez le rôle d'ingénieur ML référent sur la recherche (sans encadrement d'équipe).

LOCALISATION
Télétravail partout en France métropolitaine, ou bureau à Paris
MODE DE TRAVAIL
100 % de télétravail, ou sur site à Paris si vous le préférez

Vos missions

Avoir la main sur toute la chaîne de recherche : approches lexicales, sémantiques, hybrides, multi-vecteurs et multimodales, segmentation des documents, reclassement des résultats, mise en production, surveillance et réentraînement.
Choisir et adapter les modèles : passer en revue ce qui existe, trancher selon la tâche, puis entraîner (fine-tuning) modèles d'embeddings, retrievers multi-vecteurs et cross-encoders sur les données maison.
Remonter à la cause d'un résultat décevant : formuler des hypothèses à partir de ce que vous observez, puis les convertir en plan de travail.
Enrichir le dispositif d'évaluation — corpus de test, métriques, signaux issus de la production — pour qu'aucune modification ne soit livrée sans preuve à l'appui.
Échanger avec l'équipe de recherche interne : besoins en modèles, remontées du terrain, intégration rapide des travaux de recherche dans le produit.
Rendre votre travail intelligible aux équipes d'ingénierie, au produit et à des interlocuteurs qui ne font pas de ML : ce que vous avez arbitré, ce qui reste incertain, et ce qu'un score de benchmark veut dire concrètement.

Environnement technique

PythonPyTorchvLLMEmbeddingsCross-encodersRerankersRetrieval multi-vecteursInteraction tardiveRecherche hybrideRecherche multilingueParsing de documentsOCRPipelines d'ingestionQuantification
Plusieurs millions de fragments documentaires, du texte comme de l'image, interrogés en plusieurs langues, en production. Le dispositif de test qualité existe déjà et fonctionne : vous partez de bases d'évaluation solides, pas d'une page blanche.

Votre profil

Au moins une première expérience professionnelle solide en retrieval.
Vous avez déjà mené un modèle sur tout son cycle : choix et architecture, entraînement, mesure, mise en production.
Vous connaissez la recherche d'information en détail — lexicale, sémantique, embeddings, cross-encoders, reclassement, approches hybrides — et savez expliquer précisément pourquoi et comment chacune échoue.
Vous savez comment un Transformer est construit et entraîné, et vous vous en servez pour trancher des choix d'ingénierie.
Python solide et outillage de mise en service actuel (PyTorch, vLLM ou équivalent), avec les compromis d'inférence qui arrivent avec le volume : quantification, traitement par lots, latence contre débit.
Une discipline de mesure : vous vous méfiez de vos propres chiffres et vous vérifiez avant de conclure.
Un anglais professionnel, à l'écrit comme à l'oral. Le français est un confort, pas une obligation.
Appréciés : recherche multi-vecteurs ou à interaction tardive (modèles de type ColBERT) et modèles sparse ; recherche multilingue ; travaux académiques ou benchmarks en recherche d'information ; extraction documentaire, OCR, chaînes d'ingestion volumineuses ; contributions open source dans l'écosystème de la recherche ou de l'outillage ML.
Ce poste n'est probablement pas pour vous si votre pratique de la recherche s'arrête à des prototypes RAG assemblés avec LangChain ou LlamaIndex : ici, le travail se situe en dessous de cette couche — dans les modèles eux-mêmes, leur entraînement, leur évaluation et leur exploitation.

Vos avantages

Télétravail 100 % du temps, ou bureaux parisiens — selon vos préférences.
Horaires flexibles.
Tickets-restaurant 10 €.
Prime de vacances.
Prévoyance 100 %.
Processus d'embauche efficace.
ADN tech et produit IA très innovant.
Un accès direct à l'équipe de recherche interne, qui entraîne les modèles que vous déployez, et une voix sur ce qu'elle optimisera ensuite.
Pour en savoir plus sur ce métier : fiche métier AI Engineer · Toutes nos offres · Cooptation

Postuler à cette offre

4 champs, 1 minute. En toute confidentialité.

Protection de vos données — En candidatant, vos données (CV, lettre, échanges) sont traitées par Anakine pour évaluer votre candidature et la transmettre aux entreprises clientes concernées par votre recherche. Anakine utilise des outils d'intelligence artificielle pour aider à l'analyse et au tri des candidatures ; aucune décision de refus n'est prise sans examen humain. Conservation : 2 ans maximum après notre dernier contact. Droits d'accès, de rectification, d'effacement et d'opposition : contact@anakine.io. Notice complète.

Cette offre ne vous correspond pas ?

Décrivez-nous votre job idéal — c'est gratuit, sans engagement et confidentiel.

Trouver un job sur mesure