Opportunité Rennes ! Data Scientist Python / NLP H/F
ADONYS · Rennes, FR
Job description
ContexteDans le cadre du développement de solutions d'Intelligence Artificielle appliquées au traitement documentaire, nous recherchons un Data Scientist spécialisé en NLP pour renforcer une équipe Data & IA.
Le consultant interviendra sur des problématiques d'analyse et d'extraction d'informations à partir de documents contractuels (contrats clients, fournisseurs, NDA, conventions, marchés publics, avenants, etc.) afin d'automatiser leur traitement et leur exploitation.
L'environnement est fortement orienté vers les technologies de traitement du langage naturel (NLP), l'IA générative et les modèles de langage (LLM).
MissionsAnalyse documentaireComprendre la structure et les spécificités des documents contractuels.
Identifier les informations métier à extraire (parties prenantes, dates, montants, échéances, clauses, pénalités, obligations, renouvellements, etc.).
Participer à la définition des modèles de données cibles.
Développement NLPConcevoir et développer des pipelines de traitement documentaire.
Mettre en ?uvre des modèles de :
Classification de documents
Extraction d'entités nommées (NER)
Extraction de clauses contractuelles
Résumé automatique
Recherche sémantique
Fine-tuner des modèles NLP adaptés aux besoins métier.
Évaluer et améliorer les performances des modèles.
IA GénérativeConcevoir des solutions basées sur les LLM.
Développer des architectures RAG (Retrieval Augmented Generation).
Optimiser les prompts et les chaînes de traitement.
Évaluer les performances et limiter les hallucinations.
IndustrialisationDévelopper des services Python robustes et maintenables.
Participer aux revues de code.
Mettre en place des tests et métriques de qualité.
Contribuer à l'industrialisation des modèles en environnement cloud.
CollaborationTravailler en étroite collaboration avec :
Product Owner
Experts métier
Data Engineers
ML Engineers
Architectes Data
Compétences Techniques RequisesLangagesPython (expert)
NLP & Machine LearningSpaCy
Hugging Face Transformers
NLTK
Scikit-Learn
PyTorch ou TensorFlow
IA GénérativeOpenAI / Azure OpenAI
LangChain
LlamaIndex
RAG
Embeddings
Vector Search
Traitement documentaireOCR
Azure Document Intelligence
Tesseract
Extraction PDF
Parsing documentaire
Bases de donnéesSQL
PostgreSQL
MongoDB (apprécié)
MLOps & CloudGit
Docker
Kubernetes (apprécié)
Azure
Azure Machine Learning
Azure AI Foundry
CI/CD
Profil candidat:
Minimum4 ans d'expérience en Data Science.
2 ans minimum sur des projets NLP.
IdéalementExpérience sur des projets de traitement documentaire.
Expérience dans les domaines :
Juridique
Contract Management
Procurement
Banque
Assurance
ML/AI Work links you to the employer's original posting — always verify the details there before applying.
More Data Science roles
View all →Financial Analytics Data Scientists
Daiichi Sankyo · Yonkers, US
Data Scientist
Meridian Credit Union · Remote · Toronto
Data Science Intern (TikTok Product) - 2027 Summer
TikTok · Remote · San Jose
(USA) Senior Manager, Data Science
Walmart · San Jose, US
2027 Data for Good Hackathon - Data & AI Program - Summer Internship
JPMorganChase · Chicago, US
Data Science Graduate Student Intern
Point Blue Conservation Science · Remote · San Francisco