Data Ingénieur Confirmé(e) H/F

Détail de l'offre

Informations générales

Entité de rattachement

Unicancer est l'unique réseau hospitalier français dédié à 100 % à la lutte contre le cancer et la seule fédération hospitalière nationale dédiée à la cancérologie. Il réunit 18 Centres de lutte contre le cancer (CLCC), établissement de santé privé à but non lucratif, répartis sur 20 sites hospitaliers en France. 540 000 patients par an sont pris en charge dans le réseau Unicancer, plus de 20 000 femmes et hommes sont engagés, au quotidien, dans une quête permanente d'excellence en matière de soins, de recherche et d'enseignement supérieur.
Unicancer est aussi le premier promoteur académique d'essais cliniques, en oncologie, à l'échelle européenne. Reconnu comme leader de la recherche en cancérologie en France, le réseau Unicancer bénéficie d'une réputation mondiale avec la production d'un tiers des publications internationales en oncologie. Les 18 CLCC et l'activité R&D d'Unicancer sont certifiés ISO 9001 pour leur recherche clinique.  

Référence

2026-5307  

Ce poste est ouvert aux candidats en situation de handicap

OUI

Description du poste

Intitulé du poste

Data Ingénieur Confirmé(e) H/F

Type de contrat

CDD

Si CDD, durée

12 mois

Date de prise de poste

01/10/2026

Temps de travail

Temps plein

Organisation du temps de travail

Télétravail possible jusqu'à 3 jours/semaine

Description du poste

Finalités :

Acteur majeur dans la construction de pipelines de données évolutifs pour traiter des données structurées et non structurées (données de santé de vie réelle).

Développer, maintenir et améliorer les solutions et infrastructures datas nécessaires à la collecte, la centralisation, le stockage et l’accès aux données de santé collectées auprès des établissements de soins contributeurs et mises à disposition des équipes scientifiques.

 

Missions :

Conception & architecture (amont projet)

Piloter l'élaboration du plan de traitement et de l'architecture data en phase de conception

Participer à la conception de plateformes pour le traitement de volumes importants, en garantissant leur sécurité

Être force de proposition sur l'évolution de la data stack du Pôle GD (EDS fédérés, appariement SNDS)

Construction & exploitation des flux de données

Concevoir et maintenir les flux d'intégration (collecte, ingestion, stockage) multi-établissements
Mettre en place des pipelines sécurisés en amont des bases « gelées »
Piloter le gel des bases à échéance des jalons projets (vérification, figeage, qualification)
Améliorer et automatiser les flux d'intégration existants


Qualité & conformité

Concevoir un process et un pipeline de contrôle qualité (confrontation auto/manuel)
Garantir et documenter la conformité réglementaire (RGPD/CNIL) et rédiger la documentation associée (SMQ, ISO 9001)


Innovation IA

Participer aux projets d'innovation IA internes (LLM open weights, mise en production)
Assister les prestataires externes sur les solutions NLP/NER (données non structurées)


Pilotage, reporting & montée en compétence

Proposer des indicateurs de suivi de l'activité DI et construire un dashboard
Assurer la montée en compétence de l'équipe Data Ingénieurs


Communication & coordination

Reporting auprès du manager hiérarchique et des managers fonctionnels, en lien avec les pilotes de projets
Participer aux réunions avec les équipes projets et le Pôle GD

Compétences requises

PROFIL TYPE

Les connaissances et capacités recherchées sont notamment les suivantes :

 

CONNAISSANCES

 

Langages : SQL, Python (packages appréciés : solar, pandas, exploitation confs YAML), apprécié : SAS, PHP
Technos stockage / échange de données : BdD Relationnelle classique (apprécié : expérience sur Oracle), SFTP, apprécié : db analytique (ex : ClickHouse), NoSQL (ex : MongoDb pour documentaire), « Elasticsearch »
Outils : VCS (ex : git), outils de gestion de database (ex : Oracle SQL dev, Datagrip, MySQL Workbench, etc), Suite Office (dans l’ordre d’importance : Excel, PP, Word), apprécié : expérience sur l’utilisation d’outils d’ETL, de transformation de données (ex : dbt) et de création de « semantic layer »
Connaissances formats : JSON, CSV, YAML, XLSX (Excel), apprécié : SAS7BDAT (SAS), DICOM (fichier imagerie)
Intégration continue : connaissances en CI/CD
Transverses : Méthodologie Agile
Interopérabilité données de santé : connaissance format OMOP, FHIR HL7, OSIRIS serait un plus
Fonctionnelles : secteur de la santé, Entrepôts de Données de Santé, RGPD / CNIL, curiosité très prononcée pour la cancérologie
Soft skills :

o   Aisance dans la communication

o   Créativité et curiosité

o   Dynamisme et réactivité

o   Autonomie / Travail et esprit d’équipe (incluant le partage des connaissances) ;

o   Force de proposition / Capacité à rechercher et trouver des solutions

 

CAPACITES

 

4 à 5 ans d'expérience minimum en tant que Data Ingénieur, avec une première expérience réussie en tant que Data Ingénieur dans le secteur de la santé.

Bonne compréhension du cycle de vie de la donnée, connaissances en architecture data (archi, data lineage, etc) et data modeling, de la data gouvernance et de la data privacy.

Capacité à travailler de manière agile dans un environnement collaboratif.

 

 

FORMATION

 
o   Diplôme d'ingénieur, d'informatique ou équivalent (Bac+4/5)

o   Master Spécialisé dans la Data Science ou IA ou ingénierie de données

o   Niveau d’expérience minimum : 4 à 5 ans

o   Une première expérience réussie en tant que Data Ingénieur dans le secteur de la santé

 

Fourchette de salaire

> 50 K€

Rémunération

55 - 60 K€

Catégorie socio-professionnelle

Cadre

Critères candidat

Niveau d'études min. requis

BAC+4

Niveau d'expérience min. requis

2-5 ans

Localisation du poste

Localisation du poste

Ile-de-France, Val de Marne (94)

Lieu

Le Kremlin-Bicêtre

Service

Pole Gestion de la Donnée