Senior Databricks Data Engineer
Sopra Steria Professional Services
Tiempo completoRoma, Italy
Sobre el puesto
Chi è Sopra Steria
Sopra Steria - fra i maggiori player tecnologici in Europa, con 51.000 dipendenti in circa 30 paesi - è riconosciuta per i suoi servizi di consulenza, per i suoi servizi digitali e per le sue soluzioni IT. Sopra Steria supporta i propri clienti nel loro percorso di trasformazione digitale, garantendo loro benefici concreti e sostenibili. Nel 2025, il Gruppo ha registrato un fatturato di 5,6 miliardi di euro.
Con circa 1.200 persone e un fatturato 2025 di €107,35 milioni, Sopra Steria opera sul mercato italiano attraverso le sue sedi di Assago (MI), Roma, Collecchio (PR), Padova, Ariano Irpino (AV) e Pozzuoli (NA).
The world is how we shape it
Sopra Steria (SOP) è quotata su Euronext Paris (Comparto A) – ISIN: FR0000050809. Scopri di più su www.soprasteria.com
Ai fini dell’ampliamento del nostro centro di competenza dedicato alla Data Engineering e all'Advanced Analytics, siamo alla ricerca di un/una Senior Databricks Data Engineer che operi come pilastro tecnico per la costruzione di architetture dati moderne. La risorsa garantirà la qualità dei processi di ingestione e trasformazione, promuovendo le best practice di sviluppo su ambienti Cloud (Azure/AWS/GCP) all'interno dei team di progetto.
Sarai responsabile di progettare, sviluppare e implementare pipeline di dati scalabili e performanti, coordinando l'ottimizzazione dei carichi di lavoro in collaborazione con i Data Scientist e i Data Architect.
In scenari complessi, guiderai il design dell'architettura Medallion (Bronze, Silver, Gold) e la gestione dei Delta Lake , risolvendo colli di bottiglia tecnici e garantendo la consegna di soluzioni robuste per il processamento di grandi volumi di dati (Batch e Streaming).
In un contesto orientato all'innovazione tecnologica con un’impostazione Business Oriented , ti occuperai di:
Sviluppo Pipeline ETL/ELT : Progettazione e implementazione di flussi di dati complessi utilizzando Apache Spark (PySpark, Spark SQL, Scala);
Gestione del Data Lakehouse: Ottimizzazione delle tabelle Delta Lake e implementazione di logiche di partizionamento e indexing per massimizzare le performance di lettura/scrittura;
Data Governance & Security: Configurazione della sicurezza e del controllo accessi ai dati tramite Unity Catalog , garantendo la conformità alle policy aziendali;
Collaborazione Agile: Cooperazione con i Data Scientist per l'integrazione di modelli di Machine Learning (MLflow) e con i Power BI Developer per l'esposizione di set di dati ottimizzati (Gold Layer);
Automazione e Monitoraggio: Implementazione di workflow tramite Databricks Jobs, integrazione con strumenti di CI/CD e monitoraggio della qualità del dato (Data Quality checks).
Competenze richieste:
Apache Spark
Ecosistema Hadoop
Programmazione Scala e Python
Almeno 2 anni di esperienza su servizi e tecnologie del cloud Microsoft Azure, con competenze nella progettazione e gestione di architetture dati cloud‑native.
Esperto nei processi di data ingestion sia batch che streaming, orientato alle performance e alla qualità del dato.
— Published by Sopra Steria. Apply on the employer's own posting.
Competencias
innovazione tecnologica
data engineering
machine learning
microsoft azure
analytics
power bi
pyspark
python
hadoop
scala
azure
collaboration
En InTransparency te postulas con competencias verificadas a partir de tus proyectos reales, no con un CV autodeclarado.
Cómo funciona →