Senior data engineer (San Donato Milanese)

Senior data engineer (San Donato Milanese)

15 ago
|
Cerved
|
San Donato Milanese

15 ago

Cerved

San Donato Milanese

Cerved è la tech company italiana che, grazie a segnali predittivi unici e a un patrimonio esclusivo di dati e analytics, supporta la crescita sostenibile, la gestione del rischio e la trasformazione digitale di imprese e istituzioni.

Con Cerved Rating

Agency, elaboriamo valutazioni sul merito di credito, rating ESG e analisi sulle emissioni di debito. Dal 2021 Cerved è parte di ION Group, uno dei più grandi operatori Fin Tech internazionali. Per consolidare il nostro Team Data Models Tools &

- Processes , siamo alla ricerca di una figura di Senior Data Engineer che avrà la responsabilità di progettare, sviluppare e ottimizzare pipeline di dati robuste e scalabili, a supporto dei processi di business e delle iniziative di Analytics, AI e Machine Learning. Principali responsabilità
- Sviluppare, testare e mantenere pipeline di ingestione, trasformazione e distribuzione dei dati (ETL/ELT) utilizzando Python, Java, Apache Spark e Databricks
- Implementare e ottimizzare Job Spark (batch e streaming) su Databricks, garantendo performance, affidabilità e copertura dei test
- Integrare sorgenti dati eterogenee (database relazionali, API REST, file system, code di messaggistica) sfruttando i servizi AWS S3, Glue, Kinesis, SQS, Lambda, Redshift
- Scrivere codice di qualità production‐grade in Python e/o Java, applicando principi SOLID, design pattern, code review e test automatizzati (unit, integration)
- Costruire e gestire workflow di orchestrazione con Apache Airflow o Databricks Workflows, assicurando monitoraggio, alerting e gestione degli errori
- Applicare tecniche di data modeling e trasformazione con Databricks (Delta Live Tables, Databricks SQL, Auto Loader), garantendo la tracciabilità e la qualità dei dati lungo tutto il flusso (data lineage,



data quality checks)
- Collaborare con i team di Data Architect, Data Science e BI
- Contribuire all'adozione di best practice Dev Ops/Data Ops versionamento del codice (Git), CI/CD per pipeline dati, Infrastructure as Code (Terraform) e ambienti containerizzati (Docker, Kubernetes)
- Preparare e ottimizzare i dati a supporto di modelli ML e soluzioni AI feature engineering, costruzione di Feature Store, pipeline di embedding e RAG per applicazioni di Generative AI.

Requisiti Laurea in Informatica, Ingegneria Informatica, Matematica o discipline affini. Certificazioni AWS (Cloud Practitioner, Developer, Data Analytics) o Databricks sono apprezzate

- Esperienza di almeno 3 anni nello sviluppo di pipeline dati e soluzioni di data engineering in contesti produttivi
- Solide competenze di programmazione in Python (pandas, Py Spark, asyncio, Fast API) e/o Java (Spring Boot, Maven/Gradle); capacità di scrivere codice pulito, testabile e documentato
- Esperienza con Apache Spark (RDD, Data Frame API, Spark SQL, Structured Streaming) e con la piattaforma Databricks (notebooks, jobs, Delta Live Tables)
- Conoscenza pratica dei servizi AWS per i dati S3, Glue, Athena, Redshift, EMR, Kinesis Data Streams/Firehose, Lambda, Step Functions, IAM
- Esperienza con le funzionalità avanzate di Databricks per la trasformazione e qualità del dato (Delta Live Tables,



Databricks SQL, Auto Loader, Delta Lake) e con formati di storage columnar (Parquet, Delta, Iceberg)
- Familiarità con sistemi di orchestrazione (Apache Airflow, Databricks Workflows) e messaggistica event-driven (Apache Kafka, Amazon Kinesis, SQS)
- Buona padronanza di SQL avanzato (window functions, CTE, ottimizzazione delle query) su database relazionali e analitici (Postgre SQL, Redshift, Athena)
- Esperienza con pratiche Dev Ops/Data Ops Git, CI/CD (Git Hub Actions, Git Lab CI, Jenkins), Docker, Kubernetes; conoscenza di base di Terraform o Cloud Formation è un plus
- Conoscenza di base di tecniche ML/AI applicate ai dati feature engineering, pipeline di preprocessing per modelli, Vector Store e architetture RAG per Generative AI costituisce un vantaggio
- Propensione al lavoro in team Agile, attitudine alla collaborazione cross‐funzionale, curiosità tecnologica e orientamento alla qualità del codice e alla continuous improvement.

Sede di lavoro Milano, Mangone (CS), Padova, Roma Modalità di lavoro Ibrida La posizione è inquadrata al 1 Livello, secondo il CCNL Terziario, Distribuzione e Servizi (Commercio) e il range retributivo iniziale previsto è compreso tra Euro 45.000 ed Euro 60.000. L'esatta attribuzione all'interno della fascia retributiva sarà determinata sulla base di criteri oggettivi, trasparenti e neutrali sotto il profilo del genere (nel rispetto della normativa vigente).

Cerved

Group garantisce (ai sensi del D. Lgs 198/2006, D. Lgs.215/2003 e D. Lgs.216/2003) pari possibilità di accesso al lavoro a tutt i/le candidat e si impegna a favorire il rispetto delle diversità e l'inclusione sul posto di lavoro.

📌 Senior data engineer (San Donato Milanese)
🏢 Cerved
📍 San Donato Milanese

Candidati a questo annuncio

Mostra le tue capacità professionali all'azienda, compila il form e lascia un tocco personale nella lettera di presentazione, aiuterà il recruiter nella scelta del candidato.

Iscriviti a questa job alert:

Ricevi via email le nuove offerte di lavoro per: senior data engineer (san donato milanese) / san donato milanese

Iscriviti a questa job alert:

Ricevi via email le nuove offerte di lavoro per: senior data engineer (san donato milanese) / san donato milanese