Data Engineer | Azure Databricks • PySpark • Delta Lake
Send a job offer directly to this candidate
Data Engineer with 3 years of experience designing and delivering production-grade ETL/ELT pipelines using Azure Databricks, PySpark, Delta Lake, and Azure Data Factory. Deep expertise in Apache Spark internals — DAG execution, Catalyst optimizer, Tungsten engine, and shuffle tuning. Hands-on experience building scalable data warehouse solutions using Medallion Architecture, dimensional data modeling, and star schema design.
Proven track record in Spark version migrations, incremental pipeline design, and performance optimization.
Data Engineer — Retail Analytics Platform at Persistent Systems (2024-04 – Present)
Data Engineer — Global Media Data Integration Platform at Persistent Systems (2023-10 – 2024-03)
Data Engineering Intern at Persistent Systems (2023-01 – 2023-05)
B.Tech in Computer Science & Engineering – Meghnad Saha Institute of Technology, Kolkata (2019 – 2023)