About
Results-driven Azure Data Engineer with 3.2 years of experience at Wipro in designing and implementing scalable data engineering solutions using Azure Data Factory, Azure Databricks, PySpark, Python, and SQL. Experienced in building end-to-end ETL/ELT pipelines, implementing incremental data processing, and handling structured, semi-structured, and unstructured data. Strong experience in Medallion Architecture (Bronze, Silver, Gold), Delta Lake, data validation, reconciliation, Spark optimization, and data modeling concepts such as Star Schema and Snowflake Schema. Skilled in developing scalable batch processing pipelines, handling real-time production issues, and delivering business-ready datasets for reporting and analytics. Experienced in Agile sprint-based development model with strong collaboration across cross-functional teams.
Skills & Expertise (26)
Work Experience
Data Engineer
Wipro
May 2022 - Jun 2025
Developed scalable Azure Data Factory pipelines to ingest structured, semi-structured, and unstructured data from multiple source systems into ADLS Gen2. Implemented incremental data loading using watermark logic and metadata tables to process only newly inserted and updated records. Implemented and developed PySpark transformation logic in Azure Databricks for data cleaning, validation, deduplication, joins, aggregations, and business rule implementation using SQL and window functions. Worked extensively on Medallion Architecture using Bronze, Silver, and Gold layers for organizing raw, cleaned, and business-ready data. Implemented Delta Lake merge/upsert logic to handle incremental processing and late-arriving data efficiently. Performed source-to-target reconciliation, duplicate validation, and null checks to ensure data quality. Worked on Spark optimization techniques including partition pruning, repartition/coalesce strategies, broadcast joins, caching optimization, and shuffle reduction to improve processing performance and reduce execution time by nearly 40%. Handled real-time production issues such as duplicate data, schema drift, data skew, OOM issues, late-arriving data, and pipeline failures. Used Self-Hosted Integration Runtime (SHIR) to connect Azure services with on-premise systems. Monitored ADF pipelines and Databricks jobs and resolved production support issues. Participated in Agile sprint ceremonies including sprint planning, daily stand-ups, backlog discussions, and retrospective meetings.
Education
B.Tech (ECE) - DRK Institute of Science & Technology, JNTUH University
2017 - 2021 ยท Afghanistan
Certifications
No certifications added yet
Interested in this developer?
Profile Score Breakdown
Profile Overview
Availability Details
Visa Status
Citizen
Relocation
Open to Relocation
Skills (26)
Click a skill to find developers with the same skill