Key Responsibilities
Design, develop, and optimize data solutions using Microsoft Fabric and PySpark.
Analyze and tune Spark workloads for performance, scalability, and cost efficiency.
Develop and maintain Lakehouse architectures for enterprise analytics platforms.
Optimize data ingestion, transformation, and processing pipelines.
Perform Spark code reviews and recommend performance improvements.
Implement partitioning, caching, indexing, and file optimization techniques.
Monitor and troubleshoot Fabric workloads, Spark jobs, and resource utilization.
Collaborate with data architects, data scientists, and business stakeholders.
Design robust ETL/ELT frameworks using Fabric Data Factory and Notebooks.
Ensure data quality, governance, security, and compliance standards.
Implement best practices for distributed computing and big data processing.
Create technical documentation, optimization reports, and performance metrics dashboards.
Required Skills
Microsoft Fabric
Microsoft Fabric
Fabric Data Engineering
Fabric Lakehouse
Fabric Data Factory