- Design, develop, and optimize data solutions using Microsoft Fabric and PySpark.
- Analyze and tune Spark workloads for performance, scalability, and cost efficiency.
- Develop and maintain Lakehouse architectures for enterprise analytics platforms.
- Optimize data ingestion, transformation, and processing pipelines.
- Perform Spark code reviews and recommend performance improvements.
- Implement partitioning, caching, indexing, and file optimization techniques.
- Monitor and troubleshoot Fabric workloads, Spark jobs, and resource utilization.
- Collaborate with data architects, data scientists, and business stakeholders.
- Design robust ETL/ELT frameworks using Fabric Data Factory and Notebooks.
- Ensure data quality, governance, security, and compliance standards.
- Implement best practices for distributed computing and big data processing.
- Create technical documentation, optimization reports, and performance metrics dashboards.
Required Skills
Microsoft Fabric
- Microsoft Fabric
- Fabric Data Engineering
- Fabric Lakehouse
- Fabric Data Factory