Roles and Responsibilities :
- Design and develop data pipelines using Data Bricks, PySpark, and other big data technologies to extract insights from large datasets.
- Collaborate with cross-functional teams to identify business requirements and design solutions that meet those needs.
- Develop high-quality code in Python using Pandas, NumPy, Matplotlib libraries for data analysis and visualization.
- Ensure scalability, reliability, and performance of the developed solutions by testing them on large datasets.
Job Requirements :
- 6-15 years of experience in IT Services & Consulting industry as a Solution Architect or similar role.
- Strong expertise in Data Bricks, PySpark, Big Data technologies such as Hadoop/Hive/Pig etc. .
- Proficiency in writing effective code in Python using Pandas, NumPy, Matplotlib libraries for data analysis and visualization.