Roles and Responsibilities :
- Design, develop, and maintain large-scale data pipelines using Hadoop ecosystem (Hive) to extract insights from structured and unstructured data sources.
- Collaborate with cross-functional teams to identify business requirements and design solutions that meet those needs through data modeling, analysis, and visualization.
- Develop predictive models using Python libraries such as scikit-learn and NumPy to drive business decisions.
- Ensure high-quality delivery of projects by implementing testing frameworks, monitoring performance metrics, and optimizing database queries.
Job Requirements :
- 4-7 years of experience in Data Engineering with expertise in Hive/Pyspark/SQL/Python programming languages.
- Robust understanding of data modeling techniques for building scalable databases and data warehouses.
- Proficiency in working with big-data technologies like Hadoop Ecosystem (Hive), PySpark & SQL.
📌 Data Engineer (Noida)
🏢 EXL
📍 Noida