19 Sep
|
TCS
|
Vasanth Nagar
Dear Professionals,Greetings from Tata Consultancy Services (TCS)!!!Job Title : Pyspark Data EngineerExperience : 6- 10 YearsLocation: Hyderabad/ Pune/ Chennai/ BangaloreJob Requirements ;We are seeking an experienced AWS Data Engineer to design, develop,and maintain scalable data solutions on the Amazon Cloud Platform(AWS). The ideal candidate will have robust expertise in buildingmodern data pipelines, data warehousing, big data processing, andcloud-native analytics solutions. The role requires close collaborationwith business stakeholders, data architects, data scientists, andapplication teams to deliver reliable and high-performance dataplatforms.Key Responsibilities• Design, develop, and optimize scalable data pipelines usingAWS services.• Build and maintain batch and real-time data ingestion andprocessing frameworks.• Develop enterprise-grade data warehousing solutions using PySpark.• Convert Scala-based ETL, batch, and streaming pipelines intoPySpark frameworks.• Optimize PySpark jobs for performance, scalability,
andresource utilization.• Support cloud modernization initiatives on AWS/Databricksplatforms.berribot jd version 3• Implement ETL/ELT processes for structured and unstructureddata.• Integrate data from multiple sources including databases, APIs,files, and streaming platforms.• Ensure data quality, governance, security, and complianceacross data platforms.• Automate deployment and operational processes using CI/CDand Infrastructure as Code (IaC).• Monitor data pipelines and troubleshoot production issues.• Collaborate with Data Architects, Business Analysts, and DataScientists to translate business requirements into technicalsolutions.• Implement data models, metadata management, and datalineage best practices.• Support migration of on-premises or multi-cloud data platformsto AWS.• Lead the migration, modernization, and optimization of ApacheSpark workloads on AWS EMR, including conversion of Scalabased Spark applications to PySpark, performance tuning,cluster optimization, dependency management, and ensuringscalable, cost-effective, and resilient data processing solutions.Required Technical Skills• PySpark• SparkSQL• AWS Glue• AWS S3• Step Functions• Glue• Lambda• Pub/Sub• Python• SQL (Advanced)• Event Bridge• ECS
📌 Pyspark Data Engineer (Vasanth Nagar)
🏢 TCS
📍 Vasanth Nagar