08 Aug
|
Tata Consultancy Services
|
Hyderabad
08 Aug
Tata Consultancy Services
Hyderabad
Key Responsibilities:
Design, build, and maintain scalable, highly available, and fault-tolerant systems.
Monitor system performance, identify issues, and implement solutions to improve reliability.
Develop and maintain automation tools for deployment, monitoring, and operations.
Collaborate with development teams to improve application performance and reliability.
Manage incident response, troubleshooting, root cause analysis, and post-mortems.
Implement and maintain observability solutions (metrics, logging, tracing).
Ensure system security, compliance, and disaster recovery practices.
Optimize infrastructure costs and resource utilization.
Maintain CI/CD pipelines and deployment processes.
Define and track SLAs, SLOs, and SLIs.
Required Skills & Qualifications:
Bachelors degree in Computer Science, Engineering,
or related field (or equivalent experience).
Solid experience in Linux/Unix system administration.
Proficiency in one or more programming/scripting languages (Python, Go, Java, Bash, etc.).
Experience with cloud platforms (AWS, Azure, or GCP).
Knowledge of containerization and orchestration tools (Docker, Kubernetes).
Familiarity with infrastructure-as-code tools (Terraform, CloudFormation, or similar).
Experience with monitoring tools (Prometheus, Grafana, Datadog, etc.).
Robust understanding of networking concepts and distributed systems.
Excellent problem-solving and analytical skills.
📌 Senior Site Reliability Engineer S Hyderabad
🏢 Tata Consultancy Services
📍 Hyderabad