07 Aug
|
Tata Consultancy Services
|
Hyderabad
07 Aug
Tata Consultancy Services
Hyderabad
Key Responsibilities:
- Design, build, and maintain scalable, highly available, and fault-tolerant systems.
- Monitor system performance, identify issues, and implement solutions to improve reliability.
- Develop and maintain automation tools for deployment, monitoring, and operations.
- Collaborate with development teams to improve application performance and reliability.
- Manage incident response, troubleshooting, root cause analysis, and post-mortems.
- Implement and maintain observability solutions (metrics, logging, tracing).
- Ensure system security, compliance, and disaster recovery practices.
- Optimize infrastructure costs and resource utilization.
- Maintain CI/CD pipelines and deployment processes.
- Define and track SLAs, SLOs, and SLIs.
Required Skills & Qualifications:
- Bachelors degree in Computer Science, Engineering,
or related field (or equivalent experience).
- Strong experience in Linux/Unix system administration.
- Proficiency in one or more programming/scripting languages (Python, Go, Java, Bash, etc.).
- Experience with cloud platforms (AWS, Azure, or GCP).
- Knowledge of containerization and orchestration tools (Docker, Kubernetes).
- Familiarity with infrastructure-as-code tools (Terraform, CloudFormation, or similar).
- Experience with monitoring tools (Prometheus, Grafana, Datadog, etc.).
- Robust understanding of networking concepts and distributed systems.
- Excellent problem-solving and analytical skills.
📌 Senior Site Reliability Engineer - S (Hyderabad)
🏢 Tata Consultancy Services
📍 Hyderabad