08 Sep
|
Kiya.ai
|
Chennai
Position : DevOps & Site Reliability Engineer (SRE)
Experience : 9 to 13 Years
Notice period: Immediate to 15 Days (Not more than)
Location : Chennai
Type Of interview : F2F Interview (Final Discussion)
Responsibilities:
- Responsible for production availability, performance, reliability, and resilience.
- Define and monitor SLOs/SLA, error budgets, alerts, and service health.
- Strong experience in Kubernetes, Docker/OCI, Helm, and Linux.
- Hands-on with CI/CD & GitOps tools Jenkins, GitLab CI, Argo CD.
- Experience with Infrastructure as Code Ansible, Terraform, Helm.
- Solid Python/Bash scripting skills for automation and API integration.
- Experience with Observability/Monitoring Dynatrace, Prometheus, OpenSearch or similar.
- Knowledge of cloud networking, security, service mesh, and Vault.
- Lead incident management, troubleshooting, RCA, post-mortems, and remediation.
- Experience developing and supporting production-grade microservices/APIs.
- Focus on automation, continuous improvement, reliability, security, and cost optimization.
Required Skills: Kubernetes + Docker + Jenkins/GitLab/Argo CD + Ansible/Terraform + Linux + Python + Dynatrace/Prometheus + Microservices/API + SRE/DevOps.
📌 DevOps & Site Reliability Engineer (SRE) (Chennai)
🏢 Kiya.ai
📍 Chennai