09 Sep
|
Kiya.ai
|
Chennai
Position : DevOps & Site Reliability Engineer (SRE)
Experience : 9 to 13 Years
Notice period: Immediate to 15 Days (Not more than)
Location : Chennai
Type Of interview : F2F Interview (Final Discussion)
Responsibilities:
Responsible for production availability, performance, reliability, and resilience.
Define and monitor SLOs/SLA, error budgets, alerts, and service health.
Robust experience in Kubernetes, Docker/OCI, Helm, and Linux.
Hands-on with CI/CD & GitOps tools Jenkins, GitLab CI, Argo CD.
Experience with Infrastructure as Code Ansible, Terraform, Helm.
Solid Python/Bash scripting skills for automation and API integration.
Experience with Observability/Monitoring Dynatrace, Prometheus, OpenSearch or similar.
Knowledge of cloud networking, security, service mesh, and Vault.
Lead incident management, troubleshooting, RCA, post-mortems, and remediation.
Experience developing and supporting production-grade microservices/APIs.
Focus on automation, continuous improvement, reliability, security, and cost optimization.
Required Skills: Kubernetes + Docker + Jenkins/GitLab/Argo CD + Ansible/Terraform + Linux + Python + Dynatrace/Prometheus + Microservices/API + SRE/DevOps.
📌 Devops & Site Reliability Engineer Sre Chennai
🏢 Kiya.ai
📍 Chennai