

Search by job, company or skills

Senior Site Reliability Engineer / DevOps Engineer with 7+ years of experience in AWS, Kubernetes, and microservices deployment. The ideal candidate should have strong hands-on experience with Amazon EKS, Jenkins, Helm, Linux, and AWS infrastructure services, along with the ability to troubleshoot complex production issues in a multi-tier application environment.
Key Responsibilities
Must Have
Should Have
Nice to Have
Key Skills
AWS | EKS | Kubernetes | Docker | Jenkins | CI/CD | Helm | Linux | Redis | Aurora RDS | ActiveMQ | HPA | Karpenter | Nginx | Microservices | Cloud Infrastructure | Production Support | Troubleshooting | Banking/Financial Services
Candidate Profile
The ideal candidate is a hands-on Senior SRE/DevOps Engineer who can independently deploy and troubleshoot microservices on EKS, work with AWS infrastructure components, manage CI/CD pipelines, and resolve complex production issues across the application and infrastructure stack.
Job ID: 152328301
Skills:
Java, Spring Boot, Networking Concepts, Bash, Dns, Tcp Ip, Http, Sql, Google Cloud, Https, Odbc, Docker, Linux, Rest Apis, Load Balancing, Azure, Kubernetes, JDBC, Python, AWS
Skills:
Grafana, New Relic, Jenkins, Terraform, Linux, Gitlab, Microsoft Azure, Splunk, Helm, SaaS operations, Log Analytics, IAM security, Azure Monitor, Application Insights, Azure networking
Skills:
Saml, Prometheus, Kafka, Spring Boot, Datadog, Okta, Docker, Terraform, Teamcity, Python, AWS, Oauth, Java, RDS, Sso, Jenkins, Cloudwatch, Bitbucket, Sqs, AWS IAM, Helm, Kubernetes, Go, Terragrunt, Aurora, GitHub Actions, OpenTelemetry, Linux systems, Ingress networking, FluxCD, cni
Skills:
Tomcat, Ibm Datapower, Prometheus, Spring Boot, Elk Stack, Grafana, Datadog, Terraform, Connect Direct, Python, AWS, Java, Ibm Mq, Jboss, Hazelcast, SSL, Apache, Gcp, Ansible, Sqs, Azure, Go, Flink, containerized micro-services architecture
Skills:
Distributed Systems, Performance Engineering, Networking, Cloud Infrastructure, Automation, Storage, metrics, Kubernetes, Logging, SLIs, Alerting, Linux Systems, Disaster Recovery, Resilience Testing, Capacity Planning, SLOs, Site Reliability Engineering, Compute, tracing, Infrastructure-as-Code, Observability, Monitoring