

Search by job, company or skills
About Role
We are looking for a Site Reliability Engineer (SRE) to ensure the availability, reliability, and performance of our production systems. The ideal candidate will be responsible for monitoring infrastructure and applications, managing incidents, analyzing logs, performing system health checks, and supporting operational excellence across the organization.
Roles & Responsibilities
Education and Experience
Skills
Job ID: 149338477
Skills:
Unix, Servicenow, Power Bi, Prometheus, Json, Grafana, Windows, JIRA, Git, Gcp, Confluence, Terraform, Docker, Linux, Rest Apis, Azure, Python, Kubernetes, AWS
Skills:
Rust, Gcp, Terraform, Kubernetes, Python, Security baseline, Go, GPU workload understanding, IaC, FinOps mindset, Reliability, Observability
Skills:
Networking, Dns, Windows, Information Technology, Auditing, Consulting, Technical Support, Active Directory, Troubleshooting, Analytics
Skills:
Github, Jenkins, Git, Docker, Ansible, Cloud Services, Shell scripting, Kubernetes, Linux Administration, Python
Skills:
RDS, PowerShell, PostgreSQL, Prometheus, Nodejs, Bash, Dns, Grafana, Datadog, New Relic, Gcp, Terraform, MySQL, Incident Management, Load Balancing, Azure, Kubernetes, Python, cloud networking, AWS, Windows systems administration, Linux systems administration, Root Cause Analysis