Senior/ Staff SRE Engineer
Education Requirements:
Bachelor's degree in Computer Science, Engineering, or a related technical field
Certifications in AWS, GCP, Observability, Linux or Kubernetes are a plus
Experience Requirements:
5+ years of experience in Site Reliability Engineering, DevOps, or Platform Engineering roles
Leading large-scale production systems in cloud environments
Incident response and on-call best practices
Advanced proficiency in Kubernetes administration
Hands-on experience with observability tools
Other Requirements:
Knowledge in chat-based operations interfaces
Expertise in operating data platforms (Elasticsearch, MongoDB, Spark, Kafka, Redis)
Proficiency with public cloud services
Strong programming and automation skills in Python and Bash
Understanding of Infrastructure as Code (Terraform, Helm)
Responsibilities:
Administer and maintain container orchestration platforms
Monitor and troubleshoot production systems
Drive observability improvements
Administer and optimize cloud-based environments
Manage and support distributed data platforms
Show more details