Site Reliability Engineer
Quick Overview
Job Description
Resources must carry SRE-aligned mindset to support our Databricks/Genie/Attacama/Sigma platform and observability operations, with a strong preference for Databricks and/or Sigma expertise while requiring solid, transferable skills (e.g., semantic modeling, dataset governance, dashboard performance, troubleshooting data/permission issues, and stakeholder-facing support). Resources must also demonstrate hands-on capability across AWS, Databricks, and Python for operating and automating data/analytics workloads, plus deep operational experience with Splunk and Dynatrace for end-to-end monitoring, alerting, incident response, root-cause analysis, and continuous service improvements (runbooks, SLO/SLI thinking, post-incident actions). Familiarity with Attacama is a plus (and may be required on-demand) to support data quality/governance use cases as they arise; please provide profiles that clearly evidence SDLC, production support experience, on-call/incident ownership, and examples of improving reliability and observability in similar environments
Skills
Similar jobs
Site Reliability Engineer (SRE)- Kubernetes
Spiceorb · United States
48 minutes agoDEVOPS ENGINEER
AaraTechnologies Inc · Virginia Beach, United States
50 minutes agoRelease Engineer (CI/CD, Infrastructure & Automation)
Openmind Technologies · United States
52 minutes agoNetwork Engineer
TEKsystems c/o Allegis Group · Indian Head, United States
5 hours ago$45 - $50/hrSenior DevOps Architect
Select Solutions Group, LLC · United States
5 hours agoSenior Devops Engineer/Lead
Infinite Computer Solutions (ICS) · Dallas, United States
5 hours ago$80k/yr