Senior Observability Engineer - Mclean VA - Onsite
Quick Overview
Job Description
Senior Observability Engineer
Key Responsibilities
* Analyze the existing observability solution deployed in Elastic Cloud and understand the gap.
* Document ideal scenario versus existing deployment and recommend the changes required to bring the Observability solution to improve overall application monitoring.
* Implement end-to-end observability solutions for distributed and cloud-native applications; work with development, infrastructure, and application support teams to streamline application monitoring using Elastic Cloud.
* Develop comprehensive monitoring strategies covering infrastructure, applications, logs, traces, metrics, and user experience.
* Migrate application monitoring from legacy monitoring platforms (Dynatrace, Splunk, Prometheus) to modern observability platforms such as Dynatrace and Elastic.
* Design and implement Elastic-based monitoring architectures, including data pipelines, storage, APM, dashboards, and advanced analytics.
* Build custom extensions, automated workflows, and synthetic monitoring solutions using Python and JavaScript.
* Integrate observability platforms with CI/CD pipelines (Jenkins and related tools) to automate monitoring, alerting, and incident management.
* Configure OpenPipeline, Business Events, anomaly detection, and AI-driven analytics to improve operational visibility.
* Optimize observability platform licensing, data ingestion, and storage costs while maintaining monitoring effectiveness.
* Collaborate with Development, Infrastructure, and Operations teams to improve application reliability, performance, and operational excellence.
* Conduct dashboard reviews, monitoring assessments, and observability maturity improvements across enterprise applications.
* Support proactive monitoring, root cause analysis, incident response, and continuous service improvement initiatives.
Required Skills & Qualifications
* 9+ years of experience in Application Performance Monitoring (APM), Observability, and Monitoring Engineering.
* Excellent knowledge about deploying observability using OpenTelemetry framework.
* Strong expertise in onboarding applications in Elastic Search ().
* Strong knowledge of:
* Distributed tracing
* Log analytics
* Infrastructure and application monitoring
* Synthetic monitoring
* Real User Monitoring (RUM)
* Experience developing automation using Python and JavaScript.
* Experience integrating monitoring platforms with Jenkins and CI/CD pipelines.
* Hands-on experience in implementing Observability for container-based applications.
* Strong understanding of observability architecture, SRE principles, and cloud-native monitoring practices.
* Hands-on experience with AWS cloud platforms.
* Knowledge of anomaly detection, OpenPipeline configuration, Business Events, and AI-assisted observability.
* Strong analytical, troubleshooting, and root cause analysis skills.
* Experience designing scalable enterprise observability architectures.
* Knowledge of license optimization and observability cost management.
* Experience implementing AI-driven observability and automated incident management.
Similar jobs
Staff Process Engineer - Water/Wastewater (Kansas City | Omaha)
Burns & McDonnell · Omaha, United States
22 minutes agoService Engineer II- Western US territory
Atlas Copco Group · San Francisco, United States
23 minutes agoProcess Engineer
StaffRight Associates, LLC · Butte, United States
23 minutes ago$75k - $95k/yrSr. Electrical Design Engineer III
TEKsystems c/o Allegis Group · Redmond, United States
23 minutes ago$65 - $70/hrSR Civil Structural Engineer Lead
Judge Group, Inc. · New Orleans, United States
23 minutes ago$140k - $180k/yrAPIM Engineer
TEKsystems c/o Allegis Group · Toronto, United States
23 minutes ago$75 - $80/hr