Jobs and Careers
NT

Senior Observability Engineer

NTT DATA
Irelandfull_timeVerifiedPosted 28 Aug 2025

About the role

<p><span><span>NTT DATA strives to hire exceptional, innovative and passionate individuals who want to grow with us. If you want to be part of an inclusive, adaptable, and forward-thinking organization, apply now.</span></span></p><p><span><strong>Job Description: Senior Observability Engineer<br/></strong></span><span><strong>Position Title: Senior Observability Engineer (Splunk + OSS)<br/></strong></span><span><strong>Location: </strong>Dublin, Ireland<br/></span><span><strong>Experience: </strong>12 – 15 years<br/></span><span><strong>Employment Type: </strong>Full-Time</span><span><strong> </strong></span></p> <p><span><strong>Role Summary<br/></strong></span><span>We are looking for a </span><strong>high-impact Senior Observability Engineer</strong><span> to </span><strong>lead the design, implementation, and operationalization</strong><span> of end-to-end observability practices across a complex, enterprise-scale environment. You will be responsible for defining telemetry standards, building data pipelines, integrating observability into CI/CD and runtime environments, and enabling engineering and SRE teams with actionable insights.<br/></span><span>This role demands <strong>deep expertise in both Splunk Observability Cloud</strong> (including SignalFx, APM, Log Observer) and <strong>Open Source tools</strong> like OpenTelemetry, Prometheus, Grafana, and Jaeger. The ideal candidate thrives in fast-paced, high-expectation environments, and is passionate about <strong>instrumenting everything</strong>.</span></p> <p><span><strong> </strong></span></p> <p><span><strong>Key Responsibilities</strong></span></p> <ol> <li><span><strong>Design &amp; Implementation</strong></span></li> </ol> <ol> <li> <ul> <li><span>Architect and deploy <strong>observability pipelines from scratch</strong>, across metrics, logs, traces, and events</span></li> <li><span>Define observability standards (naming conventions, tags, golden signals, telemetry SLIs/SLOs)</span></li> <li><span>Design telemetry ingestion strategies using <strong>OpenTelemetry Collectors</strong>, Splunk Forwarders, Fluent Bit, etc.</span></li> </ul> </li> </ol> <p> </p> <ol start="2"> <li><span><strong>Tooling &amp; Integration</strong></span></li> </ol> <ul type="disc"> <li><span>Configure and maintain <strong>Splunk Observability Cloud</strong>:</span></li> <ul type="circle"> <li><span>SignalFx (Infrastructure Monitoring)</span></li> <li><span>APM (distributed tracing)</span></li> <li><span>Log Observer &amp; RUM</span></li> </ul> <li><span>Implement and tune OSS tools like:</span></li> <ul type="circle"> <li><span><strong>Prometheus</strong> (metrics)</span></li> <li><span><strong>Grafana</strong> (dashboards)</span></li> <li><span><strong>Loki / ELK</strong> (logs)</span></li> <li><span><strong>Jaeger/Zipkin</strong> (tracing)</span></li> </ul> <li><span>Integrate observability into <strong>CI/CD pipelines</strong> for real-time feedback on performance and reliability</span></li> </ul> <ol start="3"> <li><span><strong>Alerting &amp; Dashboards</strong></span></li> </ol> <ol start="2"> <li> <ul> <li><span>Build actionable detectors, dashboards, and alert rules that reduce noise and improve MTTD/MTTR</span></li> <li><span>Develop SPoG dashboards for leadership, engineering, and SRE stakeholders</span></li> <li><span>Correlate telemetry signals to enable deep root cause analysis</span></li> </ul> </li> </ol> <p> </p> <ol start="4"> <li><span><strong>Operationalization &amp; Automation</strong></span></li> </ol> <ol start="3"> <li> <ul> <li><span>Automate deployment and updates of telemetry agents across fleets using Ansible, Helm, Terraform, etc.</span></li> <li><span>Implement observability-as-code practices using GitOps principles</span></li> <li><span>Maintain robust documentation and reusable templates/playbooks</span></li> </ul> </li> </ol> <p> </p> <ol start="5"> <li><span><strong>Maturity Enablement</strong></span></li> </ol> <ol start="4"> <li> <ul> <li><span>Help establish and measure observability maturity models across teams</span></li> <li><span>Conduct enablement workshops, onboarding sessions, and evangelize observability-first practices</span></li> <li><span>Partner with platform, DevOps, and SRE teams to embed telemetry into every service lifecycle</span></li> </ul> </li> </ol> <p><span><strong> </strong></span></p> <ol start="6"> <li><span><strong>Required Skills &amp; Experience</strong></span></li> </ol> <ol start="5"> <li> <ul> <li><span>7+ years of experience in SRE/DevOps/Platform Engineering roles with 3+ years specializing in observability</span></li> <li><span>Hands-on expertise in Splunk Observability Cloud (SignalFx, APM, RUM, Log Observer)</span></li> <li><span>Deep familiarity with OSS observability tools:</span> <ul> <li><span>OpenTelemetry SDK/Collector</span></li> <li><span>Prometheus, Grafana, Splunk ITSI, Loki</span></li> <li><span>Jaeger, Zipkin, Fluent Bit</span></li> </ul> </li> <li><span>Strong skills in SPL (Splunk

Apply for this role

Generate a tailored application kit with a matched cover letter, interview prep, and CV highlights — in under 60 seconds.

Apply Now →Generate Application Kit

Free account required — sign up in 30s

Company

NTT DATA

View company profile →