Jobs and Careers
NT
Senior Observability Engineer
NTT DATAIrelandfull_timeVerifiedPosted 28 Aug 2025
About the role
<p><span><span>NTT DATA strives to hire exceptional, innovative and passionate individuals who want to grow with us. If you want to be part of an inclusive, adaptable, and forward-thinking organization, apply now.</span></span></p><p><span><strong>Job Description: Senior Observability Engineer<br/></strong></span><span><strong>Position Title: Senior Observability Engineer (Splunk + OSS)<br/></strong></span><span><strong>Location: </strong>Dublin, Ireland<br/></span><span><strong>Experience: </strong>12 – 15 years<br/></span><span><strong>Employment Type: </strong>Full-Time</span><span><strong> </strong></span></p>
<p><span><strong>Role Summary<br/></strong></span><span>We are looking for a </span><strong>high-impact Senior Observability Engineer</strong><span> to </span><strong>lead the design, implementation, and operationalization</strong><span> of end-to-end observability practices across a complex, enterprise-scale environment. You will be responsible for defining telemetry standards, building data pipelines, integrating observability into CI/CD and runtime environments, and enabling engineering and SRE teams with actionable insights.<br/></span><span>This role demands <strong>deep expertise in both Splunk Observability Cloud</strong> (including SignalFx, APM, Log Observer) and <strong>Open Source tools</strong> like OpenTelemetry, Prometheus, Grafana, and Jaeger. The ideal candidate thrives in fast-paced, high-expectation environments, and is passionate about <strong>instrumenting everything</strong>.</span></p>
<p><span><strong> </strong></span></p>
<p><span><strong>Key Responsibilities</strong></span></p>
<ol>
<li><span><strong>Design & Implementation</strong></span></li>
</ol>
<ol>
<li>
<ul>
<li><span>Architect and deploy <strong>observability pipelines from scratch</strong>, across metrics, logs, traces, and events</span></li>
<li><span>Define observability standards (naming conventions, tags, golden signals, telemetry SLIs/SLOs)</span></li>
<li><span>Design telemetry ingestion strategies using <strong>OpenTelemetry Collectors</strong>, Splunk Forwarders, Fluent Bit, etc.</span></li>
</ul>
</li>
</ol>
<p> </p>
<ol start="2">
<li><span><strong>Tooling & Integration</strong></span></li>
</ol>
<ul type="disc">
<li><span>Configure and maintain <strong>Splunk Observability Cloud</strong>:</span></li>
<ul type="circle">
<li><span>SignalFx (Infrastructure Monitoring)</span></li>
<li><span>APM (distributed tracing)</span></li>
<li><span>Log Observer & RUM</span></li>
</ul>
<li><span>Implement and tune OSS tools like:</span></li>
<ul type="circle">
<li><span><strong>Prometheus</strong> (metrics)</span></li>
<li><span><strong>Grafana</strong> (dashboards)</span></li>
<li><span><strong>Loki / ELK</strong> (logs)</span></li>
<li><span><strong>Jaeger/Zipkin</strong> (tracing)</span></li>
</ul>
<li><span>Integrate observability into <strong>CI/CD pipelines</strong> for real-time feedback on performance and reliability</span></li>
</ul>
<ol start="3">
<li><span><strong>Alerting & Dashboards</strong></span></li>
</ol>
<ol start="2">
<li>
<ul>
<li><span>Build actionable detectors, dashboards, and alert rules that reduce noise and improve MTTD/MTTR</span></li>
<li><span>Develop SPoG dashboards for leadership, engineering, and SRE stakeholders</span></li>
<li><span>Correlate telemetry signals to enable deep root cause analysis</span></li>
</ul>
</li>
</ol>
<p> </p>
<ol start="4">
<li><span><strong>Operationalization & Automation</strong></span></li>
</ol>
<ol start="3">
<li>
<ul>
<li><span>Automate deployment and updates of telemetry agents across fleets using Ansible, Helm, Terraform, etc.</span></li>
<li><span>Implement observability-as-code practices using GitOps principles</span></li>
<li><span>Maintain robust documentation and reusable templates/playbooks</span></li>
</ul>
</li>
</ol>
<p> </p>
<ol start="5">
<li><span><strong>Maturity Enablement</strong></span></li>
</ol>
<ol start="4">
<li>
<ul>
<li><span>Help establish and measure observability maturity models across teams</span></li>
<li><span>Conduct enablement workshops, onboarding sessions, and evangelize observability-first practices</span></li>
<li><span>Partner with platform, DevOps, and SRE teams to embed telemetry into every service lifecycle</span></li>
</ul>
</li>
</ol>
<p><span><strong> </strong></span></p>
<ol start="6">
<li><span><strong>Required Skills & Experience</strong></span></li>
</ol>
<ol start="5">
<li>
<ul>
<li><span>7+ years of experience in SRE/DevOps/Platform Engineering roles with 3+ years specializing in observability</span></li>
<li><span>Hands-on expertise in Splunk Observability Cloud (SignalFx, APM, RUM, Log Observer)</span></li>
<li><span>Deep familiarity with OSS observability tools:</span>
<ul>
<li><span>OpenTelemetry SDK/Collector</span></li>
<li><span>Prometheus, Grafana, Splunk ITSI, Loki</span></li>
<li><span>Jaeger, Zipkin, Fluent Bit</span></li>
</ul>
</li>
<li><span>Strong skills in SPL (Splunk
Apply for this role
Generate a tailored application kit with a matched cover letter, interview prep, and CV highlights — in under 60 seconds.
Apply Now →Generate Application KitFree account required — sign up in 30s