Senior Director, Reliability Engineering

Nvidia

Confirmed live yesterday High trust

Quick summary

Work type
On-site
Location
Santa Clara, CA
Salary
$332,000–$500,250 / yr
Posted
64 days ago
Freshness
Confirmed live yesterday

Market check

Salary context

Above market

How this pay compares to similar roles

Similar $216k
This role $416k
$125k most similar roles pay here $540k

This role pays more than 98% of similar roles. Most pay $176,962–$254,943 — the shaded band above. At the midpoint, this role pays about $416k versus about $216k for comparable roles.

Based on 240 similar postings.

Employer

About Nvidia

Nvidia is a leading designer of graphics processing units (GPUs) and system-on-chip units, powering gaming, professional visualization, data centers, and artificial intelligence workloads. Industry: Semiconductors & AI Computing

Nvidia currently has 896 open roles on FindRole.

Listed pay typically runs $184,000–$287,500 across 876 roles with salary data.

Most-posted roles

View all roles at Nvidia

At a glance

TL;DR · Senior Director, Reliability Engineering

As the Senior Director, Reliability Engineering, you will lead globally distributed teams and labs to establish engineering standards for board and system-level hardware reliability across a diverse product portfolio including data centers, servers, graphics cards, and automotive platforms. You will own the reliability engineering strategy, influence design and supply chain decisions, and develop new testing methods while integrating advanced AI tools and accelerated testing techniques. The role requires deep expertise in physics-of-failure, DfR, FMEA, and NUDD methodologies to ensure products meet quality standards from component qualification through field deployment. You will utilize statistics, data analytics, reliability modeling, and finite element analysis to quantify risks and provide data-driven guidance. This position addresses the critical challenge of ensuring hardware performance in demanding environments, including AI training clusters and safety-critical autonomous vehicle systems.

What you'll do

  • Own board and system level hardware reliability across all product lines including Data Center, Automotive, and Graphics Cards.
  • Develop and implement company-wide hardware reliability strategies aligned with business objectives.
  • Lead and manage globally distributed multidisciplinary reliability engineering teams and laboratory operations.
  • Influence design, manufacturing, and supply chain decisions through data-driven risk assessments and modeling.
  • Drive Design for Reliability (DfR) and Design for Excellence (DfX) methodologies across the product ecosystem.
  • Develop new reliability testing methods and qualification approaches to ensure products meet quality standards.
  • Integrate advanced AI tools and accelerated testing techniques to solve complex reliability challenges.
  • Build organizational capability through strategic hiring and structured development programs for technical excellence.

What we're looking for

  • Bachelor's degree in Engineering, Physics, Materials Science, or a related field is required; a graduate degree is preferred.
  • Candidates must have experience in board and system-level reliability testing and activities.
  • At least 5 years of experience working on Data Center equipment reliability is required.
  • At least 10 years of experience leading reliability management is required.
  • Deep understanding of reliability concepts, physics of failure, testing methodologies, and applicable industry standards is required.
  • Proficiency with methods for Building Reliability (DfR), NUDD, and FMEA is required.
  • Experience with reliability modeling, assessments, predictions, and allocations is required.
  • Strong command of statistics, data analytics, and reliability mathematics as applied to risk assessment is required.

More like this

Similar roles

Senior Reliability Engineer

Nvidia

Santa Clara, CA 51 days ago $168,000$264,500
IC Reliability JEDEC IPC AEC-Q100 JMP Weibull++ Minitab Fin-FET COWOS FCBGA DFT ESD LU Testing Wafer Fab
8+ yrs exp

Senior Silicon Reliability Engineer

Nvidia

Santa Clara, CA 50 days ago $168,000$264,500
Reliability Physics TDDB BTI HCI SM JEDEC AEC Failure Analysis JMP Memory Circuits Defect Screening
8+ yrs exp

Senior Staff Reliability Engineer

Qualcomm

San Diego, CA 9 days ago $128,000$192,000
Reliability Engineering DFMEA PFMEA Fault Tree Analysis Weibull Analysis Accelerated Life Testing JEDEC IEC Telcordia MIL-STD HTOL HAST THB Python MATLAB JMP ReliaSoft Minitab Design-for-Reliability
4+ yrs exp

Senior Reliability Engineer

Anduril Industries

Atlanta, GA +1 79 days ago $143,000$191,000
FMEA Fault Tree Analysis Weibull Analysis MIL-STD-810 MIL-HDBK-217 MIL-HDBK-472 HALT HASS HITL SITL Root Cause Analysis CAPA Environmental Testing Mechanical Testing Data Acquisition Technical Writing Systems Engineering
8+ yrs exp

Senior Reliability Engineer

Anduril Industries

Costa Mesa, CA +1 79 days ago $166,000$220,000
FMEA Fault Tree Analysis Weibull Analysis MIL-STD-810 MIL-HDBK-217 MIL-HDBK-472 HALT HASS SITL HITL Root Cause Analysis CAPA Environmental Testing Mechanical Testing Data Acquisition Technical Writing
8+ yrs exp

Senior Reliability Engineer

Anduril Industries

Waltham, MA +1 67 days ago $166,000$220,000
FMECA Fault Tree Analysis Weibull Analysis MIL-HDBK-217 MIL-HDBK-472 MIL-STD-810 MIL-STD-461 MIL-STD-516C MIL-STD-1629 DO-254 DO-178 ARP-4754 HALT HASS FRACAS 8D root-cause analysis Data Acquisition
8+ yrs exp