×
Register Here to Apply for Jobs or Post Jobs. X

Senior Enterprise Technology Resiliency and Recovery Engineer

Job in Vienna, Fairfax County, Virginia, 22180, USA
Listing for: Navy Federal Credit Union
Full Time position
Listed on 2026-07-27
Job specializations:
  • IT/Tech
    Disaster Recovery IT, Business Continuity, Cybersecurity, Cloud Computing: Infrastructure & Operations
Job Description & How to Apply Below

Senior Engineering Role in Disaster Recovery and Operational Resilience

Support Navy Federal's Enterprise Technology Resiliency & Recovery (ETRR) strategy by designing, implementing, validating, and continuously improving the resiliency and recoverability of critical technology services. This senior engineering role serves as a subject-matter expert in disaster recovery, operational resilience, cyber recovery, high availability, and service restoration across on-premises, cloud, and hybrid environments.

Partner with architecture, infrastructure, cloud, application, cybersecurity, risk, audit, and business resiliency teams to establish resilient technology patterns, recovery standards, dependency-aware recovery strategies, and recovery assurance practices that enable critical business services to withstand, adapt to, and recover from disruption.

The position contributes to Enterprise Resiliency Architecture, Recovery Engineering, Cyber Resilience, Recovery Validation, and Continuous Improvement by advancing recovery readiness, recovery automation, dependency mapping, testing methodologies, resiliency metrics, and executive reporting.

Responsibilities

Resiliency Engineering & Architecture

  • Design and maintain enterprise resiliency architectures supporting critical business services, applications, infrastructure platforms, and cloud environments.
  • Develop resiliency patterns, recovery designs, and engineering standards aligned with recovery objectives, risk tolerance, and regulatory expectations.
  • Define and maintain technology resiliency tiering, service criticality classifications, and recovery requirements.
  • Establish, validate, and govern Recovery Time Objectives (RTOs), Recovery Point Objectives (RPOs), and Maximum Tolerable Downtime (MTD) requirements.
  • Evaluate platform resilience, availability, recoverability, and operational risk posture through formal assessments and maturity reviews.
  • Identify and remediate single points of failure, architectural weaknesses, systemic risks, and technology resiliency gaps.

Recovery Engineering & Operational Readiness

  • Develop, maintain, and improve recovery strategies, disaster recovery plans, cyber recovery procedures, and technical restoration playbooks.
  • Engineer and validate recovery solutions utilizing replication, backup, failover, orchestration, automation, cloud-native recovery, and resiliency technologies.
  • Create and maintain dependency maps that document application, infrastructure, data, integration, and third-party service relationships.
  • Define recovery sequencing, service restoration priorities, and recovery dependencies for critical business services.
  • Partner with technology teams to integrate resiliency requirements into solution design, platform engineering, and technology modernization initiatives.

Testing, Validation & Recovery Assurance

  • Design, coordinate, and facilitate disaster recovery exercises, cyber recovery scenarios, resilience assessments, tabletop exercises, technical recovery drills, and enterprise failover/failback testing.
  • Validate end-to-end recoverability of applications, infrastructure, cloud platforms, and supporting services.
  • Establish recovery testing methodologies, success criteria, evidence requirements, and operational readiness assessments.
  • Document recovery test outcomes, lessons learned, risks, exceptions, and remediation plans.
  • Drive continuous improvement initiatives resulting from testing, operational incidents, audits, and resiliency reviews.
  • Leverage automation and recovery orchestration capabilities to improve testing frequency, increase coverage, and reduce recovery complexity.

Governance, Risk & Compliance

  • Support enterprise operational resilience, business continuity, and disaster recovery governance programs.
  • Develop and maintain resiliency metrics, scorecards, dashboards, and executive reporting.
  • Assess recovery risks and provide recommendations to strengthen recoverability and resilience maturity.
  • Support Business Impact Analyses (BIAs), technology risk assessments, critical service mapping, and operational resilience assessments.
  • Provide support for internal audits, external audits, regulatory examinations, and control assurance…
Position Requirements
10+ Years work experience
To View & Apply for jobs on this site that accept applications from your location or country, tap the button below to make a Search.
(If this job is in fact in your jurisdiction, then you may be using a Proxy or VPN to access this site, and to progress further, you should change your connectivity to another mobile device or PC).
 
 
 
Search for further Jobs Here:
(Try combinations for better Results! Or enter less keywords for broader Results)
Location
Increase/decrease your Search Radius (miles)
0
200
Filters
Education Level
Experience Level (years)
Posted in last:
Salary