Unknown Company

Principal Data Architect (Historical Data Migration)

bethesda, md • Posted 4 days ago
Onsite Full Time General

Principal Data Architect (Historical Data Migration)Location: Bethesda, Maryland Duration: 6+ MonthsJob Description: 20+ years in data architecture/engineering, leading large-scale migrations (hundreds of millions to billions of records) from legacy/mainframe sources (e.g., DB2) to cloud/SaaS targets. Strong SQL + PostgreSQL (staging/ETL persistence): schema design, partitioning, bulk loading, tuning, and operational rigor (HA/DR/backup, auditability, reconciliation). Delta/incremental load design (CDC/watermarking, micro-batching), with idempotent processing and replay/backfill strategies.

Salesforce data loading at scale: object modeling, external IDs, load sequencing, Bulk API patterns, and governor/locking constraints. Data quality, de-duplication, and survivorship frameworks for customer/transaction domains; strong validation and reconciliation patterns. Cloud experience on AWS supporting large-scale data platforms/migration factories (e.g., S3, RDS/Aurora PostgreSQL, Glue, EMR/Spark, Lambda/Step Functions, IAM/KMS, CloudWatch).

Define target-state data architecture (DB2 -> PostgreSQL -> Salesforce): canonical models, transformation patterns, lineage, and reconciliation controls. Design and govern high-volume migration execution: partitioning, parallelization, tuning, runtime scalability, and environment alignment. Own phased activation and delta load strategy: sequencing/dependencies, CDC or watermarking, micro-batching, replay/backfill, and idempotent loading into Salesforce.

Establish quality, resiliency, and governance: validation rules, error/quarantine handling, duplicate/survivorship rules, audit evidence, and ARB/Design reviews. Partner across Product, Salesforce, ETL/Integration, and Release teams, mentor engineers, produce HLD/LLD, mappings, runbooks, and operational dashboards.

Back to Job Search