Required Skills: Spark, Scala, Python , AWS
Job Description
Mandatory Skills: Data Engineering with Spark, Scala, Python , AWS
NOTE: Previous experience working at Capital One is highly preferred.
Summary:
This is Vendor Modernization project – Data on legacy system / AWS Fargate.
Work on a Python-based, AWS-native data ingestion platform (CDK infrastructure, Glue/Spark consumers, Lambda/ECS/Flink pipelines) that moves financial data from source systems into a 3rd party application.
Responsibilities:
Build and maintain pipeline stages across ingest, validation, tokenization, reformatting, and publishing, backed by rigorous unit and end-to-end testing. Support E2E/system test phases, drive compliance with data-protection standards (HSHD/sensitive-data handling), and remediate security findings and vulnerabilities across the codebase and dependencies. Requires strong proficiency in Python and AWS (Lambda, ECS, Kinesis, S3, DynamoDB, IAM, CDK), plus solid Git/CI-CD discipline.