Data Engineer

Bespoke Technologies, Inc.

Chantilly, Northern (VA, KY)

Hybrid

USD 140,000 - 170,000

Full time

6 hours ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Bespoke Technologies, Inc. in Chantilly, VA, is seeking a Data Engineer to design and operate large-scale data pipelines, graph databases, and cloud-native architectures.

The role requires a TS/SCI clearance to apply and involves full-stack data engineering across batch/real-time processing, NoSQL, and ML-ready data workflows. The ideal candidate will contribute to scalable data infrastructures, implement secure data practices, and collaborate with cross-functional teams in a mission-focused

Qualifications

  • Experience designing and maintaining enterprise ETL/ELT pipelines (batch and real-time).
  • Frontend development with React, Next.js, or similar frameworks.
  • Backend development using Python/Java/Scala in microservices.
  • API design experience across services.
  • Containerization with Docker and CI/CD pipelines.
  • Infrastructure-as-code patterns for scalable deployments.
  • Familiarity with probabilistic models and statistical tools.
  • Cloud-native architectures using AWS, Google, IBM, or Oracle.
  • Big data system design and operation at scale.
  • Graph databases (DynamoDB or equivalents) and graph traversal (Gremlin).
  • NoSQL solutions for complex data apps and data modeling for performance.
  • Serverless geospatial indexes (GeoMESA) and partition/sort key design.
  • Data processing pipelines with Lambda/Step Functions/PySpark.
  • React-based UI/UX and WebGL experiences.
  • Experience with Apache Cassandra and NiFi is a plus.
  • DevSecOps, Agile, security/compliance in production.
  • LDAP-based data security, encryption, auditing access.

Skills

ETL/ELT pipelines
Front-end with React/Next.js
Python/Java/Scala
API design
Docker
CI/CD
Infrastructure-as-code
Probabilistic models
Statistical modeling tools
Cloud-native architectures
Big data systems
Graph databases (DynamoDB)
Gremlin/JanusGraph
NoSQL solutions
Data modeling for performance
Geospatial/serverless (GeoMESA)
Partition/sort key design
Lambda/Step Functions/PySpark
React UI/WebGL
C/C++ interfaces
Kubernetes
DevSecOps & Agile
Security/compliance (federal)
LDAP encryption auditing
TinkerPop/Gremlin/JanusGraph
Python libraries
Data processing pipelines

Tools

Docker
Kubernetes
NiFi
Gremlin/JanusGraph
Cassandra
PySpark
Lambda
AWS/GCP/Azure

Job description

BT-393 – Data Engineer

Location- Chantilly

**MUST HAVE A TS/SCI CLEARANCE TO APPLY. Those without an active security clearance will not be considered.**

Bespoke Technologies is seeking a Software Developer to provide ETL, Data Engineering, and Full-Stack Software Development support

Required Skills:

  • Demonstrates experience designing and maintaining enterprise-grade ETL/ELT pipelines, both batch and real-time.
  • Demonstrates front-end development and implementation skills, using React, Next.js, or similar.
  • Demonstrates back-end development using Python, Java, Scala, and microservices architecture.
  • Demonstrates experience with API design.
  • Demonstrates experience with containerization, using Docker.
  • Demonstrates experience with CI/CD pipelines.
  • Demonstrates experience with infrastructure-as-code patterns.
  • Demonstrates experience with probabilistic models, risk scoring, Bayesian inference, Monte Carlo simulation, and probabilistic graphical models.
  • Demonstrates experience applying statistical modeling tools.
  • Demonstrates experience with designing cloud-native architectures using cloud services such as AWS, Google, IBM, and Oracle
  • Demonstrates experience designing and operating big data systems
  • Demonstrates experience building and optimizing performance of large scale graph databases (tens of billions of edges) using DynamoDB or new enhanced capabilities
  • Demonstrates experience developing and operating graph traversal capabilities using data graphing tool traversal capabilities built upon Apache Gremlin or new enhanced capabilities
  • Demonstrates experience developing and operating NoSQL solutions to complex big data applications
  • Demonstrates experience in data modeling for performance, partition sharding, record/event aggregation workflows, stream processing, and metrics gathering
  • Demonstrates experience designing and operating large-scale serverless geospatial indexes built with GeoMESA
  • Demonstrates experience with partition and sort key design and implementation to ensure consistent performance
  • Demonstrates experience with aggregation operations to de-duplicate records on continuous data feeds
  • Demonstrates subject matter expertise experience with relational databases to noSQL
  • Demonstrates experience building and operating high performance data processing pipelines using Lambda, Step Functions and PySpark
  • Demonstrates experience building high quality User Interface/User experiences with the React framework and webGL
  • Demonstrates experience designing and operating large scale graph databases using Apache Cassandra
  • Demonstrates experience performing in-depth technical analysis of large-scale graph databases to develop implementation strategies for search optimizations
  • Demonstrates experience developing technical capabilities for processing, persistence and search of datasets that are collected or maintained using standards common in the Sponsor's community
  • Demonstrates experience facilitating engineering discussions across teams representing multiple stakeholders to develop and execute implementation strategies that meet mission needs
  • Demonstrates experience developing Machine Learning Operations (MLOps) pipelines for large scale application
  • Demonstrates experience maintaining configuration of software using configuration management resources such as GitHub
  • Demonstrates experience designing, building and operating big data systems, such as persistence, partitioning, indexing, at scale of trillions of records/events
  • Demonstrates experience with Niagara Files (NiFi) applications or new enhanced capabilities
  • Demonstrates experience developing and operating Kubernetes infrastructure
  • Demonstrates experience supporting engineering efforts that will contribute to delivery of capabilities such as datasets and functionality such as communications, geospatial workflows
  • Demonstrates experience implementing DevSecOps and agile development in production environments
  • Demonstrates experience with agile software development and testing
  • Demonstrates experience with federal security, regulatory and compliance requirements and security accreditation package development
  • Demonstrates experience with data security and governance using centralized security controls like LDAP, encrypting the data, and auditing access to the data
  • Demonstrates experience with specialized technologies that are optimized for the particular use of the data, such as relational databases, a NoSQL database (Cassandra), or object storage
  • Demonstrates experience with Apache, TINKERPOP, GREMLIN and/or JANUSGRAPH to design, develop, implement and maintain system
  • Demonstrates knowledge of Graph Database to design, develop, implement and maintain system
  • Demonstrates experience with C or C++ to write interfaces
  • Demonstrates experience using centralized security controls like LDAP, encrypting data, and auditing access to data
  • Demonstrates experience with:
  • Languages: Python (pypi libraries)
  • Environments: large collaboration and development environments
  • Data types: Unstructured, structured, or semi-structured data, including: CSV, JSON, JSONL, AVRO, Protocol Buffers, Parquet, etc
BT-393 – Data Engineer

Location- Chantilly

**MUST HAVE A TS/SCI CLEARANCE TO APPLY. Those without an active security clearance will not be considered.**

Bespoke Technologies is seeking a Software Developer to provide ETL, Data Engineering, and Full-Stack Software Development support

Required Skills:

  • Demonstrates experience designing and maintaining enterprise-grade ETL/ELT pipelines, both batch and real-time.
  • Demonstrates front-end development and implementation skills, using React, Next.js, or similar.
  • Demonstrates back-end development using Python, Java, Scala, and microservices architecture.
  • Demonstrates experience with API design.
  • Demonstrates experience with containerization, using Docker.
  • Demonstrates experience with CI/CD pipelines.
  • Demonstrates experience with infrastructure-as-code patterns.
  • Demonstrates experience with probabilistic models, risk scoring, Bayesian inference, Monte Carlo simulation, and probabilistic graphical models.
  • Demonstrates experience applying statistical modeling tools.
  • Demonstrates experience with designing cloud-native architectures using cloud services such as AWS, Google, IBM, and Oracle
  • Demonstrates experience designing and operating big data systems
  • Demonstrates experience building and optimizing performance of large scale graph databases (tens of billions of edges) using DynamoDB or new enhanced capabilities
  • Demonstrates experience developing and operating graph traversal capabilities using data graphing tool traversal capabilities built upon Apache Gremlin or new enhanced capabilities
  • Demonstrates experience developing and operating NoSQL solutions to complex big data applications
  • Demonstrates experience in data modeling for performance, partition sharding, record/event aggregation workflows, stream processing, and metrics gathering
  • Demonstrates experience designing and operating large-scale serverless geospatial indexes built with GeoMESA
  • Demonstrates experience with partition and sort key design and implementation to ensure consistent performance
  • Demonstrates experience with aggregation operations to de-duplicate records on continuous data feeds
  • Demonstrates subject matter expertise experience with relational databases to noSQL
  • Demonstrates experience building and operating high performance data processing pipelines using Lambda, Step Functions and PySpark
  • Demonstrates experience building high quality User Interface/User experiences with the React framework and webGL
  • Demonstrates experience designing and operating large scale graph databases using Apache Cassandra
  • Demonstrates experience performing in-depth technical analysis of large-scale graph databases to develop implementation strategies for search optimizations
  • Demonstrates experience developing technical capabilities for processing, persistence and search of datasets that are collected or maintained using standards common in the Sponsor's community
  • Demonstrates experience facilitating engineering discussions across teams representing multiple stakeholders to develop and execute implementation strategies that meet mission needs
  • Demonstrates experience developing Machine Learning Operations (MLOps) pipelines for large scale application
  • Demonstrates experience maintaining configuration of software using configuration management resources such as GitHub
  • Demonstrates experience designing, building and operating big data systems, such as persistence, partitioning, indexing, at scale of trillions of records/events
  • Demonstrates experience with Niagara Files (NiFi) applications or new enhanced capabilities
  • Demonstrates experience developing and operating Kubernetes infrastructure
  • Demonstrates experience supporting engineering efforts that will contribute to delivery of capabilities such as datasets and functionality such as communications, geospatial workflows
  • Demonstrates experience implementing DevSecOps and agile development in production environments
  • Demonstrates experience with agile software development and testing
  • Demonstrates experience with federal security, regulatory and compliance requirements and security accreditation package development
  • Demonstrates experience with data security and governance using centralized security controls like LDAP, encrypting the data, and auditing access to the data
  • Demonstrates experience with specialized technologies that are optimized for the particular use of the data, such as relational databases, a NoSQL database (Cassandra), or object storage
  • Demonstrates experience with Apache, TINKERPOP, GREMLIN and/or JANUSGRAPH to design, develop, implement and maintain system
  • Demonstrates knowledge of Graph Database to design, develop, implement and maintain system
  • Demonstrates experience with C or C++ to write interfaces
  • Demonstrates experience using centralized security controls like LDAP, encrypting data, and auditing access to data
  • Demonstrates experience with:
  • Languages: Python (pypi libraries)
  • Environments: large collaboration and development environments
  • Data types: Unstructured, structured, or semi-structured data, including: CSV, JSON, JSONL, AVRO, Protocol Buffers, Parquet, etc

Desired Skills:

  • Demonstrates experience with designing cloud-native architectures using Sponsors cloud services
  • Demonstrates experience designing and operating big data systems within the Sponsors policy and regulatory environment
  • Demonstrates experience developing and operating graph traversal capabilities using the Sponsors data graphing tool traversal capabilities built upon Apache Gremlin
  • Demonstrates experience building and operating high performance data processing pipelines using Lambda, Step Functions and PySpark on the Sponsors infrastructure with EMR
  • Demonstrates experience working with the Sponsor's enterprise services used for Data Management, including the enterprise catalog service (and associated APIs), and Policy Decision Points (PDPs).
  • Demonstrates experience developing Machine Learning Operations (MLOps) pipelines for large scale application in the Sponsor's environment
  • Demonstrates experience and understanding of IT Service Management and common SLA measurements
  • Demonstrates experience presenting solutions, requirements, and presentations to diverse audiences.
  • Demonstrates experience working with container orchestration technologies such as AWS ECS, AWS Fargate, and Kubernetes or other enhanced capabilities available
  • Demonstrates experience in managing large operational cloud environments spanning multiple tenants using Multi-Account management, AWS Well Architected Best Practices, and AWS Organization Units/Service Control Policies (OU/SCP).
  • Demonstrates experience with Micro-services such as building decoupled systems, utilizing RESTful endpoints and lightweight systems
  • Demonstrates experience in total systems perspectives, including a technical understanding of systems and applications relationships, dependencies, and requirements of hardware and software components
  • Demonstrates experience consulting with customers to determine present and future user needs
  • Demonstrates experience providing frequent contact with customers, traceability within program documents, and the overall computing environment and architecture

Desired Certifications:

  • AWS Certified Solutions Architect
  • AWS Machine Learning Certification(s)
  • Agile certification
  • Azure
  • Security+
  • GSECCCNA
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Data Engineer
Data Engineer

Jobtailor • Alabama

On-site
USD 95,000 - 130,000
Software Developer/Systems Software
Software Developer/Systems Software

Ardent Principles, Inc. • Chantilly (VA)

On-site
USD 130,000 - 260,000
Competitive salary
Comprehensive benefits
Onsite in Chantilly
+1
Data Architect
Data Architect

J5cyberconsulting • Maryland

On-site
USD 90,000 - 130,000
100% employer‑paid health coverage
6% 401(k) match
PTO
+3
2026-2201 Data Scientist
2026-2201 Data Scientist

Mountain Cat LLC • McLean (VA)

On-site
USD 120,000 - 180,000
Data Engineer
Data Engineer

Jobtailor • Maryland

On-site
USD 110,000 - 160,000
Senior DevOps Engineer – TS/SCI
Senior DevOps Engineer – TS/SCI

Jobtailor • Bethesda (MD)

On-site
USD 180,000 - 260,000
Sr Data Engineer, Data Analytics & Intelligence, NA
Sr Data Engineer, Data Analytics & Intelligence, NA

Vantage Data Centers Management Company LLC • Denver (CO)

On-site
USD 130,000 - 155,000
Medical, dental, and vision coverage
Life and AD&D
401k with company match
+2
Senior AWS Data Engineer
Senior AWS Data Engineer

United States Digital Space LLC • United States

Remote
USD 140,000 - 190,000
Senior Data Engineer – 8+ Years Experience
Senior Data Engineer – 8+ Years Experience

Hudson Manpower • New Jersey

On-site
USD 140,000 - 190,000
Data Engineer Expert
Data Engineer Expert

VT Group (VTG) • Herndon (VA)

On-site
USD 120,000 - 160,000