Data Engineer - Foundational

harmattan-ai
Paris

About Us

Harmattan AI is a next-generation defense prime building autonomous and scalable defense systems. Following the close of a $200M Series B, valuing the company at $1.4 billion, we are expanding our teams and capabilities to deliver mission-critical systems to allied forces.

Our work is guided by clear values: building technologies with real-world impact, pursuing excellence in everything we do, setting ambitious goals, and taking on the hardest technical challenges. We operate in a demanding environment where rigor, ownership, and execution are expected.

About the Role

As a Data Engineer on the Foundational team, you will serve as the "plumber" for deep learning, building the massive, high-performance data infrastructure required to power our foundational models. Based in Paris, you will manage terabytes—and eventually petabytes—of raw, unstructured, and noisy video data (EO and IR). Your mission is to ensure our ML engineers spend their time designing architectures, not waiting for data loaders or wrangling corrupted files.

Responsibilities

  • Multi-Modal Ingestion Pipeline: Build ETL/ELT pipelines to extract, decode, and store raw Electro-Optical (EO) and Infrared (IR) video from field logs into highly optimised formats like WebDataset, TFRecords, or Parquet.

  • Sensor Synchronisation & Alignment: Develop algorithms to programmatically synchronise EO and IR frames temporally and spatially to provide paired inputs for model training.

  • High-Throughput Data Loading: Architect storage-to-GPU pipelines to ensure multi-node training clusters maintain >90% GPU utilisation without I/O bottlenecks.

  • Distributed Processing: Write and optimise distributed data processing jobs using tools like Apache Spark, Ray, or Apache Beam to process thousands of hours of tactical video logs.

  • Data Quality & Versioning: Implement automated quality checks to filter corrupted or blank frames and maintain 100% reproducible training runs through robust versioning and lineage tracking.

  • Infrastructure Evaluation: Assess and implement advanced storage solutions (e.g., MinIO, S3 tiering) to manage growing datasets while optimising for cost and latency.

Candidate Requirements

  • Educational Background: A BS or MS in Computer Science, Software Engineering, or Distributed Systems is highly preferred. Deep knowledge of operating systems, networking, and parallel computing is essential.

  • Technical Experience: 5-6+ years of experience building and maintaining terabyte-scale pipelines for unstructured data (video, images, or point clouds).

  • Performance Optimisation: Proven track record of maximising multi-node GPU utilisation and optimising data loaders for frameworks like PyTorch or JAX.

  • Tooling Expertise: Strong command of distributed computing tools (Spark, Ray, Beam) and ML data versioning tools (DVC, Apache Iceberg, or Pachyderm).

  • Adaptability & Ownership: A systems-thinker who thrives in a fast-paced startup environment and views messy data as an engineering problem to be solved via automation.

  • Commitment: 100% dedication to Harmattan AI’s mission of providing a defensive edge to allied nations through ethical, high-impact technology

We look forward to hearing how you can help shape the future of autonomous defense systems at Harmattan AI.

Publié le 2026-06-24

Emplois Recommandés

ERGOTHERAPEUTE H/F

MEDICOOP France
Paris

MEDICOOP FRANCE, L'humain au cœur de l'intérim MEDICOOP FRANCE est une coopérative nationale spécialisée dans le secteur médico-social et sanitaire . Nous accompagnons durablement des établisse…

Voir les Détails
Publié le 2026-05-22

Notaire salarié actes courants - famille min.5ans (H/F)

Fed Group
Paris

Poste ouvert aux personnes en situation de handicap.Nous recherchons pour l'un de nos clients, étude parisienne, un(e) notaire salarié(e). Vos missions seront : * Actes courants (ventes immobilièr…

Voir les Détails
Publié le 2026-06-18

Manipulateur en Radiologie F/H - Paris 75008

Joseph Sebban
Paris

La Solution Médicale est une agence spécialisée dans le recrutement de professionnels de santé. Elle accompagne, depuis 2014, les responsables des centres médicaux et dentaires dans leur recherche de…

Voir les Détails
Publié le 2025-07-03

Stage - Juriste Financement H/F

BNP Paribas Mission Handicap
Paris

Poste ouvert aux personnes en situation de handicap. AU QUOTIDIEN CA DONNE QUOI ? Vous serez rattaché à l'équipe juridique de la banque d’investissement de BNP Paribas intervenant sur les financement…

Voir les Détails
Publié le 2026-05-31

Talent Acquisition Specialist & Campus Manager - Alternance

malt
Paris

Discover our galaxy   Join the Future of Work ! Malt is Europe's leading freelance marketplace, connecting over 1,000,000 talented freelancers with 100,000+ companies. Founded in 2013, we're tran…

Voir les Détails
Publié le 2026-06-24

Responsable logistique & Supply chain en alternance h/f

MBway Paris Sud
Paris

Vous souhaitez intégrer notre MBA Management Supply chain pour la rentrée 2025 ? Mbway Paris Sud , notre école de management vous propose une offre en alternance avec une entreprise partenaire…

Voir les Détails
Publié le 2026-02-27

Alternance* - Communication et Social Media Manager (H/F)

Studi CFA
Paris

STUDI, l’école n°1 de la formation 100 % en ligne , recherche pour son entreprise partenaire, un Communication et Social Media Manager (H/F) en contrat d’apprentissage. Lancez votre carrière d…

Voir les Détails
Publié le 2026-02-19

Chef de projet SI / support applicatif- alternance (H/F)

GMED
Paris

Quel est l’objectif de ce poste ? Dans un contexte de transformation digitale majeure, GMED renforce la structuration de ses outils et de ses processus SI au sein du département Systèmes d’Informa…

Voir les Détails
Publié le 2026-06-24

Chef de projet textile - H/F

LTd
Paris

Le poste : Le/la Chef de projet textile pilote le développement de collections ou de produits textiles, de la conception à la mise sur le marché. Il/elle coordonne les différents acteurs (internes…

Voir les Détails
Publié le 2026-06-25

AGENT LOGISTIQUE | BILINGUE CHINOIS 普通话 (H/F)

EDT EXPRESS
Paris

Au sein du service logistique de l'entreprise, vos principa Les missions seront: Gestion des réceptions et des expeditions par camions; Supervision de la chaîne de préparation et de conditi…

Voir les Détails
Publié le 2026-06-27