Data Engineer - Foundational

harmattan-ai
Paris

About Us

Harmattan AI is a next-generation defense prime building autonomous and scalable defense systems. Following the close of a $200M Series B, valuing the company at $1.4 billion, we are expanding our teams and capabilities to deliver mission-critical systems to allied forces.

Our work is guided by clear values: building technologies with real-world impact, pursuing excellence in everything we do, setting ambitious goals, and taking on the hardest technical challenges. We operate in a demanding environment where rigor, ownership, and execution are expected.

About the Role

As a Data Engineer on the Foundational team, you will serve as the "plumber" for deep learning, building the massive, high-performance data infrastructure required to power our foundational models. Based in Paris, you will manage terabytes—and eventually petabytes—of raw, unstructured, and noisy video data (EO and IR). Your mission is to ensure our ML engineers spend their time designing architectures, not waiting for data loaders or wrangling corrupted files.

Responsibilities

  • Multi-Modal Ingestion Pipeline: Build ETL/ELT pipelines to extract, decode, and store raw Electro-Optical (EO) and Infrared (IR) video from field logs into highly optimised formats like WebDataset, TFRecords, or Parquet.

  • Sensor Synchronisation & Alignment: Develop algorithms to programmatically synchronise EO and IR frames temporally and spatially to provide paired inputs for model training.

  • High-Throughput Data Loading: Architect storage-to-GPU pipelines to ensure multi-node training clusters maintain >90% GPU utilisation without I/O bottlenecks.

  • Distributed Processing: Write and optimise distributed data processing jobs using tools like Apache Spark, Ray, or Apache Beam to process thousands of hours of tactical video logs.

  • Data Quality & Versioning: Implement automated quality checks to filter corrupted or blank frames and maintain 100% reproducible training runs through robust versioning and lineage tracking.

  • Infrastructure Evaluation: Assess and implement advanced storage solutions (e.g., MinIO, S3 tiering) to manage growing datasets while optimising for cost and latency.

Candidate Requirements

  • Educational Background: A BS or MS in Computer Science, Software Engineering, or Distributed Systems is highly preferred. Deep knowledge of operating systems, networking, and parallel computing is essential.

  • Technical Experience: 5-6+ years of experience building and maintaining terabyte-scale pipelines for unstructured data (video, images, or point clouds).

  • Performance Optimisation: Proven track record of maximising multi-node GPU utilisation and optimising data loaders for frameworks like PyTorch or JAX.

  • Tooling Expertise: Strong command of distributed computing tools (Spark, Ray, Beam) and ML data versioning tools (DVC, Apache Iceberg, or Pachyderm).

  • Adaptability & Ownership: A systems-thinker who thrives in a fast-paced startup environment and views messy data as an engineering problem to be solved via automation.

  • Commitment: 100% dedication to Harmattan AI’s mission of providing a defensive edge to allied nations through ethical, high-impact technology

We look forward to hearing how you can help shape the future of autonomous defense systems at Harmattan AI.

Publié le 2026-07-03

Emplois Recommandés

Tech Lead Java - IA Générative - Services Financiers - Ile de France

Forums Talents Handicap
Paris 1er

Poste ouvert aux personnes en situation de handicap. Description de l'entreprise Sopra Steria , acteur majeur de la Tech en Europe, avec 51000 collaborateurs dans près de 30 pays, est reconnu pou…

Voir les Détails
Publié le 2026-06-06

Chargé d'études CVC-Plomberie

Puzzle Recrutement
Paris

Présentation de la société PUZZLE RECRUTEMENT est un cabinet de recrutement spécialisé dans le secteur de la Construction/BTP & Energies. Notre objectif : vous accompagner dans votre recherche de…

Voir les Détails
Publié le 2026-06-18

Manager SAP S/4 HANA - H/F

MeltOne Advisory
Paris

Qui sommes nous ? MeltOne Advisory, c’est 200 consultants passionnés , plus de 10 ans d’aventure, et une mission claire : accélérer la transformation digitale de nos clients avec excellence o…

Voir les Détails
Publié le 2026-04-09

Alternance - Consultant en recrutement (H/F)

Studi CFA
Paris

STUDI, l’école n°1 de la formation 100 % en ligne , recherche pour son entreprise partenaire, un Consultant en recrutement (H/F) en contrat d’apprentissage. Lancez votre carrière dès à présent…

Voir les Détails
Publié le 2026-03-06

Expert Conformité CRA Cybersécurité (H/F)

groupe Artemys
Paris

Qui sommes-nous ? Artemys, acteur de la transformation numérique est une entreprise à taille humaine, avec plus de 30 ans d’expérience composée de plusieurs entités, chacune spécialisée dans leur d…

Voir les Détails
Publié le 2026-06-27

Manager logistique (F/H) BASSIN 77

Leroy Merlin France
Paris

Envie de manager une équipe et d’avoir un impact concret, chaque jour ? Le poste de Manager logistique, appelé Cheffe/Chef de secteur logistique, mêle organisation, lien humain et pilotage des flux…

Voir les Détails
Publié le 2026-06-26

Chef de Projet CVC - Data Centers H/F

B-HIVE
Paris

Le poste : Dans le cadre du développement de ses activités, B-HIVE recrute un Chef de Projet CVC – Data Centers H/F qui aura pour missions : Piloter le package mécanique (design, procurement, co…

Voir les Détails
Publié le 2026-07-01

consultant(e) technico fonctionnel(le) - Developpeur (euse)

PROPULSE IT
Paris

Le poste : CONSULTANT(E) TECHNICO-FONCTIONNEL(LE) & DEVELOPPEUR(EUSE) CONFIRME(E) CONTEXTE ET ENJEUX Notre client souhaite renforcer son équipe IT Finance afin d'accompagner la croissance de se…

Voir les Détails
Publié le 2026-06-12

Architecte d'intérieur

École Boulle
Paris

Présentation Le Studio Biehler-Graveleine est à la recherche d’un nouveau talent pour rejoindre son équipe dès que possible. Vos missions Architecte d’intérieur pour suivi de projet de la ph…

Voir les Détails
Publié le 2026-03-27

Sales Engineer (Paris) Ajouter aux favoris

Paris

Recruitment Fraud Alert We've learned that scammers are impersonating Commvault team members-including HR and leadership-via email or text. These bad actors may conduct fake interviews and ask for…

Voir les Détails
Publié le 2026-05-31