Admin Système HPC - N2/N3 (Hybrid)
Contexte de la mission (N2)
Dans le cadre d'un projet stratégique de modernisation et d'exploitation d'une infrastructure de calcul intensif au sein d'un grand organisme public réglementaire, nous recherchons un(e) Administrateur(trice) Systèmes HPC confirmé(e). L'environnement s'inscrit dans un contexte de haute disponibilité et d'exigences de sécurité strictes, en lien avec des missions critiques de simulation et d'analyse scientifique.
Responsabilités principales
– Administration et maintien en condition opérationnelle des clusters de calcul (Linux RHEL/Rocky, 500–2000+ nœuds)
– Gestion des ordonnanceurs de jobs (Slurm) : configuration des partitions, QoS, accounting et optimisation du scheduling
– Administration des systèmes de fichiers parallèles (Lustre, GPFS/Spectrum Scale) : tuning I/O, gestion des quotas, surveillance des performances
– Déploiement et gestion des environnements logiciels scientifiques via Environment Modules et Spack
– Supervision des réseaux haute performance (InfiniBand HDR/HDR100, Ethernet RoCE)
– Support utilisateur de niveau 2 : diagnostic de problèmes de performance, aide à l'optimisation d'applications scientifiques
– Contribution à l'automatisation des opérations (Ansible, scripts Bash/Python)
– Participation aux astreintes et gestion des incidents critiques en lien avec l'équipe senior
– Rédaction de documentation technique et de procédures d'exploitation
Compétences techniques requises
Systèmes & infrastructure
– Linux avancé (RHEL/Rocky Linux/CentOS) – administration à grande échelle
– Virtualisation et conteneurisation : KVM, Singularity/Apptainer
– Outils d'automatisation : Ansible (maîtrise opérationnelle), Puppet (connaissance appréciée)
– Scripting : Bash (avancé), Python (maîtrise fonctionnelle)
HPC
– Ordonnanceur Slurm : configuration, partitions, accounting, QoS
– Systèmes de fichiers parallèles : Lustre et/ou GPFS (exploitation et tuning)
– Réseaux HPC : InfiniBand, Ethernet haut débit
– Gestion des stacks logicielles scientifiques : Spack, Environment Modules
Monitoring & sécurité
– Outils de supervision : Prometheus/Grafana, Nagios/Zabbix
– Sécurité Linux : hardening, gestion des accès, audit (conformité SI sensible)
– Gestion des identités : LDAP/Active Directory
Profil et expérience attendus
– Formation supérieure en informatique, systèmes ou domaine connexe (Bac+3 à Bac+5)
– 3 à 6 ans d'expérience en administration systèmes, dont au moins 2 ans en environnement HPC ou datacenter critique
– Expérience en environnement réglementé ou sécurisé appréciée
– Capacité à travailler en équipe et à communiquer avec des utilisateurs scientifiques exigeants
– Rigueur, autonomie dans le cadre défini, sens du service
– Maîtrise du français (langue de travail) ; anglais technique lu/écrit
Modalités pratiques
Rythme de présence
2 jours sur site / 3 jours en télétravail par semaine
Durée de la mission
12 mois renouvelables
Astreintes
Participation aux astreintes de niveau 2 (planning partagé)
Déplacements
Ponctuels sur site client (Île-de-France)
Contexte de la mission (N3)
Dans le cadre d'un projet de modernisation d'infrastructure HPC critique, nous recherchons un(e) Ingénieur(e) Systèmes HPC de niveau expert pour piloter des activités techniques à forte valeur ajoutée : architecture, optimisation avancée, intégration de nouveaux composants matériels et logiciels, et transfert de compétences. Le profil exercera en pleine autonomie, en lien étroit avec l'équipe d'exploitation et les équipes scientifiques du client.
Responsabilités principales
– Référent technique de niveau 3 sur l'ensemble de la stack HPC (ordonnancement, stockage parallèle, réseaux, sécurité)
– Conception et implémentation d'architectures HPC et de stockage haute performance pour répondre aux besoins scientifiques
– Optimisation avancée des systèmes de fichiers parallèles (Lustre, GPFS) : tuning fin, diagnostics de performance I/O, gestion de la résilience
– Expertise sur les interconnexions InfiniBand (HDR/NDR) : configuration UCX, diagnostics fabric, intégration MPI
– Pilotage des enjeux GPU : intégration d'accélérateurs (AMD/NVIDIA), configuration des drivers et des stacks ROCm/CUDA
– Conseil et support N3 aux équipes internes et aux utilisateurs scientifiques sur l'optimisation d'applications (profiling, portage, scaling MPI)
– Définition et mise en œuvre de la politique de sécurité des systèmes HPC (hardening, gestion des accès, audit de conformité)
– Automatisation avancée et Infrastructure as Code (Ansible, Terraform, CI/CD HPC)
– Veille technologique, évaluation de nouvelles solutions, rédaction de documents d'architecture et de recommandations
– Encadrement technique des profils N2 de l'équipe
Compétences techniques requises
Architecture & systèmes
– Linux expert (RHEL/Rocky, architecture kernel, tuning OS à grande échelle)
– Maîtrise avancée d'Ansible ; connaissance de Terraform ou outils IaC équivalents
– Scripting avancé : Python (bibliothèques système, APIs), Bash
– Conteneurisation HPC : Singularity/Apptainer, Podman ; connaissance de Kubernetes appréciée
HPC – expertise avancée
– Slurm : architecture multi-cluster, federation, Burst Buffer, accounting avancé
– Systèmes de fichiers parallèles : Lustre (MDT/OST, tunables kernel), GPFS/Spectrum Scale (architecture NSDs, AFM)
– Réseaux : InfiniBand HDR/NDR, OpenSM, diagnostics avec ibdiagnet ; UCX/RDMA
– Interconnexion MPI : OMPI/MPICH, WI4MPI (portabilité MPI), optimisation collective
– Accélérateurs GPU : intégration AMD MI200/MI300 (ROCm), NVIDIA (CUDA), profiling matériel
Sécurité & conformité
– Sécurité SI sensible : conception et application de politiques de sécurité en environnement réglementé
– Gestion des identités et des accès : LDAP, Kerberos, PAM
– Audit et conformité : outils SCAP, gestion des CVE, durcissement système
Profil et expérience attendus
– Formation supérieure en informatique ou systèmes (Bac+5, ingénieur ou équivalent)
– 7 ans et plus d'expérience en systèmes, dont au minimum 4 ans en environnement HPC de production à grande échelle
– Expérience confirmée en environnement réglementé ou hautement sécurisé (défense, nucléaire, espace, ou équivalent)
– Capacité à exercer en pleine autonomie, à distance, avec des interlocuteurs techniques et scientifiques de haut niveau
– Excellentes capacités rédactionnelles (documentation d'architecture, procédures, rapports d'incident)
– Leadership technique naturel, capacité à structurer et transmettre une expertise
– Maîtrise du français (langue de travail) ; anglais technique courant (lu, écrit, oral)
Modalités pratiques
Rythme de présence
Full remote – déplacements ponctuels sur site si nécessaire (frais remboursés)
Durée de la mission
12 mois renouvelables
Astreintes
Participation occasionnelle aux astreintes de niveau 3 (faible fréquence)
Déplacements
Exceptionnels – à définir avec le client
Emplois Recommandés
consultant informatique fonctionnel confirmé SAP SD MM (IT)
Informations générales Démarrage : ASAP Durée : 1 mois et demi (30 jours) Langues : Français + Anglais (obligatoire - échanges avec l'Inde) Séniorité : Senior (profil unique - forte autonomie) Télétr…
Conseiller de Vente H/F - CDI - La Défense
Description de l'entreprise Depuis sa création à Paris en 1998, Maje a su construire son propre langage stylistique et esquisse un subtil écart entre la modernité et le décalé assumé, en misant s…
T2 Support Engineer / Specialist (EMEA) Ajouter aux favoris
Genetec - Protect the everyday We are a global Canadian company with a broad solutions portfolio that encompasses security , intelligence, and operations. We serve customers within a wide range …
Endocrinologue - Paris 75019 H/F - CDI
Présentation de l'entrepriseRetrouvez plus de 4000 offres d'emploi santé sur notre site et application mobile Jober Group. Profitez d'un réseau de 2000 partenaires sur toute la France, d'une équip…
Gallium Defense | Lead Software Engineer - GPU & Signal...
About Gallium Defense At Gallium Defense, they are rewriting the rules of airspace security in the context of rapidly evolving drone threats. They design and build next-generation, military-grade …
Cours d'Histoire Géographie à domicile à Paris (75)
Donnez des cours de soutien scolaire à domicile aux collégiens et lycéens avec Complétude, leader du soutien scolaire sur PARIS et sa région. Notre agence : 38 rue Blomet 75015 PARIS. Vos avant…
Senior Product Manager || Social Network || Paris || +70K
L’ENTREPRISE : Notre client est une application mobile grand public à très forte audience, portée par un groupe tech international reconnu. Dans un contexte de réorganisation produit, les équipes son…
MEDECIN GENERALISTE en CDI à temps partiel
La Caisse Primaire d'Assurance Maladie de Paris recrute pour son Centre d'Examens de Santé ATTRIBUTIONS : - Assure les examens cliniques, le dépistage, la prévention, l'éducation en santé \?
Senior Account Manager
E-commerce is booming — but independent brands still struggle to match the seamless logistics of giants like Amazon. At Bigblue , we’re on a mission to change that. We help brands by democratizi…
[VO2 Finance] - Business Analyst IT Riks
VO2 GROUP : Leader français indépendant en conseil Tech et Digital Entre conseil stratégique et réalisation technologique, nous cultivons un esprit "boutique" : de l'excellence, de l'humain et un…