10d250bc4397d5368da5b5538621bdc2.png

Découvrez Eviden

  • ESN, Editeurs de logiciel, Services informatiques

Site relialibity engineer (f/h)

  • ESN, Editeurs de logiciel, Services informatiques
  • 5 à 10 ans
  • CDI
  • De 50000.0 à 75000.0 EUR par an
  • Bac + 5 et plus (HPC & AI / SRE)
  • ( 38 - Isère )
    Plus d'infos
  • ref : 538175

L'essentiel du poste

Missions
  • Surveiller les systèmes et garantir le fonctionnement de l'infrastructure HPC & AI
  • Installer/configurer logiciels, firmwares et matériels
  • Évoluer les architectures pour intégrer du nouveau matériel
  • Maintenir une infrastructure de développement internationale à la pointe de la tech
Compétences attendues
  • Administration Linux
  • Programmation et scripting
  • CI/CD
  • Surveillance et observabilité
  • Gestion des incidents
  • Haute disponibilité
  • Sécurité
  • Linux
  • Docker
  • Kubernetes
  • Cloud providers
  • CI/CD pipelines
Qualités recherchées
  • communication écrite
  • travail en équipe
  • réactivité
  • Anglais
À savoir avant de postuler
  • Concentration soutenue
Mentionné dans l'annonce Déduit par l'IA
Vous correspondez si
Profil Bac +5 et expérience 5 à 10 ans en administration Linux, CI/CD et infra cloud, avec orchestration et sécurité
Résumé généré par l'IA -
peut contenir des inexactitudes

Offre proposée par Eviden, sur la plateforme Talents Handicap, pour l'emploi des personnes en situation de handicap (RQTH ou équivalent).

Le poste détaillé

HPC & AI Eviden est le leader du marché en Europe dans les segments des serveurs et des superordinateurs, reconnu pour ses innovations en intelligence artificielle, cybersécurité et quantique. Nos clients utilisent nos ordinateurs haute performance (HPC) pour des projets cruciaux tels que l'étude du changement climatique, la recherche de vaccins, la décarbonisation et les simulations scientifiques.L'équipe Software Factory, au cœur de la division R&D HPC & AI, est responsable du développement et de l'exploitation (DevOps) d'une pile complète d'intégration et de livraison continues (CI/CD) pour les équipes de développement logiciel en charge des produits HPC et AI. Actuellement, notre plateforme gère plus de 500 builds par semaine sur une infrastructure hybride, combinant cloud public et laboratoire interne, garantissant une production logicielle entièrement automatisée. Nous recherchons un  Site Reliability Engineer, qui jouera un rôle clé dans la gestion et l'optimisation de notre infrastructure. Vos missions : Assurer la surveillance des systèmes et garantir le bon fonctionnement de l'infrastructure du laboratoire et des clusters HPC & AI ;  Installer, mettre à jour et configurer les logiciels, firmwares et matériels ;  Faire évoluer les architectures système et infrastructure pour intégrer de nouveaux matériels ;  Maintenir une infrastructure de développement internationale à la pointe de la technologie ;  Améliorer le SLA de la plateforme.  
Votre profil :  Vous êtes diplômé en informatique  ;  Vous avez une expérience en administration Linux ;  Vous avez de bonnes compétences en programmation & scripting, administration des systèmes, plateformes cloud, conteneurs & orchestration (Docker et Kubernetes), surveillance & observabilité, pipelines CI/CD ;  Vous possedez des connaissances en gestion des incidents, récupération après sinistre & haute disponibilité, meilleures pratiques de sécurité.   Compétences personnelles :  Un bon relationnel : Excellentes compétences en communication verbale et écrite. Vous savez établir un contact efficace avec les différents interlocuteurs ;  Un esprit d'équipe :  Capacité à partager et travailler en équipe, à s'intégrer dans une équipe R&D en contexte Agile ;  Une capacité à switcher du français à l’anglais en temps réel et de manière professionnelle dans le cadre d'animation d’ateliers, de réunions, de rédaction des contenus clairs et pédagogiques.  Alors, prêt à relever le défi ?Vous n'êtes pas loin du but, GO ! Postulez ! Voici la suite de l’aventure : Si votre profil correspond aux exigences, notre équipe recrutement vous contactera pour faire connaissance et discuter de l’opportunité ; Vous aurez ensuite un ou deux entretiens opérationnels avec le responsable.