SRE COMPUTE
- GCP
- GKE
- Vertex AI
QUI SOMMES-NOUS ?
S3NS est nĂ© du partenariat industriel entre Thales, leader mondial de la cyber sĂ©curitĂ©, et Google Cloud, leader mondial des solutions cloud. Nous avons pour ambition dâoffrir le meilleur des deux mondes Ă lâensemble des organisations soucieuses de protĂ©ger leurs donnĂ©es sensibles (institutions publiques, OIV, OSEâŠ). Câest-Ă -dire une solution Ă©quivalente Ă Google Cloud Platform (incluant Ă la fois les services IaaS et PaaS de GCP) et respectant les exigences du label SecNumCloud.
Une premiĂšre offre, âContrĂŽles locaux avec S3NSâ, est dĂ©jĂ disponible depuis fĂ©vrier 2023 pour permettre Ă nos clients de bĂ©nĂ©ficier dâun premier niveau de transparence et contrĂŽles additionnels, et d'accĂ©lĂ©rer la trajectoire vers le cloud de confiance.
Votre Quotidien
En tant qu'IngĂ©nieur(e) SRE Compute, votre mission sera au cĆur de l'exploitation de notre univers GCP :Â
Vous serez responsable du maintien en condition opĂ©rationnelle, de l'exploitation et de la gestion de l'ensemble des plateformes Compute (GCE, GKE, Vertex AIâŠ), au sein d'un environnement Ă©quivalent Ă l'univers GCP.
Vous gĂ©rerez les incidents de production 24h/24 et 7j/7, et dĂ©velopperez une comprĂ©hension approfondie des services techniques qui constituent l'Ă©pine dorsale des services GCP utilisĂ©s par des millions de clients.Â
Grùce à notre partenariat privilégié, Google nous partage ses connaissances et vous ouvre les portes de sa pile technique interne (Borg, Colossus, Spanner, Sawmill, etc.). Vous bénéficierez d'unprogramme de formation accéléré et intensif, dispensé au contact direct des experts Google et de nos équipes S3NS déjà formées par leurs soins, pour maßtriser des technologies d'exception habituellement réservées aux ingénieurs internes de Google.
Responsabilités Clés :
Monitoring SLI/SLO:Surveiller la disponibilitĂ©, l'Ă©volutivitĂ©, la latence et l'efficacitĂ© des services souverains GCP liĂ©s au COMPUTE en traitant les incidents de production.Â
Gestion d'Infrastructure:Gérer le parc de machines et les stacks de compute sous-jacentes (Borg et les différents control plane de Google) pour garantir une performance optimale.
Diagnostic et Résolution d'incidents :Garantir la fiabilité maximale de la plateforme. Afin d'assurer un maintien en condition opérationnelle 24/7 de notre cloud, le poste implique des permanences en journée ainsi que des astreintes de nuit par roulement.
Collaboration d'équipe: Collaborer avec des experts des services GCP à travers le monde pour aider à mitiger et à résoudre les incidents.
Automatisation & Connaissance : Documenter les connaissances pour s'assurer que tous les SRE S3NS travaillent avec la mĂȘme information, standardiser les flux de rĂ©solution et amĂ©liorer les playbooks opĂ©rationnels.
Revues Post-incident :AprĂšs un incident, rĂ©unir les Ă©quipes pour effectuer un post-mortem, comprendre les causes, tirer des leçons et encourager l'amĂ©lioration continue.Â
ConformĂ©ment aux exigences de qualification SecNumCloud de nos services, dĂ©livrĂ©e par l'ANSSI, ce poste est soumis Ă des exigences de sĂ©curitĂ© renforcĂ©es. Le candidat retenu devra se soumettre Ă uneenquĂȘte de sĂ©curitĂ© menĂ©e par nos services, conformĂ©ment Ă notre politique de sĂ©curitĂ© du personnel.Â
Votre ProfilÂ
Ce qui vous passionne et vous motive :Â
L'innovation technologique, leCloud, et l'exploitation de services et d'infrastructures en mode"as code".Â
L'excellence opérationnelle à grande échelle : L'exploitation et la haute disponibilité (℠99,99 %) de bases de données critiques et de moteurs analytiques à forte volumétrie.
L'ADN de l'ingĂ©nierie Compute chez Google : La curiositĂ© d'explorer comment un hyperscaler gĂšre des millions de cĆurs et l'envie de maĂźtriser plus de 20 ans d'innovation en systĂšmes distribuĂ©s (GCE, GKE, Borg, Colossus, Spanner, etc.).
L'impact au sein d'un collectif d'experts : La perspective de rejoindre une Ă©quipe spĂ©cialisĂ©e au cĆur des enjeux Compute (parc de machines, control plane, virtualisation et orchestration).
ExpĂ©rience :Â
DiplĂŽmĂ©(e) d'uneĂ©cole d'ingĂ©nieur ou titulaire d'un Master.Â
Au moins 3 ansd'expérience en SRE et automatisation des opérations.Poste ouvert aux profils juniors justifiant d'une expérience significative en alternance dans un périmÚtre similaire.
Exposition Ă un environnement international avec unbon niveau dâanglais requis.
Bonus: Une expĂ©rience prĂ©cĂ©dente surGCPest un plus mais votre soif d'apprendre notre propre Cloud est primordiale !Â
Le mot de l'Ă©quipeÂ
« Envie de rejoindre une Ă©quipe passionnĂ©e Ă taille humaine ? IntĂ©grez notre Ă©quipe SRE Compute : un collectif de7 ingĂ©nieurs au cĆur du moteur de notre cloud de confiance. Votre mission est critique : piloter le parc de machines et les stacks de compute sous-jacentes (Borg, control plane). Si vous aimez l'infrastructure pure et les systĂšmes Ă grande Ă©chelle, venez faire vibrer votre expertise avec nous ! »
SRE COMPUTE · Thales