Likeremote

Subscribe to the latest remote jobs:

  • Likeremote jobs on https://LinkedIn.com/
  • Likeremote jobs on https://telegram.org/
  • Likeremote jobs on Reddit.com
T

SRE COMPUTE

Thales
đŸ‡«đŸ‡· France
Hybrid
3 weeks ago
  • GCP
  • GKE
  • Vertex AI
Not scoredNo CV on file. Upload one and this job gets a score out of 100.Upload CV

QUI SOMMES-NOUS ?

S3NS est nĂ© du partenariat industriel entre Thales, leader mondial de la cyber sĂ©curitĂ©, et Google Cloud, leader mondial des solutions cloud. Nous avons pour ambition d’offrir le meilleur des deux mondes Ă  l’ensemble des organisations soucieuses de protĂ©ger leurs donnĂ©es sensibles (institutions publiques, OIV, OSE
). C’est-Ă -dire une solution Ă©quivalente Ă  Google Cloud Platform (incluant Ă  la fois les services IaaS et PaaS de GCP) et respectant les exigences du label SecNumCloud.


Une premiĂšre offre, ‘ContrĂŽles locaux avec S3NS’, est dĂ©jĂ  disponible depuis fĂ©vrier 2023 pour permettre Ă  nos clients de bĂ©nĂ©ficier d’un premier niveau de transparence et contrĂŽles additionnels, et d'accĂ©lĂ©rer la trajectoire vers le cloud de confiance.

Votre Quotidien

En tant qu'IngĂ©nieur(e) SRE Compute, votre mission sera au cƓur de l'exploitation de notre univers GCP : 

  • Vous serez responsable du maintien en condition opĂ©rationnelle, de l'exploitation et de la gestion de l'ensemble des plateformes Compute (GCE, GKE, Vertex AI
), au sein d'un environnement Ă©quivalent Ă  l'univers GCP.

  • Vous gĂ©rerez les incidents de production 24h/24 et 7j/7, et dĂ©velopperez une comprĂ©hension approfondie des services techniques qui constituent l'Ă©pine dorsale des services GCP utilisĂ©s par des millions de clients. 

  • GrĂące Ă  notre partenariat privilĂ©giĂ©, Google nous partage ses connaissances et vous ouvre les portes de sa pile technique interne (Borg, Colossus, Spanner, Sawmill, etc.). Vous bĂ©nĂ©ficierez d'unprogramme de formation accĂ©lĂ©rĂ© et intensif, dispensĂ© au contact direct des experts Google et de nos Ă©quipes S3NS dĂ©jĂ  formĂ©es par leurs soins, pour maĂźtriser des technologies d'exception habituellement rĂ©servĂ©es aux ingĂ©nieurs internes de Google.

Responsabilités Clés :

  • Monitoring SLI/SLO:Surveiller la disponibilitĂ©, l'Ă©volutivitĂ©, la latence et l'efficacitĂ© des services souverains GCP liĂ©s au COMPUTE en traitant les incidents de production. 

  • Gestion d'Infrastructure:GĂ©rer le parc de machines et les stacks de compute sous-jacentes (Borg et les diffĂ©rents control plane de Google) pour garantir une performance optimale.

  • Diagnostic et RĂ©solution d'incidents :Garantir la fiabilitĂ© maximale de la plateforme. Afin d'assurer un maintien en condition opĂ©rationnelle 24/7 de notre cloud, le poste implique des permanences en journĂ©e ainsi que des astreintes de nuit par roulement.

  • Collaboration d'Ă©quipe: Collaborer avec des experts des services GCP Ă  travers le monde pour aider Ă  mitiger et Ă  rĂ©soudre les incidents.

  • Automatisation & Connaissance : Documenter les connaissances pour s'assurer que tous les SRE S3NS travaillent avec la mĂȘme information, standardiser les flux de rĂ©solution et amĂ©liorer les playbooks opĂ©rationnels.

  • Revues Post-incident :AprĂšs un incident, rĂ©unir les Ă©quipes pour effectuer un post-mortem, comprendre les causes, tirer des leçons et encourager l'amĂ©lioration continue. 

ConformĂ©ment aux exigences de qualification SecNumCloud de nos services, dĂ©livrĂ©e par l'ANSSI, ce poste est soumis Ă  des exigences de sĂ©curitĂ© renforcĂ©es. Le candidat retenu devra se soumettre Ă  uneenquĂȘte de sĂ©curitĂ© menĂ©e par nos services, conformĂ©ment Ă  notre politique de sĂ©curitĂ© du personnel. 

Votre Profil 

Ce qui vous passionne et vous motive : 

  • L'innovation technologique, leCloud, et l'exploitation de services et d'infrastructures en mode"as code". 

  • L'excellence opĂ©rationnelle Ă  grande Ă©chelle : L'exploitation et la haute disponibilitĂ© (≄ 99,99 %) de bases de donnĂ©es critiques et de moteurs analytiques Ă  forte volumĂ©trie.

  • L'ADN de l'ingĂ©nierie Compute chez Google : La curiositĂ© d'explorer comment un hyperscaler gĂšre des millions de cƓurs et l'envie de maĂźtriser plus de 20 ans d'innovation en systĂšmes distribuĂ©s (GCE, GKE, Borg, Colossus, Spanner, etc.).

  • L'impact au sein d'un collectif d'experts : La perspective de rejoindre une Ă©quipe spĂ©cialisĂ©e au cƓur des enjeux Compute (parc de machines, control plane, virtualisation et orchestration).

Expérience : 

  • DiplĂŽmĂ©(e) d'uneĂ©cole d'ingĂ©nieur ou titulaire d'un Master. 

  • Au moins 3 ansd'expĂ©rience en SRE et automatisation des opĂ©rations.Poste ouvert aux profils juniors justifiant d'une expĂ©rience significative en alternance dans un pĂ©rimĂštre similaire.

  • Exposition Ă  un environnement international avec unbon niveau d’anglais requis.

  • Bonus: Une expĂ©rience prĂ©cĂ©dente surGCPest un plus mais votre soif d'apprendre notre propre Cloud est primordiale ! 

Le mot de l'équipe 

« Envie de rejoindre une Ă©quipe passionnĂ©e Ă  taille humaine ? IntĂ©grez notre Ă©quipe SRE Compute : un collectif de7 ingĂ©nieurs au cƓur du moteur de notre cloud de confiance. Votre mission est critique : piloter le parc de machines et les stacks de compute sous-jacentes (Borg, control plane). Si vous aimez l'infrastructure pure et les systĂšmes Ă  grande Ă©chelle, venez faire vibrer votre expertise avec nous ! »

SRE COMPUTE · Thales

Auto apply with Likeremote