Shadow logo
Shadow

Ingénieur SRE

OnsitePlatform / DevOpsSeniorParis, FranceInfrastructurePlatformDevTools

Our Take

Ingénieur SRE at Shadow in Paris, France, focusing on operational excellence and building scalable infrastructure.

What you’ll do

  • Contribute to services and processes aiming for operational excellence and frictionless delivery
  • Design, build, and operate resilient and scalable delivery and deployment solutions
  • Design, build, and operate resilient and scalable observability and fundamental infrastructure systems (Kubernetes control plane & data plane, in overcloud and across multiple global points of presence)
  • Develop internal tools to facilitate the team's daily work
  • Investigate bugs encountered by users of the team's services within other teams
  • Accompany, advise, and train other teams on SRE best practices
  • Document software and processes, including their lifecycle and operational procedures
  • Manage metrics, automation, and the lifecycle of production environments (containers, virtual machines, bare-metal) at the scale of several thousand machines

What they’re looking for

  • Expertise in Kubernetes internal workings and large-scale deployment
  • Solid expertise in multi-tenant Infrastructure as Code tools and GitOps (ArgoCD, Terraform)
  • Familiarity with deployment and automation tools (Salt, Ansible, StackStorm)
  • Proficiency in Go and Python
  • Knowledge of Software Factory tools (Git, CI/CD)
  • Good knowledge of infrastructure technologies (bare-metal, storage, virtualization)
  • Ability to implement large-scale observability (metrics, monitoring, alerting) for critical environments
  • Ability to code, debug, and deliver concretely (hands-on)

Skills & Focus Areas

  • Kubernetes
  • Infrastructure as Code
  • GitOps
  • ArgoCD
  • Terraform
  • Salt
  • Ansible
  • Go
  • Python

As posted by Shadow

Au sein de l'équipe en charge du développement et de la maintenance de l'infrastructure et des services soutenant la plateforme interne de Shadow, la mission de l'Ingénieur.e SRE est de contribuer aux services et processus visant l'excellence opérationnelle et une livraison sans friction.

Rattaché.e au département Foundation, vous construirez et exploiterez les couches fondamentales sur lesquelles toutes les équipes peuvent s'appuyer pour livrer, déployer et faire fonctionner leurs services.

Dans ce rôle :

  • Vous concevrez, construirez et opérerez des solutions de livraison et de déploiement résilientes et évolutives.

  • Vous concevrez, construirez et opérerez des systèmes d'observabilité et d'infrastructure fondamentale résilients et évolutifs (Kubernetes control plane & data plane, en overcloud et sur plusieurs points de présence dans le monde).

  • Vous développerez des outils internes pour faciliter le travail quotidien de l'équipe.

  • Vous investiguerez les bugs rencontrés par les utilisateurs des services de l'équipe, au sein d'autres équipes.

  • Vous accompagnerez, conseillerez et formerez les autres équipes aux bonnes pratiques SRE.

  • Vous documenterez les logiciels et les processus, ainsi que leur cycle de vie, y compris les procédures opérationnelles.

  • Vous piloterez la surveillance, l'automatisation et le cycle de vie des environnements de production (conteneurs, machines virtuelles, bare-metal) à l'échelle de plusieurs milliers de machines.

  • Vous ferez évoluer les plateformes de Continuous Delivery et les solutions d'observabilité utilisées par toute l'Ingénierie.

Vous ne vous reconnaissez pas à 100 % dans les critères ci-dessous ? Aucun problème, envoyez quand même votre CV ! Tous les critères ne sont pas éliminatoires : votre passion, votre curiosité et votre motivation nous aideront à vous faire grandir 😉

  • Vous disposez d'une expertise confirmée du fonctionnement interne de Kubernetes et de son déploiement à grande échelle.

  • Vous justifiez d'une solide expertise des outils d'Infrastructure as Code multi-tenants et du GitOps (ArgoCD, Terraform).

  • Vous êtes à l'aise avec les outils de déploiement et d'automatisation (Salt, Ansible, StackStorm).

  • Vous maîtrisez Go et Python ; l'aisance dans les deux langages est un vrai plus.

  • Vous connaissez bien les outils de Software Factory (Git, CI/CD).

  • Une bonne connaissance des technologies d'infrastructure (bare-metal, stockage, virtualisation) est un atout.

  • Vous savez mettre en œuvre l'observabilité à grande échelle (métriques, monitoring, alerting) pour des environnements critiques.

  • Vous êtes capable de coder, debugger et livrer concrètement (hands-on).

  • Vous avez un ownership fort : capable de vous approprier des systèmes critiques et d'en garantir la fiabilité et la qualité de bout en bout.

  • Vous êtes en mesure de documenter des standards techniques et de les diffuser auprès des autres équipes.

  • Vous aimez accompagner, conseiller et former les autres équipes aux bonnes pratiques SRE.

  • Vous êtes autonome, proactif·ve, et avez envie de découvrir et de faire progresser des stacks technologiques peu familières.

  • Vous communiquez avec aisance en anglais à l'oral comme à l'écrit.

  • Une bonne compréhension du contexte et des enjeux de l'industrie du Cloud est un vrai plus.

Was this listing helpful?