xelys jobs xelys jobs

Senior Site Reliability Engineer

Juniper Square

full-remoteseniorpermanentbackenddevops Full remote Yesterday via WTTJ

See how well this job matches your profile

Sign up to get an AI match score and generate a tailored application in seconds.

Get your match score

Tags

Site Reliability EngineeringKubernetesAWSTerraformInfrastructure as CodeCI/CDGitHub ActionsArgoCDDatadogPostgreSQL

About the role

Senior Site Reliability Engineer (SRE)

Rejoignez l’équipe pour scaler, sécuriser et améliorer l’infrastructure cloud. Vous travaillerez avec des technologies cloud-native, automatiserez la gestion d’infrastructure et renforcerez la fiabilité des services.

Missions

  • Assumer la responsabilité des initiatives de fiabilité et d’évolutivité : identifier, prioriser et déployer des solutions avant que les problèmes ne s’aggravent.
  • Participer à une rotation d’astreinte, gérer les incidents, réaliser des analyses de causes profondes et conduire des corrections durables.
  • Concevoir, déployer et gérer des clusters Kubernetes avec des outils modernes pour optimiser les performances et les coûts.
  • Construire et maintenir des outils self-service en collaboration avec les équipes software et platform.

Responsabilités clés

  • Automatiser la gestion de l’infrastructure et mettre en place des garde-fous de sécurité.
  • Améliorer la résilience et la scalabilité grâce à l’observabilité, au monitoring et aux pratiques SRE.
  • Documenter les processus et collaborer efficacement avec les équipes d’ingénierie.

Compétences / Expérience requises

  • GitHub Actions et ArgoCD pour l’automatisation CI/CD (avec focus sécurité).
  • Kyverno pour l’application de politiques de sécurité Kubernetes.
  • Administration PostgreSQL : tuning et haute disponibilité via RDS/Aurora.
  • Bonne compréhension des best practices CI/CD security et capacité à implémenter des contrôles.
  • Python et Bash pour l’automatisation et l’administration.
  • 5+ ans en SRE, DevOps ou Infrastructure Engineering, avec un fort niveau d’ownership.
  • Observabilité/monitoring avec Datadog.
  • IaC (Infrastructure as Code) avec Crossplane et Terraform.
  • Maîtrise de AWS : RDS, Aurora, IAM, VPC, EKS, EC2.
  • Expertise Kubernetes, Helm et CNIs (réseautage et sécurité).
  • Forte posture self-starter : recherche proactive des problèmes et actions correctives.
  • Excellentes compétences en communication : Confluence, collaboration et influence.

Atouts / Nice-to-haves

  • Expérience Karpenter pour l’autoscaling Kubernetes.
  • Stratégies d’optimisation des coûts sur AWS.
  • Expérience NoSQL (scaling / performance) et bonnes pratiques.
  • Connaissance / passion pour l’expansion de l’IA dans le monde SRE/DevOps.
  • Expérience Atlassian : Jira et Confluence.

Localisation

  • Full remote

About Juniper Square

Juniper Square est une entreprise orientée cloud qui aide à faire évoluer et sécuriser des infrastructures pour des équipes produit et ingénierie. Le poste s’inscrit dans une démarche de fiabilité, d’automatisation et d’excellence opérationnelle sur des environnements cloud-natifs.

Scraped 7/26/2026