Site Reliability Engineer - SRE Paris

Scaleway

Toulouse

Sur place

EUR 80 000 - 110 000

Plein temps

14 jours+

Recevez plus de réponses des employeurs

Envoyez un CV adapté au poste en quelques minutes.

Résumé du poste

Scaleway recherche un Site Reliability Engineer pour rejoindre nos équipes. Reportant à un Lead SRE, vous garantissez la fiabilité de nos produits pour des utilisateurs dans le monde entier.

Vous avez une forte base en développement et administration système et vous adaptez nos outils à l’évolution des systèmes. Le candidat idéal maîtrise Go/Python/Rust et Docker/Kubernetes, avec une expérience en Linux et en réseaux.

Qualifications

  • Expérience en développement Go, Python ou Rust.
  • Programmation système avec scripts courants (bash, Python).
  • Capacité à dépanner des pannes en production.
  • Bonne attitude et travail en équipe.
  • Passion pour l’automatisation et l’amélioration des outils.
  • Expérience Linux (Ubuntu/Debian).
  • Expérience en architecture d’environnements cloud (baremetal, VM, containers, orchestrateurs).
  • Bonne compréhension des réseaux informatiques (TCP/IP, DNS, load-balancing, IPv6, BGP).
  • Compréhension de l’anglais écrit et oral et capacité à rédiger une documentation technique.

Responsabilités

  • Créer ou optimiser des outils et de la documentation pour identifier et résoudre les incidents de production.
  • Diagnostiquer les incidents majeurs en collaboration avec plusieurs équipes.
  • Assumer des responsabilités d’astreinte et assurer les réponses en temps réel.
  • Garantir un haut niveau de service via observabilité et monitoring.
  • Gérer le cycle de vie des produits en production.
  • Promouvoir les meilleures pratiques en stabilité, résilience et performance.

Connaissances

Go
Python
Rust
Linux
Cloud environments
Networking
English communication

Outils

RabbitMQ
PostgreSQL
Nginx
HAProxy
Flask
S3 API
Prometheus
Grafana
Kibana
Ansible
GitLab

Description du poste

Fondée en 1999, Scaleway est la filiale cloud du groupe Iliad, l’un des leaders des télécommunications en Europe. Notre mission est de favoriser une industrie numérique plus responsable en aidant les développeurs et les entreprises à créer, déployer et adapter des applications à n'importe quelle infrastructure.

Depuis nos bureaux situés à Paris et à Lille, nous perfectionnons quotidiennement l'écosystème cloud de Scaleway, dont nous sommes les premiers utilisateurs.

Nos quelques 25 000 clients nous choisissent pour notre redondance multi‑AZ, notre expérience‑utilisateur fluide, nos datacenters neutres en carbone ainsi que nos outils natifs de gestion d'architectures multi‑cloud. Nos produits incluent des solutions entièrement gérées pour le bare metal, la conteneurisation et les architectures serverless, offrant ainsi un choix responsable dans le domaine du cloud computing.

Rejoignez notre équipe dynamique de près de 600 collaborateurs venant de divers horizons, dans un environnement stimulant et international alliant excellence technique, créativité et partage.

About The Job

Scaleway is looking for a Site Reliability Engineer to join our teams.

Reporting to a Lead SRE, you will be responsible to ensure we can reliably serve our products for users around the world. We expect you to have a strong background in development and system administration. Our systems evolve constantly and the tools needed to observe and act to ensure their resilience need to evolve accordingly.

Minimum Qualifications
  • Previous experience as a developer in Go, Python or Rust
  • Experience in system programming with usual scripting languages (bash, Python)
  • Demonstrated ability to troubleshoot production systems failures
  • A great attitude and desire to work with a team
  • Passion for incremental improvements on tooling, love all things of automation
  • Experience with Linux systems (Ubuntu/Debian)
  • Experience with cloud environments architecture (baremetal, virtual machines, containers, orchestrators)
  • Good understanding of computer networks: TCP/IP, DNS, load-balancing, IPv6, BGP and network virtualisation
  • Understanding of written and spoken english, capable of writing technical documentation in English, ability to speak english if needed
Preferred Qualifications
  • Experience with infrastructure as code and continuous deployment
  • Experience dealing with physical hardware automation
  • Experience with monitoring & logging systems
  • Experience administering relational databases
  • Knowledge of one cloud platform and related use-cases
  • Take initiatives to propose new solutions and defend them
  • Team player, willing to share knowledge, opinions, and participate in regular team rituals
  • Good communication skills and coaching skills
Responsibilities
  • Create or optimize existing tools & documentation that will help identify, diagnose and remediate production incidents, automating as much as possible
  • Troubleshoot high-impact issues working with multiple engineering teams
  • Take on-call responsibilities, mitigate issues encountered in production and secure the best real-time answer to our customers
  • Ensure a high quality of service for our customers by leveraging observability and monitoring technologies
  • Manage lifecycle of products in production
  • Help implementing best practices in stability, resiliency, scalability, security and performance across our systems
Technical Stack
  • Python, Go, Rust
  • RabbitMQ
  • PostgreSQL
  • HA Proxy, Nginx, REST APIs / Flask
  • S3 API
  • Sentry, Prometheus, Grafana, ElasticSearch, Fluentd, Kibana
  • Ansible, AWX, Foreman, Salt
  • GitLab, Nexus
  • Ubuntu, Debian, CentOS
  • Jira, Confluence, Slack, GSuite
Location

This position is based in our offices in Paris, Toulouse or Lille (France)

Si vous ne vous voyez pas cocher toutes les cases, n'hésitez pas à postuler tout de même. Ne vous limitez pas à une description de poste - on ne sait jamais !

Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Site Reliability Engineer - SRE Toulouse
Site Reliability Engineer - SRE Toulouse

Scaleway • Lille

Hybride
EUR 40 000 - 60 000
Site Reliability Engineer - SRE Toulouse
Site Reliability Engineer - SRE Toulouse

Scaleway • Toulouse

Hybride
EUR 45 000 - 65 000
Devops Engineer - Developer
Devops Engineer - Developer

Scaleway • Lille

Sur place
EUR 45 000 - 65 000
Site Reliability Engineer (SRE) - Network Products
Site Reliability Engineer (SRE) - Network Products

Scaleway • Toulouse

Hybride
EUR 70 000 - 110 000
Site Reliability Engineer (SRE) - Network Products
Site Reliability Engineer (SRE) - Network Products

Scaleway • Lille

Hybride
EUR 70 000 - 90 000
Up to 3 days remote per week
Office near public transport
Swile meal card
Site Reliability Engineer (SRE) - Network Products
Site Reliability Engineer (SRE) - Network Products

Scaleway • Lyon

Hybride
EUR 70 000 - 100 000
Hybrid work (up to 3 days remote)
Office near public transport
Healthy meals at HQ
+4
Site Reliability Engineer (SRE) - Network Products
Site Reliability Engineer (SRE) - Network Products

Scaleway • Rouen

Hybride
EUR 70 000 - 100 000
Hybrid work
Lunch service
Swile lunch card
+2
Site Reliability Engineer (SRE) - Network Products
Site Reliability Engineer (SRE) - Network Products

Scaleway • Rennes

Hybride
EUR 65 000 - 90 000
Hybrid work
Free meals
Swile card
+3
Site Reliability Engineer (SRE) - Network Products
Site Reliability Engineer (SRE) - Network Products

Scaleway • Bordeaux

Sur place
EUR 75 000 - 95 000
Devops Engineer - Developer
Devops Engineer - Developer

Scaleway • Toulouse

Sur place
EUR 40 000 - 65 000