Site Reliability Engineer

Bottega52 S.R.L.

Italia

Ibrido

EUR 35.000 - 50.000

Tempo pieno

14 giorni+
Generatore di candidature

Distinguiti per questa posizione — genera un curriculum e una lettera di presentazione personalizzati in circa un minuto.

Supera i filtri ATS

Vantaggi offerti da questo lavoro

Wellhub Gold abbonamento
MacBook Pro 14” (M3 Max) e iPhone azie
Buoni pasto 8€ al giorno

Descrizione del lavoro

Bottega52 Srl cerca un Site Reliability Engineer per potenziare infrastrutture Azure/Kubernetes, garantendo resilienza, scalabilità e sicurezza. Il ruolo è ibrido a Milano e include lavoro su Kafka, PostgreSQL e MongoDB, con attenzione a operazioni di on-call e miglioramento continuo.

Il candidato ideale possiede esperienza con Linux, Python, Terraform, CI/CD e principi SRE, ed è in grado di collaborare con team di sviluppo e di prodotto in un contesto internazionale.

Competenze

  • Laurea in Informatica o Ingegneria o esperienza equivalente.
  • 3+ anni di esperienza con infrastrutture Cloud, preferibilmente Azure.
  • Esperienza con sistemi distribuiti e alta scalabilità/resilienza per applicazioni cloud-native.
  • Esperienza consolidata in ambienti Linux, inclusa gestione e debugging di problemi di networking (DNS, Load Balancer, firewall e VPN).
  • Esperienza con tool di monitoraggio e logging (Prometheus, Grafana, Azure Monitor, ecc.).
  • Esperienze nella creazione di automazioni (Python, Bash, Terraform) secondo Infrastructure-as-Code (IaC).
  • Familiarità con Site Reliability Engineering, SLO/SLA e “error budgets”.
  • Buona conoscenza dell’inglese scritto/parlato per interfacciarsi con clienti internazionali.
  • Esperienza con database relazionali (PostgreSQL) e non relazionali (MongoDB).
  • Esperienza con Apache Kafka e concetti di stream processing distribuito.
  • Esperienza CI/CD (Jenkins, Gitlab, ecc.).
  • Familiarità con architetture a microservizi e approcci DevOps/GitOps.
  • Esperienza nella progettazione di sistemi distribuiti real-time e fault-tolerant.

Mansioni

  • Migliorare la resilienza ed ottimizzare il cluster Kubernetes (AKS su Azure) garantendo performance, scalabilità, sicurezza ed alta affidabilità.
  • Configurare ed ottimizzare database relazionali (PostgreSQL su Azure) e non relazionali (MongoDB Atlas) per performance e sicurezza.
  • Gestire e ottimizzare Apache Kafka (su AKS) per la raccolta e distribuzione di dati in tempo reale.
  • Automatizzare processi operativi per ridurre il toil e migliorare l’efficacia dei team (Platform e Product).
  • Partecipare alla turnazione on-call per rispondere rapidamente a incidenti.
  • Sviluppare pipeline di monitoraggio e alerting per identificare rapidamente problemi operativi.
  • Identificare rapidamente la root cause e documentare con automazioni per evitare problemi ricorrenti.
  • Collaborare con lo sviluppo per migliorare il ciclo di vita SDLC con pratiche solide e coerenti.
  • Lavorare su infrastrutture cloud-native moderne, resilienti e scalabili in contesto di stream processing ed edge computing.

Conoscenze

Azure
AKS
PostgreSQL
MongoDB
Apache Kafka
Python
Bash
Terraform
Linux
Prometheus
Grafana
Azure Monitor
Jenkins
GitLab
SRE concepts
Microservices
DevOps
GitOps

Formazione

Laurea in Informatica o Ingegneria

Strumenti

Azure Kubernetes Service (AKS)
Azure Database for PostgreSQL
MongoDB Atlas
Apache Kafka
Prometheus
Grafana
Azure Monitor

Descrizione del lavoro

In Bottega52 stiamo cercando un Site Reliability Engineer per unirsi al nostro team.

Full-time · Hybrid · Milano · tipicamente nel range 35.000€ - 50.000€ RAL/anno

Informazioni sul ruolo

Siamo alla ricerca di un Site Reliability Engineer motivato a contribuire alla scalabilità e all’ottimizzazione di una complessa infrastruttura Cloud in produzione su Azure.

Si tratta di un sistema distribuito progettato per raccogliere, gestire e distribuire grosse moli di dati in tempo reale. Include componenti connessi “at the edge” che devono essere in grado di operare in scenari “offline” e garantire “eventual consistency” dei dati. La lingua di lavoro principale è l’inglese, dato che il sistema è utilizzato da clienti internazionali.

Il ruolo richiede un forte focus sull’affidabilità, la scalabilità, la sicurezza e la resilienza dell’infrastruttura, con un utilizzo intensivo di Azure Kubernetes Service (AKS), Azure Database for PostgreSQL, MongoDB Atlas ed Apache Kafka.

Il candidato deve inoltre essere disponibile a partecipare alla turnazione on-call, ovviamente remunerata e concordata per essere distribuita equamente nel mese, per la gestione di emergenze e incidenti fuori orario lavorativo standard.

Non è necessario avere esperienza approfondita su tutti i tool utilizzati: siamo pronti a offrire formazione tramite corsi e “training on the job” per colmare eventuali lacune e supportare la crescita professionale.

Responsabilità principali

Migliorare la resilienza ed ottimizzare il cluster Kubernetes (AKS su Azure), assicurando performance, scalabilità, sicurezza ed alta affidabilità dei servizi deployati

Configurare ed ottimizzare i database relazionali (PostgreSQL su Azure) e non relazionali (MongoDB Atlas) per garantire performance, affidabilità e sicurezza dei dati

Gestire e ottimizzare Apache Kafka (su AKS) per la raccolta e distribuzione di dati in tempo reale

Automatizzare processi operativi per ridurre il “toil” e migliorare l’efficacia dei team (Platform team e Product team)

Partecipare alla turnazione on-call per garantire una rapida risposta agli incidenti e alle emergenze

Sviluppare pipeline di monitoraggio e alerting per identificare e debuggare rapidamente problemi operativi

Identificare prontamente la “root cause” di problemi bloccanti, sviluppando documentazione tecnica dettagliata ed automazioni per evitare che problemi noti si verifichino nuovamente

Collaborare con il team di sviluppo per il miglioramento continuo del ciclo di vita dello sviluppo software (SDLC), garantendo pratiche solide e coerenti

Opportunità di lavorare su infrastrutture cloud-native moderne, resilienti e scalabili, in un contesto di stream processing ed edge computing

Forte attenzione alla cura delle persone, guidata dai nostri valori aziendali di intraprendenza, curiosità, cura e onestà

Ambiente collaborativo e stimolante, “remote friendly”, orientato alla crescita professionale e personale

Collaborazione continua con i coach di #AuthenticLeader, con percorsi di coaching individuale e di gruppo per sviluppare la tua leadership personale, migliorare la comunicazione e crescere professionalmente in un ambiente di confronto autentico.

Pacchetto retributivo competitivo

Abbonamento GOLD a Wellhub , che include l’accesso a palestre e centri sportivi ovunque ti trovi, app per il benessere mentale, il sonno e l’alimentazione, corsi live on-demand e sessioni personalizzate con personal trainer online tramite Trainiac by Wellhub.

MacBook Pro 14’’ (M3 Max) ed iPhone aziendale

Buoni pasto da 8€ al giorno

Informazioni su di te

Laurea in Informatica, Ingegneria o esperienza equivalente

3+ anni di esperienza con infrastrutture Cloud, preferibilmente Azure

Esperienza con sistemi distribuiti e principi di alta scalabilità e resilienza per applicazioni cloud-native

Esperienza consolidata in ambienti Linux, inclusa la gestione e il debugging di problemi di networking (DNS, Load Balancer, firewall e VPN)

Esperienza con tool di monitoraggio e logging (Prometheus, Grafana, Azure Monitor, etc.)

Esperienza nella creazione di automazioni (Python, Bash, Terraform) per migliorare i processi operativi, secondo il paradigma Infrastructure-as-Code (IaC)

Familiarità con i principi di Site Reliability Engineering, inclusi SLO, SLA ed “error budgets”

Disponibilità a partecipare alla turnazione on-call in reperibilità

Buona conoscenza della lingua inglese, scritta e parlata, obbligatoria per l’interazione con clienti internazionali

Esperienza nell’implementazione delle best practices di sicurezza su sistemi distribuiti, dalla configurazione di rete alla gestione dei segreti, fino alla scansione automatica per l’identificazione di vulnerabilità note

Esperienza con database relazionali (PostgreSQL) e non relazionali (MongoDB)

Esperienza con Apache Kafka e conoscenza dei concetti base di stream processing distribuito

Esperienza con CI/CD (Jenkins, Gitlab, etc.)

Familiarità con architetture di microservizi e metodologie DevOps/GitOps

Esperienza di progettazione e sviluppo di sistemi distribuiti real-time e fault-tolerant

L’offerta è rivolta a candidati ambosessi (L. 903/77 – L. 125/91) e a persone appartenenti a categorie protette (L. 68/99). I dati personali saranno trattati nel rispetto del Regolamento UE 2016/679 (GDPR) e della normativa nazionale vigente.

Ottieni la revisione del curriculum gratis e riservata.

o trascina qui il file.

Similar jobs

Offerte di lavoro simili che vale la pena confrontare

Platform Engineer / DevOps Specialist
Platform Engineer / DevOps Specialist

Hunters Group Srl • Arezzo

In loco
EUR 30.000 - 40.000
Smart working 2 giorni a settimana
Progetti internazionali ITA/Germania
Software Developer .NET
Software Developer .NET

adesso.it • Milano

In loco
EUR 70.000 - 120.000
Full stack software engineer
Full stack software engineer

3A INFORMATICA SRL • Roma

In loco
EUR 55.000 - 75.000
System Engineer
System Engineer

Var Group • Bologna

In loco
EUR 40.000 - 55.000
Formazione continua su DEI
Ambiente flessibile e inclusivo
Senior System Administrator
Senior System Administrator

Cespim Srl • Sala Bolognese

In loco
EUR 38.000 - 43.000
AWS Cloud Architect
AWS Cloud Architect

Zucchetti • Torino

In loco
EUR 26.000 - 34.000
Hybrid Work
Continuo Digital Training
People Care
+3
Mid Mobile Developer (Flutter)
Mid Mobile Developer (Flutter)

Datapizza S.r.l. • Trieste/Trst

In loco
EUR 37.000 - 42.000
Buoni pasto 8€/giorno
Salary review
Bonus psicologo
+2
Mid Frontend Developer (React)
Mid Frontend Developer (React)

Datapizza S.r.l. • Trieste/Trst

In loco
EUR 37.000 - 42.000
Welfare di € 1.000
Buoni pasto di 8€/giorno
Salary review
+2
Senior Mobile Developer (Flutter)
Senior Mobile Developer (Flutter)

Datapizza S.r.l. • Trieste/Trst

In loco
EUR 35.000 - 45.000
Welfare di € 1.000
Smart working 2/3 giorni a settimana
Senior Frontend Developer (React)
Senior Frontend Developer (React)

Datapizza S.r.l. • Trieste/Trst

In loco
EUR 37.000 - 42.000
Welfare di € 1.000
Flessibilità oraria
Possibilità di smart working