Site Reliability Engineer

Agap2 Italia

Lazio

Ibrido

EUR 70.000 - 94.000

Tempo pieno

32 ore fa
Candidati tra i primi

Ricevi più risposte dai datori di lavoro

Invia un CV specifico per questa offerta in pochi minuti.

Vantaggi offerti da questo lavoro

Remote friendly

Descrizione del lavoro

Agap2 Italia cerca un Site Reliability Engineer per potenziare l’infrastruttura cloud in produzione su Azure. Lavoro su AKS, PostgreSQL su Azure e MongoDB Atlas in un contesto internazionale, con attenzione a resilienza, sicurezza e scalabilità.

Il candidato partecipa a turni on‑call remunerati, collabora con i team di Platform e Product e contribuisce a pipeline di monitoraggio e automazione (Python, Bash, Terraform). Richiesta esperienza su Linux e Kubernetes, inglese fluente.

Competenze

  • Laurea in Informatica o equivalente.
  • 3+ anni di esperienza con infrastrutture Cloud, preferibilmente Azure.
  • Esperienza con sistemi distribuiti, alta scalabilità e resilienza per applicazioni cloud-native.
  • Ambiente Linux, gestione e debugging di networking (DNS, Load Balancer, firewall e VPN).
  • Esperienza con Docker, Kubernetes ed Helm.
  • Esperienza con strumenti di monitoraggio e logging (Prometheus, Grafana, Azure Monitor).
  • Competenze in automazione (Python, Bash, Terraform) e IaC.
  • Familiarità con SRE, SLO, SLA ed error budgets.
  • Disponibilità a turnazione on-call e disponibilità a lavorare in contesti internazionali.
  • Buona conoscenza della lingua inglese, scritta e parlata.

Mansioni

  • Migliorare resilienza e ottimizzare il cluster Kubernetes (AKS su Azure).
  • Configuare e ottimizzare database relazionali/non relazionali (PostgreSQL su Azure, MongoDB Atlas).
  • Gestire e ottimizzare Apache Kafka su AKS per dati in tempo reale.
  • Automatizzare processi operativi per ridurre il toil e migliorare efficacia dei team.
  • Partecipare alla turnazione on-call remunerata.
  • Sviluppare pipeline di monitoraggio e alerting.
  • Identificare root cause e sviluppare automazioni per prevenire problemi ricorrenti.
  • Collaborare con lo sviluppo per migliorare SDLC e pratiche DevOps.

Conoscenze

Linux
Docker
Kubernetes
Helm
Prometheus
Grafana
Azure Monitor
Python
Bash
Terraform
SLO/SLA

Formazione

Laurea in Informatica o equivalente

Strumenti

AKS (Azure Kubernetes Service)
Azure Database for PostgreSQL
MongoDB Atlas
Apache Kafka
Prometheus
Grafana

Descrizione del lavoro

Site Reliability Engineer agap2 Italia•frosinone, lazio, it

Descrizione dell’offerta di lavoro

Siamo alla ricerca di un Site Reliability Engineer motivato a contribuire alla scalabilità e all’ottimizzazione di una complessa infrastruttura Cloud in produzione su Azure.

Si tratta di un sistema distribuito progettato per raccogliere, gestire e distribuire grosse moli di dati in tempo reale. Include componenti connessi “at the edge” che devono essere in grado di operare in scenari “offline” e garantire “eventual consistency” dei dati. La lingua di lavoro principale è l’inglese, dato che il sistema è utilizzato da clienti internazionali.

Il ruolo richiede un forte focus sull’affidabilità, la scalabilità, la sicurezza e la resilienza dell’infrastruttura, con un utilizzo intensivo di Azure Kubernetes Service (AKS), Azure Database for PostgreSQL, MongoDB Atlas ed Apache Kafka.

Il candidato deve inoltre essere disponibile a partecipare alla turnazione on-call, ovviamente remunerata e concordata per essere distribuita equamente nel mese, per la gestione di emergenze e incidenti fuori orario lavorativo standard.

Non è necessario avere esperienza approfondita su tutti i tool utilizzati: siamo pronti a offrire formazione tramite corsi e “training on the job” per colmare eventuali lacune e supportare la crescita professionale.

Responsabilità principali
  • Migliorare la resilienza ed ottimizzare il cluster Kubernetes (AKS su Azure), assicurando performance, scalabilità, sicurezza ed alta affidabilità dei servizi deployati
  • Configurare ed ottimizzare i database relazionali (PostgreSQL su Azure) e non relazionali (MongoDB Atlas) per garantire performance, affidabilità e sicurezza dei dati
  • Gestire e ottimizzare Apache Kafka (su AKS) per la raccolta e distribuzione di dati in tempo reale
  • Automatizzare processi operativi per ridurre il “toil” e migliorare l’efficacia dei team (Platform team e Product team)
  • Partecipare alla turnazione on-call per garantire una rapida risposta agli incidenti e alle emergenze
  • Sviluppare pipeline di monitoraggio e alerting per identificare e debuggare rapidamente problemi operativi
  • Identificare prontamente la “root cause” di problemi bloccanti, sviluppando documentazione tecnica dettagliata ed automazioni per evitare che problemi noti si verifichino nuovamente
  • Collaborare con il team di sviluppo per il miglioramento continuo del ciclo di vita dello sviluppo software (SDLC), garantendo pratiche solide e coerenti
Requisiti
  • Laurea in Informatica, Ingegneria o esperienza equivalente
  • 3+ anni di esperienza con infrastrutture Cloud, preferibilmente Azure
  • Esperienza con sistemi distribuiti e principi di alta scalabilità e resilienza per applicazioni cloud-native
  • Esperienza consolidata in ambienti Linux, inclusa la gestione e il debugging di problemi di networking (DNS, Load Balancer, firewall e VPN)
  • Esperienza con Docker, Kubernetes ed Helm
  • Esperienza con tool di monitoraggio e logging (Prometheus, Grafana, Azure Monitor, etc.)
  • Esperienza nella creazione di automazioni (Python, Bash, Terraform) per migliorare i processi operativi, secondo il paradigma Infrastructure-as-Code (IaC)
  • Familiarità con i principi di Site Reliability Engineering, inclusi SLO, SLA ed “error budgets”
  • Disponibilità a partecipare alla turnazione on-call in reperibilità
  • Buona conoscenza della lingua inglese, scritta e parlata, obbligatoria per l’interazione con clienti internazionali
Nice to Have
  • Certificazioni Azure (es. Azure Solutions Architect, Azure DevOps Engineer)
  • Esperienza nell’implementazione delle best practices di sicurezza su sistemi distribuiti, dalla configurazione di rete alla gestione dei segreti, fino alla scansione automatica per l’identificazione di vulnerabilità note
  • Esperienza con database relazionali (PostgreSQL) e non relazionali (MongoDB)
  • Esperienza con Apache Kafka e conoscenza dei concetti base di stream processing distribuito
  • Esperienza con CI/CD (Jenkins, Gitlab, etc.)
  • Familiarità con architetture di microservizi e metodologie DevOps/GitOps
  • Esperienza di progettazione e sviluppo di sistemi distribuiti real-time e fault-tolerant
Cosa offriamo
  • Opportunità di lavorare su infrastrutture cloud-native moderne, resilienti e scalabili, in un contesto di stream processing ed edge computing
  • Forte attenzione alla cura delle persone, guidata dai nostri valori aziendali di intraprendenza, curiosità, cura e onestà
  • Ambiente collaborativo e stimolante, “remote friendly”, orientato alla crescita professionale e personale
Ottieni la revisione del curriculum gratis e riservata.
o trascina qui il file.
Similar jobs

Offerte di lavoro simili che vale la pena confrontare

Site Reliability Engineer
Site Reliability Engineer

Agap2 Italia • Pescara

Ibrido
EUR 55.000 - 75.000
Remote-Friendly Site Reliability Engineer on Azure
Remote-Friendly Site Reliability Engineer on Azure

Agap2 Italia • Pescara

Ibrido
EUR 55.000 - 75.000
Azure SRE: Real-Time Data, AKS & Kafka Reliability
Azure SRE: Real-Time Data, AKS & Kafka Reliability

Agap2 Italia • Lazio

Ibrido
EUR 70.000 - 94.000
Remote friendly
Site Reliability Engineer
Site Reliability Engineer

Michael Page International Italia S.r.l. • Milano

In loco
EUR 40.000 - 70.000
Stipendio competitivo
Un giorno di lavoro da casa alla settimana
Cultura aziendale coinvolgente
Cloud & DevOps Engineer
Cloud & DevOps Engineer

P4I – Digital360 Advisory • Milano

In loco
EUR 38.000 - 46.000
Pacchetto welfare aziendale
Buoni pasto
Azure Cloud Engineer
Azure Cloud Engineer

SynSphere • Italia

Ibrido
EUR 55.000 - 65.000
Flessibilità organizzativa
Percorso di certificazione Microsoft finanziato
Accesso a progetti enterprise
Architetto Cloud
Architetto Cloud

Agap2 Italia • Lazio

In loco
EUR 35.000 - 50.000
Collaborazioni in P.IVA
Buoni pasto giornalieri
Formazione tecnica e soft skills
+2
AWS Cloud Architect
AWS Cloud Architect

Zucchetti • Torino

Ibrido
EUR 26.000 - 34.000
Hybrid Work
Continuo Digital Training
People Care
+3
System Engineer
System Engineer

Var Group • Bologna

In loco
EUR 40.000 - 55.000
Formazione continua su DEI
Ambiente flessibile e inclusivo
Full Stack Developer (Back-end .NET)
Full Stack Developer (Back-end .NET)

Ennova Research • Lomazzo

In loco
EUR 45.000 - 65.000
Lavoro ibrido Lomazzo
Progetti enterprise stimolanti
Ambiente inclusivo e di crescita