Pubblica annuncio gratuito
Ricevi nuove offerte di lavoro

Crea una Job Alert gratuita per site reliability engineer / torino

Site Reliability Engineer

Pubblicato il 18-09-2026 - agap2 Italia in Torino

Siamo alla ricerca di un

È il candidato/la candidata ideale per questa opportunità? Lo scopra leggendo la panoramica del ruolo qui sotto.

Site Reliability Engineer motivato a contribuire alla scalabilità e all’ottimizzazione di una complessa infrastruttura Cloud in produzione su Azure.

Si tratta di un sistema distribuito progettato per raccogliere, gestire e distribuire grosse moli di dati in tempo reale. Include componenti connessi

“at the edge”

che devono essere in grado di operare in scenari

“offline”

e garantire

“eventual consistency”

dei dati. La lingua di lavoro principale è l’inglese, dato che il sistema è utilizzato da clienti internazionali.

Il ruolo richiede un forte focus sull’affidabilità, la scalabilità, la sicurezza e la resilienza dell’infrastruttura, con un utilizzo intensivo di

Azure Kubernetes Service (AKS) ,

Azure Database for PostgreSQL ,

MongoDB Atlas ed

Apache Kafka .

Il candidato deve inoltre essere disponibile a partecipare alla turnazione on-call, ovviamente remunerata e concordata per essere distribuita equamente nel mese, per la gestione di emergenze e incidenti fuori orario lavorativo standard.

Non è necessario avere esperienza approfondita su tutti i tool utilizzati: siamo pronti a offrire formazione tramite corsi e

“training on the job”

per colmare eventuali lacune e supportare la crescita qualificato.

Responsabilità principali

Migliorare la resilienza ed ottimizzare il cluster Kubernetes (AKS su Azure), assicurando performance, scalabilità, sicurezza ed alta affidabilità dei servizi deployati

Configurare ed ottimizzare i database relazionali (PostgreSQL su Azure) e non relazionali (MongoDB Atlas)



per garantire performance, affidabilità e sicurezza dei dati

Gestire e ottimizzare Apache Kafka (su AKS) per la raccolta e distribuzione di dati in tempo reale

Automatizzare processi operativi per ridurre il “toil” e migliorare l’efficacia dei team (Platform team e Product team)

Partecipare alla turnazione on-call per garantire una rapida risposta agli incidenti e alle emergenze

Sviluppare pipeline di monitoraggio e alerting per identificare e debuggare rapidamente problemi operativi

Identificare prontamente la “root cause” di problemi bloccanti, sviluppando documentazione tecnica dettagliata ed automazioni per evitare che problemi noti si verifichino nuovamente

Collaborare con il team di sviluppo per il miglioramento continuo del ciclo di vita dello sviluppo software (SDLC), garantendo pratiche solide e coerenti

Requisiti

Laurea in Informatica, Ingegneria o esperienza equivalente

3+ anni di esperienza con infrastrutture Cloud, preferibilmente Azure

Esperienza con sistemi distribuiti e principi di alta scalabilità e resilienza per applicazioni cloud-native

Esperienza consolidata in ambienti Linux, inclusa la gestione e il debugging di problemi di networking (DNS, Load Balancer, firewall e VPN)

Esperienza con Docker, Kubernetes ed Helm





Esperienza con tool di monitoraggio e logging (Prometheus, Grafana, Azure Monitor, etc.)

Esperienza nella creazione di automazioni (Python, Bash, Terraform) per migliorare i processi operativi, secondo il paradigma Infrastructure-as-Code (IaC)

Familiarità con i principi di Site Reliability Engineering, inclusi SLO, SLA ed “error budgets”

Disponibilità a partecipare alla turnazione on-call in reperibilità

Buona conoscenza della lingua inglese, scritta e parlata, obbligatoria per l’interazione xlwpduy con clienti internazionali

Nice to Have

Certificazioni Azure (es. Azure Solutions Architect, Azure DevOps Engineer)

Esperienza nell’implementazione delle best practices di sicurezza su sistemi distribuiti, dalla configurazione di rete alla gestione dei segreti, fino alla scansione automatica per l’identificazione di vulnerabilità note

Esperienza con database relazionali (PostgreSQL) e non relazionali (MongoDB)

Esperienza con Apache Kafka e conoscenza dei concetti base di stream processing distribuito

Esperienza con CI/CD (Jenkins, Gitlab, etc.)

Familiarità con architetture di microservizi e metodologie DevOps/GitOps

Esperienza di progettazione e sviluppo di sistemi distribuiti real-time e fault-tolerant

Cosa offriamo

Opportunità di lavorare su infrastrutture cloud-native moderne, resilienti e scalabili, in un contesto di stream processing ed edge computing

Forte attenzione alla cura delle persone, guidata dai nostri valori aziendali di intraprendenza, curiosità, cura e onestà

Ambiente collaborativo e stimolante,

“remote friendly” , orientato alla crescita professionale e personale

» RISPONDI A QUESTO ANNUNCIO
Altri Annunci
Impiegato del back office
2026-09-19 07:08:05 - agap2 Italia - Roma
Back Office - Savignano La preghiamo di leggere attentamente le informazioni contenute in questo annuncio di lavoro per comprendere esattamente cosa ci si aspetta dai potenziali candidati. Per conto di una rea [...]
Addetto/A Sala | Old Wild West | Brescia Oz - €8,2 All'Ora - Part Time...
2026-09-19 07:08:05 - OLD WILD WEST - Rezzato
Ricerca di un cameriere/a di sala per Old Wild West a Brescia. Si offre contratto tempo parziale di 20 ore settimanali su turni, inclusi weekend e festivi. Necessarie abilità comunicative e passione per la ristoraz [...]
Ricevi nuove offerte di lavoro

Crea una Job Alert gratuita per site reliability engineer / torino

Mechanic Technician (f/m/nb)...
2026-09-19 07:08:00 - Randstad Inhouse - Brescia
Randstad Inhouse Services, divisione specializzata di Randstad Italia Spa, Specialty Pharma, ricerca per importante azienda multinazionale del settore farmaceutico un Mechanic Technician (f/m/nb). La risorsa s [...]
Chef De Partie Hotel 4 Stelle - €25.000 All'Anno
2026-09-19 07:07:58 - AXL - Bresso
La risorsa sarà inserita come Chef de Partie in un hotel 4 stelle a Milano, occupandosi della preparazione dei piatti, gestione comande, e rispetto normative HACCP. xysqume Se desidera saperne di più su questa [...]