Pubblica annuncio gratuito
Ricevi nuove offerte di lavoro

Crea una Job Alert gratuita per site reliability engineer / palermo

Site Reliability Engineer

Pubblicato il 30-08-2026 - agap2 Italia in Palermo

Siamo alla ricerca di un Site Reliability Engineer motivato a contribuire alla scalabilità e all’ottimizzazione di una complessa infrastruttura Cloud in produzione su Azure.

Sia tra i primi a candidarsi: legga la panoramica completa del ruolo qui sotto, quindi invii la sua candidatura per essere preso/a in considerazione.

Si tratta di un sistema distribuito progettato per raccogliere, gestire e distribuire grosse moli di dati in tempo reale. Include componenti connessi “at the edge” che devono essere in grado di operare in scenari “offline” e garantire “eventual consistency” dei dati. La lingua di lavoro principale è l’inglese, dato che il sistema è utilizzato da clienti internazionali.

Il ruolo richiede un forte focus sull’affidabilità, la scalabilità, la sicurezza e la resilienza dell’infrastruttura, con un utilizzo intensivo di Azure Kubernetes Service (AKS) , Azure Database for PostgreSQL , MongoDB Atlas ed Apache Kafka .

Il candidato deve inoltre essere disponibile a partecipare alla turnazione on-call, ovviamente remunerata e concordata per essere distribuita equamente nel mese, per la gestione di emergenze e incidenti fuori orario lavorativo standard.

Non è necessario avere esperienza approfondita su tutti i tool utilizzati: siamo pronti a offrire formazione tramite corsi e “training on the job” per colmare eventuali lacune e supportare la crescita professionale.

Responsabilità principali

-

- Migliorare la resilienza ed ottimizzare il cluster Kubernetes (AKS su Azure), assicurando performance, scalabilità, sicurezza ed alta affidabilità dei servizi deployati

- Configurare ed ottimizzare i database relazionali (PostgreSQL su Azure)



e non relazionali (MongoDB Atlas) per garantire performance, affidabilità e sicurezza dei dati

- Gestire e ottimizzare Apache Kafka (su AKS) per la raccolta e distribuzione di dati in tempo reale

- Automatizzare processi operativi per ridurre il “toil” e migliorare l’efficacia dei team (Platform team e Product team)

- Partecipare alla turnazione on-call per garantire una rapida risposta agli incidenti e alle emergenze

- Sviluppare pipeline di monitoraggio e alerting per identificare e debuggare rapidamente problemi operativi

- Identificare prontamente la “root cause” di problemi bloccanti, sviluppando documentazione tecnica dettagliata ed automazioni per evitare che problemi noti si verifichino nuovamente

- Collaborare con il team di sviluppo per il miglioramento continuo del ciclo di vita dello sviluppo software (SDLC), garantendo pratiche solide e coerenti

- Laurea in Informatica, Ingegneria o esperienza equivalente

- 3+ anni di esperienza con infrastrutture Cloud, preferibilmente Azure

- Esperienza con sistemi distribuiti e principi di alta scalabilità e resilienza per applicazioni cloud-native

- Esperienza consolidata in ambienti Linux, inclusa la gestione e il debugging di problemi di networking (DNS, Load Balancer,



firewall e VPN)

- Esperienza con tool di monitoraggio e logging (Prometheus, Grafana, Azure Monitor, etc.)

- Esperienza nella creazione di automazioni (Python, Bash, Terraform) per migliorare i processi operativi, secondo il paradigma Infrastructure-as-Code (IaC)

- Familiarità con i principi di Site Reliability Engineering, inclusi SLO, SLA ed “error budgets”

- Disponibilità a partecipare alla turnazione on-call in reperibilità

- Buona conoscenza della lingua inglese, scritta e parlata, xysqume obbligatoria per l’interazione con clienti internazionali

- Esperienza nell’implementazione delle best practices di sicurezza su sistemi distribuiti, dalla configurazione di rete alla gestione dei segreti, fino alla scansione automatica per l’identificazione di vulnerabilità note

- Esperienza con database relazionali (PostgreSQL) e non relazionali (MongoDB)

- Esperienza con Apache Kafka e conoscenza dei concetti base di stream processing distribuito

- Esperienza con CI/CD (Jenkins, Gitlab, etc.)

- Familiarità con architetture di microservizi e metodologie DevOps/GitOps

- Esperienza di progettazione e sviluppo di sistemi distribuiti real-time e fault-tolerant

- Opportunità di lavorare su infrastrutture cloud-native moderne, resilienti e scalabili, in un contesto di stream processing ed edge computing

- Resistente attenzione alla cura delle persone, guidata dai nostri valori aziendali di intraprendenza, curiosità, cura e onestà

- Ambiente collaborativo e stimolante, “remote friendly”, orientato alla crescita competente e personale

#J-18808-Ljbffr

» RISPONDI A QUESTO ANNUNCIO
Altri Annunci
Maestra
2026-08-30 09:40:17 - navalwork - Ancona
cerco maestra o laureanda per mia figli 8 anni nel pomeriggio come aiuto compiti [...]
Bagnino
2026-08-30 09:40:07 - Hotel Terme Mioni Pezzato Prima - Abano Terme
BAGNINO - HOTEL MIONI PEZZATO Cerchiamo una persona attenta, affidabile e dinamica per mantenere impeccabili le nostre piscine e garantire un ambiente sicuro e accogliente ai nostri ospiti! Posizione: Hotel Mi [...]
Ricevi nuove offerte di lavoro

Crea una Job Alert gratuita per site reliability engineer / palermo

Economo Ristorazione
2026-08-30 09:39:43 - escursioni la torre - Morciano di Leuca
Siamo alla ricerca di un/una Economo/a da inserire stabilmente nel nostro team con contratto a tempo indeterminato. La figura si occuperà della gestione degli ordini e dei rapporti con i fornitori, del ricevimen [...]
Shampista e colorista
2026-08-30 09:39:39 - Ruotolo parrucchieri - Marano di Napoli
Cerchiamo personale per ampliamento STAFF cerchiamo anche con un minimo di esperienza Persona seria e volenteroso e disposta a fare corsi dí aggiornamento,garantiamo crescita qualificato [...]