Site Reliability Engineer

01 ago - Italia
agap2 Italia

pSiamo alla ricerca di un strong

Site Reliability Engineer /strongmotivato a contribuire alla scalabilità e all’ottimizzazione di una complessa strongeminfrastruttura Cloud in produzione su Azure. /em /strong /ppbr/pp

Si tratta di un sistema distribuito progettato per raccogliere, gestire e distribuire grosse moli di dati in tempo reale.

Include componenti connessi em“at the edge” /em che devono essere in grado di operare in scenari em“offline” /em e garantire em“eventual consistency” /em dei dati.

La lingua di lavoro principale è l’inglese, dato che il sistema è utilizzato da clienti internazionali. /ppbr/pp

Il ruolo richiede un forte focus sull’affidabilità, la scalabilità, la sicurezza e la resilienza dell’infrastruttura, con un utilizzo intensivo di strong

Azure Kubernetes Service (AKS) /strong, strong

Azure Database for PostgreSQL /strong, strong

MongoDB Atlas /strong ed strong

Apache Kafka /strong. /ppbr/pp

Il candidato deve inoltre essere disponibile a partecipare alla turnazione on-call, ovviamente remunerata e concordata per essere distribuita equamente nel mese, per la gestione di emergenze e incidenti fuori orario lavorativo standard. /ppbr/pp

Non è necessario avere esperienza approfondita su tutti i tool utilizzati: siamo pronti a offrire formazione tramite corsi e em“training on the job” /em per colmare eventuali lacune e supportare la crescita competente. /ppbr/ppstrong

Responsabilità principali /strong /pulli

Migliorare la resilienza ed ottimizzare il cluster Kubernetes (AKS su Azure), assicurando performance, scalabilità, sicurezza ed alta affidabilità dei servizi deployati /lili

Configurare ed ottimizzare i database relazionali (PostgreSQL su Azure) e non relazionali (MongoDB Atlas) per garantire performance,



affidabilità e sicurezza dei dati /lili

Gestire e ottimizzare Apache Kafka (su AKS) per la raccolta e distribuzione di dati in tempo reale /lili

Automatizzare processi operativi per ridurre il “toil” e migliorare l’efficacia dei team (Platform team e Product team) /lili

Partecipare alla turnazione on-call per garantire una rapida risposta agli incidenti e alle emergenze /lili

Sviluppare pipeline di monitoraggio e alerting per identificare e debuggare rapidamente problemi operativi /lili

Identificare prontamente la “root cause” di problemi bloccanti, sviluppando documentazione tecnica dettagliata ed automazioni per evitare che problemi noti si verifichino nuovamente /lili

Collaborare con il team di sviluppo per il miglioramento continuo del ciclo di vita dello sviluppo software (SDLC), garantendo pratiche solide e coerenti /li /ulpbr/ppstrong

Requisiti /strong /pulli

Laurea in Informatica, Ingegneria o esperienza equivalente /lili3+ anni di esperienza con infrastrutture Cloud, preferibilmente Azure /lili

Esperienza con sistemi distribuiti e principi di alta scalabilità e resilienza per applicazioni cloud-native /lili

Esperienza consolidata in ambienti Linux, inclusa la gestione e il debugging di problemi di networking (DNS, Load Balancer, firewall e VPN) /lili

Esperienza con Docker, Kubernetes ed Helm /lili

Esperienza con tool di monitoraggio e logging (Prometheus, Grafana,



Azure Monitor, etc.) /lili

Esperienza nella creazione di automazioni (Python, Bash, Terraform) per migliorare i processi operativi, secondo il paradigma Infrastructure-as-Code (IaC) /lili

Familiarità con i principi di Site Reliability Engineering, inclusi SLO, SLA ed “error budgets” /lili

Disponibilità a partecipare alla turnazione on-call in reperibilità /lili

Buona conoscenza della lingua inglese, scritta e parlata, obbligatoria per l’interazione con clienti internazionali /li /ulpbr/ppstrong

Nice to Have /strong /pulli

Certificazioni Azure (es.

Azure Solutions Architect, Azure Dev

Ops Engineer) /lili

Esperienza nell’implementazione delle best practices di sicurezza su sistemi distribuiti, dalla configurazione di rete alla gestione dei segreti, fino alla scansione automatica per l’identificazione di vulnerabilità note /lili

Esperienza con database relazionali (PostgreSQL) e non relazionali (MongoDB) /lili

Esperienza con Apache Kafka e conoscenza dei concetti base di stream processing distribuito /lili

Esperienza con CI/CD (Jenkins, Gitlab, etc.) /lili

Familiarità con architetture di microservizi e metodologie Dev

Ops/Git

Ops /lili

Esperienza di progettazione e sviluppo di sistemi distribuiti real-time e fault-tolerant /li /ulpbr/ppbr/ppstrong

Cosa offriamo /strong /pulli

Opportunità di lavorare su infrastrutture cloud-native moderne, resilienti e scalabili, in un contesto di stream processing ed edge computing /lili

Forte attenzione alla cura delle persone, guidata dai nostri valori aziendali di intraprendenza, curiosità, cura e onestà /lili

Ambiente collaborativo e stimolante, em“remote friendly” /em, orientato alla crescita professionale e personale /li /ul

131- Corso di amministrazione del personale in azienda, paghe e contributi - per destinatari di AssegnoVERONA

06 ago - Sommacampagna
PENTA FORMAZIONE

106387 - It Manager

06 ago - Bresso
ETJCA

Ricevi nuove offerte di lavoro

Crea una Job Alert gratuita per site reliability engineer / italia

105917 - Carrellista

06 ago - Creazzo
Ali S. P. A

102929 - Addetto Alla Logistica - €28.000 All'Anno

06 ago - Vicenza
Adecco Italia