DevOps Engineer - SRE
Listed on 2026-09-30
-
IT/Tech
SRE/Site Reliability, IT Support, Systems Engineer, Cybersecurity
CHI SIAMO
Blazar è nata nel 2012 dalla passione per l'informatica e dalla volontà di creare un ecosistema lavorativo virtuoso, in cui fosse possibile vivere meglio .
Oggi Blazar Group è una realtà internazionale, in continua espansione, che continua a far vivere quella missione.
È un grande sogno che non smette mai di realizzarsi.
Siamo affascinati dalla tecnologia, fautori della collaborazione proattiva e fermamente convinti che il successo di un gruppo derivi direttamente dalla qualità delle persone che ne fanno parte.
Per questa ragione tutti i Blazariani, fin dal primo giorno di lavoro, sono affiancati da un team di specialisti (psicologo, coach e trainer), dedicato alla costruzione del
Piano Personale di Crescita (PPC®), un percorso costruito su misura e volto alla crescita personale, sviluppato mediante incontri individuali ed esperienze in team.
Ogni anno, per dare sostegno alle attività di People Engagement,
Blazar Group riserva una quota almeno pari al 5% del proprio fatturato.
Cerchiamo una persona da inserire nel nostro team di Observability (monitoraggio) in qualità di Site Reliability Engineer (SRE), con esperienza nella gestione di sistemi e applicazioni distribuite e con una forte attenzione all'affidabilità, alle performance e all'automazione.
La persona contribuirà alla gestione e all'evoluzione degli ambienti di produzione, lavorando a stretto contatto con i team di sviluppo e infrastruttura per garantire alta disponibilità, performance, scalabilità e continuità operativa dei servizi.
Ma, prima ancora delle competenze tecniche, cerchiamo persone appassionate, curiose e con una forte predisposizione verso i dati
: persone che davanti a un'anomalia vogliano capire cosa sta succedendo e perché, che amino analizzare informazioni, metriche e log e mettere insieme gli indizi per arrivare alla causa di un problema.
Non ci aspettiamo che tu sappia già tutto. Cerchiamo piuttosto qualcuno che abbia voglia di imparare continuamente:
quello che non si sa, si impara!!
Cerchiamo quindi un profilo tecnico con un approccio proattivo, curioso e analitico, capace non solo di intervenire sui problemi, ma anche di individuarli e prevenirli attraverso monitoraggio, analisi dei dati, automazione e miglioramento continuo.
COSA FARAI- Monitoring & Observability: Monitorerai disponibilità, performance e stato di salute complessivo degli ambienti di produzione, analizzando dati, metriche, log ed eventi per individuare anomalie, correlazioni, colli di bottiglia e possibili aree di miglioramento.
- Data Analysis & Troubleshooting: Utilizzerai Splunk per interrogare e analizzare i dati provenienti dai sistemi e dalle applicazioni, approfondendo anomalie e comportamenti inattesi e contribuendo alle attività di troubleshooting e Root Cause Analysis.
- Infrastructure & Automation: Svilupperai strumenti, automazioni e sistemi per la gestione dell'infrastruttura, delle piattaforme e delle applicazioni, utilizzando anche Terraform e principi Infrastructure as Code, riducendo le attività manuali e aumentando affidabilità e ripetibilità dei processi.
- Performance & Troubleshooting: Raccoglierai e analizzerai metriche provenienti da sistemi operativi e applicazioni per attività di performance tuning, troubleshooting e identificazione delle cause dei malfunzionamenti.
- Development & Release: Collaborerai con i team di sviluppo per migliorare l'affidabilità dei servizi attraverso procedure strutturate di testing, deployment e release.
- System Design & Capacity Planning: Parteciperai alla progettazione dei sistemi, alla gestione delle piattaforme e alle attività di capacity planning, contribuendo alla loro evoluzione e scalabilità.
- Service Level Management: Contribuirai alla definizione e al monitoraggio dei Service…
(If this job is in fact in your jurisdiction, then you may be using a Proxy or VPN to access this site, and to progress further, you should change your connectivity to another mobile device or PC).