Staff Software Engineer, Site Reliability Engineering Connections - Google Careers
- Tipo di contratto
- Tempo pieno
- Percentuale
- 100%
- Luogo
- Zürich
- Lingue
- Inglese, Inglese
- Prima pubblicazione
info_outline
X Nella maggior parte dei casi, questa posizione richiede colloqui di persona come parte del processo di assunzione.
Requisiti minimi: ###
- Laurea triennale in Computer Science, un campo correlato o esperienza pratica equivalente.
- 8 anni di esperienza con lo sviluppo di software in uno o più linguaggi di programmazione.
- 3 anni di esperienza nella gestione di progetti.
- 3 anni di esperienza nella progettazione, analisi e risoluzione di problemi di sistemi distribuiti.
Requisiti preferenziali: ###
- Laurea magistrale in Computer Science o Engineering.
- Esperienza con sistemi distribuiti e paralleli.
- Forte preferenza verso soluzioni coerenti e comuni rispetto a soluzioni personalizzate.
- Approccio sistematico alla risoluzione dei problemi, unito a capacità comunicative e senso di responsabilità e iniziativa.
Informazioni sul lavoro ###
Site Reliability Engineering (SRE) combina l'ingegneria del software e dei sistemi per costruire e gestire sistemi su larga scala, massicciamente distribuiti e tolleranti ai guasti. SRE garantisce che i servizi di Google Cloud – sia i nostri sistemi internamente critici che quelli esternamente visibili – abbiano affidabilità, uptime appropriato alle esigenze del cliente e un rapido tasso di miglioramento. Inoltre, gli SRE terranno costantemente d'occhio la capacità e le prestazioni dei nostri sistemi.
Gran parte del nostro sviluppo software si concentra sull'ottimizzazione dei sistemi esistenti, sulla costruzione di infrastrutture ed sull'eliminazione del lavoro attraverso l'automazione. Nel team SRE, avrai l'opportunità di gestire le complesse sfide di scala che sono uniche per Google Cloud, utilizzando la tua esperienza nella codifica, algoritmi, analisi della complessità e progettazione di sistemi su larga scala. La cultura di SRE basata sulla curiosità intellettuale, la risoluzione dei problemi e l'apertura è fondamentale per il suo successo. La nostra organizzazione riunisce persone con una vasta gamma di background, esperienze e prospettive. Incoraggiamo la collaborazione, il pensare in grande e il correre rischi in un ambiente privo di colpe (blame-free). Promuoviamo l'autonomia nel lavorare su progetti significativi, cercando al contempo di creare un ambiente che fornisca il supporto e il mentoring necessari per imparare e crescere.
In questo ruolo, farai parte del team responsabile della ricerca di modi per migliorare l'affidabilità, la scalabilità e l'efficienza di questi e di altri sistemi che miliardi di persone in tutto il mondo utilizzano ogni giorno per migliorare la propria vita.
Dietro tutto ciò che i nostri utenti vedono online c'è l'architettura costruita dal team Technical Infrastructure per mantenerlo in funzione. Dallo sviluppo e mantenimento dei nostri data center alla costruzione della prossima generazione di piattaforme Google, rendiamo possibile il portfolio prodotti di Google. Siamo orgogliosi di essere gli ingegneri dei nostri ingegneri e amiamo invalidare le garanzie smontando le cose per poterle ricostruire. Manteniamo le nostre reti attive e funzionanti, garantendo ai nostri utenti l'esperienza migliore e più veloce possibile.
Responsabilità ###
- Partecipare e migliorare l'intero ciclo di vita dei servizi: dall'ideazione e progettazione, fino al deployment, all'operatività e al perfezionamento.
- Supportare i servizi prima del lancio attraverso attività come la consulenza sulla progettazione dei sistemi, lo sviluppo di piattaforme e framework software, la pianificazione della capacità e le revisioni di lancio.
- Mantenere i servizi una volta attivi misurando e monitorando la disponibilità, la latenza e la salute complessiva del sistema.
- Scalare i sistemi in modo sostenibile attraverso meccanismi come l'automazione, ed evolvere i sistemi spingendo per cambiamenti che migliorino l'affidabilità e la velocità.
- Praticare una gestione degli incidenti sostenibile e post-mortem senza attribuzione di colpa.
Tradotto automaticamente dall’originale.
Pubblicato 2 giorni fa