jobportalschweiz.ch
← Alle Stellen

Site Reliability Engineer - eFX/ Crypto

Swissquote Bank SA

Anstellung
Vollzeit
Ort
Gland
Erstmals ausgeschrieben
Jetzt bewerben
Unternehmensbeschreibung ## Bei Swissquote sind wir voll dabei. Mit vollem Einsatz, um Dinge aufzumischen. Mit vollem Einsatz, um die Bank zu bauen, die die Menschen tatsächlich nutzen wollen. Mit vollem Einsatz, um Finanzen weniger langweilig – und viel leistungsfähiger zu machen. Wir sind die führende digitale Bank der Schweiz – über 1.400 Mitarbeitende in Europa, dem Nahen Osten und Asien, die echte Finanzlösungen für über eine Million Kunden weltweit entwickeln. Vom Handel und Investieren bis hin zum alltäglichen Banking decken wir das gesamte Spektrum ab. Wir bewegen uns schnell, aber wir bauen Dinge, auf die wir wirklich stolz sind. Werfen Sie einen Blick hinter die Kulissen, indem Sie Humans of Swissquote auf Instagram besuchen. Schnelles Wachstum schafft Raum. Raum, um Dinge auszuprobieren, Verantwortung zu übernehmen und in einem Tempo zu wachsen, das die meisten Orte nicht bieten können. Egal, ob Sie das Rampenlicht lieben oder es vorziehen, sich einfach auf Ihre Arbeit zu konzentrieren – hier ist Platz für beides. Wir haben den Dresscode abgeschafft – aber niemals die Chance zu feiern. Ob grosser oder kleiner Erfolg, wir lassen ihn zählen. Die Art von Ort, an dem sich die Atmosphäre von selbst ergibt. Als Arbeitgeber, der Chancengleichheit fördert, begrüssen wir Kandidatinnen und Kandidaten aus allen Hintergründen, Erfahrungen und Perspektiven, um unser Team zu verstärken und zu unserem gemeinsamen Erfolg beizutragen. Fühlen Sie es? Das ist ein guter Anfang. Bewerben Sie sich. Jobbeschreibung ## Wir suchen einen hands-on Site Reliability Engineer (SRE), der dabei hilft, die Zuverlässigkeit, Verfügbarkeit, Skalierbarkeit und Performance unserer Produktionsplattformen für eFX/Crypto sicherzustellen. Die Rolle hat einen starken Fokus auf Kubernetes, Produktionsbetrieb, Automatisierung, Observability und Infrastruktur-Zuverlässigkeit. Sie werden eng mit Infrastructure- und Development-Engineers zusammenarbeiten, um unsere Produktionsumgebung über On-Premise- und Private-Cloud-Infrastrukturen zu betreiben und kontinuierlich zu verbessern. Hauptverantwortlichkeiten • Überwachung der Produktionssysteme, Reaktion auf Vorfälle und Sicherstellung der optimalen Uptime und Performance von Anwendungen und Infrastruktur. • Betrieb, Wartung und Fehlerbehebung von Kubernetes-Clustern und containerisierten Anwendungen in der Produktion sowie On-Premise-Infrastruktur. • Mitwirkung an der Konzeption und Implementierung skalierbarer und zuverlässiger Infrastrukturlösungen. • Automatisierung von IT- und Betriebsprozessen, um manuelle Arbeit zu reduzieren und die Effizienz zu steigern. • Implementierung und Wartung von CI/CD-Pipelines und der Deployment-Automatisierung. • Überwachung und Verbesserung der System-Observability unter Verwendung von Tools wie Prometheus, Grafana und Elastic/Kibana. • Analyse von Fehlern, Durchführung von Ursachenanalysen (Root-Cause-Analysis) sowie Implementierung von Korrektur- und Präventivmassnahmen. • Durchführung von Stress-, Resilienz-, Disaster-Recovery- und BCP-Tests zur Validierung der Plattformstabilität. • Enge Zusammenarbeit mit Infrastructure- und Development-Teams zur Verbesserung der Produktionsbereitschaft und Systemzuverlässigkeit. • Teilnahme an der On-Call-Rotation und Bereitstellung von operativem Support für Produktionssysteme. • Kontinuierliche Verbesserung der Betriebsprozesse, Automatisierung, Überwachung und Zuverlässigkeitspraktiken. Qualifikationen ## • Mehr als 3 Jahre Erfahrung in SRE, DevOps, Systems Engineering, Platform Engineering oder einer ähnlichen Rolle im Production Engineering. • Starke Hands-on-Erfahrung mit Kubernetes in Produktionsumgebungen – obligatorisch. • Fundiertes Verständnis der Kubernetes-Architektur und des täglichen Betriebs, einschliesslich: • Service Mesh und Istio • Benutzerverwaltung • Health Checks und Probes • Kubernetes Networking und DNS • Fehlerbehebung und Performance-Probleme • Linux-Administration und Troubleshooting-Fähigkeiten. • Erfahrung mit Docker und Container-Technologien. • Hands-on-Erfahrung mit On-Premise-Infrastruktur und/oder Private-Cloud-Umgebungen. • Erfahrung mit Infrastructure as Code und Automatisierungstools wie Terraform und Ansible. • Erfahrung mit CI/CD-Pipelines. • Erfahrung mit Observability- und Monitoring-Tools wie Prometheus, Grafana, Elastic/Kibana. • Gute Programmier- und Scripting-Kenntnisse in Python und Shell. • Starkes Verständnis von Netzwerk-Grundlagen, einschliesslich TCP/IP, DNS, HTTPS, HTTP und Load Balancing. • Gutes Verständnis von SRE-Prinzipien, einschliesslich SLIs, SLOs, SLAs, Verfügbarkeit, Zuverlässigkeit und Service-Performance. • Gutes Verständnis von Java-Webanwendungen und Webservern wie Spring Boot und Apache Tomcat. • Fliessendes Englisch, in Wort und Schrift, mit der Bereitschaft, Französisch zu lernen. Schön zu haben • CKA- oder CKAD-Zertifizierung. • Erfahrung mit Helm, ArgoCD, Github Actions oder Kubernetes-Operatoren. • Kenntnisse von Apache Kafka oder RabbitMQ. • Kenntnisse von MT4/MT5. • Erfahrung mit Windows Server 2016/2022. • Erfahrung in eFX, Trading, Kryptowährungen, Banking oder anderen Finanzdienstleistungen. • Erfahrung in der Arbeit mit Hochverfügbarkeits- oder Low-Latency-Produktionssystemen. Wer Sie sind: • Ein Teamplayer, der gerne Kollegen hilft und Lücken zwischen Abteilungen schliesst, • Detailorientiert und akribisch in Ihrer Arbeit, • Fliessend in Englisch (gesprochen und geschrieben) und bereit, Französisch zu lernen. • Leidenschaftlich für Technologie und bestrebt, bei KI-Innovationen auf dem Laufenden zu bleiben.

Automatisch aus dem Original übersetzt.

Ausgeschrieben vor 3 Tagen

Ort

Auf Google Maps ansehen