jobportalschweiz.ch
← Alle Stellen

Site Reliability Engineer - Cloud Operations

Swissquote

Anstellung
Vollzeit
Ort
Schweiz
Erstmals ausgeschrieben
Jetzt bewerben
In dieser Rolle werden Sie: Produktionsanwendungen auf Kubernetes migrieren und modernisieren, Drittanbietersoftware in unsere Produktionsplattformen integrieren und an unsere operativen Standards anpassen, Zusammen mit Software- und IT-Engineers an der Verbesserung der Zuverlässigkeit, Performance und Betriebsbereitschaft arbeiten, Anwendungen auf unserer Service Mesh Plattform entwerfen und betreiben, Sichere Deployment-Muster wie Canary Releases und progressive Rollouts integrieren, SLOs, SLIs und nützliche operative KPIs definieren und diese zur Steuerung von Verbesserungen nutzen, Die Observability über Metriken, Logs und Traces verbessern, damit Probleme leichter erkannt und verstanden werden können, KI-Tools explorieren und integrieren, die bei der Fehlersuche, Incident-Analyse und Behebung helfen können, Testen, wie sich Systeme unter Last, bei Ausfällen und beim Verschwinden von Abhängigkeiten verhalten, Repetitive operative Aufgaben automatisieren, wann immer es sinnvoll ist, Level-3-Support leisten und an der Rufbereitschaft teilnehmen. Mindestens 3 Jahre Erfahrung in SRE, DevOps, Platform Engineering oder einer ähnlichen produktionsfokussierten Rolle, Fundierte praktische Erfahrung im Betrieb von Produktions-Workloads auf Kubernetes, OpenShift, EKS oder einer ähnlichen Kubernetes-Plattform, Gute Kenntnisse von Helm und wie man Anwendungen damit paketiert, konfiguriert und wartet, Erfahrung mit Service Mesh Technologien wie Istio oder Linkerd, oder starke Kubernetes-Networking-Erfahrung, Ein gutes Verständnis von Service-to-Service-Networking, Traffic Routing, mTLS und TLS, Erfahrung mit GitOps und modernen Deployment-Strategien wie Canary oder Progressive Delivery, Ein praktisches Verständnis von SRE-Konzepten wie SLIs, SLOs und Error Budgets, Erfahrung mit Observability- und Tracing-Tools wie Prometheus, Grafana, Elastic Stack oder OpenTelemetry, Starke Linux- und Networking-Grundkenntnisse, einschließlich TCP/IP, DNS und Load Balancing, Sicherer Umgang mit der Fehlersuche in JVM-basierten Anwendungen in der Produktion und in der Lage, Probleme im Zusammenhang mit Heap-Nutzung, Garbage Collection oder JVM-Konfiguration zu untersuchen, Sicherer Umgang mit der Automatisierung mittels Python, Go, Bash oder einer anderen Programmiersprache, Erfahrung oder starkes Interesse an der Anwendung von KI auf Observability, Incident Response oder operative Automatisierung, Erfahrung oder ein starkes Interesse am Betrieb von Anwendungen, die auf GPU-Ressourcen oder andere KI-Infrastruktur angewiesen sind, Vertrautheit mit Infrastructure as Code Tools wie Terraform, Ansible oder Puppet. Nice-to-Haves Erfahrung mit Argo CD, Argo Rollouts oder Argo Workflows, Tiefere Erfahrung mit Istio, Linkerd oder Envoy-basierten Service Mesh Plattformen, Erfahrung im Entwerfen oder Betreiben von Kubernetes-Plattformen in großem Maßstab, Erfahrung im Betrieb von Java oder Spring Boot Anwendungen in der Produktion, Praktische Erfahrung bei der Optimierung von JVM-Anwendungen für Performance oder Low-Latency Workloads, Erfahrung bei der Integration von Anwendungen mit selbst gehosteten KI-Plattformen wie vLLM, Erfahrung bei der Fehlersuche in KI-Infrastruktur-Integrationen, einschließlich Modellzugriff, GPU-Verfügbarkeit und NVIDIA MIG-Konfigurationen. Kenntnisse von Cilium, eBPF oder anderen modernen Kubernetes-Networking-Technologien, Erfahrung mit Public Cloud oder großen Private Cloud Umgebungen, CKAD, CKA, CKS oder gleichwertige praktische Kubernetes-Erfahrung, Ein Homelab, selbst gehostete Dienste oder Nebenprojekte, bei denen Sie experimentieren, Dinge kaputt machen und wieder aufbauen können. Wer Sie sind Sie verstehen gerne, warum Systeme sich so verhalten, wie sie es tun, besonders wenn etwas schiefgeht, Sie automatisieren repetitive Aufgaben, anstatt sie als Teil des Jobs zu akzeptieren, Sie arbeiten gerne über Development-, Infrastructure- und Operations-Teams hinweg, Es macht Ihnen nichts aus, sich tief in Software einzuarbeiten, die Sie nicht selbst gebaut haben, Sie sind neugierig auf KI und darauf, wo sie den täglichen Betrieb wirklich verbessern kann, Sie sprechen fließend Englisch und haben gute konversationelle Französischkenntnisse, Sie genießen es, auf dem Laufenden mit Cloud-Native-Technologien zu bleiben und neue Ansätze auszuprobieren, wenn sie ein echliches Problem lösen. Please note that Swissquote never requests sensitive personal information or payment of any kind during the recruitment process. Any such request is fraudulent. SQ2 At Swissquote, we’re all in. All in to shake things up. All in to build the bank people actually want to use. All in to make finance less boring — and a lot more powerful. We’re Switzerland’s leading digital bank — 1,400+ people across Europe, the Middle East and Asia, building real financial solutions for over a million clients worldwide. From trading and investing to everyday banking, we cover the full picture. We move fast, but we build things we’re genuinely proud of. Have a look behind the scenes by checking Humans of Swissquote on Instagram. Growing fast creates room. Room to try things, own things, and grow at a pace most places can’t offer. Whether you like the spotlight or prefer to just put your head down and do great work, there’s space for both here. We’ve ditched the dress code — but never the chance to celebrate. Big win or small, we make it count. The kind of place where the atmosphere takes care of itself. As an equal opportunity employer, we welcome candidates from all backgrounds, experiences and perspectives to join our team and contribute to our shared success. Feeling it? It’s a good start. Apply. Team Mission and Stakeholders Are you passionate about Kubernetes, distributed systems and keeping production platforms reliable at scale? Join our Cloud Operations team and help us migrate and modernize applications running at the core of Swissquote. We’re looking for a Site Reliability Engineer who enjoys working close to pr

Automatisch aus dem Original übersetzt.

Ausgeschrieben heute