jobportalschweiz.ch
← Alle Stellen

Senior AI Infrastructure & Platform Engineer

Albedis

Anstellung
Vollzeit
Ort
Basel
Unternehmen
Albedis, 4001 Basel
Erstmals ausgeschrieben
Jetzt bewerben
Senior AI Infrastructure \& Platform Engineer (Basel) Beschreibung des Unternehmens Unser Kunde ist ein etabliertes Finanzinstitut, das für seine langjährige Stabilität, seine internationale Präsenz und sein Engagement für operative Exzellenz bekannt ist. Die Organisation fördert eine kollaborative Kultur, schätzt Fachwissen und fördert die kontinuierliche Verbesserung in ihren globalen Technologie- und Datenfunktionen. Rolle \& Verantwortlichkeiten Als Senior AI Infrastructure \& Platform Engineer werden Sie eine Schlüsselrolle beim Entwurf, Betrieb und der kontinuierlichen Verbesserung von KI-Infrastrukturplattformen auf Unternehmensebene spielen, die fortschrittliche Machine-Learning- und Generative-AI-Initiativen unterstützen. Sie werden eng mit Infrastruktur-, Platform-Engineering- und Data-Science-Teams zusammenarbeiten, um hochverfügbare GPU-gestützte Umgebungen und skalierbare Container-Plattformen aufzubauen, die in der Lage sind, groß angelegte Modelltraining- und Inferenz-Workloads zu unterstützen. Hauptverantwortlichkeiten: Entwurf, Implementierung und Betrieb von GPU-gestützten Infrastrukturplattformen für KI- und Machine-Learning-Workloads Administration und Optimierung von Kubernetes- und OpenShift-Plattformen, die Enterprise-KI-Dienste unterstützen Verwaltung von High-Performance-Computing (HPC) Umgebungen, einschliesslich Bare-Metal- und virtualisierten GPU-Systemen Entwicklung und Wartung der Infrastrukturautomatisierung unter Verwendung von Ansible, Terraform und GitOps-Methodologien Fehlerbehebung bei komplexen Plattformproblemen, die Linux, Networking, Storage, Kubernetes und GPU-Architekturen betreffen Unterstützung von KI- und Data-Science-Teams bei der Plattformbereitstellung, Ressourcenallokation und operationalen Exzellenz Implementierung von Plattform-Monitoring- und Observability-Lösungen Teilnahme am Incident Management und an Rufbereitschaften Anforderungsprofil Sie verfügen über einen Hochschulabschluss in Informatik oder einer verwandten Disziplin und bringen mehrere Jahre aktuelle, praktische Erfahrung im Betrieb von gross angelegten Linux- und containerisierten Infrastrukturumgebungen mit. Zusätzlich: Mindestens 5 Jahre Erfahrung im Enterprise Infrastructure Engineering Mindestens 3 Jahre praktische Erfahrung in der Administration von Red Hat Enterprise Linux Umgebungen Nachgewiesene Erfahrung im Betrieb von Kubernetes- und/oder OpenShift-Plattformen in Produktionsumgebungen Starke praktische Erfahrung mit Terraform, ArgoCD und Ansible Praktische Erfahrung in der Unterstützung von NVIDIA GPU Infrastrukturen und GPU-gestützten Computing-Umgebungen Kenntnisse von GPU-Architekturen und Technologien wie NVLink, PCIe switching und GPU-Virtualisierung Erfahrung mit Prometheus, Grafana und Infrastruktur-Monitoring-Lösungen Starke Shell- und Scripting-Fähigkeiten Erfahrung in der Arbeit in stark regulierten Unternehmensumgebungen ist von Vorteil Fliessend in Englisch; Deutsch von Vorteil Gültige CH-Arbeitsbewilligung oder EU/EFTA-Staatsbürgerschaft erforderlich Bereitschaft, zu 100% vor Ort zu arbeiten Benefits: Zentrale Büros in Städten in der ganzen Schweiz Überdurchschnittlicher Versicherungsschutz, der vollständig von unserem Kunden getragen wird Beitrag zur Krankenversicherung und Verpflegungspauschale Exzellente Möglichkeiten für Weiterbildung und persönliche Entwicklung Internationales Umfeld jpid1edbe14jm jit0832jm jiy26jm

Automatisch aus dem Original übersetzt.

Ausgeschrieben vor 2 Wochen

Ort

Auf Google Maps ansehen