Senior AI Infrastructure & Platform Engineer
- Type de contrat
- Temps plein
- Lieu
- Basel
- Entreprise
- Albedis, 4001 Basel
- Première publication
Senior AI Infrastructure \& Platform Engineer (Basel)
Description de l'entreprise
Notre client est une institution financière bien établie, reconnue pour sa stabilité de longue date, sa présence internationale et son engagement envers l'excellence opérationnelle. L'organisation favorise une culture collaborative, valorise l'expertise et promeut l'amélioration continue à travers ses fonctions mondiales de technologie et de données.
Rôle \& Responsabilités
En tant que Senior AI Infrastructure \& Platform Engineer, vous jouerez un rôle clé dans la conception, l'exploitation et l'amélioration continue de plateformes d'infrastructure IA de classe entreprise soutenant des initiatives avancées d'apprentissage automatique et d'IA générative. Vous travaillerez en étroite collaboration avec les équipes d'infrastructure, d'ingénierie de plateforme et de science des données pour construire des environnements compatibles GPU hautement disponibles et des plateformes de conteneurs évolutives capables de supporter des charges de travail d'entraînement et d'inférence de modèles à grande échelle.
Responsabilités clés :
Concevoir, implémenter et exploiter des plateformes d'infrastructure compatibles GPU pour les charges de travail d'IA et d'apprentissage automatique
Administrer et optimiser les plateformes Kubernetes et OpenShift soutenant les services d'IA d'entreprise
Gérer les environnements de calcul haute performance (HPC), y compris les systèmes GPU bare-metal et virtualisés
Développer et maintenir l'automatisation de l'infrastructure en utilisant les méthodologies Ansible, Terraform et GitOps
Dépanner des problèmes de plateforme complexes impliquant Linux, le réseau, le stockage, Kubernetes et les architectures GPU
Soutenir les équipes d'IA et de science des données avec le provisionnement de plateformes, l'allocation de ressources et l'excellence opérationnelle
Implémenter des solutions de surveillance et d'observabilité de plateforme
Participer à la gestion des incidents et aux rotations d'astreinte
Profil du candidat
Vous détenez un diplôme de niveau universitaire en informatique ou dans une discipline connexe et apportez plusieurs années d'expérience pratique actuelle dans l'exploitation d'environnements d'infrastructure Linux et conteneurisés à grande échelle.
De plus :
Minimum 5 ans d'expérience en ingénierie d'infrastructure d'entreprise
Minimum 3 ans d'expérience pratique dans l'administration d'environnements Red Hat Enterprise Linux
Expérience avérée dans l'exploitation de plateformes Kubernetes et/ou OpenShift dans des environnements de production
Forte expérience pratique avec Terraform, ArgoCD et Ansible
Expérience pratique du support des infrastructures NVIDIA GPU et des environnements de calcul compatibles GPU
Connaissance des architectures et technologies GPU telles que NVLink, le commutateur PCIe et la virtualisation GPU
Expérience avec Prometheus, Grafana et les solutions de surveillance d'infrastructure
Fortes capacités en Shell et en scripting
Une expérience de travail dans des environnements d'entreprise hautement réglementés est un avantage
Anglais courant ; l'allemand est un avantage
Permis de travail CH valide ou citoyenneté UE/AELE requis
Volonté de travailler à 100% sur site
Avantages :
Bureaux situés dans des centres-villes à travers la Suisse
Couverture d'assurance supérieure à la moyenne entièrement prise en charge par notre client
Contribution à l'assurance maladie et indemnité de repas
Excellentes opportunités de formation continue et de développement personnel
Environnement international jpid1edbe14jm jit0832jm jiy26jm
Traduit automatiquement depuis l’original.
Publié il y a 2 semaines