Senior AI Infrastructure & Platform Engineer
- Anstellung
- Vollzeit
- Ort
- Basel
- Unternehmen
- Albedis, 4001 Basel
- Erstmals ausgeschrieben
Senior AI Infrastructure \& Platform Engineer (Basel)
Beschreibung des Unternehmens
Unser Kunde ist ein etabliertes Finanzinstitut, das für seine langjährige Stabilität, seine internationale Präsenz und sein Engagement für operative Exzellenz bekannt ist. Die Organisation fördert eine kollaborative Kultur, schätzt Fachwissen und fördert die kontinuierliche Verbesserung in ihren globalen Technologie- und Datenfunktionen.
Rolle \& Verantwortlichkeiten
Als Senior AI Infrastructure \& Platform Engineer werden Sie eine Schlüsselrolle beim Entwurf, Betrieb und der kontinuierlichen Verbesserung von KI-Infrastrukturplattformen auf Unternehmensebene spielen, die fortschrittliche Machine-Learning- und Generative-AI-Initiativen unterstützen. Sie werden eng mit Infrastruktur-, Platform-Engineering- und Data-Science-Teams zusammenarbeiten, um hochverfügbare GPU-gestützte Umgebungen und skalierbare Container-Plattformen aufzubauen, die in der Lage sind, groß angelegte Modelltraining- und Inferenz-Workloads zu unterstützen.
Hauptverantwortlichkeiten:
Entwurf, Implementierung und Betrieb von GPU-gestützten Infrastrukturplattformen für KI- und Machine-Learning-Workloads
Administration und Optimierung von Kubernetes- und OpenShift-Plattformen, die Enterprise-KI-Dienste unterstützen
Verwaltung von High-Performance-Computing (HPC) Umgebungen, einschliesslich Bare-Metal- und virtualisierten GPU-Systemen
Entwicklung und Wartung der Infrastrukturautomatisierung unter Verwendung von Ansible, Terraform und GitOps-Methodologien
Fehlerbehebung bei komplexen Plattformproblemen, die Linux, Networking, Storage, Kubernetes und GPU-Architekturen betreffen
Unterstützung von KI- und Data-Science-Teams bei der Plattformbereitstellung, Ressourcenallokation und operationalen Exzellenz
Implementierung von Plattform-Monitoring- und Observability-Lösungen
Teilnahme am Incident Management und an Rufbereitschaften
Anforderungsprofil
Sie verfügen über einen Hochschulabschluss in Informatik oder einer verwandten Disziplin und bringen mehrere Jahre aktuelle, praktische Erfahrung im Betrieb von gross angelegten Linux- und containerisierten Infrastrukturumgebungen mit.
Zusätzlich:
Mindestens 5 Jahre Erfahrung im Enterprise Infrastructure Engineering
Mindestens 3 Jahre praktische Erfahrung in der Administration von Red Hat Enterprise Linux Umgebungen
Nachgewiesene Erfahrung im Betrieb von Kubernetes- und/oder OpenShift-Plattformen in Produktionsumgebungen
Starke praktische Erfahrung mit Terraform, ArgoCD und Ansible
Praktische Erfahrung in der Unterstützung von NVIDIA GPU Infrastrukturen und GPU-gestützten Computing-Umgebungen
Kenntnisse von GPU-Architekturen und Technologien wie NVLink, PCIe switching und GPU-Virtualisierung
Erfahrung mit Prometheus, Grafana und Infrastruktur-Monitoring-Lösungen
Starke Shell- und Scripting-Fähigkeiten
Erfahrung in der Arbeit in stark regulierten Unternehmensumgebungen ist von Vorteil
Fliessend in Englisch; Deutsch von Vorteil
Gültige CH-Arbeitsbewilligung oder EU/EFTA-Staatsbürgerschaft erforderlich
Bereitschaft, zu 100% vor Ort zu arbeiten
Benefits:
Zentrale Büros in Städten in der ganzen Schweiz
Überdurchschnittlicher Versicherungsschutz, der vollständig von unserem Kunden getragen wird
Beitrag zur Krankenversicherung und Verpflegungspauschale
Exzellente Möglichkeiten für Weiterbildung und persönliche Entwicklung
Internationales Umfeld jpid1edbe14jm jit0832jm jiy26jm
Automatisch aus dem Original übersetzt.
Ausgeschrieben vor 2 Wochen