Senior HPC AI Cluster Engineer

Senior HPC AI Cluster Engineer

Zürich 81000 - 99000 CHF / Jahr (geschätzt) Kein Homeoffice möglich
N

Auf einen Blick

  • Aufgaben: Entwickle und verwalte HPC/AI Cluster mit modernster Technologie.
  • Unternehmen: NVIDIA, ein führendes Unternehmen in der KI- und HPC-Branche.
  • Vorteile: Attraktives Gehalt, flexible Arbeitszeiten und Weiterbildungsmöglichkeiten.
  • Weitere Informationen: Dynamisches Team mit Fokus auf Innovation und Vielfalt.
  • Warum dieser Job: Sei Teil von bahnbrechenden Technologien und gestalte die Zukunft der KI.
  • Qualifikationen: Abschluss in Informatik oder Ingenieurwesen und 8+ Jahre Erfahrung.

Das prognostizierte Gehalt liegt zwischen 81000 - 99000 CHF pro Jahr.

NVIDIA sucht einen erfahrenen HPC-AI Ingenieur, um dem Networking Clusters Solutions Infrastructure Team beizutreten. Wir konzentrieren uns auf den Bau von Supercomputern und AI-Clustern basierend auf bahnbrechenden Technologien. Wir suchen einen herausragenden Ingenieur, der ein Schlüsselspieler in der aufregendsten Computerhardware und -software ist, um zu den neuesten Durchbrüchen in der künstlichen Intelligenz und GPU-Computing beizutragen.

Was Sie tun werden:

  • Design, Implementierung und Wartung von großen HPC/AI-Clustern mit Überwachung, Protokollierung und Alarmierung
  • Verwaltung von Linux-Job-/Arbeitslastplänen und Orchestrierungstools
  • Entwicklung und Wartung von kontinuierlichen Integrations- und Bereitstellungspipelines
  • Entwicklung von Werkzeugen zur Automatisierung der Bereitstellung und Verwaltung von großflächigen Infrastrukturumgebungen
  • Bereitstellung von Überwachungslösungen für Server, Netzwerk und Speicher
  • Fehlerbehebung vom Bare Metal über das Betriebssystem bis hin zur Anwendungsebene
  • Entwicklung, Neudefinition und Dokumentation von Standardmethoden zur Weitergabe an interne Teams
  • Unterstützung von Forschungs- und Entwicklungsaktivitäten und Teilnahme an POCs/POVs für zukünftige Verbesserungen

Was wir sehen möchten:

  • Ein Abschluss in Informatik, Ingenieurwesen oder einem verwandten Bereich und 8+ Jahre Erfahrung
  • Kenntnisse über HPC- und AI-Lösungstechnologien von CPUs und GPUs bis hin zu Hochgeschwindigkeitsverbindungen und unterstützender Software
  • Erfahrung mit Job-Scheduling-Arbeitslasten und Orchestrierungstools wie Slurm, K8s
  • Ausgezeichnete Kenntnisse in Windows und Linux (Redhat/CentOS und Ubuntu) Netzwerken und Interna
  • Erfahrung mit mehreren Speicherlösungen wie Lustre, GPFS, Weka.io
  • Python-Programmierung und Bash-Skripting-Erfahrung
  • Vertrautheit mit Automatisierungs- und Konfigurationsmanagement-Tools wie Jenkins, Ansible, Puppet/Chef
  • Tiefes Wissen über Netzwerkprotokolle wie InfiniBand, Ethernet
  • Tiefes Verständnis und Erfahrung mit virtuellen Systemen (z.B. VMware, Hyper-V, KVM oder Citrix)
  • Vertrautheit mit Cloud-Computing-Plattformen (z.B. AWS, Azure, Google Cloud)

Wie Sie sich von der Masse abheben können:

  • Kenntnisse über CPU- und/oder GPU-Architektur
  • Kenntnisse über Kubernetes, containerbezogene Mikrodienste
  • Erfahrung mit GPU-fokussierter Hardware/Software (DGX, Cuda)
  • Erfahrung mit RDMA (InfiniBand oder RoCE) Fabrics

Wir sind ein Arbeitgeber, der Chancengleichheit bietet und Vielfalt in unserem Unternehmen schätzt. Wir diskriminieren nicht aufgrund von Rasse, Religion, Hautfarbe, nationaler Herkunft, Geschlecht, Geschlechtsidentität, sexueller Orientierung, Alter, Familienstand, Veteranenstatus oder Behinderungsstatus. Wir stellen sicher, dass Personen mit Behinderungen angemessene Vorkehrungen erhalten, um am Bewerbungs- oder Interviewprozess teilzunehmen, um wesentliche Arbeitsfunktionen auszuführen und um andere Vorteile und Privilegien der Beschäftigung zu erhalten.

Senior HPC AI Cluster Engineer Arbeitgeber: NVIDIA

NVIDIA ist ein herausragender Arbeitgeber, der eine dynamische und unterstützende Arbeitsumgebung bietet, in der Innovation und Zusammenarbeit gefördert werden. Mit einem starken Fokus auf Mitarbeiterentwicklung und einer Kultur, die Vielfalt schätzt, haben Sie die Möglichkeit, an bahnbrechenden Projekten im Bereich KI und Hochleistungsrechnen zu arbeiten. Zudem profitieren Sie von wettbewerbsfähigen Gehältern und einem umfassenden Leistungspaket, das Ihre berufliche und persönliche Zukunft unterstützt.

N

Kontaktdaten:

NVIDIA Recruiting-Team

Wir glauben, dass du diese Fähigkeiten brauchst, um Senior HPC AI Cluster Engineer mit Bravour zu bestehen

HPC und AI Lösungstechnologien
Job Scheduling und Orchestrierungstools (z.B. Slurm, K8s)
Windows und Linux Netzwerkkenntnisse (Redhat/CentOS und Ubuntu)
Speicherlösungen (z.B. Lustre, GPFS, Weka.io)
Python Programmierung und Bash Scripting
Automatisierungs- und Konfigurationsmanagement-Tools (z.B. Jenkins, Ansible, Puppet/Chef)
Netzwerkprotokolle (z.B. InfiniBand, Ethernet)