jobsswitzerland.ch
← Alle Stellen

Member of Technical Staff - Data Research Engineer

Microsoft Schweiz GmbH

Anstellung
Vollzeit
Ort
Zürich
Unternehmen
Microsoft Schweiz GmbH, Seestrasse 356, 8038 Zürich
Sprachen
Englisch (fliessend)
Erstmals ausgeschrieben
Jetzt bewerben
Überblick Wir suchen einen Data Research Engineer für unser AI-Team, in dem wir die nächste Generation von Foundation Models über verschiedene Modalitäten hinweg entwickeln: Text, Bild, Video, Audio. Wenn Sie leidenschaftlich daran interessiert sind, hochwertige Datensätze zu erforschen, zu entwerfen und aufzubauen, um bahnbrechende AI-Modelle voranzutreiben, ist diese Rolle genau das Richtige für Sie. Bei Microsoft AI steht Daten im Mittelpunkt der Innovation – und in dieser Rolle werden Sie eng mit anderen Kollegen zusammenarbeiten, um vielfältige Datenquellen zu kuratieren, zu analysieren und zu bewerten, die für die Modellentwicklung entscheidend sind. Sie werden Bemühungen in der Entwicklung neuartiger Datenerfassungsstrategien leiten, die Qualität von Datensätzen verbessern, datengesteuerte Modellverhaltensweisen verstehen und Datensätze mit ethischen und gesellschaftlichen Werten in Einklang bringen. Dies ist eine interdisziplinäre Rolle mit hoher Tragweite, die ideal für Ingenieure ist, die die Grenzen dessen verschieben wollen, was KI aus Daten lernen kann. Microsofts Mission ist es, jedem Menschen und jeder Organisation auf dem Planeten zu helfen, mehr zu erreichen. Als Mitarbeitende kommen wir mit einer Wachstumsmentalität zusammen, innovieren, um andere zu stärken, und arbeiten zusammen, um unsere gemeinsamen Ziele zu verwirklichen. Jeden Tag bauen wir auf unseren Werten Respekt, Integrität und Verantwortlichkeit auf, um eine Kultur der Inklusion zu schaffen, in der jeder bei der Arbeit und darüber hinaus erfolgreich sein kann. Verantwortlichkeiten Erstellen von hochwertigen Datensätzen für das Training und die Evaluierung; Durchführung von Experimenten mit neuen Datensätzen (Data Ablations), um deren Auswirkungen zu bewerten und die effektivsten Daten zu bestimmen Entwicklung und Wartung skalierbarer Daten-Pipelines für die Datenaufnahme, Vorverarbeitung, Filterung und Annotation Analyse von realen multimodalen Datensätzen zur Bewertung von Qualität, Diversität und Relevanz sowie zur Identifizierung von Verbesserungspotenzialen Aufbau von Tools und Workflows für das Auditing, die Visualisierung und die Versionierung von Datensätzen Zusammenarbeit mit Safety-, Ethics- und Governance-Teams, um sicherzustellen, dass Datensätze die Standards für Qualität, Datenschutz und verantwortungsvolle AI-Praktiken erfüllen Qualifikationen Erforderliche Qualifikationen: Bachelor-Abschluss in AI, Informatik, Data Science, Statistik, Physik, Ingenieurwesen oder einem verwandten technischen Bereich. Kenntnisse in Python. Erfahrung mit Frameworks zur verteilten Datenverarbeitung wie Spark, Ray und Workflow-Orchestrierungstools wie Airflow. Erfahrung in der Verarbeitung von Datensätzen im Petabyte-Bereich mit Billionen von Zeilen. Erfahrung im Aufbau von Datensätzen für das Training von Foundation Models, einschließlich Sprach- oder multimodaler Modelle. Starke Erfahrung in der Datenanalyse, im Data Engineering oder in beidem. Fähigkeit, technische Ergebnisse klar und effektiv an Research-, Engineering- und Produktteams zu kommunizieren. Erfahrung in der Bewertung der Datensatzqualität und in der Messung der Auswirkungen von Daten durch kontrollierte Modelltrainingsexperimente. Bevorzugte Qualifikationen: Master-Abschluss in Informatik oder einem verwandten technischen Bereich oder gleichwertige Erfahrung. Erfahrung in der Arbeit mit groß angelegten, realen Datensätzen, die unstrukturiert oder semistrukturiert sind Erfahrung in der Bewertung der Datensatzqualität und in der Messung der Auswirkungen von Daten durch kontrollierte Modelltrainingsexperimente. Erfahrung mit multimodalen Daten, wie Bild-, Video- oder Audiodaten.

Automatisch aus dem Original übersetzt.

Ausgeschrieben gestern

Ort

Auf Google Maps ansehen