Junior Data Engineer
- Type de contrat
- Temps plein
- Lieu
- Neuchâtel
- Entreprise
- Consult & Pepper AG, 2000 Neuchâtel
- Première publication
Junior Data Engineer (a)
Imaginez utiliser vos compétences en ingénierie des données pour améliorer la façon dont la santé cardiovasculaire est surveillée et gérée. Hilo by Aktiia redéfinit la surveillance de la pression artérielle grâce à une technologie optique pilotée par l'IA, basée sur plus de 20 ans de recherche au Swiss Center for Electronics and Microtechnology (CSEM). Leur solution combine un dispositif portable (Hilo), une application mobile et une plateforme basée sur le cloud pour les professionnels de la santé — offrant aux utilisateurs et aux médecins des informations continues et exploitables sur les modèles de pression artérielle. Avec plus de 200 000 utilisateurs, plus de $120M de financement et un dispositif médical certifié CE déjà disponible sur plusieurs marchés, Aktiia continue de développer sa technologie, son écosystème de produits et sa présence internationale.
Alors qu'Aktiia étend ses capacités de données, nous recherchons un Junior Data Engineer qui aidera à faire passer un Lakehouse medallion basé sur Databricks d'une configuration principalement R&D/Core Tech à une plateforme de données plus large à l'échelle de l'entreprise. En travaillant étroitement avec et en apprenant directement d'un Senior Data Engineer expérimenté, vous soutiendrez l'ingestion, la centralisation, la documentation et la validation des données cliniques, héritées (legacy) et opérationnelles. Votre travail aidera à transformer des sources de données complexes et parfois désordonnées en pipelines propres, fiables et prêts pour la modélisation, utilisés par les équipes Data Science, ML, Algorithm et Core Tech.
VotreRôle
Ingestion de données & Développement de Lakehouse : Concevoir, construire et maintenir des pipelines d'ingestion et de traitement de données au sein du Lakehouse medallion hébergé sur Databricks par Aktiia, en travaillant sous la direction d'un senior tout en assumant progressivement plus de responsabilités.
Intégration de données cliniques & héritées : Jouer un rôle actif dans l'ingestion, la centralisation et la documentation des données cliniques actuellement réparties sur des plateformes EDC telles que Castor et RedCap, des bases de données, des archives autonomes et d'autres sources ayant évolué historiquement.
Exploration de données & Archéologie pratique des données : Travailler concrètement sur des ensembles de données inconnus et parfois désordonnés, identifier les structures et les incohérences, et transformer des situations non structurées en actifs de données fiables et utilisables.
Développement de pipelines & Prétraitement : Construire des pipelines de prétraitement et d'ETL/ELT qui fournissent des ensembles de données propres, structurés et prêts pour la modélisation aux équipes Algorithm Development, Core Tech, Machine Learning et Data Science.
Qualité des données, Validation & Documentation : Définir et appliquer des normes pratiques pour la qualité, la validation, la traçabilité et la documentation des données — en particulier pour les ensembles de données sensibles et cliniquement pertinents.
Observabilité & Pratiques d'ingénierie : Implémenter la journalisation (logging), les contrôles de validation, les alertes et l'observabilité de base pour les nouveaux pipelines, tout en contribuant aux pratiques de base de code partagées telles que Git, les revues de code, le CI/CD et les tests.
Mise à l'échelle de la plateforme & Collaboration : Soutenir l'évolution du lakehouse de cas d'utilisation techniques sélectionnés vers une infrastructure de données à l'échelle de l'entreprise, en travaillant étroitement avec le Senior Data Engineer, les ML Engineers, les Data Scientists et les parties prenantes transversales.
Votre Profil
Formation Académique
Licence ou diplôme supérieur en informatique, ingénierie des données, science des données, génie logiciel ou un domaine technique connexe.
Expertise Professionnelle
Au moins 1+ an d'expérience pratique post-études en ingénierie des données, infrastructure de données, ingestion de données ou un rôle technique pratique similaire. Vous pouvez en être au début de votre carrière, mais vous avez déjà travaillé avec de vrais pipelines de données, des flux de travail de données orientés production ou des plateformes de données collaboratives.
Expérience Technique
Vous avez une solide expérience pratique de SQL et apportez une expérience pratique de Databricks. Vous êtes familier avec les environnements cloud — idéalement AWS. Vous comprenez les bases de la conception de pipelines ETL/ELT, des modèles d'ingestion de données et de la modélisation des données, et vous avez travaillé avec des bases de code partagées utilisant Git, les revues de code, le CI/CD ou les pratiques de test. L'expérience avec Spark, Delta Lake ou Parquet est un sérieux atout.
Adéquation avec l'Industrie
Idéalement, vous avez acquis de l'expérience dans une start-up, une scale-up ou un environnement techniquement exigeant où vous avez travaillé concrètement sur l'ensemble du pipeline de données. Une exposition à des industries réglementées ou sensibles aux données telles que la MedTech, la Pharma, la FinTech ou la santé est un plus, surtout en ce qui concerne la qualité, la validation et la documentation des données.
Compétences Linguistiques
Un niveau de maîtrise élevé de l'anglais est indispensable. Le français est un avantage.
Personnalité
Curieux, pragmatique et orienté vers la résolution concrète de problèmes, vous aimez apporter de la structure à des environnements de données complexes. Vous travaillez de manière indépendante, posez les bonnes questions, restez bien organisé et collaborez ouvertement avec les parties prenantes de la Data Engineering, Data Science, ML, Algorithm, Core Tech et Product. Vous êtes basé en Suisse et êtes à l'aise avec un fonctionnement hybride avec une présence régulière d'un jour par semaine à Neuchâtel.
Nous recherchons un constructeur de données pragmatique et pratique
Traduit automatiquement depuis l’original.
Publié il y a 4 jours