Pattern Bioscience
Pattern Bioscience
Pattern Bioscience is een biotechnologie- en gezondheidszorgbedrijf dat snelle, kweekvrije diagnostiek ontwikkelt voor infecties met resistente bacteriën. De technologie combineert eencellige analyse van micro-organismen met machine learning om binnen enkele uren klinisch bruikbare resultaten te leveren. Zo kunnen zorgprofessionals sneller passende behandelingen bepalen. Het werk van het bedrijf draagt bij aan de aanpak van antimicrobiële resistentie door snellere en beter onderbouwde beslissingen te ondersteunen, die mogelijk de behandelresultaten verbeteren en vermijdbare zorgkosten verlagen.

Senior Data Engineer, Data en Analytics – Pune Hybride

Leid de datatechnologie voor advertentieoptimalisatie van Pattern Bioscience, waaronder de feature store en workflows voor machine-learninginferentie. Zorg voor betrouwbare, kwaliteitsgecontroleerde biedings- en budgetupdates voor API's voor marketplace-advertenties.

Beschrijving

  • Bouw, implementeer en ondersteun schaalbare geautomatiseerde batchpipelines die diverse bronnen in het lakehouse opnemen
  • Beheer en verbeter de Airflow-orchestratie voor dagelijkse en 15-minutenworkflows met meerdere DAG's, inclusief afhankelijkheden, nieuwe pogingen, backfills, volledige verversingen en veilige heruitvoeringen
  • Ontwikkel en optimaliseer analytische SQL met brede joins, windowfuncties, incrementele merges, dimensionering van het datawarehouse en queryprofiling
  • Voeg features en labels toe aan de feature store en handhaaf daarbij bestaande standaarden voor het voorkomen van datalekken en het waarborgen van datavolledigheid
  • Coördineer modeltraining en batchinferentie in SageMaker via Airflow, inclusief datasets, S3- en Parquet-overdrachten, trainingsimages, dimensionering van instanties, voorspellingen en metrieken
  • Ontwikkel methoden voor data-auditing en dwing blokkerende kwaliteitscontroles af vóór externe schrijfbewerkingen
  • Diagnosticeer en verhelp grootschalige problemen met gegevensverwerking, onderzoek storingen en neem deel aan triage tijdens bereikbaarheidsdiensten
  • Bescherm idempotentie, detectie van nieuwe gegevens, actievalidering, invalidatie en audit trails voor marketplace-updates
  • Werk samen met data scientists, advertentiestrategen en teams voor platformengineering
  • Vertaal ROAS-doelen, budgetverloop, playbookregels en advertentiestrategie naar betrouwbare datamodellen en pipelines
  • Neem verantwoordelijkheid voor datakwaliteit binnen toegewezen domeinen en coördineer het oplossen van problemen met teams voor data-infrastructuur
  • Begeleid data engineers, geef technische richtlijnen en beoordeel wijzigingen in SQL en DAG's

Vereisten

  • Bacheloropleiding in data science, data-analyse, informatiemanagement, computerwetenschappen, informatietechnologie, een verwante studierichting of gelijkwaardige professionele ervaring
  • Minimaal vier jaar algemene werkervaring
  • Minimaal vier jaar praktische ervaring met SQL- en Python-ontwikkeling, inclusief geavanceerde SQL
  • Minimaal drie jaar ervaring met het bouwen van productiegegevenspipelines op moderne data-architecturen
  • Minimaal twee jaar ervaring met clouddatawarehouses zoals Snowflake, Amazon Redshift of BigQuery
  • Professionele ervaring met een workfloworchestrator; ervaring met Airflow heeft sterk de voorkeur
  • Ervaring met het plannen van machine-learningtraining en batchinferentie via SageMaker of een vergelijkbaar platform
  • Werkkennis van toegepaste machine-learningconcepten, waaronder het samenstellen van datasets, datalekken, evaluatiemetrieken en modellevenscyclusbeheer
  • Praktische AWS-ervaring, waaronder minimaal S3 en IAM, plus vertrouwdheid met kolomgebaseerde bestandsindelingen
  • Aantoonbare verantwoordelijkheid voor datakwaliteit via tests, monitoring, waarschuwingen en oorzaakanalyse
  • Sterke software-engineering- en scriptingpraktijken, waaronder versiebeheer, codebeoordeling en modulaire ontwikkeling
  • Uitstekende communicatieve vaardigheden en het vermogen om crossfunctioneel samen te werken
  • Vermogen om data-engineeringteams te leiden en te begeleiden
  • Gewenste ervaring omvat digitale advertenties, geavanceerd gebruik van Snowflake, tijdreeksgegevens, big data, frameworks voor datakwaliteit, gedistribueerde dataplatforms, aanvullende AWS-services, datagovernance en AI-codeeragents

Voordelen

  • De arbeidsvoorwaarden omvatten betaald verlof, verzekeringen en een concurrerende beloning
  • Betaald verlof
  • Verzekeringen

Gerelateerde vacatures

Terumo Medical Corporation

Gebiedsmanager Interventiesystemen – Philadelphia

Terumo Medical Corporation

Verantwoordelijk voor de verkoop van Terumo Interventional Systems-producten aan ziekenhuizen en poliklinische instellingen in de regio Philadelphia. Klantenaccounts uitbouwen, procedures ondersteunen, zorgprofessionals opleiden en verkoopdoelen behalen.

Openen
Cross River

Engineeringmanager Cloud en gedistribueerde systemen – Cross River, Jeruzalem

Cross River

Leid en coach engineers die fintechdiensten en infrastructuur bouwen voor betalingen, kaarten, leningen en crypto. Deze hybride functie in Jeruzalem richt zich op cloudnative systemen en een sterke uitvoering van engineeringwerk.

Openen
Aleph Alpha

Senior AI Researcher voor pre-training van foundationmodellen — Aleph Alpha, Heidelberg

Aleph Alpha
51 – 200 Medewerkers
B2BKunstmatige intelligentie

Leid architectuur- en pre-trainingwerk op grote schaal voor Aleph Alpha’s Europese foundationmodellen en geef vorm aan trainingsmethoden voor duizenden GPU’s. Bouw en verfijn PyTorch-trainingsrecepten met het hybride team in Heidelberg.

Openen