Baseten
Baseten
Baseten biedt bedrijven die machinelearning- en AI-toepassingen ontwikkelen infrastructuur voor modelinference. Het platform is ontworpen voor snelle, schaalbare serving en combineert inference met hoge verwerkingscapaciteit, snelle implementatie, autoscaling, veilige model serving voor ondernemingen en ondersteuning voor het verpakken van opensourcemodellen. Baseten helpt engineering- en machinelearningteams bij het beheren van de operationele vereisten van modelinfrastructuur, zodat zij zich kunnen richten op de ontwikkeling van domeinspecifieke modellen. Het bedrijf is actief op het gebied van kunstmatige intelligentie, SaaS en technologie voor ondernemingen en heeft 11–50 medewerkers.

Software engineer, LLM-inferentieplatform - Baseten Hybrid

Bouw Basetens gedistribueerde LLM-inferentieplatform voor AI-bedrijven. Werk aan Kubernetes-orchestratie, model-API's, routering, autoscaling en production observability.

Beschrijving

  • Bouw infrastructuur en orchestratie voor grootschalige gedistribueerde LLM-inferentie, met routing, autoscaling, scheduling en runtimebeheer.
  • Ontwikkel en beheer model-API's die gestructureerde uitvoer, tool- en functieaanroepen en multimodale serving ondersteunen.
  • Implementeer API-versioning, validatie van verzoeken, gebruiksmeting, quota's en authenticatie.
  • Creëer instrumentatie voor metrics, traces en logs, samen met reproduceerbare benchmarks voor snelheid, betrouwbaarheid en kwaliteit.
  • Definieer sterke werkwijzen voor testen, release-automatisering en operationele excellentie.
  • Diagnosticeer en versterk productiesystemen op het gebied van Kubernetes, gedistribueerde runtimes, netwerken en GPU-workloads.
  • Werk samen met engineers voor inferentieprestaties en partnerteams om klantgerichte optimalisaties te leveren.
  • Leid projecten van architectuur en implementatie tot monitoring en iteratie op basis van klantfeedback.
  • Breng systeemprestaties, betrouwbaarheid, operationele eenvoud en developer experience met elkaar in balans.

Vereisten

  • Bachelor-, master- of doctoraatsdiploma in computerwetenschappen, engineering of een verwant vakgebied, of gelijkwaardige praktische ervaring.
  • Minstens drie jaar ervaring met het bouwen en beheren van gedistribueerde systemen, backendinfrastructuur of grootschalige API's waarbij betrouwbaarheid, latency en schaalbaarheid cruciaal zijn.
  • Aantoonbare verantwoordelijkheid voor betrouwbare backenddiensten met lage latency, waaronder rate limiting, authenticatie, quota's, meting en migraties.
  • Sterk inzicht in infrastructuur, inclusief ervaring met profiling, tracing, capaciteitsplanning en SLO-beheer.
  • Vermogen om problemen met prestaties en betrouwbaarheid te diagnosticeren over applicatie-, runtime- en infrastructuurlagen heen.
  • Sterke focus op developer experience.
  • Bereidheid om nieuwe talen, frameworks en systemen te leren, met interesse in inferentie-engineering.
  • Uitstekende schriftelijke communicatie- en samenwerkingsvaardigheden, inclusief duidelijke ontwerpdocumentatie en effectieve samenwerking tussen teams.
  • Ervaring met of bijdragen aan LLM-inferentie-engines of frameworks zoals vLLM, SGLang, TensorRT-LLM, TGI of Dynamo zijn een pluspunt.
  • Diepgaande Kubernetes-ervaring, waaronder operators en custom resources; vertrouwdheid met service meshes of API-gateways is een pluspunt.
  • Ervaring met gedistribueerde scheduling, autoscaling of service-orchestratie is een pluspunt.
  • Ervaring met het draaien van GPU-workloads in productie is een pluspunt.
  • Achtergrond in infrastructuur of API's voor ontwikkelaars, of bijdragen aan open-source-infrastructuur of machine-learning systemen, is een pluspunt.
  • Vertrouwdheid met observabilitytools, CI/CD-systemen of release-automatisering is een pluspunt.

Voordelen

  • Competitieve vergoeding met een betekenisvol aandelenbelang.
  • Voor werknemers en hun gezinsleden in de VS volledige dekking van medische, tandheelkundige en oogzorgverzekering.
  • Flexibele betaalde vrije tijd, inclusief een bedrijfsbrede winterpauze.
  • Betaald ouderschapsverlof.
  • Ondersteuning bij vruchtbaarheid en gezinsvorming via een Carrot-toelage.
  • Voor werknemers in de VS een door het bedrijf gefaciliteerd 401(k)-plan.
  • Blootstelling aan uiteenlopende ML-start-ups, met ruime mogelijkheden om te leren en een professioneel netwerk op te bouwen.

Gerelateerde vacatures

Skai

Partner voor bureaus – verkoop aan onafhankelijke bureaus

Skai

Zorg voor nieuwe klanten, klantbehoud en groei bij onafhankelijke bureaus met de digitale marketingsoftware van Skai. Begeleid complexe AdTech- en AI- en data-SaaS-verkooptrajecten van kennismaking tot contractondertekening.

Openen
Pacific Life

Senior specialist aanvullende zorgclaims

Pacific Life

Pacific Life zoekt een ervaren specialist voor de behandeling van complexe claims rond aanvullende zorgverzekeringen en vrijwillige secundaire arbeidsvoorwaarden. De functie omvat het beoordelen van claims, het verbeteren van werkprocessen en het ondersteunen van een klantgerichte en regelconforme dienstverlening.

Openen
DomainTools

Growthmarketingmanager

DomainTools
51 – 200 Medewerkers
AdviesGezondheidszorgLogistiek

Leid de growthmarketingstrategie van DomainTools door de hele funnel, met experimenten, betaalde acquisitie, conversieoptimalisatie, SEO en AI-ondersteunde workflows. Werk samen met Product, Sales en Revenue Operations om conversie, acquisitie-efficiëntie en de pipeline te verbeteren.

Openen
Sedgwick

Schadebehandelaar arbeidsongevallen – Salt Lake City (hybride)

Sedgwick

Behandel complexe claims voor arbeidsongevallen voor Sedgwick: beoordeel de dekking, onderzoek risico’s en onderhandel over schikkingen. De functie omvat ook het communiceren van beslissingen en de voortgang van claims aan claimanten en klanten.

Openen