FluidStack
FluidStack
FluidStack levert GPU-supercomputinginfrastructuur voor AI-labs en bedrijven. Het beheerde cloudplatform biedt op aanvraag toegang tot grootschalige Nvidia-GPU-capaciteit voor het trainen en uitvoeren van modellen, evenals ondersteuning bij de implementatie en het beheer van clusters met technologieën zoals Kubernetes en Slurm. Door de onderliggende hardware en infrastructuur te beheren, helpt FluidStack AI-teams hun workloads op te schalen, zodat zij zich kunnen richten op modelontwikkeling, prestaties en operationele efficiëntie.

Software Engineer, Ontologie (op locatie)

Bouw ontologie-, CMDB-, DCIM-, observability- en automatiseringssystemen voor de AI-cloudinfrastructuur van FluidStack. Ontwikkel schaalbare platforms voor infrastructuurassets, datacenteractiviteiten en wereldwijd vlootbeheer.

Beschrijving

  • Ontwerp en implementeer een CMDB van de volgende generatie als bron van waarheid voor infrastructuurassets, netwerktopologie en configuratiegegevens
  • Ontwikkel DCIM-software voor rackactiviteiten, server- en GPU-implementatie, installatie van besturingssystemen, kwaliteitsborging en white-screenactiviteiten
  • Creëer platforms voor de volledige levenscyclus van assets, van ontvangst, plaatsing in racks en inventarisatie tot reparatie en buitengebruikstelling
  • Ontwikkel monitoring- en observabilitysystemen die BMS-, EPMS- en telemetriegegevens van IT-apparaten combineren met intelligente waarschuwingen en incidentbeheer
  • Bouw selfserviceportalen en automatisering voor regionale bootstrap, day-two-activiteiten en beheer op vlootschaal
  • Verminder operationele belasting door handmatige processen te vervangen door workflowautomatisering en selfservicetools
  • Implementeer orkestratiesystemen voor workflows rond incidenten-, probleem- en changemanagement
  • Produceer visualisaties van digitale tweelingen en operationele dashboards in samenwerking met datateams
  • Ontwikkel integratielagen tussen interne platforms, leveranciers en externe systemen
  • Werk samen met teams voor datacenteractiviteiten, systemen, netwerkengineering, beveiliging, product, business, support en operations
  • Beoordeel of platformcomponenten intern moeten worden gebouwd of ingekocht
  • Bevorder CI/CD, infrastructure as code, geautomatiseerd testen en observability-first engineering
  • Draag bij aan architectuurreviews en technische ontwerpbeslissingen
  • Verbeter de kwaliteit van engineering via code reviews, documentatie en kennisdeling
  • Ontwerp veerkrachtige systemen met hoge prestaties die duizenden query's per seconde kunnen verwerken
  • Implementeer monitoring, logging, debugging en uitgebreide foutafhandeling
  • Plan datamigraties en onderhoud platformafhankelijkheden
  • Leid projecten van het eerste concept tot implementatie en productiegereedheid

Vereisten

  • Minimaal drie jaar professionele ervaring met het ontwikkelen van softwaresystemen voor productieomgevingen
  • Sterke programmeervaardigheden in Python, Go of een vergelijkbare taal
  • Praktische kennis van patronen voor systeemontwerp
  • Ervaring met het ontwerpen van REST-API's, datamodellen en gedistribueerde systemen
  • Goede kennis van relationele en NoSQL-databases, waaronder PostgreSQL en Redis
  • Praktische ervaring met Docker en infrastructure-as-code-tools zoals Terraform en Ansible
  • Inzicht in CI/CD-pipelines en moderne softwareontwikkelingspraktijken
  • Sterke kennis van TCP/IP, DNS, HTTP en Linux- of Unix-omgevingen
  • Aantoonbare probleemoplossende vaardigheden met aandacht voor schaalbaarheid, betrouwbaarheid en operationele behoeften
  • Duidelijke communicatieve vaardigheden bij het werken met technische en niet-technische belanghebbenden
  • Ervaring met CMDB-producten zoals NetBox of Device42, of met assetmanagementplatforms
  • Ervaring met infrastructuurautomatisering, DevOps of platformengineering
  • Vertrouwdheid met tools voor workfloworkestratie zoals Temporal, Airflow of Camunda
  • Kennis van monitoring- en observabilitytechnologieën, waaronder Prometheus, Grafana of OpenTelemetry
  • Ervaring met tijdreeksdatabases en datavisualisatie
  • Inzicht in ITSM-frameworks zoals ITIL en service-managementpraktijken
  • Ervaring met datacenteractiviteiten, facilitymanagement of fysieke infrastructuur
  • Bijdragen aan open-source-infrastructuurprojecten
  • Bachelor in Computer Science of gelijkwaardige praktische ervaring
  • De vereisten voor werkautorisatie in de VS worden tijdens het sollicitatieproces besproken

Voordelen

  • Voor alle fulltimefuncties is aandelenparticipatie beschikbaar, mogelijk in de vorm van restricted stock units
  • Pensioen- of pensioenverzekeringsvoorzieningen worden aangeboden volgens lokale normen
  • Zorg-, tand- en oogverzekering
  • Royaal betaald verlof afgestemd op lokale normen
  • Concurrerend totaalbeloningspakket
  • Inzet voor gelijke beloning en transparantie

Gerelateerde vacatures

SPERTON - Where Great People Meet

Businessdevelopmentmanager Smart Home-automatisering

SPERTON - Where Great People Meet
51 – 200 Medewerkers

Stimuleer de verkoop van de smart home-automatiseringsproducten van Smartwitz Marketing Solutions in Navi Mumbai. Beheer klantrelaties, demonstraties, offertes en verkoopkansen tot en met de installatie.

Openen