Cerebras
Cerebras
501 – 1.000 Medewerkers
HardwareKunstmatige intelligentieSaaS
Cerebras ontwikkelt AI-hardware op waferschaal en geïntegreerde software voor het krachtig trainen en uitvoeren van modellen. De Wafer-Scale Engine vormt de basis van het CS-3-systeem en de Cerebras Inference Cloud, die workflows ondersteunt die compatibel zijn met de OpenAI-API en implementatie in on-premises-, cloud- en edge-omgevingen mogelijk maakt. Het platform is ontworpen voor toepassingen zoals model-serving, fine-tuning, pre-training, realtime-AI-agents, genomica, geneesmiddelenonderzoek, cybersecurity en enterprise search. Cerebras brengt gespecialiseerde chips, systemen en software samen voor organisaties die veeleisende workloads op het gebied van kunstmatige intelligentie ontwikkelen en beheren, met een team van 501–1.000 medewerkers.

Machine-learningengineer, modelimplementatie

Breng transformermodellen naar Cerebras-AI-acceleratorhardware en optimaliseer hun inferentieprestaties. Ontwikkel MLIR-compilerpaden en verbeter de correctheid, latentie, doorvoer en geheugenefficiëntie van modellen.

Beschrijving

  • Breng nieuwe modellen in productie door architecturen te analyseren, gewichten te converteren, uitvoeringspaden te implementeren en resultaten te valideren aan de hand van referentie-implementaties.
  • Breng modellen naar Cerebras-hardware met MLIR-dialecten, graaftransformaties, lowering-passes en hardwarespecifieke mappings.
  • Ondersteun attention, matrixvermenigvuldiging, normalisatie, positionele embeddings en andere operators via compiler- en kernelontwikkeling.
  • Optimaliseer operatorfusie, tensorlayouts, tiling, geheugentoewijzing, databeweging en parallelle uitvoering.
  • Verbeter de prefill- en decodeprestaties door KV-cachebeheer, batching en kwantisatie af te stemmen voor betere latentie, doorvoer en geheugengebruik.
  • Analyseer numerieke afwijkingen en beoordeel hoe wijzigingen in precisie en compileroptimalisaties de nauwkeurigheid beïnvloeden.
  • Gebruik profilers, uitvoeringstraces en hardwaretellers om knelpunten in berekening, geheugen, communicatie en runtime te lokaliseren.
  • Werk samen met hardware-, compiler-, kernel- en runtimeteams om betrouwbare modelondersteuning en reproduceerbare prestatiebenchmarks te leveren.

Vereisten

  • Uitstekende beheersing van programmeren in C++ en Python.
  • Praktische ervaring met het implementeren en debuggen van machine-learningmodellen in PyTorch of een vergelijkbaar framework.
  • Praktische ervaring met MLIR, waaronder dialecten, rewrite-patronen, transformatiepasses en lowering-pipelines.
  • Kennis van compilerbasisprincipes, waaronder intermediaire representaties, dataflowanalyse en codegeneratie.
  • Inzicht in transformerarchitecturen, attentionmechanismen, tensorbewerkingen en numerieke precisie.
  • Ervaring met het profileren en optimaliseren van workloads op GPU's of andere AI-accelerators.
  • Vermogen om problemen met correctheid en prestaties te diagnosticeren in modelcode, compileroutput, kernels en runtime-uitvoering.
  • Ervaring met inferentie van grote taalmodellen, waaronder GQA, sliding-window attention, mixture-of-experts, KV-caching en speculatieve decoding.
  • Ervaring met FP16, BF16, FP8 of low-bitkwantisatie en de afwegingen tussen nauwkeurigheid en prestaties.
  • Achtergrond in de ontwikkeling van acceleratorkernels of hardwarespecifieke compilerbackends.
  • Vertrouwdheid met gedistribueerde uitvoering, modelparallelisme en geheugenhiërarchieën van accelerators.
  • Bijdragen aan MLIR, LLVM, inferentieframeworks of verwante opensourceprojecten.

Voordelen

  • Een stabiele baan in een omgeving met het tempo van een startup.
  • Mogelijkheden om geavanceerd AI-onderzoek te publiceren en als opensource beschikbaar te stellen.
  • Werk met een van de snelste AI-supercomputers ter wereld.
  • Een directe, niet-corporate cultuur die individuele overtuigingen respecteert.
  • Doorlopend leren, professionele groei en ondersteuning.
  • Een rechtvaardige en diverse werkomgeving.

Gerelateerde vacatures

Terumo Medical Corporation

Gebiedsmanager Interventiesystemen – Philadelphia

Terumo Medical Corporation

Verantwoordelijk voor de verkoop van Terumo Interventional Systems-producten aan ziekenhuizen en poliklinische instellingen in de regio Philadelphia. Klantenaccounts uitbouwen, procedures ondersteunen, zorgprofessionals opleiden en verkoopdoelen behalen.

Openen
Cross River

Engineeringmanager Cloud en gedistribueerde systemen – Cross River, Jeruzalem

Cross River

Leid en coach engineers die fintechdiensten en infrastructuur bouwen voor betalingen, kaarten, leningen en crypto. Deze hybride functie in Jeruzalem richt zich op cloudnative systemen en een sterke uitvoering van engineeringwerk.

Openen
Aleph Alpha

Senior AI Researcher voor pre-training van foundationmodellen — Aleph Alpha, Heidelberg

Aleph Alpha
51 – 200 Medewerkers
B2BKunstmatige intelligentie

Leid architectuur- en pre-trainingwerk op grote schaal voor Aleph Alpha’s Europese foundationmodellen en geef vorm aan trainingsmethoden voor duizenden GPU’s. Bouw en verfijn PyTorch-trainingsrecepten met het hybride team in Heidelberg.

Openen
General Motors

Zomerstage AI-onderzoek: Embodied AI

General Motors

Doe bij General Motors onderzoek naar machine learning, robotica en multimodale modellen voor autonoom rijden. Voer experimenten uit en werk samen met onderzoeks- en engineeringteams tijdens een hybride stage in Sunnyvale, Californië.

Openen
Mobileye

Senior onderzoeker deep learning voor autonome voertuigen

Mobileye

Onderzoek en ontwikkel deeplearningsystemen voor de autonome voertuigen van Mobileye, waaronder grootschalige neurale netwerken voor de EyeQ-chip. Verbeter de modelprestaties en breng onderzoeksresultaten naar de praktijk.

Openen
Local Crafts

Remote Klantenservicespecialist – Local Crafts (VS)

Local Crafts

Ondersteun de online merken van Local Crafts door klanten via telefoon, e-mail en chat te helpen met bestellingen, verzending, retouren en handwerkvragen. De functie combineert het afhandelen van tickets, het bijwerken van bestellingen en klantaccounts en samenwerking met verschillende teams.

Openen