Cerebras
Cerebras
501 – 1.000 Mitarbeitende
HardwareKünstliche IntelligenzSaaS
Cerebras entwickelt KI-Hardware im Wafer-Maßstab und integrierte Software für das leistungsstarke Training und die Inferenz von Modellen. Die Wafer-Scale Engine bildet das Herzstück des CS-3-Systems und der Cerebras Inference Cloud, die mit der OpenAI-API kompatible Workflows sowie die Bereitstellung in On-Premises-, Cloud- und Edge-Umgebungen unterstützt. Die Plattform ist für Anwendungen wie das Bereitstellen von Modellen, Fine-Tuning, Pre-Training, KI-Agenten in Echtzeit, Genomik, Wirkstoffforschung, Cybersicherheit und die Unternehmenssuche konzipiert. Cerebras vereint spezialisierte Chips, Systeme und Software für Organisationen, die anspruchsvolle Workloads im Bereich der künstlichen Intelligenz entwickeln und betreiben, und beschäftigt 501–1.000 Mitarbeitende.

ML-Runtime- und Kernel-Engineer, Core ML

Entwickle leistungsstarke Runtimes und Kernel, die die Core-ML-Forschung in produktionsreife Software überführen. Entwickle und optimiere Software für Cerebras’ Wafer-scale-KI-Plattform und Machine-Learning-Systeme.

Beschreibung

  • Entwirf und implementiere Runtime-Komponenten und leistungsstarke Kernel für neue Core-ML-Algorithmen
  • Überführe Forschungsprototypen in effiziente Implementierungen auf der Cerebras-Plattform, einschließlich Referenzversionen und, wo sinnvoll, GPU-Vergleichen
  • Analysiere und behebe Performanceprobleme in ML-Frameworks, Compilern, Runtimes, Kommunikationssystemen und Kerneln
  • Optimiere Berechnungen, Speicherübertragungen, Kommunikation und Nebenläufigkeit für groß angelegtes Training und Inferenz mit geringer Latenz
  • Erstelle Benchmarks, Instrumentierung und automatisierte Tests für Funktionalität, Performance und numerische Genauigkeit
  • Arbeite eng mit Core-ML-Forschenden sowie Compiler-, Runtime-, Kernel- und Inferenzingenieurinnen und -ingenieuren zusammen
  • Leiste durch das Erkennen wiederkehrender Einschränkungen und von Verbesserungsmöglichkeiten einen Beitrag zu Softwarearchitektur und Roadmap-Entscheidungen

Anforderungen

  • Bachelor-, Master- oder Promotionsabschluss oder gleichwertige praktische Erfahrung in Informatik, Computertechnik, Elektrotechnik oder einem verwandten Fachgebiet
  • Erfahrung in der Entwicklung leistungsstarker Systemsoftware, Machine-Learning-Systeme, Runtimes, Compiler oder Rechenkernel
  • Sehr gute Kenntnisse in C++ und Python
  • Fundierte Kenntnisse in paralleler Programmierung, Speicherverwaltung, Nebenläufigkeit, Datenstrukturen und Performance-Optimierung
  • Nachweisliche Fähigkeit, komplexe Software über mehrere Systemebenen hinweg zu debuggen und zu analysieren
  • Vertrautheit mit modernen Machine-Learning-Architekturen und Frameworks wie PyTorch oder JAX
  • Fähigkeit zur effektiven Zusammenarbeit mit Forschenden und zur Umsetzung sich wandelnder algorithmischer Anforderungen in zuverlässige Software
  • Von Vorteil: Erfahrung mit CUDA, Triton, Low-Level-Assembly, Accelerator-Programmierung oder einer C-ähnlichen domänenspezifischen Sprache
  • Von Vorteil: Erfahrung mit Compiler-Interna, verteilten Runtimes, benutzerdefinierten Hardwareschnittstellen oder Hochleistungsrechnersystemen
  • Von Vorteil: Verständnis der Grundlagen des maschinellen Lernens und von ML-Systemen
  • Von Vorteil: Vertrautheit mit dem Training oder der Inferenz von LLMs, einschließlich Attention, KV-Cache-Verwaltung, paralleler Generierung oder verteilter Ausführung
  • Von Vorteil: Erfahrung in der Softwareentwicklung in einem industriellen oder akademischen Forschungsumfeld
  • Von Vorteil: Beiträge zu umfangreichen Open-Source-Systemen, Machine-Learning-Frameworks, Compilern oder Kernel-Bibliotheken

Zusatzleistungen

  • Hilf beim Aufbau einer KI-Plattform, die über die Grenzen herkömmlicher GPUs hinausgeht
  • Möglichkeiten zur Veröffentlichung und zur Veröffentlichung als Open Source fortschrittlicher KI-Forschung
  • Arbeite mit einem der schnellsten KI-Supercomputer der Welt
  • Startup-Energie kombiniert mit Arbeitsplatzsicherheit
  • Eine unkomplizierte, nicht von Konzernstrukturen geprägte Kultur, die individuelle Überzeugungen respektiert
  • Ein gleichberechtigtes und vielfältiges Arbeitsumfeld
  • Kontinuierliche Möglichkeiten für Lernen, Weiterentwicklung und Unterstützung

Ähnliche Stellen

Salonkee

Salonkee-Vertriebsmitarbeiter (Quereinstieg) – Hannover

Salonkee
51 – 200 Mitarbeitende
MarktplatzSaaSSchönheit

Baue Salonkees Salonsoftware-Geschäft in Hannover aus, indem du Beziehungen zu Saloninhaberinnen und -inhabern aufbaust und sie durch Produktvorführungen führst. Betreue den gesamten Verkaufsprozess von der Akquise bis zum Abschluss und plane deine Woche selbstständig.

Öffnen
Red Hat

Consulting-Cloud-Architekt für OpenShift

Red Hat

Entwirf und implementiere Lösungen mit Red Hat OpenShift, Kubernetes und Hybrid-Cloud für Unternehmenskunden. Leite Kundenprojekte mit Schwerpunkt auf Infrastruktur, Automatisierung und Anwendungsbereitstellung.

Öffnen
Kreato Global | BPO and Language Solutions

Remote-Dolmetscher für Englisch-Spanisch (OPI/VRI)

Kreato Global | BPO and Language Solutions
201 – 500 Mitarbeitende
GastgewerbeGesundheitswesenLogistik

Dolmetschen Sie remote zwischen englisch- und spanischsprachigen Personen in den Bereichen Medizin, Finanzen, Sozialdienste und Kundenbetreuung. Bieten Sie Kreato Global Sprachunterstützung in ganz Lateinamerika.

Öffnen