adaption
adaption
1 – 10 Mitarbeitende
BeratungLogistikMarketing
adaption entwickelt adaptive KI-Systeme und Werkzeuge, die darauf ausgelegt sind, intelligente Funktionen auf einzelne Nutzer, Sprachen, Branchen und spezielle Anwendungsfälle zuzuschneiden. Die Arbeit des Unternehmens umfasst Adaptive Data, Adaptive Intelligence und Adaptive Interfaces – Ansätze, die Modellen helfen, sich kontinuierlich anzupassen und reaktionsfähigere Nutzererlebnisse zu ermöglichen, ohne in gleichem Maß auf manuelle Eingabeaufforderungen oder ein einzelnes monolithisches Modell angewiesen zu sein. Die Technologie des Unternehmens ist für Organisationen relevant, die praktische KI-Anwendungen unter anderem in den Bereichen Beratung, Logistik und Marketing erkunden.

Inference Engineer – Adaption (Hybrid, Bay Area)

Optimiere die Inference-Infrastruktur bei Adaption, einem KI-Unternehmen, das adaptive Intelligenzsysteme entwickelt, für Durchsatz, Kosten und Latenz. Verbessere das Modell-Serving über GPUs, Inference-Engines und Produktions-Workloads hinweg.

Beschreibung

  • Verantwortung für Kosten und Leistung des Inference-Stacks übernehmen.
  • Durch KV-Cache-Management, kontinuierliches Batching, spekulatives Decoding und Quantisierung den Durchsatz erhöhen sowie Kosten und Tail-Latenz senken.
  • Prefill- und Decode-Workloads mit langen Kontexten anhand realer Produktionslast optimieren.
  • Das Routing zwischen interner Infrastruktur und externen Anbietern abhängig von Kosten, Kapazität und Leistung anpassen.
  • Serving-Engines wie vLLM, SGLang und TensorRT-LLM einsetzen und bei Bedarf unterhalb des Frameworks arbeiten.
  • Profiling- und Messsysteme entwickeln, um Zeit-, Speicher- und Rechenverbrauch zu ermitteln.
  • Eng mit den für die Serving-Flotte verantwortlichen Ingenieurinnen und Ingenieuren zusammenarbeiten.

Anforderungen

  • Mindestens fünf Jahre Erfahrung mit ML-Systemen, Inference-Infrastruktur oder Performance Engineering sowie messbare Verbesserungen bei Kosten oder Latenz mitbringen.
  • Tiefgehende Kenntnisse im Model-Serving nachweisen, einschließlich Prefill und Decode, Speicherbandbreite, Batching und Nebenläufigkeit.
  • Produktionserfahrung mit Serving-Engines wie vLLM, SGLang oder TensorRT-LLM haben.
  • Python sicher beherrschen und in C++, Rust oder einer anderen Systemprogrammiersprache versiert sein.
  • GPU-Performance-Themen wie CUDA, NCCL, Mixed Precision, Speicherlayout, Kernel oder Quantisierung verstehen.
  • Bereit sein, im Rahmen eines hybriden Arbeitsmodells vor Ort in der Bay Area zu arbeiten.

Zusatzleistungen

  • Vor-Ort-Zusammenarbeit in der Bay Area mit einem verteilten, global ausgerichteten Team und Team-Offsites verbinden.
  • Ein jährliches Adaption-Passport-Reisebudget erhalten, um ein Land zu erkunden, das du zuvor noch nicht besucht hast.
  • Eine wöchentliche Pauschale für bestellte Mahlzeiten oder Lebensmittellieferungen erhalten.
  • Umfassenden Krankenversicherungsschutz und großzügige bezahlte Freistellung nutzen.

Ähnliche Stellen

Red Hat

Consulting-Cloud-Architekt für OpenShift

Red Hat

Entwirf und implementiere Lösungen mit Red Hat OpenShift, Kubernetes und Hybrid-Cloud für Unternehmenskunden. Leite Kundenprojekte mit Schwerpunkt auf Infrastruktur, Automatisierung und Anwendungsbereitstellung.

Öffnen
Kreato Global | BPO and Language Solutions

Remote-Dolmetscher für Englisch-Spanisch (OPI/VRI)

Kreato Global | BPO and Language Solutions
201 – 500 Mitarbeitende
GastgewerbeGesundheitswesenLogistik

Dolmetschen Sie remote zwischen englisch- und spanischsprachigen Personen in den Bereichen Medizin, Finanzen, Sozialdienste und Kundenbetreuung. Bieten Sie Kreato Global Sprachunterstützung in ganz Lateinamerika.

Öffnen
RecruitGo

Remote Executive Assistant für Outreach und Marketing – Philippinen

RecruitGo
51 – 200 Mitarbeitende
BeratungLogistikMarketing

Administrative Unterstützung, CRM, Outreach und Marketing für RecruitGo, einen Employer of Record für internationale Kunden mit Fachkräften aus aufstrebenden Märkten. Unterstützung von zwei britisch ausgerichteten Kunden bei der täglichen Verwaltung und kreativen Kampagnen.

Öffnen
SPERTON - Where Great People Meet

Vertriebsmitarbeiter für Aufzüge und Parksysteme

SPERTON - Where Great People Meet
51 – 200 Mitarbeitende

Steuern Sie den Vertrieb von Aufzügen und Parksystemen in der westlichen Region von Mumbai. Bauen Sie Kunden- und Händlerbeziehungen auf und betreuen Sie Geschäfte von der ersten Anfrage bis zur Projektausführung.

Öffnen
Salonkee

Vertriebsmitarbeiter:in im Außendienst (Hybrid) in Lindau

Salonkee
51 – 200 Mitarbeitende
MarktplatzSaaSSchönheit

Baue Salonkees Geschäft mit Salonsoftware in Lindau und Friedrichshafen durch Kontaktaufnahme, Produktvorführungen und den gesamten Verkaufsprozess aus. Knüpfe Beziehungen zu lokalen Saloninhaber:innen und begleite jede Verkaufschance bis zum Abschluss.

Öffnen