42dot
42dot
51 – 200 Anställda
FordonKonsultverksamhetLogistik
42dot är ett AI-företag inom mobilitet som arbetar i gränslandet mellan fordonsteknik och logistik. Företagets arbete fokuserar på mjukvarudefinierad fordonsteknik, autonoma elfordon samt den mjukvaru- och datainfrastruktur som krävs för skalbar stadsbaserad transport. Företaget utvecklar fordonsmjukvara, plattformar för fordonsparksdata och AI-modeller för perception och styrning, tillsammans med TAP!, företagets mobilitetsoperativsystem för att driftsätta autonoma tjänster. Genom forskning och samarbete kring fordonselektronik och mjukvarubaserade arkitekturer strävar 42dot efter att göra mobilitetssystem mer autonoma, anpassningsbara och enklare att driva.

Deep Learning-ingenjör för text-till-tal-utveckling

Optimera text-till-tal-modeller för Gleo AI:s röstupplevelser i fordon. Bygg realtidssyntes av tal på flera språk för enheter och servermiljöer.

Beskrivning

  • Optimera TTS-modeller för enhets- och servermiljöer
  • Portera och optimera modeller för NPU- och andra AI-acceleratormiljöer
  • Minska modellstorleken och förbättra prestandan genom kvantisering
  • Utveckla system för strömmande talsyntes i realtid och optimera fördröjningen
  • Utveckla och driftsätt TTS-modeller för flera språk och flera talare
  • Forska kring och utveckla avancerade TTS-modeller baserade på LLM:er och flow matching
  • Bygg dataset för talsyntes med generativa modeller och förbättra datakvaliteten
  • Analysera och åtgärda problem med TTS-modeller och -tjänster i produktionsmiljöer
  • Integrera utforskad och utvecklad TTS-teknik i fordonsprodukter och -tjänster

Krav

  • Minst 3 års relevant erfarenhet av TTS
  • Grundläggande kunskaper om talsyntes och TTS-koncept
  • Erfarenhet av modellkomprimering och beräkningsoptimering
  • Erfarenhet av att optimera kvantisering, minnesanvändning och fördröjning
  • Erfarenhet av att porta och optimera modeller för NPU- och andra AI-acceleratormiljöer
  • Erfarenhet av att optimera modeller med TensorRT och ONNX
  • Förståelse för ljudsignalbehandling
  • Erfarenhet av utveckling och felsökning i Linux-miljöer
  • Programmeringskunskaper i Python, C++ eller shell
  • Goda kunskaper i ramverk för deep learning med öppen källkod, såsom PyTorch
  • Erfarenhet av att utveckla TTS-modeller för flera språk och flera talare är meriterande
  • Forsknings- eller utvecklingserfarenhet av teknik för tokenisering av tal eller ljud är meriterande
  • Publikation som författare i en ledande konferens eller tidskrift inom talsyntes, maskininlärning eller artificiell intelligens är meriterande
  • En relevant master- eller doktorsexamen, eller slutförd utbildning på sådan nivå, är meriterande
  • Information om kunskaper i koreanska måste anges

Förmåner

  • Sökande som är berättigade till nationell merit- eller anställningsskyddsförmån prioriteras
  • Sökande med registrerat intyg om funktionsnedsättning prioriteras
  • En provanställningsperiod på tre månader kan tillämpas
  • Referenser kan kontrolleras med den sökandes samtycke efter att intervjuprocessen har slutförts

Relaterade jobb

Maxibook OÜ

Bidragsgivare inom vetenskapligt språk och AI-anpassning

Maxibook OÜ

Hjälp AI-utbildningsstartupen Maxibook att anpassa engelskt vetenskapligt innehåll för koreansk-, japansk- eller arabiskspråkiga målgrupper. Bedöm AI-genererat material utifrån begreppslig korrekthet, naturligt språk och akademisk trovärdighet.

Öppna