Mercor
Mercor
51 – 200 Medarbejdere
Mercors tilgængelige profil indeholder ikke tilstrækkelige verificerede oplysninger om virksomhedens produkter, tjenester, kunder, branche eller rekrutteringsfokus til at understøtte en nøjagtig virksomhedsbeskrivelse. Der er brug for mere kildemateriale, før virksomheden eller dens muligheder kan beskrives.

AI-sikkerhedsekspert – engelsk og punjabi

Fjernbaseret kontraktarbejde for AI-sikkerhedseksperter, der behersker engelsk og punjabi, og som understøtter Mercors projekter med red teaming af konversationsbaseret AI. Test jailbreaks, promptinjektioner, risici ved skadeligt indhold og modelsårbarheder, mens du dokumenterer reproducerbare resultater.

Beskrivelse

  • Udfør adversarial testing af konversationsbaserede AI-modeller og agenter ved hjælp af jailbreaks, promptinjektioner, misbrugsscenarier, udnyttelse af bias og manipulation over flere samtaletrin
  • Skab menneskegenererede data ved at annotere fejl, kategorisere sårbarheder og identificere systemiske risici
  • Anvend etablerede taksonomier, benchmarktests og arbejdsmetoder for at sikre ensartede evalueringer
  • Udarbejd reproducerbare rapporter, datasæt og angrebseksempler til kunder
  • Vurder AI-output for bias, misinformation, skadelig adfærd og andre risici ved følsomt indhold
  • Identificer svagheder, som automatiserede evalueringer kan overse
  • Udvid evalueringsdækningen for at bidrage til at begrænse uventede problemer i produktion
  • Forbedr kundernes AI-systemer gennem struktureret adversarial testing

Krav

  • Modersmålsniveau i både engelsk og punjabi
  • God dømmekraft ved vurdering af sprog og indhold
  • Evne til at afgøre, om AI-svar er korrekte, fuldstændige og passende, og til at forklare vurderingen
  • Stor opmærksomhed på subtile fejl, uoverensstemmelser og udeladelser
  • Konsekvent overholdelse af retningslinjer og kvalitetsstandarder
  • Klar kommunikation af ræsonnement til tekniske og ikke-tekniske målgrupper
  • Evne til at tilpasse sig forskellige projekter, opgaveformater og kunder
  • Status som selvstændig kontrahent
  • Må ikke være H-1B- eller STEM OPT-kandidat
  • Foretrukket: erfaring med adversarial machine learning, herunder jailbreak-datasæt, promptinjektioner, RLHF/DPO-angreb eller modeludtræk
  • Foretrukket: erfaring med cybersikkerhed inden for penetrationstest, exploitudvikling eller reverse engineering
  • Foretrukket: erfaring med sociotekniske risici, herunder sondering efter chikane eller misinformation, misbrugsanalyse eller test af konversationsbaseret AI
  • Foretrukket: erfaring med psykologi, skuespil eller skrivning, der understøtter ukonventionel adversarial tænkning

Fordele

  • Fuldt fjernbaseret arbejde
  • Fleksibel planlægning med mulighed for at arbejde efter eget skema
  • Ugentlige betalinger via Stripe eller Wise
  • Projekter kan forlænges, forkortes eller afsluttes før tid afhængigt af virksomhedens behov og arbejdsindsats
  • Mulighed for frivillig deltagelse i projekter med højere følsomhed
  • Der stilles indholdsretningslinjer og trivselsressourcer til rådighed
  • Konkurrencedygtig betaling
  • Rimelige tilpasninger tilbydes efter anmodning
  • Henvisningsbetalinger på op til 90 USD pr. vellykket henvisning, med forbehold for henvisningsgrænser

Relaterede job