Mercor
Mercor
51 – 200 Medewerkers
Het beschikbare profiel van Mercor bevat onvoldoende geverifieerde informatie over zijn producten, diensten, klanten, sector of focus op werving om een nauwkeurig bedrijfsoverzicht te kunnen geven. Er is meer bronmateriaal nodig voordat het bedrijf of zijn mogelijkheden kan worden beschreven.

Remote-expert AI-veiligheid (Engels en Marathi) bij Mercor

Test conversatie-AI-modellen op kwetsbaarheden met red-teamtests in het Engels en Marathi. Maak reproduceerbare datasets, aanvalsscenario's en rapporten voor AI-veiligheidsprojecten met menselijke data.

Beschrijving

  • Voer red-teamtests uit op conversatie-AI-modellen en -agents met jailbreaks, promptinjectie, misbruikscenario's, exploitatie van vooroordelen en manipulatie over meerdere gespreksrondes
  • Maak menselijke data door fouten te annoteren, kwetsbaarheden te categoriseren en systemische risico's te identificeren
  • Gebruik taxonomieën, benchmarks en playbooks om consistente evaluaties te handhaven
  • Ontwikkel reproduceerbare rapporten, datasets en aanvalsscenario's voor klanten
  • Beoordeel AI-uitvoer over gevoelige onderwerpen, waaronder vooroordelen, desinformatie en schadelijk gedrag
  • Identificeer zwakke plekken die geautomatiseerde tests mogelijk over het hoofd zien
  • Vergroot de evaluatiedekking om onverwachte problemen in productie te helpen voorkomen
  • Ondersteun klanten bij het verbeteren van de veiligheid, robuustheid en betrouwbaarheid van hun AI-systemen

Vereisten

  • Vloeiende of moedertaalvaardigheid in het Engels en Marathi is vereist
  • Goed beoordelingsvermogen op het gebied van taal en inhoud, inclusief het vermogen om te beoordelen of AI-antwoorden accuraat, volledig en passend zijn en de redenering toe te lichten
  • Uitzonderlijke aandacht voor subtiele fouten, inconsistenties en omissies
  • Consistente naleving van vastgestelde richtlijnen en kwaliteitsnormen
  • Duidelijke communicatie van redeneringen aan zowel technische als niet-technische doelgroepen
  • Vermogen om je aan te passen aan verschillende projecten, taakindelingen en klanten
  • Je moet als zelfstandig opdrachtnemer werken
  • Kandidaten met H1-B- of STEM-OPT-status worden niet ondersteund
  • Pré: ervaring met adversarial machine learning, waaronder jailbreakdatasets, promptinjectie-, RLHF- of DPO-aanvallen of model extraction
  • Pré: ervaring met cybersecurity, waaronder penetratietests, exploitontwikkeling of reverse engineering
  • Pré: ervaring met sociaal-technische risico's, waaronder onderzoek naar intimidatie of desinformatie, misbruikanalyse of het testen van conversatie-AI
  • Pré: ervaring met psychologie, acteren of schrijven die onconventioneel adversarieel denken ondersteunt

Voordelen

  • Volledig op afstand werken
  • Flexibele planning met de mogelijkheid om je werktijden zelf te kiezen
  • Wekelijkse betalingen via Stripe of Wise op basis van geleverde diensten
  • De projectduur kan op basis van bedrijfsbehoeften en prestaties worden verlengd, verkort of voortijdig beëindigd
  • Middelen voor welzijn en duidelijke begeleiding voor projecten met inhoud met een hogere gevoeligheid
  • Redelijke aanpassingen zijn op verzoek beschikbaar
  • Referralprogramma met maximaal 90 USD voor elke succesvolle referral, zonder limiet op het aantal referrals
  • Mogelijkheid om samen te werken met vooraanstaande onderzoekers
  • Ervaring met het uitvoeren van human-data-gedreven AI-red teaming op het gebied van AI-veiligheid

Gerelateerde vacatures