
AI 안전성 레드팀 전문가
Mercor는 적대적 프롬프트로 고급 AI 시스템을 탐색할 AI 안전성 레드팀 전문가를 모집합니다. 위험을 기록하고 연구자와 협력해 모델의 안전성과 정렬을 강화하는 역할입니다.
설명
- 적대적 프롬프트를 만들어 고급 AI 모델을 테스트합니다
- 탈옥, 안전하지 않은 출력, 환각 및 정책의 허점을 찾아냅니다
- 허위 정보, 사이버 보안, 생물 보안, 사기, 정치 콘텐츠 등 민감한 영역에서 모델의 복원력을 평가합니다
- 취약점을 기록하고 안전성 벤치마크 및 레드팀 보고서 작성을 지원합니다
- AI 연구자와 협력해 모델 정렬, 복원력 및 안전성을 강화합니다
- AI 시스템을 학습시키고 개선하는 프로젝트에 기여합니다
지원 자격
- 컴퓨터 과학, 사이버 보안, 저널리즘, 커뮤니케이션, 심리학, 생물학, 화학, 공공 정책 또는 관련 분야의 학사 학위 이상
- AI 안전성, AI 레드팀, 신뢰 및 안전, 사이버 보안, 탐사 저널리즘, 생명과학 또는 관련 분야에서 5년 이상의 전문 경력
- 뛰어난 분석적 사고력, 프롬프트 설계 및 글쓰기 역량
- 적대적 프롬프트를 만들거나 고급 AI 시스템을 평가한 경험
- 우대 사항: AI 레드팀, RLHF, 지도 미세 조정, AI 정렬 또는 신뢰 및 안전 관련 배경
- 우대 사항: 탈옥 테스트, 프롬프트 엔지니어링 또는 적대적 평가 방법에 대한 지식
- 우대 사항: 사이버 보안, 생물 보안, 정치 콘텐츠, 허위 정보 또는 과학 안전 등 세밀한 전문성이 필요한 분야의 전문 지식
- 독립 계약자로 근무할 수 있어야 합니다
- H-1B 및 STEM OPT 지원자는 지원할 수 없습니다
복리후생
- 완전 원격 근무와 유연한 일정
- 제공한 서비스 대금을 Stripe 또는 Wise를 통해 매주 지급
- 필요와 업무 성과에 따라 프로젝트 기간이 연장, 단축 또는 조기 종료될 수 있습니다
- 경쟁력 있는 보상
- 선도적인 연구자 및 안전 팀과 협업할 기회
- 요청 시 합리적인 편의를 제공합니다
- 성공적인 추천 1건당 최대 340달러의 추천 인센티브 제공(한도 적용)







