
AIセーフティレッドチーマー
Mercorは、敵対的テストを通じて最先端AIシステムを検証し、AIトレーニングプロジェクトを支援するAIセーフティレッドチーマーを募集しています。 高リスクなテーマ領域における、難易度の高いプロンプトの作成と脆弱性の記録を担当します。
仕事内容
- 最先端AIモデルに挑戦する敵対的プロンプトを作成する
- 脱獄、不安全な挙動、ハルシネーション、ポリシー違反を検出する
- 誤情報、サイバーセキュリティ、バイオセキュリティ、不正、政治的コンテンツ、その他のセンシティブな領域におけるモデルの耐性を評価する
- 発見した脆弱性を記録し、安全性ベンチマークとレッドチーミングレポートを支援する
- AI研究者と連携し、モデルのアライメント、堅牢性、安全性を強化する
- AIシステムのトレーニングと改善に取り組むプロジェクトに貢献する
応募要件
- コンピューターサイエンス、サイバーセキュリティ、ジャーナリズム、コミュニケーション、心理学、生物学、化学、公共政策、または関連分野の学士号以上
- AIセーフティ、AIレッドチーミング、トラスト&セーフティ、サイバーセキュリティ、調査報道、ライフサイエンス、または関連分野で5年以上の実務経験
- 優れた分析的推論力、プロンプトエンジニアリング能力、文章によるコミュニケーション能力
- 敵対的プロンプトの作成または最先端AIシステムの評価経験
- 対象として列挙された資格要件を満たす地域のいずれかに居住していること
- H-1BおよびSTEM OPTの候補者は対象外
福利厚生
- 完全リモートで勤務できる
- 柔軟なスケジュールを選び、自分に合った時間に業務を完了できる
- StripeまたはWiseを通じて毎週支払いを受けられる
- 一流のAI研究者やセーフティチームと協働できる
- 最先端AIシステムの安全性とアライメントの形成に貢献できる
- プロジェクト期間は、事業上のニーズや成果に応じて変更または早期終了する場合がある
- 紹介制限の対象となるが、紹介1件の成功につき最大340ドルの紹介報酬を受け取れる









