
AI安全専門家――英語・マラーティー語(リモート)
Mercorは、英語とマラーティー語を話せるAI安全専門家を募集しています。対話モデルやエージェントのレッドチームテスト、脆弱性の特定、センシティブな出力の評価、AIラボや顧客向けの再現可能な安全性データの作成を担当します。
仕事内容
- 脱獄、プロンプトインジェクション、誤用シナリオ、バイアスの悪用、複数ターンにわたる操作を用いて、対話型AIモデルやエージェントのレッドチームテストを実施する
- 失敗事例へのアノテーション、脆弱性の分類、システム上のリスクの特定を通じて、人手による評価データを作成する
- 確立された分類体系、ベンチマーク、プレイブックを使用し、一貫した評価を支援する
- 顧客向けに再現可能なレポート、データセット、攻撃事例を作成する
- バイアス、誤情報、有害な行動、その他のセンシティブなトピックに関するAI出力を評価する
- 自動テストでは見落とされる可能性のある脆弱性を特定する
- 評価範囲を広げ、予期しない本番環境の問題を最小限に抑える
- 顧客がAIシステムの安全性、堅牢性、信頼性を向上できるよう支援する
応募要件
- 英語とマラーティー語の両方を母語レベルで流暢に扱えること
- AIの回答が正確、完全、適切かどうかを含め、言語とコンテンツを評価する際の優れた判断力
- 微妙な誤り、不整合、欠落を検出できること
- ガイドラインと品質基準を一貫して遵守できること
- 技術者と非技術者の双方に推論を明確に伝えられること
- さまざまなプロジェクト、タスクの種類、顧客に対応できる適応力
- 独立請負業者として働けること
- H-1BまたはSTEM OPTのサポートを必要としないこと
- 歓迎:脱獄データセット、プロンプトインジェクション、RLHFまたはDPO攻撃、モデル抽出などの敵対的機械学習の経験
- 歓迎:ペネトレーションテスト、エクスプロイト開発、リバースエンジニアリングなどのサイバーセキュリティ経験
- 歓迎:ハラスメントや偽情報のプロービング、悪用分析、対話型AIテストなどの社会技術的リスクに関する経験
- 歓迎:型破りな敵対的思考に役立つ心理学、演技、または執筆の経験
福利厚生
- 完全リモートで、自分のスケジュールに合わせて取り組める
- StripeまたはWiseによる週払い
- より高い機密性が求められるプロジェクトへの任意参加
- センシティブなコンテンツを扱う業務向けの明確なガイドラインとウェルネスリソース
- 競争力のある報酬
- 第一線の研究者と協力できる機会
- 紹介が成功するごとに最大90米ドルの紹介報酬(上限あり)





