
Mercor リモートAI安全専門家(英語・マラーティー語)
英語とマラーティー語でレッドチームテストを行い、対話型AIモデルの脆弱性を探ります。人間のデータを活用したAI安全性プロジェクト向けに、再現可能なデータセット、攻撃事例、レポートを作成します。
仕事内容
- 脱獄、プロンプトインジェクション、悪用シナリオ、バイアスの悪用、マルチターン操作などを用いて、対話型AIモデルとエージェントのレッドチームテストを実施する
- 失敗事例のアノテーション、脆弱性の分類、体系的リスクの特定を通じて、人間のデータを作成する
- 分類体系、ベンチマーク、プレイブックを使用して、一貫した評価を維持する
- 顧客向けに再現可能なレポート、データセット、攻撃事例を作成する
- バイアス、誤情報、有害行動など、機微なテーマに関するAI出力を評価する
- 自動テストでは見落とされる可能性のある弱点を特定する
- 評価範囲を広げ、実運用環境での予期せぬ問題の防止に貢献する
- 顧客がAIシステムの安全性、堅牢性、信頼性を向上できるよう支援する
応募要件
- 英語とマラーティー語を流暢に、または母語として使用できること
- 言語とコンテンツに関する適切な判断力があり、AIの応答が正確、完全、適切かを評価し、その理由を説明できること
- 微妙な誤り、不整合、抜け漏れに対する並外れた注意力
- 定められたガイドラインと品質基準を一貫して遵守できること
- 技術者と非技術者の双方に判断理由を明確に伝えられること
- プロジェクト、タスク形式、顧客の違いに適応できること
- 独立請負業者として働くこと
- H1-BおよびSTEM OPTの候補者には対応していません
- 歓迎:脱獄データセット、プロンプトインジェクション、RLHFまたはDPO攻撃、モデル抽出などに関する敵対的機械学習の経験
- 歓迎:ペネトレーションテスト、エクスプロイト開発、リバースエンジニアリングなどのサイバーセキュリティ経験
- 歓迎:嫌がらせや偽情報の探索、悪用分析、対話型AIテストなどに関する社会技術的リスクの経験
- 歓迎:型破りな敵対的思考に役立つ心理学、演技、執筆の経験
福利厚生
- 完全リモート勤務
- 勤務時間を選択できる柔軟なスケジュール
- 提供したサービスに応じて、StripeまたはWiseを通じて毎週支払い
- プロジェクト期間は、事業上の必要性や業績に応じて延長、短縮、または早期終了となる場合があります
- より高い機微性を伴うコンテンツのプロジェクト向けに、ウェルネスリソースと明確なガイダンスを提供
- 要望に応じて合理的配慮を利用可能
- 紹介プログラムにより、紹介が成功するごとに最大90ドルを獲得可能。紹介人数に上限なし
- 一流の研究者と協働する機会
- AI安全性の最前線で、人間のデータを活用したAIレッドチームテストを実施する経験



