
AI安全専門家――英語・パンジャブ語
英語とパンジャブ語に堪能なAI安全専門家を対象としたリモート契約職で、Mercorの会話型AIレッドチームプロジェクトを支援します。ジェイルブレイク、プロンプトインジェクション、有害コンテンツのリスク、モデルの脆弱性をテストし、再現可能な調査結果を記録します。
仕事内容
- ジェイルブレイク、プロンプトインジェクション、悪用シナリオ、バイアスの悪用、マルチターン操作を用いて、会話型AIモデルとエージェントの敵対的テストを実施する
- 失敗事例のアノテーション、脆弱性の分類、体系的なリスクの特定を通じて、人手で生成したデータを作成する
- 確立された分類体系、ベンチマーク、プレイブックを適用し、一貫した評価を維持する
- 顧客向けに再現可能なレポート、データセット、攻撃ケースを作成する
- AIの出力について、バイアス、誤情報、有害な挙動、その他のセンシティブな内容に関するリスクを評価する
- 自動評価では見落とされる可能性のある弱点を特定する
- 評価範囲を広げ、本番環境で予期しない問題が発生する可能性を抑える
- 体系的な敵対的テストを通じて、顧客のAIシステムを改善する
応募要件
- 英語とパンジャブ語の両方を母語レベルで流暢に使えること
- 言語とコンテンツを評価する際の適切な判断力
- AIの回答が正確、完全、適切かどうかを判断し、その評価を説明できる能力
- 微妙な誤り、不整合、抜け漏れに対する高い注意力
- ガイドラインと品質基準を一貫して遵守できること
- 技術者と非技術者の双方に推論を明確に伝えられること
- プロジェクト、タスク形式、顧客の違いに適応できること
- 独立請負業者としての資格
- H-1BまたはSTEM OPTの候補者ではないこと
- 歓迎:ジェイルブレイクデータセット、プロンプトインジェクション、RLHF/DPO攻撃、モデル抽出などの敵対的機械学習の経験
- 歓迎:侵入テスト、エクスプロイト開発、リバースエンジニアリングなどのサイバーセキュリティ経験
- 歓迎:ハラスメントや偽情報の調査、悪用分析、会話型AIテストなど、社会技術的リスクに関する経験
- 歓迎:型破りな敵対的思考に役立つ心理学、演技、ライティングの経験
福利厚生
- 完全リモート勤務
- 自分で勤務時間を設定できる柔軟なスケジュール
- StripeまたはWiseによる週払い
- 事業上のニーズや業績に応じて、プロジェクトが延長、短縮、または早期終了となる場合があります
- より高い感度が求められるプロジェクトへの任意参加
- コンテンツガイドラインとウェルネスリソースの提供
- 競争力のある報酬
- 申請に応じて合理的配慮を提供
- 紹介上限の範囲内で、紹介が成功するごとに最大90米ドルの紹介料







