

DISA Technologies, Inc.は、採鉱・資源事業者向けに鉱物処理技術を開発する科学・ハードウェア企業です。特許取得済みのDISA Tech™プラットフォームは、高圧スラリーアブレーションを用い、高速で衝突するスラリーによって価値ある鉱物を単体分離することで、エネルギー使用量の削減と、従来の粉砕で生じる微粒分やスライムの抑制を目指しています。同社のモジュール式システムは、稼働中の鉱床、鉱石堆積場、尾鉱、旧ウラン鉱山跡地などへの導入を想定して設計されており、浮選や浸出などの工程による下流の濃縮性向上を支援するとともに、資源回収と現地修復を両立します。
データエンジニアリング・機械学習インターン――ハイブリッド勤務
DISA Technologies の鉱物処理試験データを整理・標準化し、クラウド分析に活用します。 過去の記録を分析してデータ品質を評価し、機械学習に適した関係性を特定します。
仕事内容
- 所在地、顧客、プロジェクト、サイトまたはプログラム、設備ユニット、期間、形式、完全性などの詳細を含め、過去のデータソースをカタログ化する。
- 繰り返し使用される記録形式の仕様を文書化し、代表的なファイルを添付する。
- 試験ファイルを標準化された表形式のテンプレートに変換し、指定されたステージング領域に配置する。
- 欠落情報、不完全または疑わしい分析結果、ファイル間の不整合を指摘するデータ品質レポートを作成する。
- データセットを調査し、潜在的な相関や関係性を見つける。
- 過去のデータで回答できる質問と回答できない質問を説明する実現可能性メモを作成する。
- 必要に応じて、旧フォルダー内のファイル名とタグを標準化する。
- 必要に応じて、文書管理システムへの移行に必要なメタデータを整理する。
- 必要に応じて、試験記録を関連する測定データセットと照合する。
応募要件
- コンピューターサイエンス、データサイエンス、統計学、工学、または関連分野の学位を取得中、または最近取得した方。
- Python と pandas、または同等のツールセットを使って表形式データを読み込み、クリーニングし、再構成できる。
- Excel ブック、CSV、PDF、不統一な命名や構造など、整理されていない実際のファイルを扱った実務経験。
- 几帳面で細部に注意を払い、欠落情報や未解決の不整合を記録することに前向きである。
- 定義済みのスキーマとテンプレートに基づいて自律的に作業し、ファイルが適合しない場合は確認を求められる。
- 優れた文章によるコミュニケーション能力。
- SQL、データカタログ、またはブロンズ・シルバー・ゴールド層などのデータレイク概念に関する知識。
- matplotlib、seaborn、Jupyter などのツールを使った基礎統計または探索的データ分析の経験。
- 鉱物処理、化学、または工業プロセスデータに関心がある方。業界経験は必須ではない。
- SharePoint または OneDrive を上級ユーザーとして扱える。
福利厚生
- 管理対象のノートパソコンまたは仮想デスクトップが提供される。
- 顧客の機密データを扱う職務のため、機密保持確認書への署名が必要。






