Citi
Citi
Citi es una empresa global de banca y servicios financieros que atiende a consumidores, corporaciones, gobiernos e instituciones. Su oferta abarca la banca minorista, las tarjetas de crédito, la gestión patrimonial, la banca corporativa y la banca de inversión, respaldadas por operaciones en más de 100 países. Como una gran organización financiera internacional, Citi reúne equipos que trabajan en los sectores de la banca, los servicios financieros y la tecnología financiera.

Ingeniero de Big Data – Python, PySpark y Databricks | Citi | Pune híbrido

Desarrolla y brinda soporte a canalizaciones de datos a gran escala con Python, PySpark y Databricks para la infraestructura global de datos financieros de Citi. Trabaja con Hadoop, Tableau, Linux y la entrega de soluciones analíticas empresariales.

Descripción

  • Desarrollar y mantener canalizaciones escalables en Python y PySpark que procesen datos estructurados y no estructurados en plataformas distribuidas
  • Diseñar y mejorar flujos de trabajo basados en Hadoop, incluidos HDFS y Hive, para proporcionar datos fiables para informes y análisis
  • Preparar evaluaciones de viabilidad, estimaciones de entrega y planes técnicos para iniciativas de ingeniería de datos en distintas áreas del negocio
  • Supervisar el ciclo de vida de las aplicaciones de datos, desde el análisis y el diseño hasta las pruebas, la implementación y el soporte en producción
  • Colaborar con los equipos de análisis e informes para desarrollar paneles de Tableau y convertir los datos de origen en información empresarial útil
  • Administrar y solucionar problemas de procesos de datos basados en Linux para mantener la estabilidad, el rendimiento y la continuidad operativa de los sistemas
  • Evaluar los riesgos de entrega y alinear las soluciones de ingeniería de datos con los requisitos de seguridad, gobierno y cumplimiento

Requisitos

  • Aportar entre 5 y 8 años de experiencia en ingeniería de datos, desarrollo de big data o desarrollo de aplicaciones de software centrado en plataformas de datos a gran escala
  • Demostrar experiencia práctica en el desarrollo con Python y PySpark para la ingesta, transformación y orquestación de canalizaciones a gran escala
  • Tener conocimientos expertos de ETL, Oracle Database y SQL
  • Tener conocimientos prácticos de Databricks
  • Comprender las tecnologías del ecosistema Hadoop, como HDFS, Hive y las operaciones de clústeres, incluida la familiaridad con el almacenamiento Ozone
  • Trabajar eficazmente en entornos Linux mediante scripting, programación de trabajos y gestión de procesos
  • Tener experiencia creando o dando soporte a paneles e informes de Tableau
  • Estar familiarizado con RStudio para análisis estadístico o exploración de datos en contextos de ingeniería de datos
  • Aportar conocimientos profundos sobre modelos de lenguaje grandes, incluidos OpenAI, Gemini, Claude, Llama y modelos locales o de código abierto
  • Tener una licenciatura o experiencia equivalente en un campo técnico relevante
  • Tener experiencia gestionando y entregando proyectos exitosos
  • Comprender las técnicas y los métodos de consultoría y gestión de proyectos
  • Poder trabajar bajo presión cumpliendo los plazos y adaptándose a cambios inesperados en los requisitos o las expectativas
  • Tener experiencia con plataformas de datos nativas de la nube o en la migración de cargas de trabajo desde entornos Hadoop locales a plataformas de datos modernas
  • Comprender los marcos de gobierno de datos, gestión de metadatos o calidad de datos utilizados en entornos a gran escala
  • Estar familiarizado con los métodos de consultoría o gestión de proyectos utilizados en la entrega de tecnología

Beneficios

  • Horario híbrido con dos días en la oficina y tres días de trabajo remoto
  • Recursos continuos de aprendizaje y desarrollo profesional
  • Autonomía para tomar decisiones técnicas con supervisión directa limitada, incluida la posibilidad de actuar como especialista para altos responsables
  • Oportunidades definidas de progresión profesional dentro de la organización tecnológica global de Citi
  • Apoyo al bienestar financiero y beneficios adaptados a la ubicación y al nivel

Empleos relacionados

Innovatrics

Ingeniero sénior de entrega de soluciones – Soluciones biométricas, Marruecos híbrido

Innovatrics

Lidera el diseño, la migración y la entrega de soluciones biométricas de Innovatrics para clientes de identidad, fronteras, justicia y empresas. Este puesto híbrido en Marruecos combina ingeniería, formación de clientes e implementación técnica.

Abrir
Mindrift

Ingeniero sénior de scraping web con Python - Remoto en Brasil

Mindrift

Ingeniero sénior de Python responsable de realizar scraping web fiable, validar datos y entregar conjuntos de datos estructurados para los proyectos de tecnología de IA de Mindrift. El puesto abarca sitios web dinámicos, sistemas antibots, infraestructura en la nube y herramientas de automatización basadas en LLM.

Abrir
Mindrift

Ingeniero sénior de scraping de datos en Python — Freelance, remoto desde Polonia

Mindrift

Mindrift busca un ingeniero sénior de Python para crear flujos de trabajo fiables de scraping web para proyectos de IA. El puesto se centra en extraer, validar y procesar datos estructurados de sitios web complejos y dinámicos.

Abrir
Mindrift

Ingeniero sénior de scraping de datos con Python — remoto en Rumanía

Mindrift

Ingeniero sénior de Python responsable de crear flujos fiables de scraping web y procesamiento de datos para el proyecto Tendem AI de Mindrift. El puesto se centra en extraer, validar y escalar conjuntos de datos estructurados de sitios web complejos.

Abrir
Hewlett Packard Enterprise

Desarrollador de materiales didácticos de Aruba (remoto desde México)

Hewlett Packard Enterprise

Desarrolla materiales didácticos y contenidos técnicos dirigidos a clientes para los productos HPE Aruba Networking. Convierte tecnologías complejas de nube, automatización y redes en materiales prácticos para clientes.

Abrir
Hewlett Packard Enterprise

Desarrollador de materiales formativos de Aruba - remoto en México

Hewlett Packard Enterprise

Desarrolla materiales formativos técnicos y contenido de aprendizaje para clientes sobre los productos de nube, automatización y gestión de HPE Networking. Convierte conceptos complejos de redes en materiales claros y prácticos para los clientes.

Abrir
Hewlett Packard Enterprise

Desarrollador de cursos de Aruba – remoto en México

Hewlett Packard Enterprise

Desarrolla cursos y contenido técnico centrados en el cliente para los productos de nube, automatización y gestión de HPE Aruba Networking. Convierte tecnologías de redes complejas en documentación y materiales de aprendizaje prácticos.

Abrir
Hewlett Packard Enterprise

Desarrollador de materiales didácticos de Aruba - Remoto en México

Hewlett Packard Enterprise

Desarrolla materiales didácticos y documentación técnica para clientes sobre productos HPE Aruba Networking. Convierte conceptos complejos de la nube, la automatización y la gestión de redes en contenidos de aprendizaje claros.

Abrir
Ellison Institute of Technology Oxford

Ingeniero/a de Datos, Sistemas Autónomos — Oxford híbrido

Ellison Institute of Technology Oxford

Construye infraestructura de datos del extremo a la nube para laboratorios científicos autónomos en el Ellison Institute of Technology Oxford. Trabaja con telemetría robótica, grafos de conocimiento y conjuntos de datos preparados para aprendizaje automático.

Abrir