Mindrift
Mindrift
Mindrift es un mercado de talento especializado en inteligencia artificial y una plataforma SaaS que conecta a colaboradores profesionales y expertos en distintas áreas con proyectos de entrenamiento y evaluación de IA de empresas tecnológicas. Como parte de Toloka, trabaja con redactores, editores, especialistas en control de calidad, científicos y otros expertos en la materia que ayudan a generar datos de entrenamiento, evaluar la seguridad y el razonamiento de los modelos, valorar la calidad de los contenidos multimedia y crear escenarios del mundo real para mejorar el rendimiento y la fiabilidad de la IA. Mindrift selecciona y verifica a los colaboradores mediante evaluaciones y comprobación de identidad, y luego ofrece oportunidades flexibles de proyectos remunerados relacionados con el entrenamiento y la evaluación de IA.

Ingeniero sénior de web scraping con Python – Freelance remoto

Desarrolla flujos fiables de web scraping y procesamiento de datos con Python para los proyectos de IA de Mindrift. Extrae, valida y escala conjuntos de datos estructurados de sitios web complejos y dinámicos.

Descripción

  • Gestiona flujos de extracción de principio a fin en sitios web complejos y entrega conjuntos de datos completos, precisos y estructurados
  • Utiliza las herramientas disponibles y flujos de trabajo personalizados para acelerar la recopilación y validación de datos, así como la ejecución de tareas conforme a requisitos definidos
  • Adapta los métodos de extracción para contenido renderizado con JavaScript, fuentes interactivas y cambios en el comportamiento de los sitios web
  • Aplica validaciones, comprobaciones entre fuentes, controles de formato y verificaciones sistemáticas para mantener la calidad de los datos
  • Escala el scraping de grandes conjuntos de datos mediante procesamiento eficiente por lotes o en paralelo
  • Supervisa los fallos de extracción y mantiene la estabilidad ante cambios menores en la estructura de los sitios
  • Aplica experiencia en web scraping, extracción y procesamiento de datos con herramientas como Apify, OpenRouter y tecnologías relacionadas

Requisitos

  • Más de 5 años de experiencia relevante en ingeniería de datos, web scraping, automatización o desarrollo de software
  • Se valorará una licenciatura o máster en Ingeniería, Matemáticas Aplicadas, Informática u otro campo técnico relacionado
  • Sólida base técnica con experiencia práctica en scripting, automatización y flujos de extracción de datos
  • Amplia experiencia en scraping con Python y BeautifulSoup, Selenium o herramientas similares, incluyendo JavaScript, AJAX, desplazamiento infinito y API basadas en proxies
  • Capacidad para extraer datos de jerarquías complejas, páginas archivadas y estructuras HTML inconsistentes
  • Experiencia en limpiar, normalizar y validar conjuntos de datos estructurados en CSV, JSON o Google Sheets
  • Experiencia gestionando mecanismos antibots y estructuras de sitios cambiantes a escala
  • Experiencia práctica con AWS o infraestructura en la nube equivalente y contenedorización con Docker
  • Experiencia práctica aplicando LangChain, OpenRouter u otros frameworks de LLM a tareas de automatización
  • Gran atención al detalle y firme compromiso con la precisión de los datos
  • Enfoque autónomo y capacidad para resolver problemas de forma independiente
  • Nivel de inglés intermedio alto (B2) o superior
  • Se valorará incluir un enlace a GitHub

Beneficios

  • Colaboración freelance
  • Trabajo remoto a tiempo parcial
  • Aproximadamente 10–20 horas semanales durante las fases activas de los proyectos

Empleos relacionados

FHI 360

Director asociado de Compras, Administración y Logística

FHI 360

Dirige las áreas de compras, administración, logística y operaciones de la oficina nacional de FHI 360 en la República Democrática del Congo. Supervisa a los responsables funcionales y vela por el cumplimiento de los requisitos de los donantes, el gobierno y la cadena de suministro.

Abrir
CaixaBank

Científico de datos de riesgo operacional

CaixaBank

Únete a CaixaBank como científico de datos de riesgo operacional y crea modelos predictivos para estimar pérdidas y evaluar su impacto en la organización. El puesto incluye analítica avanzada y la migración de procesos a Google Cloud.

Abrir
CaixaBank

Científico de datos de riesgo operacional

CaixaBank

Desarrolla modelos predictivos y procesos de datos en Google Cloud para apoyar la gestión del riesgo operacional de CaixaBank. Contribuye a la estimación de pérdidas, la elaboración de informes y la mitigación de riesgos, desde Madrid o Barcelona.

Abrir
AlphaSys

Especialista sénior en migración de datos de Salesforce

AlphaSys

Lidera migraciones integrales de datos a Salesforce para organizaciones sin ánimo de lucro y benéficas de Australia, desde la estrategia y los procesos ETL hasta las pruebas y la puesta en producción. El puesto combina conocimientos de SQL e ingeniería de datos con talleres para clientes, liderazgo de equipos y gestión de proyectos.

Abrir
Expivia Interaction Marketing Group Inc.

Representante de atención al cliente en un centro de llamadas de salud

Expivia Interaction Marketing Group Inc.
201 – 500 Empleados
ConsultoríaLogísticaMarketing

Ayuda a los afiliados con cuentas de ahorro para gastos médicos y cuentas de beneficios por teléfono, chat y correo electrónico. El puesto incluye tres semanas de formación presencial remunerada en Erie, Pensilvania, antes de pasar a un horario híbrido.

Abrir