AWISEE
AWISEE
11 – 50 Mitarbeitende
E-CommerceMarketingSaaS
AWISEE ist eine europäische Digitalmarketing- und SEO-Agentur mit Schwerpunkt auf internationalem Linkaufbau, Digital PR sowie Influencer- und KOL-Marketing. Das vollständig remote arbeitende Team bietet manuelle Ansprache und White-Label-Linkaufbau für Unternehmen und Agenturen. Dafür nutzt es ein Publisher-Netzwerk, das Europa, Lateinamerika, den asiatisch-pazifischen Raum, Nordamerika und weitere Regionen abdeckt. Die maßgeschneiderten SEO-Leistungen richten sich an Kunden aus Bereichen wie SaaS, E-Commerce, iGaming, Kryptowährungen und Fintech.

Senior Data Infrastructure Engineer für Web Scraping

Aufbau von Scraping-Clustern zur Bot-Erkennung und leistungsstarken Datenpipelines für ein Social-Media-Datenlabor. Entwicklung skalierbarer Speicher- und Datensysteme für KI-Modelle.

Beschreibung

  • Entwickle und betreibe die Ingestion-Engine für das Social-Media-Datenlabor.
  • Baue und betreibe unauffällige Scraping-Cluster mit Residential-Proxys, TLS-Fingerprinting, Browserfarmen und Sitzungsrotation.
  • Erstelle robuste, skalierbare Scraping-Pipelines für Instagram, TikTok, YouTube, X und weitere Webquellen.
  • Entwirf verteilte Warteschlangen und Workflow-Engines, die täglich Millionen asynchroner Scraping-Aufgaben bewältigen.
  • Konzipiere strukturierte und unstrukturierte Speicherlösungen für nachgelagerte KI-Modellierung.
  • Richte automatische Warnmeldungen zu Änderungen an Plattformoberflächen und APIs, Blockierungsmustern und Proxy-Ausfällen ein.
  • Stelle täglich Millionen von Profil-, Beitrags- und Videodatensätzen bei nahezu durchgehender Verfügbarkeit bereit.

Anforderungen

  • Mindestens vier Jahre Erfahrung mit Web Scraping in großem Umfang, Data Engineering oder Reverse Engineering.
  • Fundierte Erfahrung beim Umgehen fortgeschrittener Anti-Bot-Dienste wie Cloudflare, Akamai und PerimeterX mit TLS-Impersonation, Browserautomatisierung und Proxy-Verwaltung.
  • Sehr gute Kenntnisse in Python oder Go.
  • Umfassende Kenntnisse in Playwright, Puppeteer, Scrapy oder Selenium.
  • Erfahrung mit verteilten Systemen und Aufgabenwarteschlangen wie Temporal, Ray, Kafka und Redis.
  • Sehr gute SQL-Kenntnisse.
  • Erfahrung mit modernen analytischen Data Lakes oder Data Warehouses.
  • Von Vorteil: Erfahrung beim Extrahieren von Kurzvideos und Nutzer-Metadaten aus TikTok, Instagram und YouTube.
  • Von Vorteil: Erfahrung mit der direkten Übermittlung von Scraping-Ergebnissen an Vektordatenbanken und Echtzeit-Warteschlangen für KI-Verarbeitung.

Zusatzleistungen

  • Remote-Arbeitsmodell.

Ähnliche Stellen

Terumo Medical Corporation

Regionalmanager Vertrieb für Terumo Interventional Systems

Terumo Medical Corporation

Leiten Sie den Vertrieb medizinischer Produkte in einer Region im Norden von Zentral-New-Jersey und verantworten Sie Außendienstteams sowie die Beziehungen zu Krankenhäusern. Steigern Sie den regionalen Umsatz und die Vertriebsleistung und sorgen Sie für eine regelkonforme Vermarktung der Produkte von Terumo Interventional Systems.

Öffnen
Claroty

QA-Automatisierungsingenieur

Claroty

Entwickle API- und UI-Automatisierungen sowie Qualitätsprüfungen in CI/CD-Pipelines für Clarotys Plattform für die Sicherheit cyberphysischer Systeme. Mit zuverlässigen Tests trägst du zum Schutz kritischer Infrastrukturen bei.

Öffnen