Rehire
Rehire
Rehire ist ein Unternehmen für Personalvermittlung und HR-Technologie, das Arbeitgeber dabei unterstützt, geprüfte Fachkräfte über flexible Personaldienstleistungen und Headhunting zu gewinnen. Das Angebot umfasst gezielte Führungskräfte-Suchen und Match Staffing, ergänzt durch die Kandidatensuche, strukturierte Vorstellungsgespräche, technische Assessments, Onboarding, Employer Branding, Recruiting-Analysen und ATS-Integrationen. Rehire nutzt KI-gestützte Recherche und automatisierte Vorauswahl, damit Unternehmen geeignete Kandidatinnen und Kandidaten effizient identifizieren können. Das Abonnementmodell berechnet Gebühren pro aktiver Stelle und verzichtet auf Vermittlungsgebühren. Das Onboarding kann in etwa 48 Stunden abgeschlossen werden, während der Datenschutz den gesamten Einstellungsprozess über berücksichtigt wird.

Junior-SRE-Ingenieur (vor Ort, Mexiko)

Unterstütze Rehire als Junior-SRE-Ingenieur bei der AWS-Zuverlässigkeit einer regulierten Finanzdienstleistungsplattform. Automatisiere Observability, Incident Response und KI-gestützte Produktionsabläufe.

Beschreibung

  • Unterstütze die Incident Response als Beobachter oder sekundärer Responder mithilfe KI-basierter Tools zur Erkennung, Korrelation und Ursachenanalyse.
  • Erstelle Incident-Zeitabläufe aus Metriken, Logs, Traces und der Deployment-Historie.
  • Dokumentiere Postmortems und verfolge Korrekturmaßnahmen bis zu ihrem Abschluss.
  • Betreibe und überwache KI-SRE-Subagenten für Incident-Zusammenfassungen, die Erkennung von Monitoring-Lücken und die Zuordnung der Nutzung.
  • Erstelle und pflege Datadog-Monitorings, Dashboards und mit Terraform verwaltete SLO-Definitionen.
  • Unterstütze SLI-, SLO- und Error-Budget-Überprüfungen für wichtige Customer Journeys.
  • Reduziere die Alarmflut durch KI-/ML-gestützte Erkennung und regelmäßige Überprüfungen der Monitoring-Qualität.
  • Unterstütze die Zuverlässigkeit von AWS-Workloads in ECS/Fargate, EKS, Lambda, RDS/Aurora, ALB, SQS/SNS und Step Functions.
  • Erkenne Anomalien bei Kapazität, Auslastung und Cloud-Kosten und ordne Ausgaben sowie Telemetrievolumen den verantwortlichen Teams und Services zu.
  • Entwickle Automatisierungen in Python und Bash unter Verwendung der APIs von Datadog, AWS, GitHub, PagerDuty und Jira.
  • Reiche Beiträge zu Terraform-Modulen über Pull Requests ein.
  • Integriere Zuverlässigkeitskontrollen und KI-gestützte Prüfungen in CI/CD-Pipelines.
  • Entwickle Runbooks mit dem Ziel einer schrittweisen Automatisierung zur Selbstheilung.
  • Beteilige dich an Architektur-, Zuverlässigkeits- und KI-Risikobewertungen.
  • Baue Wissen darüber auf, wie PCI-DSS-, SOC-2-, SOX- und GLBA-Anforderungen in einem regulierten Umfeld angewendet werden.

Anforderungen

  • Bachelorabschluss in Informatik, Ingenieurwesen oder einer verwandten Fachrichtung.
  • Ein bis drei Jahre Berufserfahrung in SRE, DevOps, Cloud-Infrastruktur, Plattform- oder Produktionssupport-Engineering.
  • Sehr gute mündliche und schriftliche Englischkenntnisse sind erforderlich.
  • Praktische Erfahrung mit AWS oder einem anderen großen Cloud-Anbieter in den Bereichen Computing, Netzwerke, Speicher und verwaltete Datenbanken.
  • Erfahrung mit mindestens einer Observability-Plattform; Datadog wird bevorzugt, relevant sind auch Grafana/Prometheus, New Relic, CloudWatch und ELK/OpenSearch.
  • Grundverständnis von SLI-, SLO- und Error-Budget-Praktiken.
  • Praktische Kenntnisse in Containern und Orchestrierung, etwa Docker, ECS oder Kubernetes, sowie in serverlosen Ausführungsmodellen.
  • Grundlegende bis fortgeschrittene Erfahrung mit Infrastructure as Code; Terraform wird bevorzugt, auch Ansible oder CloudFormation sind geeignet.
  • Erfahrung mit Skripterstellung in Python, Bash oder einer ähnlichen Sprache, einschließlich der Nutzung von REST-APIs und der Verarbeitung von JSON.
  • Grundlegende Linux-Fehlerbehebung und Netzwerkgrundlagen zu DNS, TLS, Load Balancing, Timeouts und Retries.
  • Sicherer Umgang mit Git, Pull-Request-Prozessen und CI/CD-Plattformen wie GitHub Actions, Jenkins, GitLab CI oder ArgoCD.
  • Vertrautheit mit Incident-Management und Bereitschaftsdiensten, einschließlich Schweregradmodellen, Eskalationsrichtlinien sowie PagerDuty oder Opsgenie.
  • Erfahrung in produktnahen Engineering-Dienstleistungen, Unternehmenssoftware oder Fintech ist von Vorteil.
  • Kenntnisse der Compliance-Rahmenwerke PCI-DSS, SOC 2, SOX oder GLBA sind von Vorteil.
  • Bevorzugte, aber nicht zwingend erforderliche Zertifizierungen sind AWS Cloud Practitioner oder eine Zertifizierung auf Associate-Niveau, Terraform Associate, Datadog Fundamentals oder eine gleichwertige Zertifizierung, CKA oder KCNA.

Zusatzleistungen

  • Wettbewerbsfähiges Gehalt in USD.
  • Praxisnahe Weiterentwicklung im Bereich KI-gestützter SRE-Praktiken mit Möglichkeiten zur beruflichen Weiterentwicklung.
  • Dynamisches und kollaboratives Arbeitsumfeld.

Ähnliche Stellen

My Hero VA

Zweisprachige Person für Terminvereinbarung (remote, Kolumbien)

My Hero VA
1 – 10 Mitarbeitende
BeratungLogistikMarketing

Führen Sie ausgehende Anrufe auf Englisch und Spanisch, um Besuche an einer Schule eines Barbier-Ausbildungsunternehmens in Florida zu vereinbaren. Die Remote-Stelle in Kolumbien umfasst auch die Nachverfolgung von Interessenten und tägliche Verwaltungsaufgaben.

Öffnen