FluidStack
FluidStack
FluidStack stellt GPU-Supercomputing-Infrastruktur für KI-Labore und Unternehmen bereit. Die verwaltete Cloud-Plattform bietet bei Bedarf Zugriff auf umfangreiche Nvidia-GPU-Kapazitäten für das Training und die Inferenz von Modellen sowie Unterstützung bei der Bereitstellung und dem Betrieb von Clustern mit Technologien wie Kubernetes und Slurm. Durch die Verwaltung der zugrunde liegenden Hardware und Infrastruktur unterstützt FluidStack KI-Teams dabei, ihre Workloads zu skalieren und sich auf die Entwicklung von Modellen, die Leistung und die betriebliche Effizienz zu konzentrieren.

Software Engineer, Ontologie (vor Ort)

Entwickle Ontologie-, CMDB-, DCIM-, Observability- und Automatisierungssysteme für die KI-Cloud-Infrastruktur von FluidStack. Baue skalierbare Plattformen für Infrastrukturressourcen, Rechenzentrumsbetrieb und die globale Flottenverwaltung.

Beschreibung

  • Entwirf und implementiere eine CMDB der nächsten Generation als zentrale Quelle für Infrastrukturressourcen, Netzwerktopologie und Konfigurationsdaten
  • Entwickle DCIM-Software für Rack-Betrieb, die Bereitstellung von Servern und GPUs, Betriebssysteminstallationen, Qualitätssicherung und White-Screen-Abläufe
  • Erstelle Plattformen für den gesamten Lebenszyklus von Ressourcen – von Wareneingang, Rack-Einbau und Inventarisierung bis zu Reparatur und Ausmusterung
  • Entwickle Monitoring- und Observability-Systeme, die BMS-, EPMS- und Telemetriedaten von IT-Geräten mit intelligenter Alarmierung und Incident-Management verbinden
  • Baue Self-Service-Portale und Automatisierungen für den regionalen Bootstrap, den laufenden Betrieb und die Verwaltung der gesamten Flotte
  • Reduziere den manuellen Aufwand, indem du manuelle Prozesse durch Workflow-Automatisierung und Self-Service-Tools ersetzt
  • Implementiere Orchestrierungssysteme für Incident-, Problem- und Change-Management-Workflows
  • Erstelle Visualisierungen digitaler Zwillinge und operative Dashboards in Zusammenarbeit mit Datenteams
  • Entwickle Integrationsschichten zwischen internen Plattformen, Anbietern und externen Systemen
  • Arbeite mit Teams aus Rechenzentrumsbetrieb, Systemtechnik, Netzwerkengineering, Sicherheit, Produkt, Business, Support und Operations zusammen
  • Bewerte, ob Plattformkomponenten intern entwickelt oder zugekauft werden sollten
  • Förderere CI/CD, Infrastructure as Code, automatisierte Tests und einen Observability-First-Ansatz in der Entwicklung
  • Beteilige dich an Architektur-Reviews und technischen Designentscheidungen
  • Verbessere die Engineering-Qualität durch Code-Reviews, Dokumentation und Wissensaustausch
  • Entwirf robuste, leistungsstarke Systeme, die Tausende von Abfragen pro Sekunde verarbeiten können
  • Implementiere Monitoring, Logging, Debugging und umfassende Fehlerbehandlung
  • Plane Datenmigrationen und pflege Plattformabhängigkeiten
  • Leite Projekte vom ersten Konzept bis zur Bereitstellung und Produktionsreife

Anforderungen

  • Mindestens drei Jahre Berufserfahrung in der Entwicklung von Softwaresystemen für den Produktionseinsatz
  • Sehr gute Programmierkenntnisse in Python, Go oder einer vergleichbaren Sprache
  • Gute Kenntnisse in Mustern des Systemdesigns
  • Erfahrung mit dem Entwurf von REST-APIs, Datenmodellen und verteilten Systemen
  • Sicherer Umgang mit relationalen und NoSQL-Datenbanken, einschließlich PostgreSQL und Redis
  • Praktische Erfahrung mit Docker und Infrastructure-as-Code-Tools wie Terraform und Ansible
  • Verständnis von CI/CD-Pipelines und zeitgemäßen Praktiken der Softwareentwicklung
  • Sehr gute Kenntnisse in TCP/IP, DNS, HTTP und Linux- oder Unix-Umgebungen
  • Nachweisbare Problemlösungskompetenz mit Fokus auf Skalierbarkeit, Zuverlässigkeit und betriebliche Anforderungen
  • Klare Kommunikation im Umgang mit technischen und nichttechnischen Stakeholdern
  • Erfahrung mit CMDB-Produkten wie NetBox oder Device42 oder mit Asset-Management-Plattformen
  • Erfahrung in Infrastrukturautomatisierung, DevOps oder Platform Engineering
  • Vertrautheit mit Workflow-Orchestrierungstools wie Temporal, Airflow oder Camunda
  • Kenntnisse in Monitoring- und Observability-Technologien wie Prometheus, Grafana oder OpenTelemetry
  • Erfahrung mit Zeitreihendatenbanken und Datenvisualisierung
  • Verständnis von ITSM-Frameworks wie ITIL und Service-Management-Praktiken
  • Erfahrung mit Rechenzentrumsbetrieb, Facility Management oder physischer Infrastruktur
  • Beiträge zu Open-Source-Infrastrukturprojekten
  • Bachelorabschluss in Informatik oder gleichwertige praktische Erfahrung
  • Die Anforderungen an eine US-Arbeitsgenehmigung werden im Bewerbungsprozess besprochen

Zusatzleistungen

  • Für alle Vollzeitstellen ist eine Beteiligung möglich, die Restricted Stock Units umfassen kann
  • Altersvorsorge- oder Pensionsleistungen werden entsprechend den lokalen Gegebenheiten angeboten
  • Kranken-, Zahn- und Augenversicherung
  • Großzügiger bezahlter Urlaub gemäß den lokalen Gegebenheiten
  • Wettbewerbsfähiges Gesamtvergütungspaket
  • Engagement für Lohngleichheit und Transparenz

Ähnliche Stellen

EY

KI-Softwareingenieur:in für Financial Advisory

EY

Entwickle und implementiere GenAI-, LLM- und MLOps-Lösungen für EY-Kund:innen im Financial Advisory in Nahost und Nordafrika. Trage zur KI-Strategie, zur Umsetzung produktiver Lösungen und zur Geschäftsentwicklung bei.

Öffnen
Maxibook OÜ

Mitwirkende für Wissenschaftssprache und KI-Adaption

Maxibook OÜ

Unterstütze das KI-Bildungs-Startup Maxibook dabei, englische wissenschaftliche Inhalte für ein koreanisch-, japanisch- oder arabischsprachiges Publikum anzupassen. Prüfe KI-generierte Inhalte auf fachliche Genauigkeit, natürliche Sprache und akademische Glaubwürdigkeit.

Öffnen
ZACO Robot

B2B Sales Setter für gewerbliche Reinigungsrobotik

ZACO Robot
11 – 50 Mitarbeitende
BauwesenBeratungLogistik

Du qualifizierst Leads und vereinbarst Verkaufsgespräche für die professionellen Reinigungsroboter von RV-Tech – im Remote-Vertrieb an geschäftliche Entscheidungsträger. Im Mittelpunkt stehen Automatisierung und Robotik in einem wachsenden Gewerbemarkt.

Öffnen
Prospeum

Sales Engineer und technischer Berater

Prospeum

Konfiguriere Prospeums KI-gestützte Beschaffungsplattform und entwickle Proofs of Concept für Unternehmen. Leite technische Demos, Integrationen und Kundenworkshops, um komplexe Vertriebsprozesse zu unterstützen.

Öffnen
MMG Management Consulting

Strategische Beschaffungsberaterin / Strategischer Beschaffungsberater

MMG Management Consulting
11 – 50 Mitarbeitende
BankwesenBeratungVersicherungen

Steuern Sie Lieferantenauswahl, Verhandlungen und Beschaffungsinitiativen für Kunden einer spezialisierten Managementberatung. Arbeiten Sie mit verschiedenen Anspruchsgruppen an Beschaffungsstrategien, Prozessen und Werkzeugen.

Öffnen
SUXXEED Sales for your Success GmbH

Werkstudent AI Engineer

SUXXEED Sales for your Success GmbH
201 – 500 Mitarbeitende
B2BBeratung

Werde Teil des KI-Teams von SUXXEED und entwickle praktische KI-Anwendungen und Automatisierungen für einen B2B-Vertriebsspezialisten. Arbeite in einer hybriden Rolle mit Kolleginnen und Kollegen aus KI, IT und den Fachbereichen zusammen.

Öffnen
Peraton

Senior Engineer für hybride Konnektivität

Peraton

Entwirft und behebt Störungen bei Verbindungen zwischen klassifizierten AWS-Clouds, Kubernetes und lokalen Netzwerken. Unterstützt Peratons Aufgaben in den Bereichen nationale Sicherheit und Regierungstechnologie.

Öffnen