Team Lead - Site Reliability Engineering (all genders)
Career Integrity & Compliance Audit Report
This vacancy has been independently reviewed by the OppaJob Transatlantic Career Intelligence Desk to confirm authentic direct employer recruiting, verify compensation transparency, and eliminate applicant processing fees.
Transatlantic Cost of Living & Purchasing Power Benchmark
Compare US ($) vs UK (£) Salary & Net Take-Home Pay
Calculate tax deductions, living costs, and purchasing power parity across US & UK metros.
Position Overview & Specifications
FACT-Finder entwickelt Product-Discovery-Technologie für den eCommerce und ist mit den Produkten Next Generation und Infinity bei führenden Online-Shops in Europa im Einsatz. Aktuell modernisieren wir unser Hosting konsequent in Richtung Kubernetes auf Harvester – als on-prem Hybrid mit der Option, mittelfristig vollständig in die Cloud zu skalieren. Als Team Lead Site Reliability Engineering (all genders) verantwortest du Reliability, Skalierbarkeit und Kosten unserer Hosting-Umgebungen, treibst diese Transformation end-to-end voran und führst das Team, das sie umsetzt.
Deine Aufgaben- Du verantwortest die operative Gesundheit unseres Hostings über On-Premise (Frankfurt, Stockholm) und Cloud hinweg – Verfügbarkeit, Performance, Incident Management.
- Du treibst die Modernisierung in Richtung Kubernetes auf Harvester aktiv voran: Cluster-Topologie, Storage (Longhorn), Networking (VLAN, Load Balancing, Ingress), Backup und Disaster Recovery.
- Du baust eine produktionsreife k8s-Plattform auf: Lifecycle, Upgrades, RBAC, Secrets, GitOps (Argo CD / Flux), Observability und Policy-Guardrails.
- Du gestaltest den NG Search Operator (Custom Kubernetes Operator) und löst Auto-Scaling (HPA, VPA, KEDA, Cluster Autoscaler) für die aktuelle Architektur.
- Du definierst unser On-Prem-Hybrid-Modell konkret: welche Workloads laufen wo, wie burst’en wir in die Cloud, wie halten wir Latenz und Kosten im Griff – und hältst die Architektur portabel genug für einen späteren Cloud-Only-Schritt.
- Du verantwortest Kapazitätsplanung und Hosting-Kosten und machst Kosten zu einem gezielt steuerbaren Hebel.
- Du führst und entwickelst unser derzeit 4-köpfiges Hosting-Team fachlich und disziplinarisch, verantwortest Performance und prägst die technische Standards- und Ownership-Kultur.
- Du machst AI zum festen Bestandteil unserer Operations: Diagnose, Automatisierung, Monitoring und Insight.
- Fundierter Hintergrund in Infrastructure oder Platform Engineering über On-Premise und Cloud hinweg.
- Hands-on Tiefe mit Kubernetes in Produktion: Cluster-Lifecycle, Upgrades, Networking, Storage, RBAC, Observability, GitOps-Delivery.
- Nachweislich starke Führungserfahrung, exzellente Kommunikation und Stakeholder-Management.
- Idealerweise praktische Erfahrung mit Harvester oder vergleichbaren HCI-/Virtualisierungsplattformen (KubeVirt, vSphere/ESXi, OpenStack).
- Erfahrung mit einer echten Migration von Bare Metal / klassischen VMs auf eine k8s-basierte Plattform – inklusive stateful Workloads, Storage-Migration, Cutover und Rollback.
- Sicherer Umgang mit Kubernetes Operators (Custom Controllers / CRDs), idealerweise für stateful Systeme wie Search, Datenbanken oder Streaming.
- Solides Verständnis von Auto-Scaling-Primitiven (HPA, VPA, Cluster Autoscaler, KEDA) und deren Zusammenspiel mit Kapazitätsplanung.
- Erfahrung mit On-Prem-Hybrid-Architekturen und der Verantwortung für Reliability, Kapazität und Kosten produktiver Systeme.
- Hands-on Fluency im Einsatz von AI-Tools im operativen Betrieb.
- Sehr gute Englischkenntnisse; Deutsch von Vorteil.
- Impact from day one: Deine Arbeit wirkt direkt auf die Umsätze führender eCommerce-Marken in Europa.
- Führungsrolle mit Gestaltungsspielraum: Du führst ein eingespieltes Team und gestaltest unsere Plattform in einer entscheidenden Phase unserer Transformation.
- Moderner Tech-Stack: Kubernetes, Harvester, GitOps, Auto-Scaling und ein spannender Weg in Richtung Cloud – mit Raum, Dinge neu und richtig zu bauen.
- AI-first Mindset: Wir nutzen AI nicht als Buzzword, sondern als festen Bestandteil unserer täglichen Arbeit.
- Ownership & Wachstum: Klare Verantwortung, kurze Entscheidungswege und die Möglichkeit, deine Rolle aktiv mitzugestalten.
- Flexibles Arbeiten: Hybrides Arbeitsmodell mit Fokus auf Ergebnisse.
- Starkes Team: Erfahrene Engineers, offene Feedback-Kultur und ein Umfeld, in dem Reliability als Engineering-Disziplin ernst genommen wird.
- Attraktive Benefits: Wettbewerbsfähiges Gehalt, moderne Ausstattung, Weiterbildungsbudget und regelmäßige Team-Events.
Berlin, München, Pforzheim oder Stockholm (hybrid)
Find Jobs in Germany on Arbeitnow
Candidate Selection & Onboarding Process
Application & Resume Screening
Submit your tailored CV/Resume directly to the talent acquisition portal.
Technical & Competency Interviews
Virtual interviews with the hiring manager and multidisciplinary team.
Formal Offer & Benefits Negotiation
Written agreement outlining compensation, equity, retirement vesting, and relocation allowances.
Onboarding & Corporate Integration
Equipment provisioning, team orientation, and commencement of duties.
United States Work Authorization & Sponsorship Guide
Under United States immigration law (INA § 101(a)(15)(H)), foreign nationals seeking full-time professional positions typically navigate either non-immigrant specialty occupation classifications or immigrant visa sponsorship:
Requires a relevant Bachelor's degree or higher. Employers must file an approved Labor Condition Application (LCA) with the US Department of Labor confirming the prevailing wage rate.
Canadian and Mexican citizens qualify under USMCA (TN status). F-1 STEM graduates benefit from 36-month aggregate work authorization through E-Verify enrolled employers.
Candidate Preparation Blueprint: Technology
Based on transatlantic hiring benchmarks for Team Lead - Site Reliability Engineering (all genders) roles across FactFinder's corporate sector, successful applicants typically excel across three core dimensions:
Demonstrated portfolio evidence, architecture/system design case studies, or validated professional certifications directly applicable to Technology.
STAR method competency responses highlighting cross-functional leadership, conflict resolution, and delivering measurable enterprise ROI under tight timelines.
Total compensation expectation aligned within the benchmarked Salary Disclosed on Application bracket, including retirement vesting and health parity.
Explore Related Opportunities (Germany)
Other high-paying verified positions matching your industry profile.
Senior Full Stack Cloud Architect (AI Platform)
Critical Care & ICU Registered Nurse (RN)
Director of Corporate Operations & Strategy
Staff Machine Learning & LLM Systems Engineer
Apply for this Position
Receive high-paying Technology openings directly to your inbox.