Skip to main content
smartclip

Site Reliability Engineer (f/m/d) – Observability & Internal Tools

RemoteGermany only
Published
Role
Fullstack
Experience
Mid
Employment
Full-time
Salary not disclosed
Check eligibility

Open to DE only. Set where you work from to check your eligibility.

No BS summary

Wir suchen einen SRE, der unseren Observability-Stack (Prometheus, Grafana, Forgejo) zu einer Plattform ausbaut, Open-Source-Alternativen evaluiert, Security Engineering in die Pipeline integriert und Linux-Systeme beherrscht. Remote-Fokus, On-site in Berlin oder Köln wenn nötig. Bewerbung mit Portfolio oder Side-Project schlägt CV.

Core skills

Observability implementationMetrics, logs, tracesLinux systems engineering

Required skills

PrometheusGrafanaForgejoLinuxDistributed systemsAutomation/infrastructure-as-codeMetricsLogsTracesObservability/Prometheus, Grafana, ForgejoSystems Engineering/Linux, distributed systemsAutomation/Code-based infrastructure

Optional skills

GCPAWSOpen-source community engagementSelf-hosted projectsBlameless post-mortemsRoot-cause analysis

Required languages

German unknown

What you'll do

  • Übernimm die Verantwortung als Hüter und Architekt der internen Infrastruktur von smartclip – Entwickle Observability und Automatisierung zu einer echten Plattformfähigkeit, die jeden anderen Engineer im Unternehmen unterstützt und produktiver macht.
  • Übernimm Verantwortung für unseren Observability-Stack: Treibe Prometheus, Grafana und Forgejo voran. Verwalte diese Tools nicht einfach – entwickle sie zu einem Monitoring-Ökosystem auf höchstem Niveau weiter.
  • Entwickle auf Zuverlässigkeit: Entwirf aussagekräftige und handlungsorientierte Alerts und definiere SLOs, die uns vom reaktiven ‘Feuerlöschen’ hin zu proaktiver Stabilität bringen.
  • Treibe Open Source voran: Evaluiere und implementiere moderne Open-Source-Alternativen zu proprietärer Software. Entscheide mit, welche Technologien in unseren Stack aufgenommen werden und wie sie sich integrieren lassen.
  • Sichere unsere Delivery-Pipeline: Integriere Security Engineering direkt in unseren Entwicklungs- und Auslieferungsprozess. Identifiziere Schwachstellen, bevor es der Penetrationstest tut.
  • Beherrsche die Infrastruktur: Tauche tief in Linux-Systeme und verteilte Tools ein. Verbinde mutiges Experimentieren mit einer absolut stabilen Produktionsumgebung.

What they require

  • Observability: nachweisbare Erfahrung mit der Implementierung von Metrics, Logs und Traces; verstehen, wie man aus großen Datenmengen konkrete, verwertbare Erkenntnisse gewinnt.
  • Linux & Systems Engineering: Zuhause im Terminal, verstehen wie verteilte Systeme kommunizieren und wie und warum sie ausfallen.
  • Automatisierungs-Mindset: erledigst dieselbe Aufgabe zweimal ungern; nutzt Code, um Infrastruktur zu automatisieren und unnötige manuelle Arbeit zu eliminieren.
  • Ownership-Mentalität: lebst die Philosophie 'You build it, you run it' und übernimmst Verantwortung für die Stabilität der Systeme.

Benefits

  • 30 Tage Urlaub + frei an Heiligabend und Silvester
  • Smart Fridays (4-Tage-Woche möglich)
  • Mobilitätsangebote (Deutschlandticket & JobRad)
  • Sport- und Gesundheitsangebote
  • Mental-Health-Support
  • Corporate Benefits
  • RTL+-Zugang
  • Remote-Flexibilität, vor Ort wenn es darauf ankommt (Berlin oder Köln)
  • Hackathons, Konferenzen und Community für Weiterentwicklung

Wir glauben daran, dass tiefgehendes internes Know-how und ein konsequenter Open-Source-Ansatz die Flexibilität und Performance ermöglichen, mit denen Enterprise-SaaS-Lösungen nicht mithalten können. Wir entwickeln selbst, steuern unsere Systeme und übernehmen Verantwortung für unseren gesamten Tech-Stack – End-to-End.

Unknown
Salary not disclosed