Linux - UCRS Engineer
Verfasst am 2026-09-24
-
IT/Informationstechnik
System Administrator, Systemingenieur, Unix
Job Location (Short):
Niederkassel, Germany
Du arbeitest analytisch, faktenbasiert und mit Blick auf nachhaltige Stabilität.
Du verstehst komplexe Systemzusammenhänge und willst wissen, warum ein System unter Last kippt – und wie man es sauber behebt.
Zuverlässiger Betrieb, saubere Ursachenanalyse und kontinuierliche Verbesserung sind für dich selbstverständlich.
Wenn du diese Haltung teilst und dich in komplexen Systemlandschaften wohlfühlst, bist du bei uns richtig.
Deine Aufgaben
- Administration von Debian-Systemen
- Betrieb, Wartung und Hardening von Debian-Servern
- Analyse und Behebung komplexer Störungen (CPU/IO/Memory/Netzwerk, systemd, Kernel-Logs)
- JVM-Fehleranalyse inkl. Thread Dumps sowie bei Bedarf Heap Dumps
- Memory-Tuning, GC-Analyse und Performance-Optimierung
- Ursachenanalyse bei Deadlocks, Hängern, Ressourcenauslastung und Latenzproblemen
Betrieb von Applikations- und Middleware-Komponenten
- Betrieb und Optimierung von Tomcat, Apache HTTPD und ActiveMQ (AMQ)
- Logdiagnose und strukturierte Fehleranalyse (Service-, System- und Application-Logs)
- Konfiguration und Pflege von Betriebsparametern (z.
B. Thread Pools, Connection Pools)
TLS / Zertifikate / Reverse Proxy
- Verwaltung von TLS-Zertifikaten, Zertifikatsketten sowie Truststores/Keystores
- Konfiguration und Troubleshooting von Reverse Proxies (z.
B. Apache, HAProxy, NGINX – abhängig von der Umgebung)
Resilienz & Recovery
- Testen von Ausfallszenarien (Failover-, Recovery- und Restart-Strategien)
- Erstellung und kontinuierliche Verbesserung von Runbooks für Service-Recovery und Incident Response
Automatisierung & Plattformintegration
- Automatisierung wiederkehrender Aufgaben mit Bash (Python optional)
- Unterstützung und Weiterentwicklung bestehender Automatisierung (z.
B. Ansible, optional) - Integration in bestehende Plattformen und Provisioning-Umgebungen (z.
B. Foreman/Puppet) - Aufbau und Weiterentwicklung von Monitoring- und Alerting-Strukturen
- Interpretation relevanter Metriken (GC, Heap, Threads, Response Times, Queue Depths)
- Ableitung nachhaltiger Maßnahmen zur Stabilitäts- und Performanceverbesserung
- Mehrjährige Erfahrung in der Debian-Systemadministration
- Sehr gutes Verständnis von Linux-Troubleshooting (systemd, Logging, Performance/IO, Netzwerkgrundlagen)
- Erfahrung in der JVM-Analyse (Thread Dumps, Memory- und GC-Themen, Performance-Tuning)
- Routine im Betrieb von Tomcat, Apache HTTPD sowie idealerweise ActiveMQ
- Fundierte Kenntnisse zu TLS, Zertifikatsketten sowie im Umgang mit Keystores und Truststores
- Erfahrung mit Reverse-Proxy-Konfigurationen und typischen Fehlerbildern
- Automatisierungskompetenz mit Bash (Ansible/Puppet von Vorteil)
- Fähigkeit, Ursachen sauber zu analysieren, zu dokumentieren und nachhaltig zu beheben
- Erfahrung mit Foreman (Provisioning/Integration) und/oder Puppet-Umfeld
- Erfahrung mit Monitoring-Stacks wie Prometheus/Grafana, ELK oder Graylog
- Erfahrung mit Hochverfügbarkeits- und Recovery-Konzepten in produktiven Umgebungen
Persönlich
- Strukturierte, analytische Arbeitsweise („Hypothese → Messung → Ursache → Fix“)
- Hohes Verantwortungsbewusstsein im Betrieb produktionskritischer Systeme
- Ruhiges, professionelles Arbeiten auch unter Incident- und SLA-Druck
- Teamfähigkeit sowie Bereitschaft, Wissen zu teilen und Standards mitzugestalten
- Sehr gute Deutsch- und Englischkenntnisse in Wort und Schrift
- Sorgfältige Dokumentations- und Kommunikationsfähigkeit
- Bereitschaft zur kontinuierlichen Weiterentwicklung
Octave bietet unternehmenskritische Software, die Organisationen dabei unterstützt, fundierte Entscheidungen in jeder Phase des Asset-Lebenszyklus zu treffen – Design, Build, Operate und Protect – überall dort, wo Leistung, Sicherheit und Zuverlässigkeit unverzichtbar sind und ein Versagen keine Option…
(Wenn dieser Job tatsächlich in Ihrem Zuständigkeitsbereich liegt, verwenden Sie möglicherweise einen Proxy oder VPN, um auf diese Seite zuzugreifen. Um weiterzukommen, sollten Sie Ihre Verbindung zu einem anderen Mobilgerät oder PC wechseln).