Platform Operations Engineer (all genders)

Köln · Remote ok

About this role

Über das Arbeiten bei envelio

Zu einfach ist langweilig! Gemeinsam haben wir die Mission, die Energiewende voranzutreiben. Wir lieben, was wir tun und dabei ist uns kein Thema zu groß. Wir übernehmen Verantwortung für unsere Arbeit und wachsen an jeder neuen Aufgabe. Kurz gesagt: Own it, love it, grow with it.

Wir sind ein bodenständiges Team aus Kaffee- und Mate-Liebhaber:innen. Unser Geek-Humor resultiert in einer rituellen Nutzung von Emojis und der enzyklopädischen Herausarbeitung von unnützem Wissen. Mehr als 150 envelianer:innen mit über 20 verschiedenen Nationalitäten sind bereits an Bord. Komm dazu und wachse mit uns!

Deine Rolle

Als Platform Operations Engineer (all genders) bist du verantwortlich für den zuverlässigen Betrieb, die Überwachung und das Deployment der Softwarelösungen von envelio in komplexen Kundenumgebungen. Du stellst sicher, dass Updates, Bugfixes und neue Versionen der Intelligent Grid Platform (IGP) reibungslos in Cloud-, On-Premise- und Operational-Technology-(OT)-Umgebungen ausgerollt werden.

Ein zentraler Bestandteil deiner Rolle ist der tägliche Betrieb der Kundensysteme, einschließlich der Überwachung der Systemgesundheit, der Bearbeitung von Incidents und der Koordination einer effektiven Incident-Lösung. Du trägst aktiv zu einem stabilen 24/7-Betrieb bei, indem du Probleme frühzeitig erkennst, auf Incidents reagierst und eine klare Kommunikation sowie Übergaben sicherstellst.

Du arbeitest an der Schnittstelle zwischen Engineering, Betrieb und Kunden. In enger Zusammenarbeit mit den IT- und OT-Teams der Kunden hilfst du dabei, Betriebsmodelle zu klären, die bestehende Infrastruktur zu verstehen und sicherzustellen, dass unsere Software zuverlässig und sicher in realen Netzumgebungen läuft.

Wie du etwas bewirkst

  • Du führst Software-Updates, Patches und Bugfixes in Kundenumgebungen aus – sowohl in Cloud-, On-Premise- als auch in OT-Infrastrukturen
  • Du betreibst und wartest Kundensysteme und stellst einen stabilen und sicheren Tagesbetrieb sicher
  • Du trägst zum 24/7-Betrieb bei, indem du an Bereitschaftsdiensten teilnimmst und eine schnelle Reaktionszeit im Falle von Incidents sicherstellst
  • Du unterstützt Kunden bei Rollouts, Upgrades und operativen Incidents – auch außerhalb der regulären Geschäftszeiten, wenn erforderlich
  • Du arbeitest direkt mit Kunden zusammen, um ihre Cloud-Kundenumgebungen (Kubernetes, meist Single-Tenant pro Kunde) sowie On-Premise- und OT-Landschaften zu verstehen und passende Betriebsmodelle zu definieren
  • Du analysierst operative Probleme und koordinierst Troubleshooting gemeinsam mit Development, SRE und Security Teams
  • Du dokumentierst kundenspezifische Setups, operative Prozesse und Deployment-Verfahren
  • Du trägst dazu bei, Deployment- und Betriebsprozesse kundenübergreifend zu verbessern und zu standardisieren
  • Du unterstützt interne Teams, indem du Feedback aus dem realen Kundenbetrieb in Produkt- und Engineering-Entscheidungen einbringst

Dein Profil

Perfektion ist ein Mythos! Viel mehr interessiert uns der Mensch hinter dem Bildschirm. Diese Kriterien sind also eher als Orientierungshilfe für dich gedacht. Wir sind gespannt, wie deine individuellen Fähigkeiten zu uns passen.
  • Du hast starke Erfahrung im Betrieb komplexer Cloud-Applikationen und weißt, wie man Services unter realen Bedingungen zuverlässig betreibt
    • Du betreibst produktive Services auf Cloud-Infrastruktur (AWS/Azure/GCP) und kennst typische Failure-Modes
    • Du hast praktische Erfahrung mit Linux und Networking-Basics im Troubleshooting (Logs, Systemzustand, Connectivity)
    • Du kennst moderne Betriebsmodelle, wie Container/Kubernetes (oder vergleichbar) und kannst Deployments im Betrieb bewerten (Rollouts, Rollbacks)
    • Du hast Erfahrung mit Infrastructure-as-Code-Tools (Terraform)
    • Du arbeitest gerne hands-on operativ - von Deployments bis zum Troubleshooting in Produktionsumgebungen
    • Du verfügst über gute Kenntnisse in grundlegenden Security-Konzepten
  • Du arbeitest gerne eng mit Kunden zusammen und kannst technische Themen klar und pragmatisch erklären
  • Du hast Erfahrung mit Monitoring- und Observability-Plattformen (z. B. Datadog, Grafana oder vergleichbar)
  • Du bist bereit und in der Lage, zum 24/7-Betrieb durch Bereitschaftsdienste im Rahmen einer geteilten Team-Rotation beizutragen
  • Du bist strukturiert, zuverlässig und übernimmst Verantwortung für operative Aufgaben
  • Du arbeitest gut mit Software-Entwicklern zusammen und kannst operative Anforderungen in technische Requirements übersetzen
  • Du bist mit Teilen unseres Tech Stacks vertraut oder traust dir zu, dich schnell einzuarbeiten
  • Du beherrschst Deutsch und Englisch fließend in Wort und Schrift

Wie wir lokalisieren

Wie wir Software entwickeln

  • Klar definierte Verantwortung für Produktthemen und effiziente Koordination zwischen Squads und Customer Success
  • Strukturiertes Incident Management (Service wiederherstellen, klar kommunizieren, dann Ursachenanalyse)
  • Release-Prozesse mit pragmatischem Risikomanagement (sichere Änderungen, schnelle Rollbacks bei Bedarf)
  • Monitoring- und Alerting-Hygiene (signal over noise)
  • Umfassende Runbooks und Automatisierung zur langfristigen Reduzierung operativer Belastung

Unser Tech Stack

  • Hybrid-Cloud und on-prem Umgebungen, einschließlich vom Kunden betriebener Infrastruktur
  • Containerisierte Anwendungen, orchestriert mit Kubernetes und Helm
  • Anwendung primär in Python und TypeScript
  • Standard Backing Services wie PostgreSQL, RabbitMQ, Redis
  • Cloudflare
  • Gitlab & Gitlab CI zur Verwaltung des Software-Delivery-Lifecycles
  • Mehrere Cloud-Anbieter
  • Terraform und Automatisierungs-Tooling zur Unterstützung von Deployments und Betrieb
  • Datadog (Monitoring, Alerting, Dashboards)
  • Linux-Systeme, VPN-Technologien

Deine Benefits

  • Passe den Arbeitsmodus an deinen Lifestyle an – fully remote (#LI-Remote) oder hybrid mit Office-Option
  • Option zum mobilen Arbeiten aus dem Ausland (bis zu drei Monate pro Jahr von überall in der EU oder den USA)
  • State of the Art Technologie und moderner Tech Stack
  • Sehr gute Hardware-Ausstattung (16 Zoll MacBooks, 2 Bildschirme an deinem Arbeitsplatz)
  • 30 Urlaubstage + 3 corporate holidays
  • Unterstützung deiner Gesundheit mit der Urban Sports Club Kooperation
  • Professionelle Unterstützung rund um mentales Wohlbefinden für dich und deine Familie durch unseren Partner nilo
  • Flexible Nutzung eines monatlichen Mobilitätsbudgets (z.B. Jobrad, ÖPNV)
  • Zeit und Budget für individuelles Wachstum
  • Regelmäßige Tech & Growth Talks für internen Wissensaustausch
  • optionale betriebliche Altersvorsorge
  • Regelmäßige Company und Team Events

About us

Intelligente Netze für eine nachhaltige Zukunft weltweit – das ist unsere Vision! Deshalb schaffen wir das digitale Zentrum für die Zukunft des Stromnetzbetriebs: Die Intelligent Grid Platform (IGP). Die IGP bildet den Kern unserer SaaS-Lösung. Dabei ist es unser Ziel, die IGP und envelio jeden Tag 1 % besser zu machen. Komm ins envelio-Team und trage mit deiner Arbeit zur Energiewende bei.

Als Remote-First-Unternehmen lassen wir dich entscheiden, wie viel du remote arbeiten möchtest – von 0% bis 100%. Ob du in Köln oder Aachen, Bonn oder Berlin, München oder Castrop-Rauxel wohnst; Hauptsache du hast Internet! Du kannst auch bis zu drei Monate im Jahr vom Ausland aus arbeiten. Seit 2017 haben wir ein vielfältiges internationales Team aufgebaut, mit Englisch als Unternehmenssprache.

Company at a glance

⚡ envelio - Supporting the smarter, faster evolution of your power grid.

We provide distribution grid operators with the Intelligent Grid Platform (IGP) – a software suite that brings all your grid data together to enable real-time decisions, long-term planning, and much, much more.

With real-time digital twins, automated grid assessments, and live monitoring, IGP empowers DSOs to manage increasing infrastructure complexity, renewable integration, and growing power demand.

Our applications cover the full spectrum of operations and planning:
🔹 Process thousands of connection requests in minutes, not days
🔹 Detect grid congestion risks before they cause trouble
🔹 Simulate and plan new grid areas with confidence
🔹 Evaluate the grid impact of EVs, PVs, and heat pumps before they’re built

IGP integrates seamlessly with existing systems like GIS, NIS, SCADA, MDM, EDM and others – enhancing visibility without overhauling existing workflows. And because it’s modular, grid operators can start where they need impact the most.

Trusted by grid operators across Europe and beyond – from Westnetz to Helen Electricity Network and Eversource – envelio's IGP is setting new standards in grid management and planning, facilitating a smoother transition to renewable energies.

💡 Not sure which part of IGP fits your needs? We’ll help you find it.
👉 Visit our product pages or message us directly.

🚀 Want to work with us? We're hiring – and with a 95% recommendation rate on Kununu, we're proud of the culture we've built. ⭐ Check our open positions on Kununu: https://www.kununu.com/de/envelio

Founded2017
Team Size51-200 employees
WorkspaceRemote ok
IndustryInformation Technology & Services
Location
Cologne, North Rhine-Westphalia, Germany
LinkedInLinkedIn

Top Benefits

  • Remote work options
  • Mobile work from abroad
  • Modern hardware equipment
  • 30 days of vacation
  • 3 corporate holidays
  • Urban Sports Club membership
  • Mental health support
  • Mobility budget
  • Professional development budget
  • Company and team events
  • Occupational pension scheme

Tired of cold applications?

Sign up with Clera and we'll reach out the moment a role actually fits you — no more spraying applications into the void.

Know someone who'd be great for this?