Skip to content
DevOps Engineer

The week's list

Every role like this one, in one letter

You are reading one posting. There are hundreds like it on the board, and new ones every week. Pick what you want, leave an email, and the list comes to you — no searching, no coming back here.

Counting what came out this past week…

The first letter arrives right away, then one a week. Unsubscribe in one click from any letter — the address goes nowhere else.

DevOps Engineer

AI Engineering & Automation Specialist (on-site)

Cloover

Berlinfulltime

Apply on the employer's site

Role description

Deine Rolle
Jedes interne Team bei Cloover, Ops, Energy, Sales, CS, Finance, hat Arbeit, die KI-Agenten schneller und besser erledigen können. Du baust die Systeme, die das real machen: agentische Pipelines, MCP-Server und interne Tools, die unseren Arbeitsalltag verändern, nicht irgendwann, sondern jetzt. Erfolg in dieser Rolle heißt: Kolleg:innen hören auf, die Arbeit zu machen, die du automatisiert hast, und konzentrieren sich auf das, was nur sie tun können.

Du berichtest an Florent (Head of Operations & Energy) und arbeitest in einem starken, eng vernetzten Team.

Deine Aufgaben

  • Konzipiere, baue und shippe end-to-end agentische Systeme, RAG-Pipelines, Embeddings, Retrieval, Prompt Engineering und Evaluation, die Cloovers volumenstärkste interne Workflows automatisieren.
  • Entwickle und deploye eigene MCP-Server sowie Integrationen, die HubSpot, Slack, Notion, Aircall und weitere Tools verbinden, damit Daten dort landen, wo sie gebraucht werden, ohne manuelle Zwischenschritte.
  • Schreibe Production-Code in Python und TypeScript mit sauberem Schema-Design, Security und Authorization, Code, der live geht und läuft, keine Prototypen, die liegen bleiben.
  • Verantworte internes Tooling von Anfang bis Ende: Lücke erkennen, Tool bauen, auf Firebase, Vercel oder GCP deployen, mit ordentlichem Versionsmanagement und CI/CD.
  • Baue eigene Claude-Code-Skills, Plugins und Connectors, und onboarde Kolleg:innen in AI-native Workflows, die wirklich genutzt werden.
  • Arbeite eng mit Ops, Energy, Sales, CS und Finance zusammen, um die hebelstärksten Automatisierungs-Use-Cases zu identifizieren, und setze sie dann selbst um.

Dein Profil
Wie du denkst und was du aufgebaut hast, zählt mehr als wo du warst. Das sind die Voraussetzungen für deinen Erfolg in dieser Rolle:

  • Du hast bereits agentische Systeme, RAG-Pipelines oder KI-gestützte Tools geshippt — im Studium, in Side Projects, bei Hackathons oder im Job, nicht nur mit Prompts im Chat-Fenster experimentiert.
  • Du schreibst Production-Code in Python und/oder TypeScript und kannst die Trade-offs in deinem Code verteidigen.
  • Du fühlst dich sicher beim Verdrahten von REST-APIs, Webhooks und Authentifizierung über Drittsysteme hinweg (HubSpot, Slack, Notion oder ähnlich) und kannst Daten sinnvoll modellieren.
  • Du erkennst die Lücke, definierst die Lösung und shippst sie, ohne darauf zu warten, dass dir jemand sagt, was zu tun ist.
  • Du bist in Berlin ansässig und gehst mit Energie in den Büroalltag. Wir sind bewusst Office-first, Entscheidungen fallen in Echtzeit, Prototypen werden beim Mittagessen getestet, und das Gründerteam ist zehn Meter entfernt. Wenn du so am besten arbeitest, wirst du dich hier sofort wohlfühlen.

Nice to have (aber kein Muss):

  • Praktische Erfahrung mit MCP, Claude Code oder agentischen Frameworks wie LangChain, CrewAI oder Google ADK.
  • Deutschkenntnisse (B1 oder höher) hilfreich für die Zusammenarbeit mit dem Ops- & Energy-Team.

Nicht alle Anforderungen erfüllt?
Bewirb dich trotzdem. Wir stellen nach Potenzial und Perspektive ein, Qualifikationen sind ein Ausgangspunkt, keine Obergrenze.

So läuft's bei uns
Wir halten den Prozess transparent und gehen respektvoll mit deiner Zeit um. Die meisten kommen innerhalb von drei Wochen vom ersten Gespräch zum Angebot.

  • Erstes Kennenlernen (30 Min.) — Wir möchten verstehen, was du suchst — nicht nur deinen Lebenslauf prüfen.
  • Interview mit deiner künftigen Führungskraft (30 Min.) — Wir gehen tief: deine Erfahrung, deine Denkweise, wie du an Probleme herangehst.
  • Case Study (1 Std.) — Du bekommst die Aufgabe vorab. Uns interessiert dein Ansatz — nicht ob du auf die eine richtige Antwort kommst.
  • Angebot & unterschriebener Vertrag

Brauchst du zu irgendeinem Zeitpunkt besondere Unterstützung? Meld dich einfach

Warum wir?

  • Faire Vergütung. Eine wettbewerbsfähige Bezahlung für deine Zeit und deinen Beitrag — am Berliner Praktikumsmarkt ausgerichtet.
  • AI-first & ungedrosselt. Unbegrenzte Enterprise-KI, keine Obergrenzen, kein Genehmigungsprozess. Jede Rolle, jedes Team. Die Routinearbeit verschwindet, damit du dich auf das konzentrieren kannst, was wirklich menschliches Urteilsvermögen erfordert.
  • Echte Verantwortung für eine echte Mission. Ab Tag eins gestaltest du Entscheidungen, die Tausende von Installateurpartnern in Deutschland und Österreich direkt betreffen. Wir bauen nicht nur Software, wir treiben die Energiewende in ganz Europa voran.
  • Schneller wachsen als anderswo. Du arbeitest direkt neben dem Gründerteam und erstklassigen Investoren. Wenn du irgendwann gründen willst, du bist hier genau richtig.
  • Das Wesentliche, richtig gemacht. Büro in Prenzlauer Berg mit neuester Apple-Hardware, kostenloses Frühstück und Abendessen, eine gut bestückte Küche, regelmäßige Team-Events, 25 Urlaubstage, Urban Sports Club (M) und Mitarbeiterrabatte.

Über uns
Bei Cloover bauen wir das KI-Betriebssystem für die Energiewende — eine Plattform, die Tausenden von Installationsunternehmen in Deutschland und Österreich hilft, mehr zu verkaufen, schneller zu planen und besser zu liefern. Gesichert haben wir $1,22 Mrd. an Gesamtfinanzierung — darunter $1,2 Mrd. an zugesagter Fremdfinanzierung und eine Series-A-Runde über $22 Mio. — und stehen erst am Anfang unserer europäischen Expansion.

Wir sind ein hochleistungsorientiertes Team, das mit Sinn arbeitet. Wir übernehmen volle Verantwortung für unsere Arbeit, diskutieren Ideen intensiv, ziehen gemeinsam an einem Strang und setzen ohne Zögern um. Hier gewinnt nicht die Hierarchie — hier gewinnt die beste Idee. Schnelligkeit ist kein Ziel, das wir anstreben — sie ist die Art, wie wir arbeiten.

Und wir sind von Grund auf KI-first. Wir experimentieren nicht mit KI — wir sind damit gebaut. Tech liefert schneller, weil KI prototypisiert, bevor wir bauen. Sales schließt mehr ab, weil Outreach in großem Maßstab personalisiert wird. Finance testet Szenarien in Echtzeit. People & Culture baut Prozesse in einem Bruchteil der Zeit. Egal in welcher Funktion — KI ist das, womit wir über unsere Gewichtsklasse hinausschlagen, und es ist eine Fähigkeit, die du hier schneller entwickelst als fast überall sonst.

Wir glauben, dass die Energiewende allen gehört — und das gilt auch für unser Team. Wir sind international, zielstrebig und bewusst inklusiv. Wir stellen nach Potenzial und Perspektive ein und heißen Menschen aller Hintergründe, Identitäten und Erfahrungen willkommen.

Klingt nach deiner Art von Herausforderung? Dann bewirb dich unten.

This is a saved copy of a posting published elsewhere. Postings get taken down without notice — check the employer's site before applying. mentors.coach is not the hiring party.

Coming to this page

A resume for this role — and a ticket to the draw

We take the posting apart down to the real requirements and rewrite your resume against it — by asking, not inventing: no line appears without your confirmation. Sign in to get it first, and to enter the draw.

  • A resume for this exact role, not a universal one
  • Answers are kept: edit any one, not the whole conversation
  • All in your account — open it from any device

On the wheel

A discount on mentoring

Winners are drawn at random among entries with a confirmed email. The date and the full rules are on the draw page.

Draw rules

DevOps Engineer

Senior HPC Cluster Administrator - Deep Learning Frameworks Infrastructure

NVIDIA

Berlinfulltimesenior

Apply on the employer's site

Role description

NVIDIA's Deep Learning Frameworks (DLFW) Infrastructure team is looking for a deeply technical Senior HPC Cluster Administrator to lead the design, deployment, and reliability of our large-scale GPU compute clusters. These systems run the most demanding deep learning training, inference, and high-performance computing workloads in the industry — from DGX/HGX platforms to ground-breaking Grace Blackwell systems. You will drive architectural decisions across compute, networking, and storage, and partner closely with software, research, and product teams to keep our infrastructure ahead of the workloads it supports.

What You'll Be Doing

  • Own the full lifecycle of GPU compute clusters — procurement, provisioning, configuration management, monitoring, and deprecation — across heterogeneous Linux environments (DGX, HGX, embedded systems)
  • Design and scale storage solutions (NFS, Lustre, WekaFS, or equivalent) with a clear roadmap for capacity and performance growth
  • Lead automation of infrastructure using modern IaC tools (Ansible, Terraform) and CI/CD pipelines (GitLab)
  • Manage and optimize job scheduling via Slurm, including fair-share policies, reservation management, and MIG/GPU partitioning strategies
  • Maintain and improve observability stacks (Prometheus, Grafana, DCGM) and drive proactive resolution of hardware and software incidents
  • Collaborate with ML engineers and software teams to tune cluster configuration for large-scale distributed training workloads
  • Evaluate and introduce new technologies — networking fabrics (InfiniBand, NVLink, EFA/RDMA), storage tiers, container runtimes — to improve performance and reliability
  • Mentor junior engineers and contribute to team-wide engineering standards

What We Need To See

  • BS/MS in CS, EE, CE, or equivalent hands-on experience
  • 5+ years of experience deploying and administering large-scale HPC or ML training clusters
  • Deep expertise in Linux systems administration at scale
  • Strong scripting and automation skills in Python and/or bash
  • Hands-on experience with Slurm (scheduling, accounting, cgroup configuration)
  • Proficiency with configuration management and IaC (Ansible required; Terraform a plus)
  • Experience with container technologies (Docker, Apptainer/Singularity, Kubernetes)
  • Solid understanding of high-speed networking (InfiniBand, RoCE, RDMA, EFA)
  • Experience with distributed/parallel filesystems and storage architecture
  • Ability to own problems end-to-end and communicate clearly with engineering and management stakeholders

Ways To Stand Out From The Crowd

  • Experience with NVIDIA GPU infrastructure tools (DCGM, nvidia-smi, MIG, NVSwitch diagnostics)
  • Familiarity with cluster management platforms (Colossus, Bright Cluster Manager, xCAT, or similar)
  • Experience supporting large-scale distributed deep learning workloads (PyTorch, JAX, Megatron)
  • Knowledge of BMC/IPMI/Redfish for out-of-band management and hardware lifecycle
  • Background in MLOps tooling or ML platform engineering

Join our team of world-class engineers and be part of the groundbreaking work we do at NVIDIA. We are committed to encouraging a collaborative and inclusive environment, where every team member has the opportunity to thrive and make a significant impact!

Your base salary will be determined based on your location, experience, and the pay of employees in similar positions. For Poland: The base salary range is 221,250 PLN - 383,500 PLN for Level 3, and 292,500 PLN - 507,000 PLN for Level 4. , , JR2015529

This is a saved copy of a posting published elsewhere. Postings get taken down without notice — check the employer's site before applying. mentors.coach is not the hiring party.

DevOps Engineer

DevOps Engineer *German required (GCP) (m/w/d)

ventx - we make IT!

Munichfulltime

Apply on the employer's site

Role description

Zur Verstärkung unseres Teams im Großraum München suchen wir, zum nächstmöglichen Termin, engagierte Leute die Lust haben, deine bisher erworbenen IT-Kenntnisse zu erweitern und sich firmenintern zu einem DevOps Cloud Engineer (m/w/d) mit Schwerpunkt AWS Cloud ausbilden zu lassen.

Aufgaben

  • Lust sich in neue Themengebiete einzuarbeiten

  • Mut sich zum Spezialisten ausbilden zu lassen

  • CI/CD Implementationen

  • Erstellung von Infrastrucure as Code

  • Consulting von Projekten im Bereich IT-Infrastruktur

  • Gute Deutsch- und Englischkenntnisse

Qualifikation

Dein Profil

eine erfolgreich abgeschlossene IT-Ausbildung bzw. ein abgeschlossenes Studium der Informatik oder entsprechende Berufserfahrung

  • sicherer Umgang mit Linux

  • beherrschen mindestens einer Script-Sprache wie Bash oder Python

  • Kenntnisse in der Administration von Netzwerken

  • gute Infrastrukturkenntnisse und Coding-Skills

Wünschenswert, aber nicht zwingend erforderlich

Erfahrungen in dem Bereich von Cloud Providern – insbesondere GCP

  • Know-How über Infrastruktur als Code – Cloudformation, Terraform

  • Kenntnisse der Tools CI/CD, GIT, Ansible, Chef, Puppet, Jenkins

  • Kenntnisse in der Administration von Netzwerken

  • praktische Erfahrung mit Monitoring-Tools wie Grafana, Graphite, Prometheus sowie Logging-Tools wie ElasticSearch, lostack, Kibana

Benefits

  • neben attraktiver Vergütung und abwechslungsreicher Tätigkeit, Spaß bei der Arbeit

  • flache Hierarchien mit kurzen Entscheidungswegen

  • ein Team dass sich gerne bei Problemen und Fragen gegenseitig unterstützt

  • moderne Büroräume mit aktuellster Hard- und Software

  • Team-Events

  • Kostenlose Getränke im Office

BEWIRB DICH JETZT! Wir antworten in kürzester Zeit.

This is a saved copy of a posting published elsewhere. Postings get taken down without notice — check the employer's site before applying. mentors.coach is not the hiring party.

DevOps Engineer

Senior Systems Engineer – Business Applications (m/w/d)

BWI GmbH

Strausbergfulltimesenior

Apply on the employer's site

Role description

Sorge gemeinsam mit uns für die digitale Zukunftsfähigkeit der Bundeswehr.

Deine Aufgaben:

  • 2nd Level Support für die LAMP (Linux/Apache/MySQL/PHP) - Plattformen und Applikationen in unserer eigenen Cloud
  • Mitwirkung bei der automatisierten Bereitstellung von Plattformkomponenten durch CI/CD
  • Erstellung, Test und Implementierung von Containerbuilds
  • Bearbeitung von Störungen gemäß Spezifikation der BWI (Störungsannahme, Fehleranalyse, Fehlerbehebung)
  • Identifikation von Risiken, sowie Absicherung und Behebung von Security Risiken
  • Mitwirkung bei der Entwicklung von Schulungskonzepten
  • Pflege und Weiterentwicklung der technischen Dokumentation

Dein Profil:

  • Erfahrungen mit einem oder mehreren der folgenden Technologien: Webservern (Apache, NGINX), Linux Betriebssysteme (z.B. CentOS, SuSE, RHEL, Debian), Datenbanken (z.B.: MySQL, MariaDB, PostgreSQL), LAMP basierte Anwendungen
  • Gute Kenntnisse in Kubernetes und Cloud-nativen Konzepten
  • Kenntnisse von Anwendungsdeployments as Code via Helm-Charts, kustomize, k8s-Operators
  • Erfahrungen mit Automatisierungswerkzeugen (z.B. GitLab-CI, Terraform, Crossplane, Ansible, ArgoCD und FluxCD)
  • Erfahrungen mit Container-Builds (z.B. Docker, Buildah) und Artefaktverwaltung (Nexus, Harbor)
  • Vertrautheit mit Monitoring- , Logging- und Alerting-Stacks (z.B. Prometheus, Grafana, Instana)
  • Erfahrungen mit Skalierung und Ressourcenoptimierung in Container basierten Umgebungen sowie Git/Git-Ops
  • Grundverständnis TCP Netze wie Firewalling, Netzstruktur, Sicherheit
  • Erfahrungen mit CMDB/Asset-Managementsystemen
  • ITIL Grundkenntnisse (Change/Incident/Problem-Management)
  • Fließende Deutsch- und gute Englischkenntnisse

Wir bieten:

  • Durch abwechslungsreiche und gesellschaftlich relevante Aufgaben gewährleisten wir den reibungslosen IT-Betrieb und die Digitalisierung der Bundeswehr
  • Das Ziel eint uns. Dabei sind für uns ein wertschätzender Umgang miteinander sowie ein großer Teamgeist elementar
  • Die Vergütung liegt zwischen 57.800 € und 84.680 €. Die tatsächliche Höhe wird basierend auf deinem Verantwortungsbereich sowie Erfahrungen und Kompetenzen festgelegt
  • Wir bieten 30 Tage Jahresurlaub, 1 Brauchtumstag plus Optionen auf individuelle Anpassungen
  • Über unsere Benefit-App erhält man ein monatliches Guthaben und kann sich zusätzlich Steuervergünstigungen auf Tickets für den ÖPNV sichern
  • Wir ermöglichen Flexibilität, um Beruf und Privatleben in Einklang zu bringen, etwa durch mobiles Arbeiten oder Vertrauensarbeitszeit
  • Wir unterstützen die berufliche und persönliche Weiterbildung durch individuelle Maßnahmen sowie einen kostenfreien Zugriff auf LinkedIn Learning
  • Unser Jobradangebot ermöglicht das Leasing von bis zu 2 Fahrrädern

This is a saved copy of a posting published elsewhere. Postings get taken down without notice — check the employer's site before applying. mentors.coach is not the hiring party.

DevOps Engineer

IT Expert DevOps / Platform Engineering (m/w/d)

BWI GmbH

Berlinfulltime

Apply on the employer's site

Role description

Sorge gemeinsam mit uns für die digitale Zukunftsfähigkeit der Bundeswehr.

Ihre Aufgaben:

  • Betreuung und (Weiter-)Entwicklung einer Cloud-Native-Plattform für Data Analytics und KI Tools für unseren Kunden Bundeswehr
  • Realisierung und Sicherstellung der Betreibbarkeit eines PaaS/SaaS auf Basis von Kubernetes mit hohem Automatisierungsgrad in der Provisionierung und Deployment in einem agil aufgestellten Team
  • Automatisierte Bereitstellung von containerisierten Plattformkomponenten durch CI/CD sowie Überwachung und Optimierung der Plattform durch den gezielten Einsatz von Logging, Monitoring und Tracing
  • Kontinuierliche und systematische Härtung durch die Realisierung von Anforderungen der IT-Sicherheit
  • Mitwirkung an der Erstellung von code-naher technischen Dokumentationen

Ihr Profil:

  • Abgeschlossenes fachbezogenes Hochschulstudium oder eine vergleichbare Ausbildung
  • Etwa 2 Jahre Berufserfahrung in einem oder mehreren der folgenden Themenfelder Cloud-native Plattformen, Deployment von Microservices und/oder Automatisierung containerisierter Anwendungen
  • Gute Kenntnisse in Kubernetes und den Cloud-native Konzepten, API-Gateways, Service-Mesh (z.B. Istio), Authentifizierung und Observability
  • Erfahrungen im Umgang mit Automatisierungswerkzeugen und Infrastructure as Code und GitOps, z.B. mit GitLab-CI, Terraform, Crossplane oder ArgoCD
  • Erfahrung im Deployment von Machine Learning Systemen (MLOps) wünschenswert
  • Gute Kommunikations- und Teamfähigkeiten, ein analytisches Denkvermögen Lernbereitschaft sowie eine sorgfältige und gewissenhafte Arbeitsweise
  • Verhandlungssichere Deutschkenntnisse und ein sicheres Verständnis der englischen Sprache

Wir bieten:

  • Durch abwechslungsreiche und gesellschaftlich relevante Aufgaben gewährleisten wir den reibungslosen IT-Betrieb und die Digitalisierung der Bundeswehr
  • Das Ziel eint uns. Dabei sind für uns ein wertschätzender Umgang miteinander sowie ein großer Teamgeist elementar
  • Die Vergütung liegt zwischen 57.800 € und 84.680 €. Die tatsächliche Höhe wird basierend auf deinem Verantwortungsbereich sowie Erfahrungen und Kompetenzen festgelegt
  • Wir bieten 30 Tage Jahresurlaub, 1 Brauchtumstag plus Optionen auf individuelle Anpassungen
  • Über unsere Benefit-App erhält man ein monatliches Guthaben und kann sich zusätzlich Steuervergünstigungen auf Tickets für den ÖPNV sichern
  • Wir ermöglichen Flexibilität, um Beruf und Privatleben in Einklang zu bringen, etwa durch mobiles Arbeiten oder Vertrauensarbeitszeit
  • Wir unterstützen die berufliche und persönliche Weiterbildung durch individuelle Maßnahmen sowie einen kostenfreien Zugriff auf LinkedIn Learning
  • Unser Jobradangebot ermöglicht das Leasing von bis zu 2 Fahrrädern

This is a saved copy of a posting published elsewhere. Postings get taken down without notice — check the employer's site before applying. mentors.coach is not the hiring party.

206 more openings in this category and country

AI Engineering & Automation Specialist (on-site)Cloover · Germany

Apply on the employer's site