Job
Aus Partner-Feed
Plattformingenieur (Fernarbeit)
Preis auf Anfrage
Details
- Beschäftigungsart
- Vollzeit
- Remote
- Ja
- Unternehmen
- Cloudlinux
Beschreibung
Automatisch aus dem English übersetzt. Der Originaltext ist maßgeblich. Maschinenübersetzung – eine genauere Version wird vorbereitet.
Beschreibung
CloudLinux entwickelt Linux-Infrastruktur- und Sicherheitsprodukte. Sie werden Teil unserer Automation & Management Services-Zelle und arbeiten eng mit Dmitrii Petrov zusammen, um Probleme team- und dienstübergreifend zu lösen: Cloud-Kostendaten, Infrastrukturinventur, Netzwerkrichtlinien und Kapazitätsworkflows.
Weitere Informationen finden Sie auf unserer Website https://cloudlinux.com/
Innerhalb der Infrastrukturabteilung ist die Plattformzelle ein kleines Team. Wir betreiben die Observability-Plattform, das GitLab des Unternehmens und die dahinter stehenden CI-Läufer, einige kleinere Engineering-Dienste und die Automatisierung, auf die sich die Abteilung bei der Bereitstellung und Konfiguration verlässt.
Wir suchen einen Plattformingenieur für das PaaS-Team, der die Verantwortung für eine vereinbarte Reihe von Plattformdiensten übernimmt: Sie müssen dafür sorgen, dass sie zuverlässig sind und innerhalb der vereinbarten Serviceniveaus liegen, Änderungen und Wiederherstellungen wiederholbar machen und wiederkehrende Betriebsarbeiten durch Automatisierung und Selbstbedienung reduzieren.
Sie erhalten echte Freiheit bei der Umsetzung und sind für das Ergebnis verantwortlich: Sie wählen den Ansatz, verteidigen ihn bei der Überprüfung und sind dafür verantwortlich, wie sich der Dienst danach verhält.
Bei der Arbeit geht es größtenteils darum, worum es beim Site Reliability Engineering geht: Dienste, die Tag für Tag gut funktionieren, und Anfragen von Produktteams werden ordnungsgemäß bearbeitet. Ein Teil davon ist im Aufbau. Die Observability-Plattform und der Runner-Cluster wurden beide im letzten Jahr von Grund auf neu aufgebaut, und davon wird es noch mehr geben. Erwarten Sie, dass sich die Arbeit auf die Plattformentwicklung, die Reaktion auf Vorfälle und die Unterstützung der Ingenieure in anderen Teams bei der Nutzung unserer Ressourcen aufteilt.
Was Sie tun werden
• Führen Sie die Observability-Plattform aus. Halten Sie es funktionsfähig, binden Sie Teams ein, überwachen Sie Kosten und Kapazität und behalten Sie die Alarmierung bei, die darüber läuft.
• Führen Sie GitLab und die CI-Runner-Flotte aus. Upgrades, Kapazität, Zugriff, Backups und Wiederherstellungsübungen.
• Halten Sie den Rest unserer Dienste funktionsfähig, mit der Überwachung und den Runbooks, die ein Produktionsdienst benötigt.
• Stellen Sie neue Dienste bereit, wenn sie angefordert werden. Informieren Sie sich über die Optionen, wählen Sie ein Design aus und bauen Sie den Dienst gemäß bewährter Verfahren von Grund auf neu auf: als Code, überwacht, gesichert, dokumentiert.
• Arbeiten Sie mit den Anfragen der Entwickler. Zugriff, Onboarding, Pipeline-Probleme, neue Exporteure und Dashboards. Beantworten Sie sie und verwandeln Sie die wiederkehrenden Fragen in Selbstbedienung.
• Vorfälle ausführen. Diagnostizieren und mildern Sie die Auswirkungen, stellen Sie den Dienst sicher wieder her und führen Sie dann die Ursachenanalyse und die Obduktion durch. Liefern Sie die Präventions- oder Erkennungsverbesserungen, die der Vorfall erfordert.
• Versenden Sie alles als Code, der in Zusammenführungsanfragen überprüft wird. Planen und prüfen Sie vor jeder Änderung.
• Schreiben Sie für Ingenieure außerhalb des Teams. Runbooks, Onboarding-Leitfäden, Wartungshinweise und Statusaktualisierungen, auf die die Mitarbeiter reagieren können.
• Arbeiten Sie mit KI-Agenten. Delegieren Sie die Erfassung und Erstellung von Texten an sie, überprüfen Sie die Ergebnisse wie die Zusammenführungsanfrage eines Kollegen und notieren Sie, was Sie erfahren, wo das Team es finden kann.
Quelle: EU Remote Jobs (https://euremotejobs.com/job/platform-engineer-remote-work/)
CloudLinux entwickelt Linux-Infrastruktur- und Sicherheitsprodukte. Sie werden Teil unserer Automation & Management Services-Zelle und arbeiten eng mit Dmitrii Petrov zusammen, um Probleme team- und dienstübergreifend zu lösen: Cloud-Kostendaten, Infrastrukturinventur, Netzwerkrichtlinien und Kapazitätsworkflows.
Weitere Informationen finden Sie auf unserer Website https://cloudlinux.com/
Innerhalb der Infrastrukturabteilung ist die Plattformzelle ein kleines Team. Wir betreiben die Observability-Plattform, das GitLab des Unternehmens und die dahinter stehenden CI-Läufer, einige kleinere Engineering-Dienste und die Automatisierung, auf die sich die Abteilung bei der Bereitstellung und Konfiguration verlässt.
Wir suchen einen Plattformingenieur für das PaaS-Team, der die Verantwortung für eine vereinbarte Reihe von Plattformdiensten übernimmt: Sie müssen dafür sorgen, dass sie zuverlässig sind und innerhalb der vereinbarten Serviceniveaus liegen, Änderungen und Wiederherstellungen wiederholbar machen und wiederkehrende Betriebsarbeiten durch Automatisierung und Selbstbedienung reduzieren.
Sie erhalten echte Freiheit bei der Umsetzung und sind für das Ergebnis verantwortlich: Sie wählen den Ansatz, verteidigen ihn bei der Überprüfung und sind dafür verantwortlich, wie sich der Dienst danach verhält.
Bei der Arbeit geht es größtenteils darum, worum es beim Site Reliability Engineering geht: Dienste, die Tag für Tag gut funktionieren, und Anfragen von Produktteams werden ordnungsgemäß bearbeitet. Ein Teil davon ist im Aufbau. Die Observability-Plattform und der Runner-Cluster wurden beide im letzten Jahr von Grund auf neu aufgebaut, und davon wird es noch mehr geben. Erwarten Sie, dass sich die Arbeit auf die Plattformentwicklung, die Reaktion auf Vorfälle und die Unterstützung der Ingenieure in anderen Teams bei der Nutzung unserer Ressourcen aufteilt.
Was Sie tun werden
• Führen Sie die Observability-Plattform aus. Halten Sie es funktionsfähig, binden Sie Teams ein, überwachen Sie Kosten und Kapazität und behalten Sie die Alarmierung bei, die darüber läuft.
• Führen Sie GitLab und die CI-Runner-Flotte aus. Upgrades, Kapazität, Zugriff, Backups und Wiederherstellungsübungen.
• Halten Sie den Rest unserer Dienste funktionsfähig, mit der Überwachung und den Runbooks, die ein Produktionsdienst benötigt.
• Stellen Sie neue Dienste bereit, wenn sie angefordert werden. Informieren Sie sich über die Optionen, wählen Sie ein Design aus und bauen Sie den Dienst gemäß bewährter Verfahren von Grund auf neu auf: als Code, überwacht, gesichert, dokumentiert.
• Arbeiten Sie mit den Anfragen der Entwickler. Zugriff, Onboarding, Pipeline-Probleme, neue Exporteure und Dashboards. Beantworten Sie sie und verwandeln Sie die wiederkehrenden Fragen in Selbstbedienung.
• Vorfälle ausführen. Diagnostizieren und mildern Sie die Auswirkungen, stellen Sie den Dienst sicher wieder her und führen Sie dann die Ursachenanalyse und die Obduktion durch. Liefern Sie die Präventions- oder Erkennungsverbesserungen, die der Vorfall erfordert.
• Versenden Sie alles als Code, der in Zusammenführungsanfragen überprüft wird. Planen und prüfen Sie vor jeder Änderung.
• Schreiben Sie für Ingenieure außerhalb des Teams. Runbooks, Onboarding-Leitfäden, Wartungshinweise und Statusaktualisierungen, auf die die Mitarbeiter reagieren können.
• Arbeiten Sie mit KI-Agenten. Delegieren Sie die Erfassung und Erstellung von Texten an sie, überprüfen Sie die Ergebnisse wie die Zusammenführungsanfrage eines Kollegen und notieren Sie, was Sie erfahren, wo das Team es finden kann.
Quelle: EU Remote Jobs (https://euremotejobs.com/job/platform-engineer-remote-work/)
Dieses Angebot stammt aus einem Partner-Feed. Bewerben Sie sich auf der Quell-Website.
Quelle: Cloudlinux
Inserat bereitgestellt von Cloudlinux.