Job
Aus Partner-Feed
Netzwerkbetriebsingenieur
Preis auf Anfrage
Details
- Beschäftigungsart
- Vollzeit
- Remote
- Ja
- Unternehmen
- Share
Beschreibung
Automatisch aus dem English übersetzt. Der Originaltext ist maßgeblich. Maschinenübersetzung – eine genauere Version wird vorbereitet.
Netzwerkbetriebsingenieur
1. Über die Rolle
Share ist der globale Marktplatz für Bandbreite. Wir fassen die Telekommunikationsinfrastruktur in einer einzigen Ebene zusammen und bieten ISPs, Hyperscalern und KI-Unternehmen einen sauberen Weg, um Konnektivität in jedes Zuhause und jedes Unternehmen in Kenia und auf dem Kontinent bereitzustellen. Hinter diesem Marktplatz verbirgt sich ein echtes Netzwerk: ein BGP-Edge-Peering mit Tier-1-Transit, Hyperscalern und lokalen Vermittlungsstellen, ein MPLS-Backbone, Aggregations- und Zugriffsgeräte sowie die Systeme, die alles überwachen.
Für die Partner, die auf uns arbeiten, ist das Netzwerk das Produkt, und das NOC ist der Ort, an dem sie es spüren. Eine saubere Schicht ist ein Partner, der nie wusste, dass etwas passiert ist. Das ist die Bar.
Wir sind früh dran und das Team ist klein, daher können wir uns keine Hände leisten, die nur wissen, wie man eskaliert. Wir brauchen einen fähigen Netzwerktechniker, der eine Schicht übersteht, echte Fehler behebt, ohne jemanden zu wecken, und dann das Netzwerk weiter aufbaut, während Ostafrika schläft: Ausbreitungs- und Peering-Prüfungen, Gesundheitsdurchgänge im gesamten Anwesen, Konfigurationsänderungen bis hin zur Zusammenführung, Tickets von der Tafel, Automatisierung, die jedem die nächste sich wiederholende Aufgabe abnimmt. Das Zuschauen ist der Boden dieser Rolle, nicht die Decke.
Das NOC, dem Sie beitreten würden, ist kein Legacy-Mitglied. Wir bauen es von Grund auf als KI-gestützte Betriebsumgebung auf. Die Weiterleitungsebene läuft auf Open-Source-Routing- und Weiterleitungssoftware, jede Gerätekonfiguration befindet sich in Git und eine LLM-Schicht sitzt über dem Live-Netzwerkstatus. Wenn sich etwas bewegt, liest diese Ebene die Telemetrie, korreliert sie mit der Topologie und dem Konfigurationsverlauf und legt dem Techniker im Dienst eine wahrscheinliche Ursache und eine mögliche Lösung vor. Es geht nicht darum, Ihr Urteilsvermögen zu ersetzen. Es dient dazu, die Zeit zwischen der Auslösung eines Alarms und dem Wissen, wo Sie suchen müssen, zu verkürzen, sodass die durchschnittliche Reparaturzeit in Minuten gemessen wird.
Sie sitzen in diesem System. Man nutzt es, wehrt es ab, wenn es falsch ist, und was man merkt, dass es übersieht, trägt dazu bei, dass es intelligenter wird. Während wir die Automatisierung im gesamten NOC ausbauen, sind Sie nicht nur ein Verbraucher der Werkzeuge. Du hilfst beim Schreiben.
2. Was Sie tun werden
Schauen Sie zu und wissen Sie, was Sie sehen. Setzen Sie sich auf unseren Überwachungsstapel (Zabbix- und Grafana-Dashboards, Flusstelemetrie, Alarmierung) und lesen Sie ihn tatsächlich. Erfahren Sie, wie das Normale aussieht, sodass Ihnen das Ungewöhnliche ins Auge springt: eine abgebrochene BGP-Sitzung, ein ausgefallener Link, steigende Latenz auf einem Pfad, eine durchbrochene Kapazitätsschwelle, ein Partner, der plötzlich nichts drückt oder zieht.
Fehlerbehebung und Lösung. Hier verdienen Sie sich Ihren Sitzplatz. Bestätigen Sie, dass die Warnung echt ist, sammeln Sie die Fakten und lokalisieren Sie den Fehler: ein Peer oder mehrere, wir oder Upstream, ein echter Ausfall oder ein Überwachungsfehler. Die unterstützende Ebene zeigt eine wahrscheinliche Diagnose und einen Lösungsvorschlag an, der Konfigurationsverlauf ist direkt in Git vorhanden und die Runbooks sind live. Ihre Aufgabe ist es, alles kritisch zu lesen, zu entscheiden, was tatsächlich wahr ist, und so viel wie möglich auszuschließen. Bei jedem Ticket, das Sie selbst lösen, handelt es sich um eines, für dessen Bearbeitung unsere leitenden Mitarbeiter nicht aus der Arbeit oder aus dem Bett geholt wurden.
Halten Sie das Netzwerk gesund und nicht nur am Leben. Eine ruhige Schicht ist keine Leerlaufschicht. Führen Sie die proaktiven Durchgänge aus: Überprüfen Sie, ob sich Routen wie vorgesehen ausbreiten, dass RPKI und Filterketten ihre Aufgabe erfüllen, dass Peering- und Transitsitzungen über den Edge hinweg sauber sind und dass kein PoP in Richtung einer Kapazitätsgrenze driftet. Erkennen Sie die langsamen Verschlechterungen, die nie einen Alarm auslösen. Das Tagesteam sollte ein Netzwerk in einem bekanntermaßen guten Zustand übernehmen.
Erstellen und automatisieren. Die sich wiederholenden Teile dieser Arbeit sollten sich nicht wiederholen. Schreiben Sie die Skripte, die eine manuelle Prüfung in eine geplante Prüfung umwandeln. Treiben Sie unsere Konfigurationsautomatisierung voran (Jinja-gesteuerte Generierung, NAPALM oder NETCONF/gNMI für die Geräte), sodass Änderungen aus Daten und nicht aus dem Speicher versendet werden. Wenn der unterstützenden Ebene immer wieder das Gleiche fehlt, ist das ein Kandidat für die Automatisierung, und Sie sind gut aufgestellt, um sie in den Stunden zu erstellen, in denen sonst niemand online ist.
Bringen Sie die Arbeit voran. Sie sind Teil des Netzwerkteams und arbeiten im gleichen Vorstand wie sie. Nehmen Sie Tickets aus der Linear-Warteschlange auf, führen Sie Konfigurationsänderungen durch Überprüfung zur Zusammenführung durch und sorgen Sie dafür, dass unsere Quelle der Wahrheit (Nautobot) korrekt bleibt, wenn sich der Bestand ändert. Die eigentliche Arbeit findet statt, während Ostafrika offline ist, sodass das Team früher aufwacht, als es zu Bett gegangen ist.
Berichten Sie genau, was passiert. Bei allem, was Sie nicht alleine beheben können oder sollten, muss die Übergabe sauber sein: Was ist falsch, wo, seit wann, was ist betroffen, ob es schlimmer wird und was Sie bereits versucht haben. Kein als Tatsache verkleidetes Raten. Nein: „Das Internet ist ausgefallen.“ Eine klare, schriftliche Vorfallnotiz, auf die ein leitender Ingenieur reagieren kann, sobald er sie öffnet, und eine ordentliche Übergabe an das Ostafrika-Team am Ende Ihrer Schicht.
Gut eskalieren. Kennen Sie die Leiterkälte: Was Sie anfassen dürfen, was Sie nicht allein anfassen dürfen und wen Sie wofür hinzuziehen müssen. Bei einem echten Ausfall frühzeitig zu eskalieren, ist eine gute Entscheidung. Still über ein Problem zu sitzen, weil man sich nicht sicher ist, ist das Einzige, was Menschen wütend aus dem Bett treibt. Behandeln Sie, was Sie können, heben Sie den Rest schnell und deutlich an und drehen Sie keinen Regler zu weit.
3. Wen wir suchen
Ein Netzwerktechniker, der eine Schicht alleine durchstehen kann und die ruhigen Stunden eher als Zeit zum Aufbauen denn als Zeit des Wartens betrachtet. Sie werden nicht der ranghöchste Ingenieur in diesem Team sein und müssen es auch nicht sein. Die Personen, an die Sie eskalieren, haben die CCIE-Ebene. Was wir von Ihnen brauchen, ist Unabhängigkeit und Reichweite: Behandeln Sie ein Problem richtig, lösen Sie einen Großteil davon selbst und nutzen Sie den Rest der Veränderung, um das Netzwerk tatsächlich voranzubringen. Kombinieren Sie dies mit einer klaren Berichterstattung, einem fundierten Urteilsvermögen darüber, wann Hilfe in Anspruch genommen werden muss, und dem Instinkt, den Vorschlag einer Maschine zu hinterfragen, anstatt ihm blind zu folgen, und Sie sind der, den wir suchen.
Ein Muss…
Quelle: Arbeitnow (https://www.arbeitnow.com/jobs/companies/share/remote-network-operation-engineer-320363)
1. Über die Rolle
Share ist der globale Marktplatz für Bandbreite. Wir fassen die Telekommunikationsinfrastruktur in einer einzigen Ebene zusammen und bieten ISPs, Hyperscalern und KI-Unternehmen einen sauberen Weg, um Konnektivität in jedes Zuhause und jedes Unternehmen in Kenia und auf dem Kontinent bereitzustellen. Hinter diesem Marktplatz verbirgt sich ein echtes Netzwerk: ein BGP-Edge-Peering mit Tier-1-Transit, Hyperscalern und lokalen Vermittlungsstellen, ein MPLS-Backbone, Aggregations- und Zugriffsgeräte sowie die Systeme, die alles überwachen.
Für die Partner, die auf uns arbeiten, ist das Netzwerk das Produkt, und das NOC ist der Ort, an dem sie es spüren. Eine saubere Schicht ist ein Partner, der nie wusste, dass etwas passiert ist. Das ist die Bar.
Wir sind früh dran und das Team ist klein, daher können wir uns keine Hände leisten, die nur wissen, wie man eskaliert. Wir brauchen einen fähigen Netzwerktechniker, der eine Schicht übersteht, echte Fehler behebt, ohne jemanden zu wecken, und dann das Netzwerk weiter aufbaut, während Ostafrika schläft: Ausbreitungs- und Peering-Prüfungen, Gesundheitsdurchgänge im gesamten Anwesen, Konfigurationsänderungen bis hin zur Zusammenführung, Tickets von der Tafel, Automatisierung, die jedem die nächste sich wiederholende Aufgabe abnimmt. Das Zuschauen ist der Boden dieser Rolle, nicht die Decke.
Das NOC, dem Sie beitreten würden, ist kein Legacy-Mitglied. Wir bauen es von Grund auf als KI-gestützte Betriebsumgebung auf. Die Weiterleitungsebene läuft auf Open-Source-Routing- und Weiterleitungssoftware, jede Gerätekonfiguration befindet sich in Git und eine LLM-Schicht sitzt über dem Live-Netzwerkstatus. Wenn sich etwas bewegt, liest diese Ebene die Telemetrie, korreliert sie mit der Topologie und dem Konfigurationsverlauf und legt dem Techniker im Dienst eine wahrscheinliche Ursache und eine mögliche Lösung vor. Es geht nicht darum, Ihr Urteilsvermögen zu ersetzen. Es dient dazu, die Zeit zwischen der Auslösung eines Alarms und dem Wissen, wo Sie suchen müssen, zu verkürzen, sodass die durchschnittliche Reparaturzeit in Minuten gemessen wird.
Sie sitzen in diesem System. Man nutzt es, wehrt es ab, wenn es falsch ist, und was man merkt, dass es übersieht, trägt dazu bei, dass es intelligenter wird. Während wir die Automatisierung im gesamten NOC ausbauen, sind Sie nicht nur ein Verbraucher der Werkzeuge. Du hilfst beim Schreiben.
2. Was Sie tun werden
Schauen Sie zu und wissen Sie, was Sie sehen. Setzen Sie sich auf unseren Überwachungsstapel (Zabbix- und Grafana-Dashboards, Flusstelemetrie, Alarmierung) und lesen Sie ihn tatsächlich. Erfahren Sie, wie das Normale aussieht, sodass Ihnen das Ungewöhnliche ins Auge springt: eine abgebrochene BGP-Sitzung, ein ausgefallener Link, steigende Latenz auf einem Pfad, eine durchbrochene Kapazitätsschwelle, ein Partner, der plötzlich nichts drückt oder zieht.
Fehlerbehebung und Lösung. Hier verdienen Sie sich Ihren Sitzplatz. Bestätigen Sie, dass die Warnung echt ist, sammeln Sie die Fakten und lokalisieren Sie den Fehler: ein Peer oder mehrere, wir oder Upstream, ein echter Ausfall oder ein Überwachungsfehler. Die unterstützende Ebene zeigt eine wahrscheinliche Diagnose und einen Lösungsvorschlag an, der Konfigurationsverlauf ist direkt in Git vorhanden und die Runbooks sind live. Ihre Aufgabe ist es, alles kritisch zu lesen, zu entscheiden, was tatsächlich wahr ist, und so viel wie möglich auszuschließen. Bei jedem Ticket, das Sie selbst lösen, handelt es sich um eines, für dessen Bearbeitung unsere leitenden Mitarbeiter nicht aus der Arbeit oder aus dem Bett geholt wurden.
Halten Sie das Netzwerk gesund und nicht nur am Leben. Eine ruhige Schicht ist keine Leerlaufschicht. Führen Sie die proaktiven Durchgänge aus: Überprüfen Sie, ob sich Routen wie vorgesehen ausbreiten, dass RPKI und Filterketten ihre Aufgabe erfüllen, dass Peering- und Transitsitzungen über den Edge hinweg sauber sind und dass kein PoP in Richtung einer Kapazitätsgrenze driftet. Erkennen Sie die langsamen Verschlechterungen, die nie einen Alarm auslösen. Das Tagesteam sollte ein Netzwerk in einem bekanntermaßen guten Zustand übernehmen.
Erstellen und automatisieren. Die sich wiederholenden Teile dieser Arbeit sollten sich nicht wiederholen. Schreiben Sie die Skripte, die eine manuelle Prüfung in eine geplante Prüfung umwandeln. Treiben Sie unsere Konfigurationsautomatisierung voran (Jinja-gesteuerte Generierung, NAPALM oder NETCONF/gNMI für die Geräte), sodass Änderungen aus Daten und nicht aus dem Speicher versendet werden. Wenn der unterstützenden Ebene immer wieder das Gleiche fehlt, ist das ein Kandidat für die Automatisierung, und Sie sind gut aufgestellt, um sie in den Stunden zu erstellen, in denen sonst niemand online ist.
Bringen Sie die Arbeit voran. Sie sind Teil des Netzwerkteams und arbeiten im gleichen Vorstand wie sie. Nehmen Sie Tickets aus der Linear-Warteschlange auf, führen Sie Konfigurationsänderungen durch Überprüfung zur Zusammenführung durch und sorgen Sie dafür, dass unsere Quelle der Wahrheit (Nautobot) korrekt bleibt, wenn sich der Bestand ändert. Die eigentliche Arbeit findet statt, während Ostafrika offline ist, sodass das Team früher aufwacht, als es zu Bett gegangen ist.
Berichten Sie genau, was passiert. Bei allem, was Sie nicht alleine beheben können oder sollten, muss die Übergabe sauber sein: Was ist falsch, wo, seit wann, was ist betroffen, ob es schlimmer wird und was Sie bereits versucht haben. Kein als Tatsache verkleidetes Raten. Nein: „Das Internet ist ausgefallen.“ Eine klare, schriftliche Vorfallnotiz, auf die ein leitender Ingenieur reagieren kann, sobald er sie öffnet, und eine ordentliche Übergabe an das Ostafrika-Team am Ende Ihrer Schicht.
Gut eskalieren. Kennen Sie die Leiterkälte: Was Sie anfassen dürfen, was Sie nicht allein anfassen dürfen und wen Sie wofür hinzuziehen müssen. Bei einem echten Ausfall frühzeitig zu eskalieren, ist eine gute Entscheidung. Still über ein Problem zu sitzen, weil man sich nicht sicher ist, ist das Einzige, was Menschen wütend aus dem Bett treibt. Behandeln Sie, was Sie können, heben Sie den Rest schnell und deutlich an und drehen Sie keinen Regler zu weit.
3. Wen wir suchen
Ein Netzwerktechniker, der eine Schicht alleine durchstehen kann und die ruhigen Stunden eher als Zeit zum Aufbauen denn als Zeit des Wartens betrachtet. Sie werden nicht der ranghöchste Ingenieur in diesem Team sein und müssen es auch nicht sein. Die Personen, an die Sie eskalieren, haben die CCIE-Ebene. Was wir von Ihnen brauchen, ist Unabhängigkeit und Reichweite: Behandeln Sie ein Problem richtig, lösen Sie einen Großteil davon selbst und nutzen Sie den Rest der Veränderung, um das Netzwerk tatsächlich voranzubringen. Kombinieren Sie dies mit einer klaren Berichterstattung, einem fundierten Urteilsvermögen darüber, wann Hilfe in Anspruch genommen werden muss, und dem Instinkt, den Vorschlag einer Maschine zu hinterfragen, anstatt ihm blind zu folgen, und Sie sind der, den wir suchen.
Ein Muss…
Quelle: Arbeitnow (https://www.arbeitnow.com/jobs/companies/share/remote-network-operation-engineer-320363)
Dieses Angebot stammt aus einem Partner-Feed. Bewerben Sie sich auf der Quell-Website.
Quelle: Share
Inserat bereitgestellt von Share.