Вакансія
З партнерського стрічки
Інженер з експлуатації мережі
Ціна за запитом
Деталі
- Тип зайнятості
- Повна зайнятість
- Віддалено
- Так
- Компанія
- Share
Опис
Автоматичний переклад з English. Оригінальний текст є авторитетним. Машинний переклад — готується точніший варіант.
Інженер з експлуатації мережі
1. Про роль
Share — це глобальний ринок пропускної здатності. Ми об’єднуємо телекомунікаційну інфраструктуру в один рівень і надаємо провайдерам Інтернет-послуг, компаніям, які займаються гіпермасштабуванням, і компаніям зі штучним інтелектом, чистий шлях для забезпечення зв’язку в кожному домі та на підприємстві в Кенії та на континенті. За цим ринком стоїть справжня мережа: периферійний піринг BGP із транзитом рівня 1, гіпермасштабувальниками та локальними обмінами, магістраль MPLS, засоби агрегації та доступу, а також системи, які спостерігають за всім цим.
Для наших партнерів мережа — це продукт, а NOC — це те, де вони це відчувають. Чиста зміна — це партнер, який нічого не знав. Це бар.
Ми рано, а команда невелика, тому ми не можемо дозволити собі пару рук, які знають, як тільки ескалувати. Нам потрібен здібний мережевий інженер, який міг би витримати зміну, усунути реальні помилки, не розбудивши нікого, а потім продовжувати будувати мережу, поки Східна Африка спить: розповсюдження та однорангові перевірки, передачі стану здоров’я через маєток, зміни конфігурації для злиття, квитки з дошки, автоматизація, яка знімає наступну повторювану роботу з тарілки кожного. Спостереження - це підлога цієї ролі, а не стеля.
НОК, до якого ви хочете приєднатися, не є успадкованим. Ми створюємо його як операційне середовище за допомогою ШІ з нуля. Площина переадресації працює на програмному забезпеченні для маршрутизації та переадресації з відкритим кодом, кожна конфігурація пристрою зберігається в Git, а рівень LLM знаходиться поверх поточного стану мережі. Коли щось рухається, цей рівень зчитує телеметричні дані, співвідносить їх із топологією та історією конфігурації та надає інженеру на зміну ймовірну причину та варіант виправлення. Справа не в тому, щоб замінити своє судження. Він призначений для того, щоб скоротити час між спрацьовуванням тривоги й тим, як ви знаєте, де шукати, тому середній час ремонту вимірюється в хвилинах.
Ви сидите всередині цієї системи. Ви використовуєте його, ви відмовляєтеся від нього, коли він помиляється, і те, що ви вловлюєте, що він пропускає, є частиною того, як він стає розумнішим. Оскільки ми розробляємо автоматизацію в усіх NOC, ви не просто споживачі інструментів. Ви допоможіть це написати.
2. Що ви будете робити
Дивіться і знайте, на що ви дивитеся. Сядьте на наш стек моніторингу (інформаційні панелі Zabbix і Grafana, телеметрія потоку, сповіщення) і фактично прочитайте це. Дізнайтеся, як виглядає звичайний стан, а потім вискакує на вас ненормальне: сеанс BGP, який перервався, посилання, яке впало, затримка піднімається на шляху, порушено поріг пропускної здатності, партнер раптово нічого не натискає або не тягне.
Усунення та вирішення проблеми. Тут ви отримуєте своє місце. Підтвердьте, що сповіщення реальне, зберіть факти та локалізуйте несправність: один вузол чи багато, ми чи вище за течією, реальний збій чи проблиск моніторингу. Допоміжний рівень показує ймовірну діагностику та пропоноване виправлення, історія конфігурацій знаходиться прямо в Git, а Runbook активні. Ваше завдання полягає в тому, щоб прочитати все це критично, вирішити, що насправді правда, і закрити те, що ви можете самостійно. Кожен запит, який ви вирішуєте самостійно, — це той, з яким наші старші люди не витягнули з роботи чи з ліжка.
Підтримуйте мережу здоровою, а не просто живою. Тиха зміна не є простою. Запустіть проактивні пропуски: перевірте, чи маршрути поширюються належним чином, чи RPKI та ланцюги фільтрів виконують свою роботу, чи однорангові та транзитні сеанси чисті через межу, чи жоден PoP не дрейфує до стіни пропускної здатності. Ловіть повільні деградації, які ніколи не спрацьовують. Денна команда має успадкувати мережу у завідомо хорошому стані.
Створюйте та автоматизуйте. Частини цієї роботи, що повторюються, не повинні повторюватися. Напишіть сценарії, які перетворюють ручну перевірку на заплановану. Просувайте нашу автоматизацію конфігурації (генерація на основі Jinja, NAPALM або NETCONF/gNMI для пристроїв), щоб зміни надсилалися з даних, а не з пам’яті. Коли допоміжному рівню постійно не вистачає одного й того ж, це є кандидатом на автоматизацію, і ви маєте хороші можливості створити його протягом годин, коли ніхто інший не в мережі.
Рухайте роботу вперед. Ви є частиною мережевої команди, яка працює на тій самій дошці, що й вони. Збирайте квитки з черги Linear, перевіряйте конфігураційні зміни, щоб об’єднати, і підтримуйте точність нашого джерела правди (Наутобота) у міру змін майна. Справжня робота починається, коли Східна Африка офлайн, тому команда прокидається набагато раніше, ніж лягла спати.
Повідомте, що саме відбувається. Для всього, що ви не можете або не повинні виправити самостійно, передача має бути чіткою: що не так, де, з якого часу, що вплинуло, чи погіршується, і що ви вже пробували. Без здогадок, виданих за факти. Ніяких «інтернет не працює». Чітка письмова записка про інцидент, якою старший інженер може впоратися в момент відкриття, і акуратна передача команді зі Східної Африки наприкінці вашої зміни.
Ескалація добре. Дізнайтеся про драбину: чого вам дозволено торкатися, чого ви не повинні торкатися поодинці і кого для чого залучати. Завчасна ескалація справжнього збою є правильним судженням. Мовчазне вирішення проблеми через те, що ви не впевнені, — це єдине, що змушує людей вставати з ліжка. Робіть усе, що можете, підніміть решту швидко й чітко, і не повертайте жоден диск занадто далеко.
3. Кого ми шукаємо
Мережевий інженер, який може самотужки стояти протягом зміни, і який розглядає спокійні години як час для створення, а не час для очікування. Ви не будете найстаршим інженером у цій команді, і вам це не потрібно. Люди, до яких ви звертаєтеся, мають рівень CCIE. Що нам потрібно від вас, так це незалежність і діапазон: правильно вирішуйте проблему, вирішуйте справедливу частину її самостійно та використовуйте те, що залишилося від зміни, щоб фактично просувати мережу вперед. Поєднайте це з чітким звітуванням, розумним судженням про те, коли залучати допомогу, і інстинктом ставити під сумнів пропозиції машини, а не слідувати їм сліпо, і ви той, кого ми шукаємо.
Необхідно мати…
Джерело: Arbeitnow (https://www.arbeitnow.com/jobs/companies/share/remote-network-operation-engineer-320363)
1. Про роль
Share — це глобальний ринок пропускної здатності. Ми об’єднуємо телекомунікаційну інфраструктуру в один рівень і надаємо провайдерам Інтернет-послуг, компаніям, які займаються гіпермасштабуванням, і компаніям зі штучним інтелектом, чистий шлях для забезпечення зв’язку в кожному домі та на підприємстві в Кенії та на континенті. За цим ринком стоїть справжня мережа: периферійний піринг BGP із транзитом рівня 1, гіпермасштабувальниками та локальними обмінами, магістраль MPLS, засоби агрегації та доступу, а також системи, які спостерігають за всім цим.
Для наших партнерів мережа — це продукт, а NOC — це те, де вони це відчувають. Чиста зміна — це партнер, який нічого не знав. Це бар.
Ми рано, а команда невелика, тому ми не можемо дозволити собі пару рук, які знають, як тільки ескалувати. Нам потрібен здібний мережевий інженер, який міг би витримати зміну, усунути реальні помилки, не розбудивши нікого, а потім продовжувати будувати мережу, поки Східна Африка спить: розповсюдження та однорангові перевірки, передачі стану здоров’я через маєток, зміни конфігурації для злиття, квитки з дошки, автоматизація, яка знімає наступну повторювану роботу з тарілки кожного. Спостереження - це підлога цієї ролі, а не стеля.
НОК, до якого ви хочете приєднатися, не є успадкованим. Ми створюємо його як операційне середовище за допомогою ШІ з нуля. Площина переадресації працює на програмному забезпеченні для маршрутизації та переадресації з відкритим кодом, кожна конфігурація пристрою зберігається в Git, а рівень LLM знаходиться поверх поточного стану мережі. Коли щось рухається, цей рівень зчитує телеметричні дані, співвідносить їх із топологією та історією конфігурації та надає інженеру на зміну ймовірну причину та варіант виправлення. Справа не в тому, щоб замінити своє судження. Він призначений для того, щоб скоротити час між спрацьовуванням тривоги й тим, як ви знаєте, де шукати, тому середній час ремонту вимірюється в хвилинах.
Ви сидите всередині цієї системи. Ви використовуєте його, ви відмовляєтеся від нього, коли він помиляється, і те, що ви вловлюєте, що він пропускає, є частиною того, як він стає розумнішим. Оскільки ми розробляємо автоматизацію в усіх NOC, ви не просто споживачі інструментів. Ви допоможіть це написати.
2. Що ви будете робити
Дивіться і знайте, на що ви дивитеся. Сядьте на наш стек моніторингу (інформаційні панелі Zabbix і Grafana, телеметрія потоку, сповіщення) і фактично прочитайте це. Дізнайтеся, як виглядає звичайний стан, а потім вискакує на вас ненормальне: сеанс BGP, який перервався, посилання, яке впало, затримка піднімається на шляху, порушено поріг пропускної здатності, партнер раптово нічого не натискає або не тягне.
Усунення та вирішення проблеми. Тут ви отримуєте своє місце. Підтвердьте, що сповіщення реальне, зберіть факти та локалізуйте несправність: один вузол чи багато, ми чи вище за течією, реальний збій чи проблиск моніторингу. Допоміжний рівень показує ймовірну діагностику та пропоноване виправлення, історія конфігурацій знаходиться прямо в Git, а Runbook активні. Ваше завдання полягає в тому, щоб прочитати все це критично, вирішити, що насправді правда, і закрити те, що ви можете самостійно. Кожен запит, який ви вирішуєте самостійно, — це той, з яким наші старші люди не витягнули з роботи чи з ліжка.
Підтримуйте мережу здоровою, а не просто живою. Тиха зміна не є простою. Запустіть проактивні пропуски: перевірте, чи маршрути поширюються належним чином, чи RPKI та ланцюги фільтрів виконують свою роботу, чи однорангові та транзитні сеанси чисті через межу, чи жоден PoP не дрейфує до стіни пропускної здатності. Ловіть повільні деградації, які ніколи не спрацьовують. Денна команда має успадкувати мережу у завідомо хорошому стані.
Створюйте та автоматизуйте. Частини цієї роботи, що повторюються, не повинні повторюватися. Напишіть сценарії, які перетворюють ручну перевірку на заплановану. Просувайте нашу автоматизацію конфігурації (генерація на основі Jinja, NAPALM або NETCONF/gNMI для пристроїв), щоб зміни надсилалися з даних, а не з пам’яті. Коли допоміжному рівню постійно не вистачає одного й того ж, це є кандидатом на автоматизацію, і ви маєте хороші можливості створити його протягом годин, коли ніхто інший не в мережі.
Рухайте роботу вперед. Ви є частиною мережевої команди, яка працює на тій самій дошці, що й вони. Збирайте квитки з черги Linear, перевіряйте конфігураційні зміни, щоб об’єднати, і підтримуйте точність нашого джерела правди (Наутобота) у міру змін майна. Справжня робота починається, коли Східна Африка офлайн, тому команда прокидається набагато раніше, ніж лягла спати.
Повідомте, що саме відбувається. Для всього, що ви не можете або не повинні виправити самостійно, передача має бути чіткою: що не так, де, з якого часу, що вплинуло, чи погіршується, і що ви вже пробували. Без здогадок, виданих за факти. Ніяких «інтернет не працює». Чітка письмова записка про інцидент, якою старший інженер може впоратися в момент відкриття, і акуратна передача команді зі Східної Африки наприкінці вашої зміни.
Ескалація добре. Дізнайтеся про драбину: чого вам дозволено торкатися, чого ви не повинні торкатися поодинці і кого для чого залучати. Завчасна ескалація справжнього збою є правильним судженням. Мовчазне вирішення проблеми через те, що ви не впевнені, — це єдине, що змушує людей вставати з ліжка. Робіть усе, що можете, підніміть решту швидко й чітко, і не повертайте жоден диск занадто далеко.
3. Кого ми шукаємо
Мережевий інженер, який може самотужки стояти протягом зміни, і який розглядає спокійні години як час для створення, а не час для очікування. Ви не будете найстаршим інженером у цій команді, і вам це не потрібно. Люди, до яких ви звертаєтеся, мають рівень CCIE. Що нам потрібно від вас, так це незалежність і діапазон: правильно вирішуйте проблему, вирішуйте справедливу частину її самостійно та використовуйте те, що залишилося від зміни, щоб фактично просувати мережу вперед. Поєднайте це з чітким звітуванням, розумним судженням про те, коли залучати допомогу, і інстинктом ставити під сумнів пропозиції машини, а не слідувати їм сліпо, і ви той, кого ми шукаємо.
Необхідно мати…
Джерело: Arbeitnow (https://www.arbeitnow.com/jobs/companies/share/remote-network-operation-engineer-320363)
Це оголошення надходить із партнерського фіду. Подайте заявку на сайті джерела.
Джерело: Share
Оголошення надано Share.