Работа
Из фида партнера
Инженер по эксплуатации сети
Цена по запросу
Детали
- Тип занятости
- Полная занятость
- Удалённо
- Да
- Компания
- Share
Описание
Автоматически переведено с языка English. Оригинальный текст является основным. Машинный перевод — готовится более точный вариант.
Инженер по эксплуатации сети
1. О роли
Share — это глобальный рынок пропускной способности. Мы объединяем телекоммуникационную инфраструктуру в один уровень и предоставляем интернет-провайдерам, гиперскейлерам и компаниям, занимающимся искусственным интеллектом, чистый путь для обеспечения подключения в каждый дом и бизнес в Кении и на континенте. За этим рынком стоит реальная сеть: пограничный пиринг BGP с транзитом уровня 1, гиперскейлерами и локальными обменами, магистральная сеть MPLS, устройства агрегации и доступа, а также системы, которые наблюдают за всем этим.
Для партнеров, которые работают с нами, сеть — это продукт, а НОК — это то место, где они это чувствуют. Чистая смена — это партнер, который никогда не знал, что что-то произошло. Это и есть бар.
Мы пришли рано, а команда небольшая, поэтому мы не можем позволить себе пару рук, которые умеют только обостряться. Нам нужен способный сетевой инженер, который сможет выдержать смену, устранить реальные неисправности, никого не разбудив, а затем продолжать строить сеть, пока Восточная Африка спит: проверки распространения и пиринга, проверка работоспособности по всему поместью, внесение изменений в конфигурацию для слияния, отказ от заявок, автоматизация, которая снимает с каждого следующую повторяющуюся работу. Наблюдение — это основа этой роли, а не потолок.
НОК, к которому вы собираетесь присоединиться, не является устаревшим. Мы с нуля создаем ее как операционную среду с поддержкой искусственного интеллекта. Плоскость пересылки работает на программном обеспечении маршрутизации и пересылки с открытым исходным кодом, каждая конфигурация устройства хранится в Git, а уровень LLM находится поверх текущего состояния сети. Когда что-то движется, этот уровень считывает данные телеметрии, сопоставляет их с топологией и историей конфигурации и представляет вероятную причину и возможное исправление инженеру смены. Дело не в том, чтобы заменить ваше суждение. Это позволит сократить время между срабатыванием тревоги и знанием того, где искать, поэтому среднее время ремонта измеряется минутами.
Вы сидите внутри этой системы. Вы используете его, сопротивляетесь ему, когда он неправ, и то, что вы замечаете, что он упускает, является частью того, как он становится умнее. Поскольку мы внедряем автоматизацию в рамках NOC, вы не просто являетесь потребителем инструментов. Вы поможете написать это.
2. Что вы будете делать
Смотрите и знайте, на что вы смотрите. Сядьте на наш стек мониторинга (панели мониторинга Zabbix и Grafana, телеметрия потока, оповещения) и прочтите его. Узнайте, как выглядит нормально, настолько ненормально бросается в глаза: прерванный сеанс BGP, обрыв соединения, увеличение задержки на пути, нарушение порога пропускной способности, внезапное нажатие или отключение партнера.
Устраните неполадку и решите ее. Здесь вы зарабатываете свое место. Подтвердите, что предупреждение действительно, соберите факты и локализуйте неисправность: один узел или несколько, мы или вышестоящие, реальный сбой или сигнал мониторинга. Вспомогательный уровень отображает вероятный диагноз и предлагаемое исправление, история конфигурации находится прямо в Git, а модули Runbook активны. Ваша задача — критически прочитать все это, решить, что на самом деле верно, и закрыть то, что вы можете, самостоятельно. Каждый вопрос, который вы решаете сами, — это тот случай, когда наши старшие сотрудники не вытаскиваются из глубокой работы или не встают с постели, чтобы разобраться.
Поддерживайте сеть здоровой, а не просто живой. Спокойная смена – это не праздная смена. Запустите упреждающие проходы: убедитесь, что маршруты распространяются так, как должны, что RPKI и цепочки фильтров выполняют свою работу, что сеансы пиринга и транзита чисты на границе, что ни один PoP не смещается к стене емкости. Отслеживайте медленное снижение производительности, которое никогда не вызывает оповещения. Дневная группа должна унаследовать сеть в заведомо исправном состоянии.
Создавайте и автоматизируйте. Повторяющиеся части этой работы не должны оставаться повторяющимися. Напишите скрипты, которые превращают ручную проверку в плановую. Продвигайте нашу автоматизацию конфигурации (генерация на основе Jinja, NAPALM или NETCONF/gNMI для устройств), чтобы изменения передавались из данных, а не из памяти. Когда на вспомогательном уровне постоянно отсутствует одно и то же, это кандидат на автоматизацию, и у вас есть хорошие возможности создать его в те часы, когда никто больше не находится в сети.
Продвигайте работу вперед. Вы являетесь частью сетевой команды и работаете на том же форуме, что и они. Берите билеты из линейной очереди, проверяйте изменения конфигурации для объединения и сохраняйте точность нашего источника истины (Наавтобота) по мере изменения состояния. Настоящая работа начинается, пока Восточная Африка не в сети, поэтому команда просыпается раньше, чем ложилась спать.
Сообщите точно, что происходит. Для всего, что вы не можете или не должны исправить в одиночку, передача должна быть чистой: что не так, где, с каких пор, что затронуто, становится ли хуже и что вы уже пробовали. Никаких догадок, выдаваемых за факт. Никаких «Интернет не работает». Четкая письменная записка о происшествии, которую старший инженер может принять, как только ее откроет, и аккуратная передача команде восточноафриканской команды в конце вашей смены.
Эскалируйте хорошо. Хладнокровно знайте лестницу: к чему вам разрешено прикасаться, к чему вам нельзя прикасаться в одиночку и кого за что приводить. Разумным решением является ранняя эскалация ситуации в случае реального сбоя. Молчание о проблеме из-за того, что вы не уверены, — это единственное, что заставляет людей вставать с постели и злиться. Берите в руки то, что можете, остальное поднимайте быстро и четко и не поворачивайте слишком далеко ни один диск.
3. Кого мы ищем
Сетевой инженер, который может самостоятельно работать в течение всей смены и который рассматривает тихие часы как время для строительства, а не как время для ожидания. Вы не будете самым старшим инженером в этой команде, да и не обязательно им быть. Люди, которым вы передаете информацию, имеют уровень CCIE. Что нам нужно от вас, так это независимость и дальность действия: проработайте проблему должным образом, решите значительную ее часть самостоятельно и используйте то, что осталось от смены, для фактического продвижения сети вперед. Соедините это с четкими отчетами, здравым суждением о том, когда следует обратиться за помощью, и инстинктом подвергать сомнению предложения машины, а не следовать им вслепую, и вы — тот, кого мы ищем.
Обязательно…
Источник: Arbeitnow (https://www.arbeitnow.com/jobs/companies/share/remote-network-operation-engineer-320363).
1. О роли
Share — это глобальный рынок пропускной способности. Мы объединяем телекоммуникационную инфраструктуру в один уровень и предоставляем интернет-провайдерам, гиперскейлерам и компаниям, занимающимся искусственным интеллектом, чистый путь для обеспечения подключения в каждый дом и бизнес в Кении и на континенте. За этим рынком стоит реальная сеть: пограничный пиринг BGP с транзитом уровня 1, гиперскейлерами и локальными обменами, магистральная сеть MPLS, устройства агрегации и доступа, а также системы, которые наблюдают за всем этим.
Для партнеров, которые работают с нами, сеть — это продукт, а НОК — это то место, где они это чувствуют. Чистая смена — это партнер, который никогда не знал, что что-то произошло. Это и есть бар.
Мы пришли рано, а команда небольшая, поэтому мы не можем позволить себе пару рук, которые умеют только обостряться. Нам нужен способный сетевой инженер, который сможет выдержать смену, устранить реальные неисправности, никого не разбудив, а затем продолжать строить сеть, пока Восточная Африка спит: проверки распространения и пиринга, проверка работоспособности по всему поместью, внесение изменений в конфигурацию для слияния, отказ от заявок, автоматизация, которая снимает с каждого следующую повторяющуюся работу. Наблюдение — это основа этой роли, а не потолок.
НОК, к которому вы собираетесь присоединиться, не является устаревшим. Мы с нуля создаем ее как операционную среду с поддержкой искусственного интеллекта. Плоскость пересылки работает на программном обеспечении маршрутизации и пересылки с открытым исходным кодом, каждая конфигурация устройства хранится в Git, а уровень LLM находится поверх текущего состояния сети. Когда что-то движется, этот уровень считывает данные телеметрии, сопоставляет их с топологией и историей конфигурации и представляет вероятную причину и возможное исправление инженеру смены. Дело не в том, чтобы заменить ваше суждение. Это позволит сократить время между срабатыванием тревоги и знанием того, где искать, поэтому среднее время ремонта измеряется минутами.
Вы сидите внутри этой системы. Вы используете его, сопротивляетесь ему, когда он неправ, и то, что вы замечаете, что он упускает, является частью того, как он становится умнее. Поскольку мы внедряем автоматизацию в рамках NOC, вы не просто являетесь потребителем инструментов. Вы поможете написать это.
2. Что вы будете делать
Смотрите и знайте, на что вы смотрите. Сядьте на наш стек мониторинга (панели мониторинга Zabbix и Grafana, телеметрия потока, оповещения) и прочтите его. Узнайте, как выглядит нормально, настолько ненормально бросается в глаза: прерванный сеанс BGP, обрыв соединения, увеличение задержки на пути, нарушение порога пропускной способности, внезапное нажатие или отключение партнера.
Устраните неполадку и решите ее. Здесь вы зарабатываете свое место. Подтвердите, что предупреждение действительно, соберите факты и локализуйте неисправность: один узел или несколько, мы или вышестоящие, реальный сбой или сигнал мониторинга. Вспомогательный уровень отображает вероятный диагноз и предлагаемое исправление, история конфигурации находится прямо в Git, а модули Runbook активны. Ваша задача — критически прочитать все это, решить, что на самом деле верно, и закрыть то, что вы можете, самостоятельно. Каждый вопрос, который вы решаете сами, — это тот случай, когда наши старшие сотрудники не вытаскиваются из глубокой работы или не встают с постели, чтобы разобраться.
Поддерживайте сеть здоровой, а не просто живой. Спокойная смена – это не праздная смена. Запустите упреждающие проходы: убедитесь, что маршруты распространяются так, как должны, что RPKI и цепочки фильтров выполняют свою работу, что сеансы пиринга и транзита чисты на границе, что ни один PoP не смещается к стене емкости. Отслеживайте медленное снижение производительности, которое никогда не вызывает оповещения. Дневная группа должна унаследовать сеть в заведомо исправном состоянии.
Создавайте и автоматизируйте. Повторяющиеся части этой работы не должны оставаться повторяющимися. Напишите скрипты, которые превращают ручную проверку в плановую. Продвигайте нашу автоматизацию конфигурации (генерация на основе Jinja, NAPALM или NETCONF/gNMI для устройств), чтобы изменения передавались из данных, а не из памяти. Когда на вспомогательном уровне постоянно отсутствует одно и то же, это кандидат на автоматизацию, и у вас есть хорошие возможности создать его в те часы, когда никто больше не находится в сети.
Продвигайте работу вперед. Вы являетесь частью сетевой команды и работаете на том же форуме, что и они. Берите билеты из линейной очереди, проверяйте изменения конфигурации для объединения и сохраняйте точность нашего источника истины (Наавтобота) по мере изменения состояния. Настоящая работа начинается, пока Восточная Африка не в сети, поэтому команда просыпается раньше, чем ложилась спать.
Сообщите точно, что происходит. Для всего, что вы не можете или не должны исправить в одиночку, передача должна быть чистой: что не так, где, с каких пор, что затронуто, становится ли хуже и что вы уже пробовали. Никаких догадок, выдаваемых за факт. Никаких «Интернет не работает». Четкая письменная записка о происшествии, которую старший инженер может принять, как только ее откроет, и аккуратная передача команде восточноафриканской команды в конце вашей смены.
Эскалируйте хорошо. Хладнокровно знайте лестницу: к чему вам разрешено прикасаться, к чему вам нельзя прикасаться в одиночку и кого за что приводить. Разумным решением является ранняя эскалация ситуации в случае реального сбоя. Молчание о проблеме из-за того, что вы не уверены, — это единственное, что заставляет людей вставать с постели и злиться. Берите в руки то, что можете, остальное поднимайте быстро и четко и не поворачивайте слишком далеко ни один диск.
3. Кого мы ищем
Сетевой инженер, который может самостоятельно работать в течение всей смены и который рассматривает тихие часы как время для строительства, а не как время для ожидания. Вы не будете самым старшим инженером в этой команде, да и не обязательно им быть. Люди, которым вы передаете информацию, имеют уровень CCIE. Что нам нужно от вас, так это независимость и дальность действия: проработайте проблему должным образом, решите значительную ее часть самостоятельно и используйте то, что осталось от смены, для фактического продвижения сети вперед. Соедините это с четкими отчетами, здравым суждением о том, когда следует обратиться за помощью, и инстинктом подвергать сомнению предложения машины, а не следовать им вслепую, и вы — тот, кого мы ищем.
Обязательно…
Источник: Arbeitnow (https://www.arbeitnow.com/jobs/companies/share/remote-network-operation-engineer-320363).
Это объявление получено из партнерского фида. Оформляйте заказ на исходном сайте.
Источник: Share
Объявление предоставлено Share.