Empleo
Del feed del socio
Ingeniero de Operación de Red
Precio a consultar
Detalles
- Tipo de empleo
- Jornada completa
- Remoto
- Sí
- Empresa
- Share
Descripción
Traducido automáticamente de English. El texto original es el oficial. Traducción automática — se está preparando una más precisa.
Ingeniero de Operaciones de Red
1. Sobre el rol
Share es el mercado global de ancho de banda. Agregamos infraestructura de telecomunicaciones en una sola capa y brindamos a los ISP, hiperescaladores y empresas de inteligencia artificial un camino limpio para brindar conectividad a todos los hogares y empresas en Kenia y el continente. Detrás de ese mercado hay una red real: un borde BGP que se empareja con tránsito de Nivel 1, hiperescaladores e intercambios locales, una columna vertebral MPLS, equipo de agregación y acceso, y los sistemas que lo vigilan todo.
Para los socios que trabajan con nosotros, la red es el producto y el NOC es donde lo sienten. Un turno limpio es un socio que nunca supo que pasó nada. Esa es la barra.
Llegamos temprano y el equipo es pequeño, por lo que no podemos permitirnos un par de manos que sólo saben escalar. Necesitamos un ingeniero de redes capaz que pueda soportar un turno, resolver fallas reales sin despertar a nadie y luego seguir construyendo la red mientras África Oriental duerme: controles de propagación y peering, pases de salud en todo el estado, cambios de configuración para fusionar, tickets fuera del tablero, automatización que elimine el siguiente trabajo repetitivo del plato de todos. La observación es el suelo de este papel, no el techo.
El CON al que se unirá no es un CON heredado. Lo estamos construyendo como un entorno de operaciones asistido por IA desde cero. El plano de reenvío se ejecuta en software de enrutamiento y reenvío de código abierto, cada configuración de dispositivo reside en Git y una capa LLM se ubica encima del estado activo de la red. Cuando algo se mueve, esa capa lee la telemetría, la correlaciona con la topología y el historial de configuración, y presenta una causa probable y una solución candidata al ingeniero de turno. El punto no es reemplazar su juicio. Se trata de reducir el tiempo entre el disparo de una alerta y el momento en que usted sabe dónde buscar, por lo que el tiempo medio de reparación se mide en minutos.
Te sientas dentro de ese sistema. Lo usas, lo rechazas cuando está mal, y lo que detectas que pasa por alto es parte de cómo se vuelve más inteligente. A medida que desarrollamos la automatización en todo el NOC, usted no es solo un consumidor de herramientas. Tú ayudas a escribirlo.
2. Qué harás
Mire y sepa lo que está mirando. Siéntese en nuestra pila de monitoreo (paneles de Zabbix y Grafana, telemetría de flujo, alertas) y léalo. Descubra cómo se ve lo normal de manera tan anormal que salta a la vista: una sesión BGP que se cayó, un enlace que se cayó, una latencia que aumenta en una ruta, un umbral de capacidad superado, un socio repentinamente empujando o tirando de nada.
Solucionar problemas y resolverlos. Aquí es donde te ganas tu asiento. Confirme que la alerta sea real, recopile los hechos y localice la falla: un par o muchos, nosotros o aguas arriba, una interrupción real o un problema de monitoreo. La capa de asistencia muestra un diagnóstico probable y una solución sugerida, el historial de configuración está ahí en Git y los runbooks están activos. Su trabajo es leerlo todo críticamente, decidir qué es realmente cierto y cerrar lo que pueda por su cuenta. Cada ticket que resuelve usted mismo es uno que nuestros altos cargos no tuvieron que sacar de un trabajo profundo o de la cama para lidiar con él.
Mantenga la red sana, no sólo viva. Un turno tranquilo no es uno inactivo. Ejecute los pases proactivos: verifique que las rutas se propaguen como deberían, que RPKI y las cadenas de filtros estén haciendo su trabajo, que las sesiones de intercambio de tráfico y de intercambio de tráfico estén limpias en todo el borde, que ningún PoP se esté desviando hacia un muro de capacidad. Capte las degradaciones lentas que nunca activan una alerta. El equipo diurno debería heredar una red en buen estado conocido.
Construya y automatice. Las partes repetitivas de este trabajo no deberían seguir siendo repetitivas. Escriba los guiones que conviertan una verificación manual en una programada. Impulsar nuestra automatización de configuración (generación impulsada por Jinja, NAPALM o NETCONF/gNMI contra los dispositivos) para que los cambios se envíen desde los datos, no desde la memoria. Cuando a la capa de asistencia le sigue faltando lo mismo, eso es un candidato para la automatización, y usted está en una buena posición para construirla durante las horas en que nadie más está en línea.
Haga avanzar el trabajo. Eres parte del equipo de la red y trabajas en el mismo tablero que ellos. Recoja tickets de la cola lineal, revise los cambios de configuración para fusionarlos y mantenga nuestra fuente de verdad (Nautobot) precisa a medida que cambia el estado. El trabajo real llega mientras África Oriental está fuera de línea, por lo que el equipo se despierta más adelantado de lo que se acostó.
Informe exactamente lo que está sucediendo. Para todo lo que no puedes o no debes solucionar solo, la transferencia tiene que ser clara: qué está mal, dónde, desde cuándo, qué está afectado, si está empeorando y qué ya has intentado. No hay conjeturas disfrazadas de hechos. No "Internet no funciona". Una nota de incidente clara y escrita sobre la que un ingeniero senior puede actuar en el momento en que la abre, y una entrega ordenada al equipo de África Oriental al final de su turno.
Escala bien. Conozca la escalera en detalle: qué está autorizado a tocar, qué no debe tocar solo y a quién recurrir para qué. Escalar temprano una interrupción genuina es un buen criterio. Sentarse en silencio sobre un problema porque no estaba seguro es lo único que hace que la gente se levante de la cama enojada. Maneja lo que puedas, levanta el resto rápida y claramente, y no gires demasiado ninguno de los diales.
3. A quién buscamos
Un ingeniero de redes que puede valerse por sí solo durante un turno y que trata las horas de tranquilidad como tiempo para construir en lugar de tiempo para esperar. No será el ingeniero de mayor rango en este equipo y no es necesario que lo sea. Las personas a las que te diriges son de nivel CCIE. Lo que necesitamos de usted es independencia y alcance: resuelva un problema adecuadamente, resuelva una buena parte del mismo usted mismo y utilice lo que queda del cambio para hacer avanzar la red. Combine eso con informes claros, buen juicio sobre cuándo pedir ayuda y el instinto de cuestionar la sugerencia de una máquina en lugar de seguirla ciegamente, y usted es a quien estamos buscando.
Imprescindible…
Fuente: Arbeitnow (https://www.arbeitnow.com/jobs/companies/share/remote-network-operation-engineer-320363)
1. Sobre el rol
Share es el mercado global de ancho de banda. Agregamos infraestructura de telecomunicaciones en una sola capa y brindamos a los ISP, hiperescaladores y empresas de inteligencia artificial un camino limpio para brindar conectividad a todos los hogares y empresas en Kenia y el continente. Detrás de ese mercado hay una red real: un borde BGP que se empareja con tránsito de Nivel 1, hiperescaladores e intercambios locales, una columna vertebral MPLS, equipo de agregación y acceso, y los sistemas que lo vigilan todo.
Para los socios que trabajan con nosotros, la red es el producto y el NOC es donde lo sienten. Un turno limpio es un socio que nunca supo que pasó nada. Esa es la barra.
Llegamos temprano y el equipo es pequeño, por lo que no podemos permitirnos un par de manos que sólo saben escalar. Necesitamos un ingeniero de redes capaz que pueda soportar un turno, resolver fallas reales sin despertar a nadie y luego seguir construyendo la red mientras África Oriental duerme: controles de propagación y peering, pases de salud en todo el estado, cambios de configuración para fusionar, tickets fuera del tablero, automatización que elimine el siguiente trabajo repetitivo del plato de todos. La observación es el suelo de este papel, no el techo.
El CON al que se unirá no es un CON heredado. Lo estamos construyendo como un entorno de operaciones asistido por IA desde cero. El plano de reenvío se ejecuta en software de enrutamiento y reenvío de código abierto, cada configuración de dispositivo reside en Git y una capa LLM se ubica encima del estado activo de la red. Cuando algo se mueve, esa capa lee la telemetría, la correlaciona con la topología y el historial de configuración, y presenta una causa probable y una solución candidata al ingeniero de turno. El punto no es reemplazar su juicio. Se trata de reducir el tiempo entre el disparo de una alerta y el momento en que usted sabe dónde buscar, por lo que el tiempo medio de reparación se mide en minutos.
Te sientas dentro de ese sistema. Lo usas, lo rechazas cuando está mal, y lo que detectas que pasa por alto es parte de cómo se vuelve más inteligente. A medida que desarrollamos la automatización en todo el NOC, usted no es solo un consumidor de herramientas. Tú ayudas a escribirlo.
2. Qué harás
Mire y sepa lo que está mirando. Siéntese en nuestra pila de monitoreo (paneles de Zabbix y Grafana, telemetría de flujo, alertas) y léalo. Descubra cómo se ve lo normal de manera tan anormal que salta a la vista: una sesión BGP que se cayó, un enlace que se cayó, una latencia que aumenta en una ruta, un umbral de capacidad superado, un socio repentinamente empujando o tirando de nada.
Solucionar problemas y resolverlos. Aquí es donde te ganas tu asiento. Confirme que la alerta sea real, recopile los hechos y localice la falla: un par o muchos, nosotros o aguas arriba, una interrupción real o un problema de monitoreo. La capa de asistencia muestra un diagnóstico probable y una solución sugerida, el historial de configuración está ahí en Git y los runbooks están activos. Su trabajo es leerlo todo críticamente, decidir qué es realmente cierto y cerrar lo que pueda por su cuenta. Cada ticket que resuelve usted mismo es uno que nuestros altos cargos no tuvieron que sacar de un trabajo profundo o de la cama para lidiar con él.
Mantenga la red sana, no sólo viva. Un turno tranquilo no es uno inactivo. Ejecute los pases proactivos: verifique que las rutas se propaguen como deberían, que RPKI y las cadenas de filtros estén haciendo su trabajo, que las sesiones de intercambio de tráfico y de intercambio de tráfico estén limpias en todo el borde, que ningún PoP se esté desviando hacia un muro de capacidad. Capte las degradaciones lentas que nunca activan una alerta. El equipo diurno debería heredar una red en buen estado conocido.
Construya y automatice. Las partes repetitivas de este trabajo no deberían seguir siendo repetitivas. Escriba los guiones que conviertan una verificación manual en una programada. Impulsar nuestra automatización de configuración (generación impulsada por Jinja, NAPALM o NETCONF/gNMI contra los dispositivos) para que los cambios se envíen desde los datos, no desde la memoria. Cuando a la capa de asistencia le sigue faltando lo mismo, eso es un candidato para la automatización, y usted está en una buena posición para construirla durante las horas en que nadie más está en línea.
Haga avanzar el trabajo. Eres parte del equipo de la red y trabajas en el mismo tablero que ellos. Recoja tickets de la cola lineal, revise los cambios de configuración para fusionarlos y mantenga nuestra fuente de verdad (Nautobot) precisa a medida que cambia el estado. El trabajo real llega mientras África Oriental está fuera de línea, por lo que el equipo se despierta más adelantado de lo que se acostó.
Informe exactamente lo que está sucediendo. Para todo lo que no puedes o no debes solucionar solo, la transferencia tiene que ser clara: qué está mal, dónde, desde cuándo, qué está afectado, si está empeorando y qué ya has intentado. No hay conjeturas disfrazadas de hechos. No "Internet no funciona". Una nota de incidente clara y escrita sobre la que un ingeniero senior puede actuar en el momento en que la abre, y una entrega ordenada al equipo de África Oriental al final de su turno.
Escala bien. Conozca la escalera en detalle: qué está autorizado a tocar, qué no debe tocar solo y a quién recurrir para qué. Escalar temprano una interrupción genuina es un buen criterio. Sentarse en silencio sobre un problema porque no estaba seguro es lo único que hace que la gente se levante de la cama enojada. Maneja lo que puedas, levanta el resto rápida y claramente, y no gires demasiado ninguno de los diales.
3. A quién buscamos
Un ingeniero de redes que puede valerse por sí solo durante un turno y que trata las horas de tranquilidad como tiempo para construir en lugar de tiempo para esperar. No será el ingeniero de mayor rango en este equipo y no es necesario que lo sea. Las personas a las que te diriges son de nivel CCIE. Lo que necesitamos de usted es independencia y alcance: resuelva un problema adecuadamente, resuelva una buena parte del mismo usted mismo y utilice lo que queda del cambio para hacer avanzar la red. Combine eso con informes claros, buen juicio sobre cuándo pedir ayuda y el instinto de cuestionar la sugerencia de una máquina en lugar de seguirla ciegamente, y usted es a quien estamos buscando.
Imprescindible…
Fuente: Arbeitnow (https://www.arbeitnow.com/jobs/companies/share/remote-network-operation-engineer-320363)
Este anuncio proviene de un feed de socios. Solicítalo en el sitio web de origen.
Fuente: Share
Publicación proporcionada por Share.