Emploi
De la source partenaire
Ingénieur Fiabilité du Site 2
Prix sur demande
Détails
- Type de contrat
- Temps plein
- À distance
- Oui
- Entreprise
- Kong Inc.
- Niveau
- Senior
Description
Traduit automatiquement depuis English. Le texte original fait foi. Traduction automatique — une traduction plus précise est en préparation.
Êtes-vous prêt à débloquer l’intelligence ?
Si vous pensez ne pas répondre à tous les critères ci-dessous mais que vous êtes toujours intéressé par le poste, veuillez postuler. Personne ne coche toutes les cases : nous recherchons des candidats particulièrement forts dans certains domaines et ayant un certain intérêt et des capacités dans d’autres.
Êtes-vous prêt à débloquer l’intelligence ?
Si vous pensez ne pas répondre à tous les critères ci-dessous mais que vous êtes toujours intéressé par le poste, veuillez postuler. Personne ne coche toutes les cases : nous recherchons des candidats particulièrement forts dans certains domaines et ayant un certain intérêt et des capacités dans d’autres.
À propos du rôle :
En tant qu'ingénieur en fiabilité de site, vous rejoindrez l'équipe mondiale de la plateforme SRE chargée de créer, d'exploiter et de faire évoluer la plateforme SaaS multirégionale de Kong qui alimente la connectivité API mondiale.
Vous concevrez, automatiserez et exécuterez des systèmes de production au service de milliers de clients sur AWS, GCP et Azure. Vous travaillerez sur tout, des clusters Kubernetes multirégionaux aux architectures de maillage de services et de passerelle, garantissant la fiabilité, l'évolutivité et la sécurité des offres SaaS de Kong.
Il s'agit d'un rôle pratique idéal pour les ingénieurs qui s'épanouit dans l'exécution de systèmes SaaS de production à grande échelle, l'automatisation des opérations et l'amélioration continue des performances, de la résilience et des pipelines de déploiement.
Ce que vous ferez :
•
Exploitez et faites évoluer la plate-forme SaaS mondiale de Kong (Konnect), garantissant la fiabilité, la disponibilité et les performances dans toutes les régions et dans les cloud.
•
Créez, automatisez et maintenez des workflows d'infrastructure et de déploiement basés sur Kubernetes à l'aide de Terraform/Terragrunt , Helm et ArgoCD .
•
Concevez, gérez et optimisez les couches de données et de mise en cache multirégionales, notamment PostgreSQL, Redis, ClickHouse et Druid, pour une haute disponibilité et une faible latence.
•
Exploitez et améliorez les environnements Kong Gateway et Kong Mesh prenant en charge les architectures hybrides et distribuées.
•
Développez et maintenez des pipelines CI/CD et des workflows GitOps pour automatiser la prestation de services et garantir des changements d'infrastructure cohérents.
•
Améliorez l'observabilité et la préparation à la réponse aux incidents grâce à des systèmes tels que Datadog, Prometheus, Grafana et Thanos, en définissant et en suivant les SLO.
•
Collaborer étroitement avec les équipes de développement et de sécurité pour assurer le bon fonctionnement des services SaaS dans le respect des normes de fiabilité, de sécurité et réglementaires.
•
Participer à une rotation mondiale de garde 24h/24 et 7j/7 et favoriser l'amélioration continue des manuels opérationnels et des pratiques post-mortem.
•
Diriger et contribuer à la mise à l'échelle d'initiatives qui améliorent l'élasticité, la fiabilité et la rentabilité sur l'ensemble de la plateforme SaaS.
Ce que vous apporterez :
•
BS en informatique ou expérience pratique équivalente.
•
Expérience avérée dans la gestion de systèmes SaaS ou PaaS à l'échelle de l'entreprise (environnements multirégionaux, multi-locataires et sécurisés).
•
Expertise approfondie de Kubernetes, y compris le débogage des problèmes de cluster/réseau et la conception pour la tolérance aux pannes et l'évolutivité.
•
Forte maîtrise des outils d'infrastructure en tant que code comme Terraform ou Terragrunt.
•
Expérience avec les pipelines CI/CD et les workflows GitOps (ArgoCD, Atlantis, Helm).
•
Maîtrise d'un ou plusieurs langages de programmation (Go, Python, Bash) pour l'automatisation et les outils.
•
Solide compréhension des systèmes Linux/Unix, des réseaux (DNS, TLS/SSL, HTTP), des équilibreurs de charge et des systèmes distribués.
•
Expérience de travail avec les technologies de passerelle API et de maillage de services
•
Familiarité avec les systèmes de streaming comme Kafka et les plateformes d'observabilité (Datadog, Prometheus, Grafana).
•
Expérience de travail dans un environnement de support de production 24 heures sur 24, 7 jours sur 7 et 365 jours par an.
Points bonus :
•
Expérience pratique avec Kong Gateway, Kong Mesh ou des technologies de connectivité de services similaires.
•
Expérience dans l'exploitation de ClickHouse, Druid ou d'autres bases de données de séries chronologiques et d'analyse.
•
Expérience de la gestion de PostgreSQL et Redis dans des configurations multirégionales.
•
Connaissance pratique du réseau AWS (PrivateLink, Transit Gateway, VPC Peering, pare-feu), Azure VNet ou GCP NCC.
•
Solide compréhension de la reprise après sinistre, des tests de résilience et des pratiques de fiabilité axées sur la conformité.
#LI-KC1
À propos de Kong :
Kong Inc., la société AI Connectivity, construit la couche de connectivité de l'IA. Approuvée par les startups Fortune 500® et natives de l'IA, la plateforme unifiée d'API et d'IA de Kong permet aux organisations de sécuriser, gérer, accélérer, gouverner et monétiser le flux d'intelligence entre les API et le trafic d'IA, sur n'importe quel modèle et n'importe quel cloud. Pour plus d'informations, visitez www.konghq.com.
Source : Jobicy (https://jobicy.com/jobs/154637-site-reliability-engineer-2-3)
Si vous pensez ne pas répondre à tous les critères ci-dessous mais que vous êtes toujours intéressé par le poste, veuillez postuler. Personne ne coche toutes les cases : nous recherchons des candidats particulièrement forts dans certains domaines et ayant un certain intérêt et des capacités dans d’autres.
Êtes-vous prêt à débloquer l’intelligence ?
Si vous pensez ne pas répondre à tous les critères ci-dessous mais que vous êtes toujours intéressé par le poste, veuillez postuler. Personne ne coche toutes les cases : nous recherchons des candidats particulièrement forts dans certains domaines et ayant un certain intérêt et des capacités dans d’autres.
À propos du rôle :
En tant qu'ingénieur en fiabilité de site, vous rejoindrez l'équipe mondiale de la plateforme SRE chargée de créer, d'exploiter et de faire évoluer la plateforme SaaS multirégionale de Kong qui alimente la connectivité API mondiale.
Vous concevrez, automatiserez et exécuterez des systèmes de production au service de milliers de clients sur AWS, GCP et Azure. Vous travaillerez sur tout, des clusters Kubernetes multirégionaux aux architectures de maillage de services et de passerelle, garantissant la fiabilité, l'évolutivité et la sécurité des offres SaaS de Kong.
Il s'agit d'un rôle pratique idéal pour les ingénieurs qui s'épanouit dans l'exécution de systèmes SaaS de production à grande échelle, l'automatisation des opérations et l'amélioration continue des performances, de la résilience et des pipelines de déploiement.
Ce que vous ferez :
•
Exploitez et faites évoluer la plate-forme SaaS mondiale de Kong (Konnect), garantissant la fiabilité, la disponibilité et les performances dans toutes les régions et dans les cloud.
•
Créez, automatisez et maintenez des workflows d'infrastructure et de déploiement basés sur Kubernetes à l'aide de Terraform/Terragrunt , Helm et ArgoCD .
•
Concevez, gérez et optimisez les couches de données et de mise en cache multirégionales, notamment PostgreSQL, Redis, ClickHouse et Druid, pour une haute disponibilité et une faible latence.
•
Exploitez et améliorez les environnements Kong Gateway et Kong Mesh prenant en charge les architectures hybrides et distribuées.
•
Développez et maintenez des pipelines CI/CD et des workflows GitOps pour automatiser la prestation de services et garantir des changements d'infrastructure cohérents.
•
Améliorez l'observabilité et la préparation à la réponse aux incidents grâce à des systèmes tels que Datadog, Prometheus, Grafana et Thanos, en définissant et en suivant les SLO.
•
Collaborer étroitement avec les équipes de développement et de sécurité pour assurer le bon fonctionnement des services SaaS dans le respect des normes de fiabilité, de sécurité et réglementaires.
•
Participer à une rotation mondiale de garde 24h/24 et 7j/7 et favoriser l'amélioration continue des manuels opérationnels et des pratiques post-mortem.
•
Diriger et contribuer à la mise à l'échelle d'initiatives qui améliorent l'élasticité, la fiabilité et la rentabilité sur l'ensemble de la plateforme SaaS.
Ce que vous apporterez :
•
BS en informatique ou expérience pratique équivalente.
•
Expérience avérée dans la gestion de systèmes SaaS ou PaaS à l'échelle de l'entreprise (environnements multirégionaux, multi-locataires et sécurisés).
•
Expertise approfondie de Kubernetes, y compris le débogage des problèmes de cluster/réseau et la conception pour la tolérance aux pannes et l'évolutivité.
•
Forte maîtrise des outils d'infrastructure en tant que code comme Terraform ou Terragrunt.
•
Expérience avec les pipelines CI/CD et les workflows GitOps (ArgoCD, Atlantis, Helm).
•
Maîtrise d'un ou plusieurs langages de programmation (Go, Python, Bash) pour l'automatisation et les outils.
•
Solide compréhension des systèmes Linux/Unix, des réseaux (DNS, TLS/SSL, HTTP), des équilibreurs de charge et des systèmes distribués.
•
Expérience de travail avec les technologies de passerelle API et de maillage de services
•
Familiarité avec les systèmes de streaming comme Kafka et les plateformes d'observabilité (Datadog, Prometheus, Grafana).
•
Expérience de travail dans un environnement de support de production 24 heures sur 24, 7 jours sur 7 et 365 jours par an.
Points bonus :
•
Expérience pratique avec Kong Gateway, Kong Mesh ou des technologies de connectivité de services similaires.
•
Expérience dans l'exploitation de ClickHouse, Druid ou d'autres bases de données de séries chronologiques et d'analyse.
•
Expérience de la gestion de PostgreSQL et Redis dans des configurations multirégionales.
•
Connaissance pratique du réseau AWS (PrivateLink, Transit Gateway, VPC Peering, pare-feu), Azure VNet ou GCP NCC.
•
Solide compréhension de la reprise après sinistre, des tests de résilience et des pratiques de fiabilité axées sur la conformité.
#LI-KC1
À propos de Kong :
Kong Inc., la société AI Connectivity, construit la couche de connectivité de l'IA. Approuvée par les startups Fortune 500® et natives de l'IA, la plateforme unifiée d'API et d'IA de Kong permet aux organisations de sécuriser, gérer, accélérer, gouverner et monétiser le flux d'intelligence entre les API et le trafic d'IA, sur n'importe quel modèle et n'importe quel cloud. Pour plus d'informations, visitez www.konghq.com.
Source : Jobicy (https://jobicy.com/jobs/154637-site-reliability-engineer-2-3)
Cette annonce provient d'un flux partenaire. Postulez sur le site source.
Source: Kong Inc.
Annonce fournie par Kong Inc..