Job
Aus Partner-Feed
Site Reliability Engineer 2
Preis auf Anfrage
Details
- Beschäftigungsart
- Vollzeit
- Remote
- Ja
- Unternehmen
- Kong Inc.
- Level
- Senior
Beschreibung
Automatisch aus dem English übersetzt. Der Originaltext ist maßgeblich. Maschinenübersetzung – eine genauere Version wird vorbereitet.
Sind Sie bereit, Informationen freizuschalten?
Wenn Sie der Meinung sind, dass Sie nicht alle unten aufgeführten Kriterien erfüllen, aber dennoch an der Stelle interessiert sind, bewerben Sie sich bitte. Niemand kreuzt jedes Kästchen an – wir suchen nach Kandidaten, die in einigen Bereichen besonders stark sind und in anderen ein gewisses Interesse und Fähigkeiten mitbringen.
Sind Sie bereit, Informationen freizuschalten?
Wenn Sie der Meinung sind, dass Sie nicht alle unten aufgeführten Kriterien erfüllen, aber dennoch an der Stelle interessiert sind, bewerben Sie sich bitte. Niemand kreuzt jedes Kästchen an – wir suchen nach Kandidaten, die in einigen Bereichen besonders stark sind und in anderen ein gewisses Interesse und Fähigkeiten mitbringen.
Über die Rolle:
Als Site Reliability Engineer werden Sie Teil des globalen Platform SRE-Teams, das für den Aufbau, Betrieb und die Skalierung der multiregionalen SaaS-Plattform von Kong verantwortlich ist, die die weltweite API-Konnektivität unterstützt.
Sie entwerfen, automatisieren und betreiben Produktionssysteme, die Tausende von Kunden in AWS, GCP und Azure bedienen. Sie arbeiten an allem, von multiregionalen Kubernetes-Clustern bis hin zu Service-Mesh- und Gateway-Architekturen, und stellen die Zuverlässigkeit, Skalierbarkeit und Sicherheit der SaaS-Angebote von Kong sicher.
Dies ist eine praktische Rolle, ideal für Ingenieure, die daran interessiert sind, Produktions-SaaS-Systeme in großem Maßstab zu betreiben, Abläufe zu automatisieren und Leistung, Belastbarkeit und Bereitstellungspipelines kontinuierlich zu verbessern.
Was Sie tun werden:
•
Betreiben und skalieren Sie Kongs globale SaaS-Plattform (Konnect) und stellen Sie so Zuverlässigkeit, Verfügbarkeit und Leistung über Regionen und Clouds hinweg sicher.
•
Erstellen, automatisieren und warten Sie Kubernetes-basierte Infrastruktur- und Bereitstellungsworkflows mit Terraform/Terragrunt, Helm und ArgoCD.
•
Entwerfen, pflegen und optimieren Sie Daten- und Caching-Ebenen für mehrere Regionen – einschließlich PostgreSQL, Redis, ClickHouse und Druid – für hohe Verfügbarkeit und geringe Latenz.
•
Betreiben und verbessern Sie Kong Gateway- und Kong Mesh-Umgebungen, die hybride und verteilte Architekturen unterstützen.
•
Entwickeln und pflegen Sie CI/CD-Pipelines und GitOps-Workflows, um die Servicebereitstellung zu automatisieren und konsistente Infrastrukturänderungen sicherzustellen.
•
Verbessern Sie die Beobachtbarkeit und die Reaktionsbereitschaft bei Vorfällen durch Systeme wie Datadog, Prometheus, Grafana und Thanos, die SLOs definieren und verfolgen.
•
Arbeiten Sie eng mit Entwicklungs- und Sicherheitsteams zusammen, um einen reibungslosen Betrieb von SaaS-Diensten unter Einhaltung von Zuverlässigkeits-, Sicherheits- und Regulierungsstandards sicherzustellen.
•
Nehmen Sie an einem weltweiten 24/7-Bereitschaftsdienst teil und treiben Sie die kontinuierliche Verbesserung der betrieblichen Vorgehensweisen und Postmortem-Praktiken voran.
•
Leiten Sie Skalierungsinitiativen, die die Elastizität, Zuverlässigkeit und Kosteneffizienz der gesamten SaaS-Plattform verbessern, und tragen Sie dazu bei.
Was Sie mitbringen:
•
Bachelor-Abschluss in Informatik oder gleichwertige praktische Erfahrung.
•
Nachgewiesene Erfahrung in der Verwaltung von SaaS- oder PaaS-Systemen auf Unternehmensebene (mehrregionale, mandantenfähige, sichere Umgebungen).
•
Umfassende Fachkenntnisse in Kubernetes, einschließlich der Fehlerbehebung bei Cluster-/Netzwerkproblemen und der Entwicklung von Fehlertoleranz und Skalierbarkeit.
•
Gute Kenntnisse im Umgang mit Infrastructure-as-Code-Tools wie Terraform oder Terragrunt.
•
Erfahrung mit CI/CD-Pipelines und GitOps-Workflows (ArgoCD, Atlantis, Helm).
•
Kenntnisse in einer oder mehreren Programmiersprachen (Go, Python, Bash) für Automatisierung und Tooling.
•
Solides Verständnis von Linux/Unix-Systemen, Netzwerken (DNS, TLS/SSL, HTTP), Load Balancern und verteilten Systemen.
•
Erfahrung in der Arbeit mit API-Gateway- und Service-Mesh-Technologien
•
Vertrautheit mit Streaming-Systemen wie Kafka und Observability-Plattformen (Datadog, Prometheus, Grafana).
•
Erfahrung in der Arbeit in einer 24/7/365-Produktionsunterstützungsumgebung.
Bonuspunkte:
•
Praktische Erfahrung mit Kong Gateway, Kong Mesh oder ähnlichen Service-Konnektivitätstechnologien.
•
Erfahrung im Betrieb von ClickHouse, Druid oder anderen Zeitreihen- und Analysedatenbanken.
•
Erfahrung in der Verwaltung von PostgreSQL und Redis in Konfigurationen mit mehreren Regionen.
•
Kenntnisse in AWS-Netzwerken (PrivateLink, Transit Gateway, VPC-Peering, Firewalls), Azure VNet oder GCP NCC.
•
Ausgeprägtes Verständnis für Disaster Recovery, Ausfallsicherheitstests und Compliance-gesteuerte Zuverlässigkeitspraktiken.
#LI-KC1
Über Kong:
Kong Inc., das AI Connectivity Company, baut die Konnektivitätsebene der KI auf. Die einheitliche API- und KI-Plattform von Kong genießt bei Fortune 500® und KI-nativen Startups gleichermaßen das Vertrauen und ermöglicht es Unternehmen, den Informationsfluss über APIs und KI-Verkehr hinweg zu sichern, zu verwalten, zu beschleunigen, zu steuern und zu monetarisieren – auf jedem Modell und in jeder Cloud. Weitere Informationen finden Sie unter www.konghq.com.
Quelle: Jobicy (https://jobicy.com/jobs/154637-site-reliability-engineer-2-3)
Wenn Sie der Meinung sind, dass Sie nicht alle unten aufgeführten Kriterien erfüllen, aber dennoch an der Stelle interessiert sind, bewerben Sie sich bitte. Niemand kreuzt jedes Kästchen an – wir suchen nach Kandidaten, die in einigen Bereichen besonders stark sind und in anderen ein gewisses Interesse und Fähigkeiten mitbringen.
Sind Sie bereit, Informationen freizuschalten?
Wenn Sie der Meinung sind, dass Sie nicht alle unten aufgeführten Kriterien erfüllen, aber dennoch an der Stelle interessiert sind, bewerben Sie sich bitte. Niemand kreuzt jedes Kästchen an – wir suchen nach Kandidaten, die in einigen Bereichen besonders stark sind und in anderen ein gewisses Interesse und Fähigkeiten mitbringen.
Über die Rolle:
Als Site Reliability Engineer werden Sie Teil des globalen Platform SRE-Teams, das für den Aufbau, Betrieb und die Skalierung der multiregionalen SaaS-Plattform von Kong verantwortlich ist, die die weltweite API-Konnektivität unterstützt.
Sie entwerfen, automatisieren und betreiben Produktionssysteme, die Tausende von Kunden in AWS, GCP und Azure bedienen. Sie arbeiten an allem, von multiregionalen Kubernetes-Clustern bis hin zu Service-Mesh- und Gateway-Architekturen, und stellen die Zuverlässigkeit, Skalierbarkeit und Sicherheit der SaaS-Angebote von Kong sicher.
Dies ist eine praktische Rolle, ideal für Ingenieure, die daran interessiert sind, Produktions-SaaS-Systeme in großem Maßstab zu betreiben, Abläufe zu automatisieren und Leistung, Belastbarkeit und Bereitstellungspipelines kontinuierlich zu verbessern.
Was Sie tun werden:
•
Betreiben und skalieren Sie Kongs globale SaaS-Plattform (Konnect) und stellen Sie so Zuverlässigkeit, Verfügbarkeit und Leistung über Regionen und Clouds hinweg sicher.
•
Erstellen, automatisieren und warten Sie Kubernetes-basierte Infrastruktur- und Bereitstellungsworkflows mit Terraform/Terragrunt, Helm und ArgoCD.
•
Entwerfen, pflegen und optimieren Sie Daten- und Caching-Ebenen für mehrere Regionen – einschließlich PostgreSQL, Redis, ClickHouse und Druid – für hohe Verfügbarkeit und geringe Latenz.
•
Betreiben und verbessern Sie Kong Gateway- und Kong Mesh-Umgebungen, die hybride und verteilte Architekturen unterstützen.
•
Entwickeln und pflegen Sie CI/CD-Pipelines und GitOps-Workflows, um die Servicebereitstellung zu automatisieren und konsistente Infrastrukturänderungen sicherzustellen.
•
Verbessern Sie die Beobachtbarkeit und die Reaktionsbereitschaft bei Vorfällen durch Systeme wie Datadog, Prometheus, Grafana und Thanos, die SLOs definieren und verfolgen.
•
Arbeiten Sie eng mit Entwicklungs- und Sicherheitsteams zusammen, um einen reibungslosen Betrieb von SaaS-Diensten unter Einhaltung von Zuverlässigkeits-, Sicherheits- und Regulierungsstandards sicherzustellen.
•
Nehmen Sie an einem weltweiten 24/7-Bereitschaftsdienst teil und treiben Sie die kontinuierliche Verbesserung der betrieblichen Vorgehensweisen und Postmortem-Praktiken voran.
•
Leiten Sie Skalierungsinitiativen, die die Elastizität, Zuverlässigkeit und Kosteneffizienz der gesamten SaaS-Plattform verbessern, und tragen Sie dazu bei.
Was Sie mitbringen:
•
Bachelor-Abschluss in Informatik oder gleichwertige praktische Erfahrung.
•
Nachgewiesene Erfahrung in der Verwaltung von SaaS- oder PaaS-Systemen auf Unternehmensebene (mehrregionale, mandantenfähige, sichere Umgebungen).
•
Umfassende Fachkenntnisse in Kubernetes, einschließlich der Fehlerbehebung bei Cluster-/Netzwerkproblemen und der Entwicklung von Fehlertoleranz und Skalierbarkeit.
•
Gute Kenntnisse im Umgang mit Infrastructure-as-Code-Tools wie Terraform oder Terragrunt.
•
Erfahrung mit CI/CD-Pipelines und GitOps-Workflows (ArgoCD, Atlantis, Helm).
•
Kenntnisse in einer oder mehreren Programmiersprachen (Go, Python, Bash) für Automatisierung und Tooling.
•
Solides Verständnis von Linux/Unix-Systemen, Netzwerken (DNS, TLS/SSL, HTTP), Load Balancern und verteilten Systemen.
•
Erfahrung in der Arbeit mit API-Gateway- und Service-Mesh-Technologien
•
Vertrautheit mit Streaming-Systemen wie Kafka und Observability-Plattformen (Datadog, Prometheus, Grafana).
•
Erfahrung in der Arbeit in einer 24/7/365-Produktionsunterstützungsumgebung.
Bonuspunkte:
•
Praktische Erfahrung mit Kong Gateway, Kong Mesh oder ähnlichen Service-Konnektivitätstechnologien.
•
Erfahrung im Betrieb von ClickHouse, Druid oder anderen Zeitreihen- und Analysedatenbanken.
•
Erfahrung in der Verwaltung von PostgreSQL und Redis in Konfigurationen mit mehreren Regionen.
•
Kenntnisse in AWS-Netzwerken (PrivateLink, Transit Gateway, VPC-Peering, Firewalls), Azure VNet oder GCP NCC.
•
Ausgeprägtes Verständnis für Disaster Recovery, Ausfallsicherheitstests und Compliance-gesteuerte Zuverlässigkeitspraktiken.
#LI-KC1
Über Kong:
Kong Inc., das AI Connectivity Company, baut die Konnektivitätsebene der KI auf. Die einheitliche API- und KI-Plattform von Kong genießt bei Fortune 500® und KI-nativen Startups gleichermaßen das Vertrauen und ermöglicht es Unternehmen, den Informationsfluss über APIs und KI-Verkehr hinweg zu sichern, zu verwalten, zu beschleunigen, zu steuern und zu monetarisieren – auf jedem Modell und in jeder Cloud. Weitere Informationen finden Sie unter www.konghq.com.
Quelle: Jobicy (https://jobicy.com/jobs/154637-site-reliability-engineer-2-3)
Dieses Angebot stammt aus einem Partner-Feed. Bewerben Sie sich auf der Quell-Website.
Quelle: Kong Inc.
Inserat bereitgestellt von Kong Inc..