Job
Aus Partner-Feed
Mitarbeiter Softwareentwickler, Inferenz
Preis auf Anfrage
Details
- Beschäftigungsart
- Vollzeit
- Remote
- Nein
- Unternehmen
- Coreweaveu
Beschreibung
Automatisch aus dem English übersetzt. Der Originaltext ist maßgeblich. Maschinenübersetzung – eine genauere Version wird vorbereitet.
CoreWeave ist die unverzichtbare Cloud für AI™. CoreWeave wurde von Pionieren für Pioniere entwickelt und bietet eine Plattform aus Technologie, Tools und Teams, die es Innovatoren ermöglicht, KI mit Zuversicht aufzubauen und zu skalieren. Führende KI-Labore, Start-ups und globale Unternehmen vertrauen auf CoreWeave. Es kombiniert überlegene Infrastrukturleistung mit fundiertem technischem Fachwissen, um Durchbrüche zu beschleunigen und Rechenleistung in Leistungsfähigkeit umzuwandeln. CoreWeave wurde 2017 gegründet und wurde im März 2025 zu einem börsennotierten Unternehmen (Nasdaq: CRWV). Erfahren Sie mehr unter www.coreweave.com.
Wir sind stolz darauf, ein Arbeitgeber mit der Auszeichnung „Existenzlohn“ zu sein.
Was Sie tun werden:
Das Inference-Team von CoreWeave erstellt und betreibt die zentrale Cloud-Plattform, die umfangreiche GPU-Workloads für KI/ML, VFX, Rendering und Echtzeit-Inferenz ermöglicht. Unser Stack ist auf Geschwindigkeit, Skalierbarkeit und Kosteneffizienz ausgelegt und stellt eine leistungsstarke Alternative zu herkömmlichen Hyperscalern dar, bei denen die Infrastruktur unser Kernprodukt ist und in großem Maßstab betrieben wird.
Über die Rolle:
Als Staff Software Engineer im Inference-Team fungieren Sie als technischer Leiter in mehreren Teams und Diensten und treiben Architektur, Leistung und Zuverlässigkeit für die Kubernetes-native Inferenzplattform von CoreWeave voran. Sie definieren und leiten komplexe, übergreifende Designinitiativen, die die Weiterleitung von Anforderungen, adaptive Planung, GPU-Ressourcenmanagement und Kosten-pro-Token-Optimierung unter strengen P99-SLAs umfassen. In dieser hochwirksamen Rolle implementieren Sie erweiterte Inferenzoptimierungen – wie spekulative Dekodierung und KV-Cache-Wiederverwendung – und etablieren gleichzeitig Leistungsbenchmarking-Frameworks, leiten die funktionsübergreifende Ausrichtung über Infrastrukturgrenzen hinweg und legen die Messlatte für technische Genauigkeit und Beobachtbarkeitspraktiken im gesamten Unternehmen höher.
Wer Sie sind:
• Bachelor-Abschluss in Informatik, Ingenieurwesen oder einem verwandten technischen Bereich (oder gleichwertige praktische Erfahrung).
• Mehr als 8 Jahre Erfahrung im Aufbau großer verteilter Systeme oder Cloud-Plattformen mit einer nachgewiesenen Erfolgsbilanz bei der Leitung technischer Initiativen auf Team- oder Organisationsebene in großem Maßstab.
• Gute Programmierkenntnisse in Go, Python oder C++.
• Umfangreiches Fachwissen zu Kubernetes im Produktionsmaßstab, einschließlich Orchestrierung, Planung und Service-Design.
• Ausgeprägtes Verständnis für vernetzte Systeme, Leistungsoptimierung und verteiltes Systemdesign.
• Praktische technische Erfahrung mit Inferenzsystemen, einschließlich Batch-/Mikro-Batching-Strategien, Caching, Speicheroptimierung, gemischter Präzision (BF16/FP8) und Streaming-Token-Lieferung.
• Nachgewiesene Fähigkeit, die Tail-Latenz (P95/P99) und die Plattformzuverlässigkeit durch metrikgesteuertes Engineering systematisch zu verbessern.
• Nachgewiesene Erfahrung im Besitz systemweiter SLIs/SLOs, Kapazitätsplanung, Autoskalierungsstrategien und Betreuung von Ingenieuren auf hoher und mittlerer Ebene.
Bevorzugt:
• Direkte Open-Source- oder Produktionsbeiträge zu modernen Inferenz-Frameworks (z. B. vLLM, Triton, TensorRT-LLM, Ray Serve oder TorchServe).
• Umfangreiche Erfahrung mit GPU-Systemtechnik und Hardware-Leistungsoptimierung (z. B. CUDA, NCCL, RDMA, NUMA oder GPU-Verbindungen).
• Direkter Kontakt mit groß angelegten KI/ML-Infrastrukturen oder Hyperscale-Cloud-Umgebungen.
Sie fragen sich, ob Sie gut zu uns passen?
Wir glauben daran, in unsere Mitarbeiter zu investieren, und schätzen Kandidaten, die ihre eigenen vielfältigen Erfahrungen in unsere Teams einbringen können – auch wenn Sie nicht zu 100 % über Ihre Fähigkeiten oder Erfahrungen verfügen.
• Sie lieben es: Hochkomplexe verteilte Architekturen zu skalieren und Ingenieurkohorten zu betreuen, um die technischen Standards im gesamten Unternehmen zu erhöhen.
• Sie sind neugierig auf: Pionierarbeit bei Inferenzoptimierungen mit geringer Latenz und die Suche nach innovativen Abkürzungen zur Optimierung der Kosten-pro-Token-Leistung.
• Sie sind Experte für: Metrikgesteuertes Engineering, die Behebung von Mikroengpässen und die Bereitstellung stabiler Cloud-Plattformen unter strengen Multi-Tenant-Einschränkungen.
Warum CoreWeave?
Bei CoreWeave arbeiten wir hart, haben Spaß und handeln schnell! Wir befinden uns in einer aufregenden Phase des Hyperwachstums, die Sie sich nicht entgehen lassen sollten. Wir haben keine Angst vor ein wenig Chaos und lernen ständig dazu. Unserem Team liegt die Art und Weise, wie wir unser Produkt entwickeln und wie wir zusammenarbeiten, sehr am Herzen, was durch unsere Grundwerte zum Ausdruck kommt:
• Seien Sie in Ihrem Innersten neugierig
• Handeln Sie wie ein Eigentümer
• Mitarbeiter stärken
• Bieten Sie erstklassige Kundenerlebnisse
• Gemeinsam mehr erreichen
Wir unterstützen und fördern unternehmerisches Denken und eigenständiges Denken. Wir fördern ein Umfeld, das die Zusammenarbeit fördert und die Entwicklung innovativer Lösungen für komplexe Probleme ermöglicht. Während wir uns auf den Start vorbereiten, erweitern sich die Wachstumschancen der Organisation ständig. Sie werden von einigen der besten Talente der Branche umgeben sein, die ebenfalls von Ihnen lernen möchten. Kommen Sie zu uns!
Das Einstiegsgehalt richtet sich nach den berufsbezogenen Kenntnissen, Fähigkeiten, Erfahrungen und der Marktlage. Bei der Festlegung der Vergütung streben wir sowohl nach Marktausrichtung als auch nach interner Gerechtigkeit. Zusätzlich zum Grundgehalt umfasst unser Gesamtprämienpaket einen Ermessensbonus, Aktienprämien und ein umfassendes Leistungsprogramm (alles basierend auf der Berechtigung).
Um unserer Verpflichtung zum Schutz von Kundendaten nachzukommen, müssen erfolgreiche Bewerber, denen eine Anstellung bei CoreWeave angeboten wird, eine grundlegende Strafregisterprüfung durchführen, die in Übereinstimmung mit der DSGVO durchgeführt wird. Voraussetzung für ein Stellenangebot ist ein zufriedenstellendes Prüfergebnis.
Was wir anbieten
Zusätzlich zu einem wettbewerbsfähigen Gehalt bieten wir eine Reihe von Zusatzleistungen zur Unterstützung Ihrer Bedürfnisse, darunter:
• Krankenversicherung auf Familienebene
• Zahnversicherung auf Familienebene
• Großzügiger Rentenbeitrag
• Lebensversicherung zum 4-fachen Gehalt
• Versicherungsschutz für schwere Krankheiten
• Mitarbeiterhilfsprogramm
• Rückerstattung der Studiengebühren
• Arbeitskultur, die auf innovative Innovationen ausgerichtet ist
Die Vorteile können je nach Standort variieren.
Chancengleichheit…
Quelle: Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/coreweaveu/staff-software-engineer-inference-london-292192)
Wir sind stolz darauf, ein Arbeitgeber mit der Auszeichnung „Existenzlohn“ zu sein.
Was Sie tun werden:
Das Inference-Team von CoreWeave erstellt und betreibt die zentrale Cloud-Plattform, die umfangreiche GPU-Workloads für KI/ML, VFX, Rendering und Echtzeit-Inferenz ermöglicht. Unser Stack ist auf Geschwindigkeit, Skalierbarkeit und Kosteneffizienz ausgelegt und stellt eine leistungsstarke Alternative zu herkömmlichen Hyperscalern dar, bei denen die Infrastruktur unser Kernprodukt ist und in großem Maßstab betrieben wird.
Über die Rolle:
Als Staff Software Engineer im Inference-Team fungieren Sie als technischer Leiter in mehreren Teams und Diensten und treiben Architektur, Leistung und Zuverlässigkeit für die Kubernetes-native Inferenzplattform von CoreWeave voran. Sie definieren und leiten komplexe, übergreifende Designinitiativen, die die Weiterleitung von Anforderungen, adaptive Planung, GPU-Ressourcenmanagement und Kosten-pro-Token-Optimierung unter strengen P99-SLAs umfassen. In dieser hochwirksamen Rolle implementieren Sie erweiterte Inferenzoptimierungen – wie spekulative Dekodierung und KV-Cache-Wiederverwendung – und etablieren gleichzeitig Leistungsbenchmarking-Frameworks, leiten die funktionsübergreifende Ausrichtung über Infrastrukturgrenzen hinweg und legen die Messlatte für technische Genauigkeit und Beobachtbarkeitspraktiken im gesamten Unternehmen höher.
Wer Sie sind:
• Bachelor-Abschluss in Informatik, Ingenieurwesen oder einem verwandten technischen Bereich (oder gleichwertige praktische Erfahrung).
• Mehr als 8 Jahre Erfahrung im Aufbau großer verteilter Systeme oder Cloud-Plattformen mit einer nachgewiesenen Erfolgsbilanz bei der Leitung technischer Initiativen auf Team- oder Organisationsebene in großem Maßstab.
• Gute Programmierkenntnisse in Go, Python oder C++.
• Umfangreiches Fachwissen zu Kubernetes im Produktionsmaßstab, einschließlich Orchestrierung, Planung und Service-Design.
• Ausgeprägtes Verständnis für vernetzte Systeme, Leistungsoptimierung und verteiltes Systemdesign.
• Praktische technische Erfahrung mit Inferenzsystemen, einschließlich Batch-/Mikro-Batching-Strategien, Caching, Speicheroptimierung, gemischter Präzision (BF16/FP8) und Streaming-Token-Lieferung.
• Nachgewiesene Fähigkeit, die Tail-Latenz (P95/P99) und die Plattformzuverlässigkeit durch metrikgesteuertes Engineering systematisch zu verbessern.
• Nachgewiesene Erfahrung im Besitz systemweiter SLIs/SLOs, Kapazitätsplanung, Autoskalierungsstrategien und Betreuung von Ingenieuren auf hoher und mittlerer Ebene.
Bevorzugt:
• Direkte Open-Source- oder Produktionsbeiträge zu modernen Inferenz-Frameworks (z. B. vLLM, Triton, TensorRT-LLM, Ray Serve oder TorchServe).
• Umfangreiche Erfahrung mit GPU-Systemtechnik und Hardware-Leistungsoptimierung (z. B. CUDA, NCCL, RDMA, NUMA oder GPU-Verbindungen).
• Direkter Kontakt mit groß angelegten KI/ML-Infrastrukturen oder Hyperscale-Cloud-Umgebungen.
Sie fragen sich, ob Sie gut zu uns passen?
Wir glauben daran, in unsere Mitarbeiter zu investieren, und schätzen Kandidaten, die ihre eigenen vielfältigen Erfahrungen in unsere Teams einbringen können – auch wenn Sie nicht zu 100 % über Ihre Fähigkeiten oder Erfahrungen verfügen.
• Sie lieben es: Hochkomplexe verteilte Architekturen zu skalieren und Ingenieurkohorten zu betreuen, um die technischen Standards im gesamten Unternehmen zu erhöhen.
• Sie sind neugierig auf: Pionierarbeit bei Inferenzoptimierungen mit geringer Latenz und die Suche nach innovativen Abkürzungen zur Optimierung der Kosten-pro-Token-Leistung.
• Sie sind Experte für: Metrikgesteuertes Engineering, die Behebung von Mikroengpässen und die Bereitstellung stabiler Cloud-Plattformen unter strengen Multi-Tenant-Einschränkungen.
Warum CoreWeave?
Bei CoreWeave arbeiten wir hart, haben Spaß und handeln schnell! Wir befinden uns in einer aufregenden Phase des Hyperwachstums, die Sie sich nicht entgehen lassen sollten. Wir haben keine Angst vor ein wenig Chaos und lernen ständig dazu. Unserem Team liegt die Art und Weise, wie wir unser Produkt entwickeln und wie wir zusammenarbeiten, sehr am Herzen, was durch unsere Grundwerte zum Ausdruck kommt:
• Seien Sie in Ihrem Innersten neugierig
• Handeln Sie wie ein Eigentümer
• Mitarbeiter stärken
• Bieten Sie erstklassige Kundenerlebnisse
• Gemeinsam mehr erreichen
Wir unterstützen und fördern unternehmerisches Denken und eigenständiges Denken. Wir fördern ein Umfeld, das die Zusammenarbeit fördert und die Entwicklung innovativer Lösungen für komplexe Probleme ermöglicht. Während wir uns auf den Start vorbereiten, erweitern sich die Wachstumschancen der Organisation ständig. Sie werden von einigen der besten Talente der Branche umgeben sein, die ebenfalls von Ihnen lernen möchten. Kommen Sie zu uns!
Das Einstiegsgehalt richtet sich nach den berufsbezogenen Kenntnissen, Fähigkeiten, Erfahrungen und der Marktlage. Bei der Festlegung der Vergütung streben wir sowohl nach Marktausrichtung als auch nach interner Gerechtigkeit. Zusätzlich zum Grundgehalt umfasst unser Gesamtprämienpaket einen Ermessensbonus, Aktienprämien und ein umfassendes Leistungsprogramm (alles basierend auf der Berechtigung).
Um unserer Verpflichtung zum Schutz von Kundendaten nachzukommen, müssen erfolgreiche Bewerber, denen eine Anstellung bei CoreWeave angeboten wird, eine grundlegende Strafregisterprüfung durchführen, die in Übereinstimmung mit der DSGVO durchgeführt wird. Voraussetzung für ein Stellenangebot ist ein zufriedenstellendes Prüfergebnis.
Was wir anbieten
Zusätzlich zu einem wettbewerbsfähigen Gehalt bieten wir eine Reihe von Zusatzleistungen zur Unterstützung Ihrer Bedürfnisse, darunter:
• Krankenversicherung auf Familienebene
• Zahnversicherung auf Familienebene
• Großzügiger Rentenbeitrag
• Lebensversicherung zum 4-fachen Gehalt
• Versicherungsschutz für schwere Krankheiten
• Mitarbeiterhilfsprogramm
• Rückerstattung der Studiengebühren
• Arbeitskultur, die auf innovative Innovationen ausgerichtet ist
Die Vorteile können je nach Standort variieren.
Chancengleichheit…
Quelle: Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/coreweaveu/staff-software-engineer-inference-london-292192)
Dieses Angebot stammt aus einem Partner-Feed. Bewerben Sie sich auf der Quell-Website.
Quelle: Coreweaveu
Standort
London, Vereinigtes Königreich
Inserat bereitgestellt von Coreweaveu.