Praca
Z kanału partnera
Inżynier oprogramowania, wnioskowanie
Cena na życzenie
Szczegóły
- Typ zatrudnienia
- Pełny etat
- Zdalnie
- Nie
- Firma
- Coreweaveu
Opis
Automatyczne tłumaczenie z języka English. Oryginał jest wiążący. Tłumaczenie maszynowe — trwają prace nad dokładniejszą wersją.
CoreWeave to niezbędna chmura dla AI™. Zbudowany przez pionierów dla pionierów, CoreWeave zapewnia platformę technologii, narzędzi i zespołów, która umożliwia innowatorom pewne budowanie i skalowanie sztucznej inteligencji. Zaufany przez wiodące laboratoria AI, start-upy i globalne przedsiębiorstwa, CoreWeave łączy doskonałą wydajność infrastruktury z głęboką wiedzą techniczną, aby przyspieszać przełomy i przekształcać obliczenia w możliwości. Założona w 2017 r. firma CoreWeave stała się spółką notowaną na giełdzie (Nasdaq: CRWV) w marcu 2025 r. Więcej informacji można znaleźć na stronie www.coreweave.com.
Jesteśmy dumni, że jesteśmy pracodawcą akredytowanym na płacę wystarczającą na utrzymanie.
Co zrobisz:
Zespół CoreWeave Inference buduje i obsługuje podstawową platformę chmurową obsługującą obciążenia GPU na masową skalę na potrzeby AI/ML, efektów wizualnych, renderowania i wnioskowania w czasie rzeczywistym. Nasz stos został zaprojektowany z myślą o szybkości, skali i efektywności kosztowej — zapewniając potężną alternatywę dla tradycyjnych hiperskalerów, w których infrastruktura jest naszym głównym produktem obsługiwanym na masową skalę.
O roli:
Jako inżynier oprogramowania w zespole Inference będziesz pełnić funkcję lidera technicznego w wielu zespołach i usługach, kierując architekturą, wydajnością i niezawodnością natywnej platformy wnioskowania CoreWeave Kubernetes. Zdefiniujesz i poprowadzisz złożone, przekrojowe inicjatywy projektowe obejmujące routing żądań, planowanie adaptacyjne, zarządzanie zasobami GPU i optymalizację kosztu tokena w ramach ścisłych umów SLA P99. Na tym wpływowym stanowisku będziesz wdrażać zaawansowane optymalizacje wnioskowania — takie jak dekodowanie spekulatywne i ponowne wykorzystanie pamięci podręcznej KV — jednocześnie ustanawiając ramy testów porównawczych wydajności, kierując dopasowaniem międzyfunkcyjnym ponad granicami infrastruktury oraz podnosząc poprzeczkę w zakresie rygoru inżynieryjnego i praktyk obserwowalności w całej organizacji.
Kim jesteś:
• Licencjat z informatyki, inżynierii lub pokrewnej dziedziny technicznej (lub równoważne doświadczenie praktyczne).
• Ponad 8 lat doświadczenia w budowaniu wielkoskalowych systemów rozproszonych lub platform chmurowych, z udokumentowanym doświadczeniem w zakresie wiodących inicjatyw technicznych na dużą skalę na poziomie wielu zespołów lub organizacji.
• Dobra znajomość kodowania w Go, Pythonie lub C++.
• Głęboka wiedza specjalistyczna w zakresie Kubernetes na skalę produkcyjną, w tym orkiestracja, planowanie i projektowanie usług.
• Dobra znajomość systemów sieciowych, optymalizacji wydajności i projektowania systemów rozproszonych.
• Praktyczne doświadczenie inżynieryjne w zakresie systemów wnioskowania, w tym strategii przetwarzania wsadowego/mikro-wsadowego, buforowania, optymalizacji pamięci, precyzji mieszanej (BF16/FP8) i dostarczania tokenów strumieniowych.
• Wykazano zdolność do systematycznego poprawiania opóźnień końcowych (P95/P99) i niezawodności platformy poprzez inżynierię opartą na wskaźnikach.
• Udokumentowane doświadczenie w posiadaniu ogólnosystemowych SLI/SLO, planowaniu wydajności, strategiach automatycznego skalowania i mentoringu dla inżynierów wyższego i średniego szczebla.
Preferowane:
• Bezpośredni wkład open source lub produkcyjny do nowoczesnych platform wnioskowania (np. vLLM, Triton, TensorRT-LLM, Ray Serve lub TorchServe).
• Głębokie doświadczenie w inżynierii systemów GPU i optymalizacji wydajności sprzętu (np. połączenia wzajemne CUDA, NCCL, RDMA, NUMA lub GPU).
• Bezpośredni kontakt z wielkoskalową infrastrukturą AI/ML lub hiperskalowymi środowiskami chmurowymi.
Zastanawiasz się, czy dobrze pasujesz?
Wierzymy w inwestowanie w naszych ludzi i cenimy kandydatów, którzy mogą wnieść do naszych zespołów własne, zróżnicowane doświadczenia — nawet jeśli nie pasujesz w 100% pod względem umiejętności i doświadczenia.
• Uwielbiasz: Skalować bardzo złożone architektury rozproszone i doradzać kohortom inżynierów, aby podnosić standardy techniczne w całej organizacji.
• Ciekawi Cię: Pionierska optymalizacja wnioskowania przy niskim opóźnieniu i znajdowanie innowacyjnych skrótów w celu optymalizacji wydajności kosztu w przeliczeniu na token.
• Jesteś ekspertem w: inżynierii opartej na metrykach, rozwiązywaniu problemów z mikrowąskimi gardłami i dostarczaniu stabilnych platform chmurowych przy ścisłych ograniczeniach dotyczących wielu dzierżawców.
Dlaczego CoreWeave?
W CoreWeave ciężko pracujemy, dobrze się bawimy i działamy szybko! Jesteśmy na ekscytującym etapie hiperrozwoju, którego nie możesz przegapić. Nie boimy się odrobiny chaosu i cały czas się uczymy. Nasz zespół bardzo dba o to, jak budujemy nasz produkt i jak współpracujemy, co odzwierciedlają nasze podstawowe wartości:
• Bądź ciekawy w swoim rdzeniu
• Zachowuj się jak właściciel
• Wzmacniaj pozycję pracowników
• Zapewniaj najlepsze w swojej klasie doświadczenia klientów
• Razem osiągnijcie więcej
Wspieramy i zachęcamy do przedsiębiorczości i niezależnego myślenia. Tworzymy środowisko zachęcające do współpracy i umożliwiające opracowywanie innowacyjnych rozwiązań złożonych problemów. W miarę jak przygotowujemy się do startu, możliwości rozwoju organizacji stale się poszerzają. Będziesz otoczony przez jedne z najlepszych talentów w branży, które również będą chciały się od Ciebie uczyć. Dołącz do nas!
Wysokość wynagrodzenia początkowego będzie uzależniona od wiedzy, umiejętności, doświadczenia i lokalizacji na rynku pracy. Przy ustalaniu wynagrodzenia dążymy zarówno do wyrównania rynku, jak i kapitału wewnętrznego. Oprócz wynagrodzenia podstawowego nasz całkowity pakiet nagród obejmuje premię uznaniową, nagrody kapitałowe i kompleksowy program świadczeń (wszystko w oparciu o uprawnienia).
Aby wywiązać się z naszego obowiązku ochrony danych klientów, kandydaci, którym zaoferowano zatrudnienie w CoreWeave, będą musieli przejść podstawowe sprawdzenie rejestru karnego, przeprowadzone zgodnie z RODO. Warunkiem otrzymania oferty pracy jest uzyskanie pozytywnych wyników kontroli.
Co oferujemy
Oprócz konkurencyjnego wynagrodzenia oferujemy szereg świadczeń dostosowanych do Twoich potrzeb, w tym:
• Ubezpieczenie medyczne na poziomie rodzinnym
• Ubezpieczenie stomatologiczne na poziomie rodzinnym
• Hojna składka emerytalna
• Ubezpieczenie na życie w wysokości 4x pensji
• Ubezpieczenie od chorób krytycznych
• Program Pomocy Pracownikom
• Zwrot czesnego
• Kultura pracy skupiona na innowacyjnych zakłóceniach
Korzyści mogą się różnić w zależności od lokalizacji.
Równe szanse…
Źródło: Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/coreweaveu/staff-software-engineer-inference-london-292192)
Jesteśmy dumni, że jesteśmy pracodawcą akredytowanym na płacę wystarczającą na utrzymanie.
Co zrobisz:
Zespół CoreWeave Inference buduje i obsługuje podstawową platformę chmurową obsługującą obciążenia GPU na masową skalę na potrzeby AI/ML, efektów wizualnych, renderowania i wnioskowania w czasie rzeczywistym. Nasz stos został zaprojektowany z myślą o szybkości, skali i efektywności kosztowej — zapewniając potężną alternatywę dla tradycyjnych hiperskalerów, w których infrastruktura jest naszym głównym produktem obsługiwanym na masową skalę.
O roli:
Jako inżynier oprogramowania w zespole Inference będziesz pełnić funkcję lidera technicznego w wielu zespołach i usługach, kierując architekturą, wydajnością i niezawodnością natywnej platformy wnioskowania CoreWeave Kubernetes. Zdefiniujesz i poprowadzisz złożone, przekrojowe inicjatywy projektowe obejmujące routing żądań, planowanie adaptacyjne, zarządzanie zasobami GPU i optymalizację kosztu tokena w ramach ścisłych umów SLA P99. Na tym wpływowym stanowisku będziesz wdrażać zaawansowane optymalizacje wnioskowania — takie jak dekodowanie spekulatywne i ponowne wykorzystanie pamięci podręcznej KV — jednocześnie ustanawiając ramy testów porównawczych wydajności, kierując dopasowaniem międzyfunkcyjnym ponad granicami infrastruktury oraz podnosząc poprzeczkę w zakresie rygoru inżynieryjnego i praktyk obserwowalności w całej organizacji.
Kim jesteś:
• Licencjat z informatyki, inżynierii lub pokrewnej dziedziny technicznej (lub równoważne doświadczenie praktyczne).
• Ponad 8 lat doświadczenia w budowaniu wielkoskalowych systemów rozproszonych lub platform chmurowych, z udokumentowanym doświadczeniem w zakresie wiodących inicjatyw technicznych na dużą skalę na poziomie wielu zespołów lub organizacji.
• Dobra znajomość kodowania w Go, Pythonie lub C++.
• Głęboka wiedza specjalistyczna w zakresie Kubernetes na skalę produkcyjną, w tym orkiestracja, planowanie i projektowanie usług.
• Dobra znajomość systemów sieciowych, optymalizacji wydajności i projektowania systemów rozproszonych.
• Praktyczne doświadczenie inżynieryjne w zakresie systemów wnioskowania, w tym strategii przetwarzania wsadowego/mikro-wsadowego, buforowania, optymalizacji pamięci, precyzji mieszanej (BF16/FP8) i dostarczania tokenów strumieniowych.
• Wykazano zdolność do systematycznego poprawiania opóźnień końcowych (P95/P99) i niezawodności platformy poprzez inżynierię opartą na wskaźnikach.
• Udokumentowane doświadczenie w posiadaniu ogólnosystemowych SLI/SLO, planowaniu wydajności, strategiach automatycznego skalowania i mentoringu dla inżynierów wyższego i średniego szczebla.
Preferowane:
• Bezpośredni wkład open source lub produkcyjny do nowoczesnych platform wnioskowania (np. vLLM, Triton, TensorRT-LLM, Ray Serve lub TorchServe).
• Głębokie doświadczenie w inżynierii systemów GPU i optymalizacji wydajności sprzętu (np. połączenia wzajemne CUDA, NCCL, RDMA, NUMA lub GPU).
• Bezpośredni kontakt z wielkoskalową infrastrukturą AI/ML lub hiperskalowymi środowiskami chmurowymi.
Zastanawiasz się, czy dobrze pasujesz?
Wierzymy w inwestowanie w naszych ludzi i cenimy kandydatów, którzy mogą wnieść do naszych zespołów własne, zróżnicowane doświadczenia — nawet jeśli nie pasujesz w 100% pod względem umiejętności i doświadczenia.
• Uwielbiasz: Skalować bardzo złożone architektury rozproszone i doradzać kohortom inżynierów, aby podnosić standardy techniczne w całej organizacji.
• Ciekawi Cię: Pionierska optymalizacja wnioskowania przy niskim opóźnieniu i znajdowanie innowacyjnych skrótów w celu optymalizacji wydajności kosztu w przeliczeniu na token.
• Jesteś ekspertem w: inżynierii opartej na metrykach, rozwiązywaniu problemów z mikrowąskimi gardłami i dostarczaniu stabilnych platform chmurowych przy ścisłych ograniczeniach dotyczących wielu dzierżawców.
Dlaczego CoreWeave?
W CoreWeave ciężko pracujemy, dobrze się bawimy i działamy szybko! Jesteśmy na ekscytującym etapie hiperrozwoju, którego nie możesz przegapić. Nie boimy się odrobiny chaosu i cały czas się uczymy. Nasz zespół bardzo dba o to, jak budujemy nasz produkt i jak współpracujemy, co odzwierciedlają nasze podstawowe wartości:
• Bądź ciekawy w swoim rdzeniu
• Zachowuj się jak właściciel
• Wzmacniaj pozycję pracowników
• Zapewniaj najlepsze w swojej klasie doświadczenia klientów
• Razem osiągnijcie więcej
Wspieramy i zachęcamy do przedsiębiorczości i niezależnego myślenia. Tworzymy środowisko zachęcające do współpracy i umożliwiające opracowywanie innowacyjnych rozwiązań złożonych problemów. W miarę jak przygotowujemy się do startu, możliwości rozwoju organizacji stale się poszerzają. Będziesz otoczony przez jedne z najlepszych talentów w branży, które również będą chciały się od Ciebie uczyć. Dołącz do nas!
Wysokość wynagrodzenia początkowego będzie uzależniona od wiedzy, umiejętności, doświadczenia i lokalizacji na rynku pracy. Przy ustalaniu wynagrodzenia dążymy zarówno do wyrównania rynku, jak i kapitału wewnętrznego. Oprócz wynagrodzenia podstawowego nasz całkowity pakiet nagród obejmuje premię uznaniową, nagrody kapitałowe i kompleksowy program świadczeń (wszystko w oparciu o uprawnienia).
Aby wywiązać się z naszego obowiązku ochrony danych klientów, kandydaci, którym zaoferowano zatrudnienie w CoreWeave, będą musieli przejść podstawowe sprawdzenie rejestru karnego, przeprowadzone zgodnie z RODO. Warunkiem otrzymania oferty pracy jest uzyskanie pozytywnych wyników kontroli.
Co oferujemy
Oprócz konkurencyjnego wynagrodzenia oferujemy szereg świadczeń dostosowanych do Twoich potrzeb, w tym:
• Ubezpieczenie medyczne na poziomie rodzinnym
• Ubezpieczenie stomatologiczne na poziomie rodzinnym
• Hojna składka emerytalna
• Ubezpieczenie na życie w wysokości 4x pensji
• Ubezpieczenie od chorób krytycznych
• Program Pomocy Pracownikom
• Zwrot czesnego
• Kultura pracy skupiona na innowacyjnych zakłóceniach
Korzyści mogą się różnić w zależności od lokalizacji.
Równe szanse…
Źródło: Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/coreweaveu/staff-software-engineer-inference-london-292192)
To ogłoszenie pochodzi z feedu partnera. Aplikuj na stronie źródłowej.
Źródło: Coreweaveu
Lokalizacja
Londyn, Wielka Brytania
Ogłoszenie pochodzi od Coreweaveu.