Praca
Z kanału partnera
Inżynier oprogramowania systemów HPC
Cena na życzenie
Szczegóły
- Typ zatrudnienia
- Pełny etat
- Zdalnie
- Tak
- Firma
- Senior Manager, Internal Communications - Greenhouse
Opis
Automatyczne tłumaczenie z języka English. Oryginał jest wiążący. Tłumaczenie maszynowe — trwają prace nad dokładniejszą wersją.
O Nscale
Nscale to chmura GPU zaprojektowana dla sztucznej inteligencji. Zapewniamy opłacalną, wysokowydajną infrastrukturę dla start-upów AI i dużych klientów korporacyjnych. Nscale umożliwia firmom zorientowanym na sztuczną inteligencję osiąganie doskonałych wyników poprzez zmniejszenie złożoności rozwoju sztucznej inteligencji. Nasza chmura GPU zwiększa możliwości techniczne i bezpośrednio wspiera strategiczne wyniki biznesowe, w tym zarządzanie kosztami, szybkie innowacje i odpowiedzialność za środowisko.
Rozwijamy się w oparciu o kulturę nieustannych innowacji, własności i odpowiedzialności, w której każdy członek zespołu jest dumny ze swojej pracy i realizuje ją z doskonałością i pilnością. Jako Nscaler zbudujesz zaufanie poprzez otwartość i przejrzystość, gdzie każdy będzie inspirowany do wykonywania swojej najlepszej pracy. Jeśli dołączysz do naszego zespołu, będziesz przyczyniać się do tworzenia technologii, która napędza przyszłość.
O roli
Zatrudnimy inżyniera oprogramowania systemów HPC, aby określił kierunek techniczny i ewolucję podstawowej domeny platformy HPC w Nscale. Na tym stanowisku będziesz działać poza jednym zespołem, kształtując sposób, w jaki wiele zespołów tworzy, automatyzuje i uruchamia funkcje oparte na Slurm w ramach szerszej, natywnej platformy chmurowej Nscale. Będziesz pracować ponad granicami inżynieryjnymi, aby zapewnić spójność architektury, interfejsów, modeli cyklu życia i podejść operacyjnych, ściśle współpracując z zespołami pracującymi nad narzędziami platformy, interfejsami API infrastruktury, systemami tożsamości i systemami sąsiadującymi z Kubernetes.
Jest to niezwykle wpływowa rola na poziomie personelu dla kogoś, kto łączy praktyczną inżynierię oprogramowania z silną oceną systemów. Twoja praca pomoże zapewnić, że usługi HPC firmy Nscale będą solidne, możliwe do wsparcia i konserwacji, jednocześnie tworząc dźwignię dzięki wspólnym wzorcom, wdrożeniom nadającym się do ponownego wykorzystania i jasnym kierunkom technicznym w niejednoznacznych obszarach problemów o krytycznym znaczeniu dla biznesu.
Co będziesz robić
Architektura domeny i kierownictwo techniczne
● Posiadaj i rozwijaj kierunek techniczny dla określonej domeny systemów HPC, takiej jak architektura platformy Slum, integracje harmonogramów, cykl życia klastra, środowiska obciążenia lub automatyzacja usług.
● Podejmuj decyzje dotyczące architektury, które równoważą jakość oprogramowania, realia operacyjne, potrzeby klientów i długoterminową łatwość konserwacji.
● Zdefiniuj, w jaki sposób sprawdzone wdrożenia Slurm powinny być spakowane, zautomatyzowane i udostępniane jako usługa.
● Rozwiązuj niejasności dotyczące własności, interfejsów, granic cyklu życia i modeli operacyjnych w zespołach.
● Pełnić rolę technicznego punktu eskalacji najbardziej złożonych problemów w danej domenie.
Międzyzespołowa dźwignia inżynieryjna
● Ustal wspólne wzorce automatyzacji, zarządzania cyklem życia usług, obserwowalności, niezawodności i możliwości wsparcia na całej platformie HPC.
● Opracuj międzyzespołowe projekty integracji pomiędzy Slurm, systemami sąsiadującymi z Kubernetes, interfejsami API infrastruktury, systemami tożsamości i narzędziami platformy.
● Twórz moduły wielokrotnego użytku, automatyzację, wzorce wdrożeń i wdrożenia referencyjne, które zwiększają dźwignię inżynieryjną.
● Tożsamość i poprawność możliwych do uniknięcia rozbieżności technicznych, powielania wysiłków i delikatnych modeli operacyjnych
● Upewnij się, że projekty domen odzwierciedlają realia planowania GPU, sieci HPC, izolacji wydajności i operacji produkcyjnych.
Dostawa, niezawodność i wpływ
● Kieruj inicjatywami o znaczeniu krytycznym pod względem technicznym, obejmującymi 2–4 zespoły lub określony obszar platformy HPC.
● Uwolnione dostarczanie poprzez wyjaśnienie kierunku technicznego i zmniejszenie niejasności w złożonych problemach związanych z projektowaniem systemów.
● W razie potrzeby wnoś praktyczny wkład, aby zmniejszyć ryzyko lub przyspieszyć pracę o znaczeniu krytycznym.
● Wywieraj wpływ na zespoły inżynierów bez formalnej władzy poprzez zdecydowaną ocenę, przejrzystość projektu i praktyczne rozwiązania.
● Współpracuj z sąsiadującymi inżynierami oprogramowania natywnymi dla chmury, aby wdrożenia HPC opierały się na wzorcach wspólnych platform, a nie na oddzielnych.
KPI
● Kierownictwo techniczne w zdefiniowanej domenie HPC
● Realizacja kluczowych inicjatyw w 2-4 zespołach
● Zmniejszenie rozbieżności technicznych i powielania wysiłków
● Niezawodność i łatwość obsługi usług HPC opartych na Slurmie
O Tobie
● Rozległe doświadczenie w projektowaniu i budowaniu oprogramowania produkcyjnego i automatyzacji dla systemów HPC, zwłaszcza środowisk opartych na Slum.
● Duże doświadczenie w pisaniu łatwego w utrzymaniu, testowalnego i odpornego oprogramowania w Go, Pythonie lub podobnych językach.
● Sprawdzona umiejętność definiowania kierunku technicznego w całej domenie obejmującej wiele zespołów lub usług.
● Silne zrozumienie wewnętrznych elementów Slurma, zachowań planistów, problemów związanych z cyklem życia klastra i kompromisów operacyjnych.
● Silna praktyczna znajomość infrastruktury wspieranej przez procesor graficzny i sieci HPC, w tym InfiniBand, RoCE, RDMA i charakterystyk obciążenia zależnych od wydajności.
● Doświadczenie w integracji systemów HPC z platformami chmurowymi, interfejsami API lub modelami świadczenia usług.
● Doświadczenie w tworzeniu dźwigni inżynieryjnej poprzez standardy, wzorce wielokrotnego użytku, współdzielone narzędzia i przejrzystość architektury.
● Mocny osąd w równoważeniu krótkoterminowej dostawy z długoterminową kondycją platformy i możliwością wsparcia.
● Silne umiejętności komunikacji pisemnej i werbalnej, z możliwością ustawienia wielu zespołów wokół spójnego kierunku technicznego.
● Doświadczenie z innymi programami planującymi lub systemami wsadowymi, takimi jak Kueue, jest cenne.
Co możemy Ci zaoferować
Będziesz miał okazję pomóc w kształtowaniu standardów operacyjnych sztucznej inteligencji nowej generacji
platformę chmurową, pracującą nad złożonymi wyzwaniami infrastrukturalnymi z prawdziwą własnością i wpływem. To
to szansa na odegranie znaczącej roli w skalowaniu wysokowydajnego, zrównoważonego centrum danych
działania w szybko zmieniającym się środowisku
Oświadczenie o równych szansach…
Źródło: Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/senior-manager-internal-lecommunications-greenhouse/staff-hpc-systems-software-engineer-290428)
Nscale to chmura GPU zaprojektowana dla sztucznej inteligencji. Zapewniamy opłacalną, wysokowydajną infrastrukturę dla start-upów AI i dużych klientów korporacyjnych. Nscale umożliwia firmom zorientowanym na sztuczną inteligencję osiąganie doskonałych wyników poprzez zmniejszenie złożoności rozwoju sztucznej inteligencji. Nasza chmura GPU zwiększa możliwości techniczne i bezpośrednio wspiera strategiczne wyniki biznesowe, w tym zarządzanie kosztami, szybkie innowacje i odpowiedzialność za środowisko.
Rozwijamy się w oparciu o kulturę nieustannych innowacji, własności i odpowiedzialności, w której każdy członek zespołu jest dumny ze swojej pracy i realizuje ją z doskonałością i pilnością. Jako Nscaler zbudujesz zaufanie poprzez otwartość i przejrzystość, gdzie każdy będzie inspirowany do wykonywania swojej najlepszej pracy. Jeśli dołączysz do naszego zespołu, będziesz przyczyniać się do tworzenia technologii, która napędza przyszłość.
O roli
Zatrudnimy inżyniera oprogramowania systemów HPC, aby określił kierunek techniczny i ewolucję podstawowej domeny platformy HPC w Nscale. Na tym stanowisku będziesz działać poza jednym zespołem, kształtując sposób, w jaki wiele zespołów tworzy, automatyzuje i uruchamia funkcje oparte na Slurm w ramach szerszej, natywnej platformy chmurowej Nscale. Będziesz pracować ponad granicami inżynieryjnymi, aby zapewnić spójność architektury, interfejsów, modeli cyklu życia i podejść operacyjnych, ściśle współpracując z zespołami pracującymi nad narzędziami platformy, interfejsami API infrastruktury, systemami tożsamości i systemami sąsiadującymi z Kubernetes.
Jest to niezwykle wpływowa rola na poziomie personelu dla kogoś, kto łączy praktyczną inżynierię oprogramowania z silną oceną systemów. Twoja praca pomoże zapewnić, że usługi HPC firmy Nscale będą solidne, możliwe do wsparcia i konserwacji, jednocześnie tworząc dźwignię dzięki wspólnym wzorcom, wdrożeniom nadającym się do ponownego wykorzystania i jasnym kierunkom technicznym w niejednoznacznych obszarach problemów o krytycznym znaczeniu dla biznesu.
Co będziesz robić
Architektura domeny i kierownictwo techniczne
● Posiadaj i rozwijaj kierunek techniczny dla określonej domeny systemów HPC, takiej jak architektura platformy Slum, integracje harmonogramów, cykl życia klastra, środowiska obciążenia lub automatyzacja usług.
● Podejmuj decyzje dotyczące architektury, które równoważą jakość oprogramowania, realia operacyjne, potrzeby klientów i długoterminową łatwość konserwacji.
● Zdefiniuj, w jaki sposób sprawdzone wdrożenia Slurm powinny być spakowane, zautomatyzowane i udostępniane jako usługa.
● Rozwiązuj niejasności dotyczące własności, interfejsów, granic cyklu życia i modeli operacyjnych w zespołach.
● Pełnić rolę technicznego punktu eskalacji najbardziej złożonych problemów w danej domenie.
Międzyzespołowa dźwignia inżynieryjna
● Ustal wspólne wzorce automatyzacji, zarządzania cyklem życia usług, obserwowalności, niezawodności i możliwości wsparcia na całej platformie HPC.
● Opracuj międzyzespołowe projekty integracji pomiędzy Slurm, systemami sąsiadującymi z Kubernetes, interfejsami API infrastruktury, systemami tożsamości i narzędziami platformy.
● Twórz moduły wielokrotnego użytku, automatyzację, wzorce wdrożeń i wdrożenia referencyjne, które zwiększają dźwignię inżynieryjną.
● Tożsamość i poprawność możliwych do uniknięcia rozbieżności technicznych, powielania wysiłków i delikatnych modeli operacyjnych
● Upewnij się, że projekty domen odzwierciedlają realia planowania GPU, sieci HPC, izolacji wydajności i operacji produkcyjnych.
Dostawa, niezawodność i wpływ
● Kieruj inicjatywami o znaczeniu krytycznym pod względem technicznym, obejmującymi 2–4 zespoły lub określony obszar platformy HPC.
● Uwolnione dostarczanie poprzez wyjaśnienie kierunku technicznego i zmniejszenie niejasności w złożonych problemach związanych z projektowaniem systemów.
● W razie potrzeby wnoś praktyczny wkład, aby zmniejszyć ryzyko lub przyspieszyć pracę o znaczeniu krytycznym.
● Wywieraj wpływ na zespoły inżynierów bez formalnej władzy poprzez zdecydowaną ocenę, przejrzystość projektu i praktyczne rozwiązania.
● Współpracuj z sąsiadującymi inżynierami oprogramowania natywnymi dla chmury, aby wdrożenia HPC opierały się na wzorcach wspólnych platform, a nie na oddzielnych.
KPI
● Kierownictwo techniczne w zdefiniowanej domenie HPC
● Realizacja kluczowych inicjatyw w 2-4 zespołach
● Zmniejszenie rozbieżności technicznych i powielania wysiłków
● Niezawodność i łatwość obsługi usług HPC opartych na Slurmie
O Tobie
● Rozległe doświadczenie w projektowaniu i budowaniu oprogramowania produkcyjnego i automatyzacji dla systemów HPC, zwłaszcza środowisk opartych na Slum.
● Duże doświadczenie w pisaniu łatwego w utrzymaniu, testowalnego i odpornego oprogramowania w Go, Pythonie lub podobnych językach.
● Sprawdzona umiejętność definiowania kierunku technicznego w całej domenie obejmującej wiele zespołów lub usług.
● Silne zrozumienie wewnętrznych elementów Slurma, zachowań planistów, problemów związanych z cyklem życia klastra i kompromisów operacyjnych.
● Silna praktyczna znajomość infrastruktury wspieranej przez procesor graficzny i sieci HPC, w tym InfiniBand, RoCE, RDMA i charakterystyk obciążenia zależnych od wydajności.
● Doświadczenie w integracji systemów HPC z platformami chmurowymi, interfejsami API lub modelami świadczenia usług.
● Doświadczenie w tworzeniu dźwigni inżynieryjnej poprzez standardy, wzorce wielokrotnego użytku, współdzielone narzędzia i przejrzystość architektury.
● Mocny osąd w równoważeniu krótkoterminowej dostawy z długoterminową kondycją platformy i możliwością wsparcia.
● Silne umiejętności komunikacji pisemnej i werbalnej, z możliwością ustawienia wielu zespołów wokół spójnego kierunku technicznego.
● Doświadczenie z innymi programami planującymi lub systemami wsadowymi, takimi jak Kueue, jest cenne.
Co możemy Ci zaoferować
Będziesz miał okazję pomóc w kształtowaniu standardów operacyjnych sztucznej inteligencji nowej generacji
platformę chmurową, pracującą nad złożonymi wyzwaniami infrastrukturalnymi z prawdziwą własnością i wpływem. To
to szansa na odegranie znaczącej roli w skalowaniu wysokowydajnego, zrównoważonego centrum danych
działania w szybko zmieniającym się środowisku
Oświadczenie o równych szansach…
Źródło: Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/senior-manager-internal-lecommunications-greenhouse/staff-hpc-systems-software-engineer-290428)
To ogłoszenie pochodzi z feedu partnera. Aplikuj na stronie źródłowej.
Źródło: Senior Manager, Internal Communications - Greenhouse
Ogłoszenie pochodzi od Senior Manager, Internal Communications - Greenhouse.