Работа
Из фида партнера
Старший инженер по высокопроизводительным вычислениям, вычисления на графических процессорах
Цена по запросу
Детали
- Тип занятости
- Полная занятость
- Удалённо
- Нет
- Компания
- Nebius
- Location raw
- London
Описание
Автоматически переведено с языка English. Оригинальный текст является основным. Машинный перевод — готовится более точный вариант.
О Небиусе:
Nebius возглавляет новую эру облачной инфраструктуры для глобальной экономики искусственного интеллекта. Мы создаем полнофункциональную облачную платформу искусственного интеллекта, которая поддерживает разработчиков и предприятия от обучения данным и моделям до производственного развертывания, без затрат и сложностей, связанных с созданием большой собственной инфраструктуры искусственного интеллекта и машинного обучения.
Создано инженерами для инженеров. От крупномасштабной оркестровки графических процессоров до оптимизации вывода — мы решаем сложные проблемы, связанные с вычислениями, хранением данных, сетями и прикладным искусственным интеллектом.
Компания зарегистрирована на Nasdaq (NBIS) и имеет штаб-квартиру в Амстердаме. Мы имеем глобальное присутствие с центрами исследований и разработок в Европе, Великобритании, Северной Америке и Израиле. В нашу команду, насчитывающую более 1500 человек, входят сотни инженеров с глубокими знаниями в области аппаратного и программного обеспечения, а также исследований и разработок в области искусственного интеллекта.
Роль
Мы ищем старшего инженера кластера высокопроизводительных вычислений, который присоединится к нашей команде и сыграет ключевую роль в разработке нашей передовой гипермасштабируемой платформы. Команда GPU и InfiniBand отвечает за улучшение и оптимизацию основных компонентов нашей облачной платформы, уделяя особое внимание вычислениям на графическом процессоре, сетям InfiniBand и стеку KVM/QEMU. Вы будете тесно сотрудничать с технологиями аппаратной виртуализации и эмуляции устройств, обеспечивая высокую производительность и безопасность в средах HPC с несколькими графическими процессорами. Эта роль включает в себя анализ, устранение неполадок и улучшение инфраструктуры для поддержки нового оборудования, тонкую настройку производительности системы и автоматизацию обнаружения и устранения ошибок в сложной системе.
На этой должности вы будете отвечать за:
• Настройка производительности кластеров графических процессоров и сетей InfiniBand для обеспечения оптимальной работы в средах HPC и графических процессорах.
• Анализ и устранение основных причин проблем, связанных с графическими процессорами и сетями InfiniBand, и предложение корректирующих действий.
• Интеграция нового оборудования в существующую инфраструктуру, включая поддержку нового оборудования графического процессора с помощью программных стеков, таких как Kubernetes, QEMU и KVM.
• Совершенствование систем автоматизации для упреждающего мониторинга, обнаружения и устранения проблем в средах графических процессоров и InfiniBand.
• Настройка и управление устройствами графического процессора и фабриками InfiniBand для обеспечения эффективной и надежной работы.
Мы ожидаем, что у вас будет:
• Более 5 лет профессионального опыта в разработке программного обеспечения системного уровня (с упором на оптимизацию производительности, низкоуровневое программирование).
• Более 3 лет практического опыта работы с системами Linux (администрирование, устранение неполадок и настройка производительности).
• Глубокое понимание серверной архитектуры, включая устройства PCIe, сетевые карты, ОС/ядро Linux и системы высокопроизводительных вычислений (HPC).
• Уверенное владение одним или несколькими языками программирования, ориентированными на производительность (C/C++, Go, Python).
Будет плюсом, если у вас есть:
• Опыт комплексного тестирования графических процессоров в кластерной среде с использованием сети InfiniBand.
• Подтвержденный опыт анализа и оптимизации производительности рабочих нагрузок HPC (например, моделирования, анализа данных, рабочих нагрузок AI/ML).
• Знакомство с протоколами RDMA, RoCE и InfiniBand для высокопроизводительной связи.
• Опыт работы в области программно-определяемых сетей (SDN) и опыт работы с сетями кластеров HPC.
• Понимание виртуализации QEMU/KVM и управления виртуализированными средами.
• Опыт работы с платформами глубокого обучения, такими как PyTorch и TensorFlow, и их интеграцией с системами HPC.
• Знакомство с библиотеками коллективного общения, такими как MPI и NCCL, для распределенных вычислений.
В рамках процесса мы проводим собеседования по программированию.
#LI-LH2
Преимущества и льготы:
• Конкурентное вознаграждение
• Карьерный рост и возможности обучения.
• Гибкость и ответственность
• Культура сотрудничества и инноваций.
• Возможность работать над эффективными проектами в области искусственного интеллекта.
• Международная среда и талантливые команды
Каково работать в Небиусе:
Быстрое движение - Смелое мышление - Постоянный рост - Значимое влияние - Доверие и реальная ответственность - Возможность формировать будущее искусственного интеллекта
Заявление о равных возможностях:
Небиус – работодатель, предоставляющий равные возможности. Мы стремимся способствовать инклюзивному и разнообразному рабочему месту и предоставлять равные возможности трудоустройства во всех аспектах занятости. Мы не проводим дискриминацию по признаку расы, цвета кожи, религии, пола (включая беременность), национального происхождения, происхождения, возраста, инвалидности, генетической информации, семейного положения, статуса ветерана, сексуальной ориентации, гендерной идентичности или самовыражения или любых других характеристик, защищаемых действующим законодательством.
Кандидаты должны иметь разрешение на работу в стране, в которой они подают заявление, и должны будут предоставить подтверждение права на трудоустройство в качестве условия найма.
Если вам понадобится жилье во время процесса подачи заявления, сообщите нам об этом.
Найдите работу в Великобритании на Arbeitnow
Источник: Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/nebius/senior-hpc-engineer-gpu-compute-london-325843).
Nebius возглавляет новую эру облачной инфраструктуры для глобальной экономики искусственного интеллекта. Мы создаем полнофункциональную облачную платформу искусственного интеллекта, которая поддерживает разработчиков и предприятия от обучения данным и моделям до производственного развертывания, без затрат и сложностей, связанных с созданием большой собственной инфраструктуры искусственного интеллекта и машинного обучения.
Создано инженерами для инженеров. От крупномасштабной оркестровки графических процессоров до оптимизации вывода — мы решаем сложные проблемы, связанные с вычислениями, хранением данных, сетями и прикладным искусственным интеллектом.
Компания зарегистрирована на Nasdaq (NBIS) и имеет штаб-квартиру в Амстердаме. Мы имеем глобальное присутствие с центрами исследований и разработок в Европе, Великобритании, Северной Америке и Израиле. В нашу команду, насчитывающую более 1500 человек, входят сотни инженеров с глубокими знаниями в области аппаратного и программного обеспечения, а также исследований и разработок в области искусственного интеллекта.
Роль
Мы ищем старшего инженера кластера высокопроизводительных вычислений, который присоединится к нашей команде и сыграет ключевую роль в разработке нашей передовой гипермасштабируемой платформы. Команда GPU и InfiniBand отвечает за улучшение и оптимизацию основных компонентов нашей облачной платформы, уделяя особое внимание вычислениям на графическом процессоре, сетям InfiniBand и стеку KVM/QEMU. Вы будете тесно сотрудничать с технологиями аппаратной виртуализации и эмуляции устройств, обеспечивая высокую производительность и безопасность в средах HPC с несколькими графическими процессорами. Эта роль включает в себя анализ, устранение неполадок и улучшение инфраструктуры для поддержки нового оборудования, тонкую настройку производительности системы и автоматизацию обнаружения и устранения ошибок в сложной системе.
На этой должности вы будете отвечать за:
• Настройка производительности кластеров графических процессоров и сетей InfiniBand для обеспечения оптимальной работы в средах HPC и графических процессорах.
• Анализ и устранение основных причин проблем, связанных с графическими процессорами и сетями InfiniBand, и предложение корректирующих действий.
• Интеграция нового оборудования в существующую инфраструктуру, включая поддержку нового оборудования графического процессора с помощью программных стеков, таких как Kubernetes, QEMU и KVM.
• Совершенствование систем автоматизации для упреждающего мониторинга, обнаружения и устранения проблем в средах графических процессоров и InfiniBand.
• Настройка и управление устройствами графического процессора и фабриками InfiniBand для обеспечения эффективной и надежной работы.
Мы ожидаем, что у вас будет:
• Более 5 лет профессионального опыта в разработке программного обеспечения системного уровня (с упором на оптимизацию производительности, низкоуровневое программирование).
• Более 3 лет практического опыта работы с системами Linux (администрирование, устранение неполадок и настройка производительности).
• Глубокое понимание серверной архитектуры, включая устройства PCIe, сетевые карты, ОС/ядро Linux и системы высокопроизводительных вычислений (HPC).
• Уверенное владение одним или несколькими языками программирования, ориентированными на производительность (C/C++, Go, Python).
Будет плюсом, если у вас есть:
• Опыт комплексного тестирования графических процессоров в кластерной среде с использованием сети InfiniBand.
• Подтвержденный опыт анализа и оптимизации производительности рабочих нагрузок HPC (например, моделирования, анализа данных, рабочих нагрузок AI/ML).
• Знакомство с протоколами RDMA, RoCE и InfiniBand для высокопроизводительной связи.
• Опыт работы в области программно-определяемых сетей (SDN) и опыт работы с сетями кластеров HPC.
• Понимание виртуализации QEMU/KVM и управления виртуализированными средами.
• Опыт работы с платформами глубокого обучения, такими как PyTorch и TensorFlow, и их интеграцией с системами HPC.
• Знакомство с библиотеками коллективного общения, такими как MPI и NCCL, для распределенных вычислений.
В рамках процесса мы проводим собеседования по программированию.
#LI-LH2
Преимущества и льготы:
• Конкурентное вознаграждение
• Карьерный рост и возможности обучения.
• Гибкость и ответственность
• Культура сотрудничества и инноваций.
• Возможность работать над эффективными проектами в области искусственного интеллекта.
• Международная среда и талантливые команды
Каково работать в Небиусе:
Быстрое движение - Смелое мышление - Постоянный рост - Значимое влияние - Доверие и реальная ответственность - Возможность формировать будущее искусственного интеллекта
Заявление о равных возможностях:
Небиус – работодатель, предоставляющий равные возможности. Мы стремимся способствовать инклюзивному и разнообразному рабочему месту и предоставлять равные возможности трудоустройства во всех аспектах занятости. Мы не проводим дискриминацию по признаку расы, цвета кожи, религии, пола (включая беременность), национального происхождения, происхождения, возраста, инвалидности, генетической информации, семейного положения, статуса ветерана, сексуальной ориентации, гендерной идентичности или самовыражения или любых других характеристик, защищаемых действующим законодательством.
Кандидаты должны иметь разрешение на работу в стране, в которой они подают заявление, и должны будут предоставить подтверждение права на трудоустройство в качестве условия найма.
Если вам понадобится жилье во время процесса подачи заявления, сообщите нам об этом.
Найдите работу в Великобритании на Arbeitnow
Источник: Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/nebius/senior-hpc-engineer-gpu-compute-london-325843).
Это объявление получено из партнерского фида. Оформляйте заказ на исходном сайте.
Источник: Nebius
Расположение
Лондон, Великобритания
Объявление предоставлено Nebius.