Emploi
De la source partenaire
Ingénieur en optimisation de l'IA
100 000 $US Salaire
Détails
- Type de contrat
- Temps plein
- À distance
- Oui
- Salaire à partir de
- 100 000
- Salaire jusqu'à
- 100 000
- Entreprise
- Bright Vision Technologies
Description
Traduit automatiquement depuis English. Le texte original fait foi. Traduction automatique — une traduction plus précise est en préparation.
Ingénieur en optimisation de l'IA – À distance
Bright Vision Technologies est une société de conseil technologique et de développement de logiciels proposant des solutions cloud, IA, données et d'entreprise à travers les États-Unis.
Il s'agit d'une opportunité fantastique de rejoindre une organisation établie et respectée offrant un énorme potentiel d'évolution de carrière.
Titre du poste : Ingénieur en optimisation de l'IA
Emplacement : 100 % à distance (États-Unis)
Type de poste : Temps plein, Direct W2
Échelle salariale : 100 000 $ par an
Expérience requise : 6+ ans
Parrainage : les citoyens américains, les titulaires de cartes vertes, les titulaires d'EAD et les candidats au transfert H-1B sont encouragés à postuler. Nous ne sommes pas en mesure de parrainer de nouvelles demandes de visa H-1B pour ce poste.
Résumé du poste
Nous recherchons un ingénieur en optimisation de l'IA pour se concentrer sur l'extraction d'un débit maximal, la minimisation de la latence et la réduction des coûts des charges de travail de formation et d'inférence pour les grands systèmes de réseaux neuronaux. Le rôle couvre l'ensemble de la pile, de l'optimisation du noyau de bas niveau au réglage du système distribué, nécessitant une compréhension approfondie de l'architecture GPU, du parallélisme des modèles, de la gestion de la mémoire et de l'optimisation au niveau du compilateur. Le candidat idéal a démontré son impact sur les charges de travail d’IA de production, avec une solide discipline en matière d’instrumentation et de mesure qui permet des décisions d’optimisation rigoureuses et basées sur les données. Dans ce rôle, vous travaillerez en étroite collaboration avec des partenaires interfonctionnels (produits, conception, ingénierie, opérations et parties prenantes commerciales) pour traduire des exigences ambiguës en solutions bien conçues, et vous devrez relever la barre grâce à la révision du code, à la révision de la conception et au mentorat d'ingénieurs plus juniors. Le candidat retenu apporte une solide discipline d'ingénierie, un style de communication clair et une expérience en matière d'exécution de travaux significatifs qui résistent bien à la production.
Qualifications requises
• Baccalauréat ou maîtrise en informatique, en génie informatique ou dans un domaine connexe.
• Six années ou plus d'expérience en ingénierie des performances, en systèmes ML ou en HPC.
• Forte maîtrise de Python et C++.
• Expérience pratique de l'optimisation des charges de travail d'apprentissage en profondeur sur des GPU modernes.
• Compréhension approfondie des techniques de formation distribuée et d'inférence.
• Expérience avec les outils de profilage sur CPU, GPU et systèmes distribués.
• Familiarité avec les techniques de compression de modèles et leurs implications en matière de précision.
• Bonne maîtrise des hiérarchies de mémoire, des primitives de communication et des stratégies de parallélisme.
• Excellentes compétences en matière de mesure, de débogage et de raisonnement analytique.
• Solides compétences en communication et en collaboration.
Qualifications préférées
• Expérience de l'optimisation de l'inférence LLM à l'échelle de la production.
• Contributions à des projets vLLM, TensorRT-LLM, DeepSpeed ou similaires.
• Familiarité avec la création de noyau personnalisée dans Triton ou CUTLASS.
• Expérience avec FinOps pour les charges de travail d'IA.
• Publications ou conférences sur les performances des systèmes d'IA.
Comment postuler
Vous souhaitez en savoir plus sur cette opportunité ? Pour une considération immédiate, veuillez envoyer votre curriculum vitae à
Vision Technologies est un employeur garantissant l'égalité des chances. Déclaration sur l'égalité des chances en matière d'emploi (EEO)
Bright Vision Technologies (BV Teck) s'engage à garantir l'égalité des chances en matière d'emploi (EEO) pour tous les employés et candidats sans égard à la race, la couleur, la religion, le sexe, l'orientation sexuelle, l'identité ou l'expression de genre, l'origine nationale, l'âge, les informations génétiques, le handicap, le statut d'ancien combattant ou tout autre statut protégé tel que défini par les lois fédérales, étatiques ou locales applicables. Cet engagement s'étend à tous les aspects de l'emploi, y compris le recrutement, l'embauche, la formation, la rémunération, la promotion, le transfert, les congés, le licenciement, les mises à pied et le rappel.
BV Teck interdit expressément toute forme de harcèlement ou de discrimination au travail. Toute ingérence inappropriée dans la capacité des employés à accomplir leurs tâches peut entraîner des mesures disciplinaires pouvant aller jusqu'au licenciement.
Publié initialement sur Himalaya
Source : Himalaya (https://himalayas.app/companies/bright-vision-technologies/jobs/ai-optimization-engineer-1494147856)
Bright Vision Technologies est une société de conseil technologique et de développement de logiciels proposant des solutions cloud, IA, données et d'entreprise à travers les États-Unis.
Il s'agit d'une opportunité fantastique de rejoindre une organisation établie et respectée offrant un énorme potentiel d'évolution de carrière.
Titre du poste : Ingénieur en optimisation de l'IA
Emplacement : 100 % à distance (États-Unis)
Type de poste : Temps plein, Direct W2
Échelle salariale : 100 000 $ par an
Expérience requise : 6+ ans
Parrainage : les citoyens américains, les titulaires de cartes vertes, les titulaires d'EAD et les candidats au transfert H-1B sont encouragés à postuler. Nous ne sommes pas en mesure de parrainer de nouvelles demandes de visa H-1B pour ce poste.
Résumé du poste
Nous recherchons un ingénieur en optimisation de l'IA pour se concentrer sur l'extraction d'un débit maximal, la minimisation de la latence et la réduction des coûts des charges de travail de formation et d'inférence pour les grands systèmes de réseaux neuronaux. Le rôle couvre l'ensemble de la pile, de l'optimisation du noyau de bas niveau au réglage du système distribué, nécessitant une compréhension approfondie de l'architecture GPU, du parallélisme des modèles, de la gestion de la mémoire et de l'optimisation au niveau du compilateur. Le candidat idéal a démontré son impact sur les charges de travail d’IA de production, avec une solide discipline en matière d’instrumentation et de mesure qui permet des décisions d’optimisation rigoureuses et basées sur les données. Dans ce rôle, vous travaillerez en étroite collaboration avec des partenaires interfonctionnels (produits, conception, ingénierie, opérations et parties prenantes commerciales) pour traduire des exigences ambiguës en solutions bien conçues, et vous devrez relever la barre grâce à la révision du code, à la révision de la conception et au mentorat d'ingénieurs plus juniors. Le candidat retenu apporte une solide discipline d'ingénierie, un style de communication clair et une expérience en matière d'exécution de travaux significatifs qui résistent bien à la production.
Qualifications requises
• Baccalauréat ou maîtrise en informatique, en génie informatique ou dans un domaine connexe.
• Six années ou plus d'expérience en ingénierie des performances, en systèmes ML ou en HPC.
• Forte maîtrise de Python et C++.
• Expérience pratique de l'optimisation des charges de travail d'apprentissage en profondeur sur des GPU modernes.
• Compréhension approfondie des techniques de formation distribuée et d'inférence.
• Expérience avec les outils de profilage sur CPU, GPU et systèmes distribués.
• Familiarité avec les techniques de compression de modèles et leurs implications en matière de précision.
• Bonne maîtrise des hiérarchies de mémoire, des primitives de communication et des stratégies de parallélisme.
• Excellentes compétences en matière de mesure, de débogage et de raisonnement analytique.
• Solides compétences en communication et en collaboration.
Qualifications préférées
• Expérience de l'optimisation de l'inférence LLM à l'échelle de la production.
• Contributions à des projets vLLM, TensorRT-LLM, DeepSpeed ou similaires.
• Familiarité avec la création de noyau personnalisée dans Triton ou CUTLASS.
• Expérience avec FinOps pour les charges de travail d'IA.
• Publications ou conférences sur les performances des systèmes d'IA.
Comment postuler
Vous souhaitez en savoir plus sur cette opportunité ? Pour une considération immédiate, veuillez envoyer votre curriculum vitae à
Vision Technologies est un employeur garantissant l'égalité des chances. Déclaration sur l'égalité des chances en matière d'emploi (EEO)
Bright Vision Technologies (BV Teck) s'engage à garantir l'égalité des chances en matière d'emploi (EEO) pour tous les employés et candidats sans égard à la race, la couleur, la religion, le sexe, l'orientation sexuelle, l'identité ou l'expression de genre, l'origine nationale, l'âge, les informations génétiques, le handicap, le statut d'ancien combattant ou tout autre statut protégé tel que défini par les lois fédérales, étatiques ou locales applicables. Cet engagement s'étend à tous les aspects de l'emploi, y compris le recrutement, l'embauche, la formation, la rémunération, la promotion, le transfert, les congés, le licenciement, les mises à pied et le rappel.
BV Teck interdit expressément toute forme de harcèlement ou de discrimination au travail. Toute ingérence inappropriée dans la capacité des employés à accomplir leurs tâches peut entraîner des mesures disciplinaires pouvant aller jusqu'au licenciement.
Publié initialement sur Himalaya
Source : Himalaya (https://himalayas.app/companies/bright-vision-technologies/jobs/ai-optimization-engineer-1494147856)
Cette annonce provient d'un flux partenaire. Postulez sur le site source.
Source: Bright Vision Technologies
Annonce fournie par Bright Vision Technologies.