Emploi
De la source partenaire
Ingénieur données et plateforme ML
Prix sur demande
Détails
- Type de contrat
- Temps plein
- À distance
- Non
- Entreprise
- Speechmatics
Description
Traduit automatiquement depuis English. Le texte original fait foi. Traduction automatique — une traduction plus précise est en préparation.
Nous recherchons un ingénieur ML Data & Platform pour posséder l'infrastructure qui alimente nos modèles d'IA vocale : les pipelines qui sourcent et préparent les données de formation, et la plate-forme qui les forme, les évalue et les sert en production. Speech AI a un problème de données que la plupart des équipes ML n'ont pas, et vous serez au centre de sa résolution, en travaillant au sein de notre équipe ML pour éliminer les frictions tout au long du cycle de vie et mettre plus rapidement de meilleurs modèles en production.
Il s'agit d'un rôle large et interfonctionnel adapté à quelqu'un qui aime travailler sur l'ensemble de la pile : infrastructure de données, systèmes distribués et ML de production, et qui s'approprie les problèmes de bout en bout plutôt que d'attendre qu'on lui dise quoi résoudre.
Ce que tu feras
• Concevoir, créer et maintenir des pipelines de données évolutifs pour l'ingestion, la transformation, la validation et le stockage de grands ensembles de données utilisés pour entraîner nos modèles.
• Développer et maintenir des solutions de web scraping et d'acquisition de données pour maintenir les ensembles de données de formation à jour, de haute qualité et disponibles à grande échelle.
• Construire et exploiter l'infrastructure qui permet à l'équipe ML de déployer et d'évaluer rapidement de nouveaux modèles, et qui sert les modèles de manière efficace et fiable en production.
• Optimisation de l'infrastructure pour la vitesse d'itération et la fiabilité de la production, y compris l'utilisation du GPU, la planification des tâches et l'efficacité de la formation.
• Mise en œuvre de l'observabilité (surveillance, journalisation, alerte) dans les pipelines de données et les systèmes ML pour détecter les problèmes rapidement et assurer le bon fonctionnement des choses.
• Dépannage de problèmes complexes sur les systèmes distribués, couvrant l'infrastructure de données, la formation et l'inférence.
• Améliorer continuellement nos données et nos pratiques MLOps, et contribuer à façonner la feuille de route sur la façon dont notre plateforme évolue à mesure que nous évoluons.
Ce dont vous aurez besoin
• Forte maîtrise de Python et SQL, avec une solide base backend ou d'ingénierie de données
• Expérience pratique de la conteneurisation et de l'orchestration (Docker, Kubernetes) et collaboration avec un fournisseur de cloud majeur
• Expérience dans la création de pipelines de données et de processus ETL/ELT à grande échelle, y compris le web scraping ou la collecte automatisée de données.
• Une solide compréhension du cycle de vie du ML, depuis les données jusqu'à la formation, l'évaluation et la diffusion des modèles.
• Expérience des pratiques de qualité des données (validation, nettoyage, normalisation) et/ou observabilité de niveau production
• Capacité à concevoir des architectures résilientes et évolutives, ainsi qu'à assurer l'exploitation et le dépannage des systèmes distribués.
• Expérience MLOps, par exemple diffusion de modèles, suivi des expériences, optimisation de la formation distribuée/GPU ou flux de travail ML reproductibles
• Une mentalité d'initiative : à l'aise pour identifier les problèmes et trouver des solutions sans avoir besoin de directives détaillées.
Nous vous encourageons à postuler même si vous pensez ne pas répondre exactement à toutes les exigences. La liste des exigences vise à montrer les types d’expérience et de qualités que nous recherchons, mais elle n’est pas exhaustive. Si vous êtes intéressé par le poste, l'équipe et notre mission, nous serions ravis d'examiner votre candidature. Nous sommes toujours ouverts aux conversations et sommes impatients de vous entendre.
Qui nous sommes :
Speechmatics est le principal expert en intelligence vocale et utilise l'IA et l'apprentissage automatique pour libérer la valeur commerciale de la parole humaine dans le monde entier. Nous travaillons avec un mélange étonnant d'entreprises mondiales et notre technologie peut s'intégrer à la pile de nos clients, quel que soit leur secteur d'activité ou leur cas d'utilisation, ce qui en fait la solution incontournable pour exploiter les informations utiles issues de la parole.
Nous rejoindre, c'est travailler avec certains des esprits les plus intelligents du monde, se concentrer sur des projets de pointe et déployer les dernières techniques pour révolutionner le marché. Nous croyons qu'il faut donner la priorité aux gens ; nous ferons tout notre possible pour vous aider à développer vos compétences et vous donner les outils dont vous avez besoin pour prospérer. Nos vendredis de concentration vous offrent une journée de concentration tranquille, compensée par les mardis ensemble lorsque nous avons nos réunions d'équipe, afin que vous ayez toujours le bon équilibre.
Nous avons structuré une approche hybride qui comprend 2 à 3 jours de bureau désignés chaque semaine. Cet arrangement garantit que, tout en profitant des avantages du travail à distance, nous maintenons également la connexion et la synergie vitales que seules les interactions en personne peuvent favoriser.
Ce n'est que le début ; nous recherchons des personnes extraordinaires comme vous pour continuer notre voyage…
Ce que nous pouvons vous offrir :
Quelle que soit l'étape de votre carrière à laquelle vous vous trouvez - des stages rémunérés et opportunités de premier emploi jusqu'aux postes de direction et de direction - nous vous accompagnerons avec la formation et le développement nécessaires pour atteindre vos aspirations professionnelles chez nous. Les opportunités ne manquent vraiment pas ici pour vous impliquer et collaborer avec ceux qui vous entourent afin de réaliser votre meilleur travail.
Nous proposons un travail incroyablement flexible, des déjeuners d'entreprise réguliers et des célébrations d'anniversaire. Mais ce n’est pas tout. Nous avons discuté avec nos équipes pour connaître leurs souhaits. Qu'il s'agisse de soins médicaux privés ou de soins dentaires pour vous et votre famille, ou encore d'opportunités de travail à l'échelle mondiale, d'une généreuse allocation de vacances et d'une pension/401K, nous voulons nous assurer que nos employés et leurs familles sont pris en charge. Chaque employé recevra une allocation de travail à domicile pour l'achat d'équipements technologiques ou de bureau à domicile (en plus de votre choix d'ordinateur portable et d'accessoires, bien sûr). Notre approche du congé parental est conçue pour soutenir les employés du monde entier. Bien que cela varie selon la zone géographique, nous avons mis en place un soutien pour les parents (y compris une aide à l'adoption et des services de santé reproductive) pour garantir qu'ils disposent du temps et des ressources financières nécessaires pour prendre soin de leur famille grandissante.
Chez Speechmatics, notre mission est simple : comprendre chaque voix.…
Source : Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/speechmatics/ml-data-platform-engineer-cambridge-284072)
Il s'agit d'un rôle large et interfonctionnel adapté à quelqu'un qui aime travailler sur l'ensemble de la pile : infrastructure de données, systèmes distribués et ML de production, et qui s'approprie les problèmes de bout en bout plutôt que d'attendre qu'on lui dise quoi résoudre.
Ce que tu feras
• Concevoir, créer et maintenir des pipelines de données évolutifs pour l'ingestion, la transformation, la validation et le stockage de grands ensembles de données utilisés pour entraîner nos modèles.
• Développer et maintenir des solutions de web scraping et d'acquisition de données pour maintenir les ensembles de données de formation à jour, de haute qualité et disponibles à grande échelle.
• Construire et exploiter l'infrastructure qui permet à l'équipe ML de déployer et d'évaluer rapidement de nouveaux modèles, et qui sert les modèles de manière efficace et fiable en production.
• Optimisation de l'infrastructure pour la vitesse d'itération et la fiabilité de la production, y compris l'utilisation du GPU, la planification des tâches et l'efficacité de la formation.
• Mise en œuvre de l'observabilité (surveillance, journalisation, alerte) dans les pipelines de données et les systèmes ML pour détecter les problèmes rapidement et assurer le bon fonctionnement des choses.
• Dépannage de problèmes complexes sur les systèmes distribués, couvrant l'infrastructure de données, la formation et l'inférence.
• Améliorer continuellement nos données et nos pratiques MLOps, et contribuer à façonner la feuille de route sur la façon dont notre plateforme évolue à mesure que nous évoluons.
Ce dont vous aurez besoin
• Forte maîtrise de Python et SQL, avec une solide base backend ou d'ingénierie de données
• Expérience pratique de la conteneurisation et de l'orchestration (Docker, Kubernetes) et collaboration avec un fournisseur de cloud majeur
• Expérience dans la création de pipelines de données et de processus ETL/ELT à grande échelle, y compris le web scraping ou la collecte automatisée de données.
• Une solide compréhension du cycle de vie du ML, depuis les données jusqu'à la formation, l'évaluation et la diffusion des modèles.
• Expérience des pratiques de qualité des données (validation, nettoyage, normalisation) et/ou observabilité de niveau production
• Capacité à concevoir des architectures résilientes et évolutives, ainsi qu'à assurer l'exploitation et le dépannage des systèmes distribués.
• Expérience MLOps, par exemple diffusion de modèles, suivi des expériences, optimisation de la formation distribuée/GPU ou flux de travail ML reproductibles
• Une mentalité d'initiative : à l'aise pour identifier les problèmes et trouver des solutions sans avoir besoin de directives détaillées.
Nous vous encourageons à postuler même si vous pensez ne pas répondre exactement à toutes les exigences. La liste des exigences vise à montrer les types d’expérience et de qualités que nous recherchons, mais elle n’est pas exhaustive. Si vous êtes intéressé par le poste, l'équipe et notre mission, nous serions ravis d'examiner votre candidature. Nous sommes toujours ouverts aux conversations et sommes impatients de vous entendre.
Qui nous sommes :
Speechmatics est le principal expert en intelligence vocale et utilise l'IA et l'apprentissage automatique pour libérer la valeur commerciale de la parole humaine dans le monde entier. Nous travaillons avec un mélange étonnant d'entreprises mondiales et notre technologie peut s'intégrer à la pile de nos clients, quel que soit leur secteur d'activité ou leur cas d'utilisation, ce qui en fait la solution incontournable pour exploiter les informations utiles issues de la parole.
Nous rejoindre, c'est travailler avec certains des esprits les plus intelligents du monde, se concentrer sur des projets de pointe et déployer les dernières techniques pour révolutionner le marché. Nous croyons qu'il faut donner la priorité aux gens ; nous ferons tout notre possible pour vous aider à développer vos compétences et vous donner les outils dont vous avez besoin pour prospérer. Nos vendredis de concentration vous offrent une journée de concentration tranquille, compensée par les mardis ensemble lorsque nous avons nos réunions d'équipe, afin que vous ayez toujours le bon équilibre.
Nous avons structuré une approche hybride qui comprend 2 à 3 jours de bureau désignés chaque semaine. Cet arrangement garantit que, tout en profitant des avantages du travail à distance, nous maintenons également la connexion et la synergie vitales que seules les interactions en personne peuvent favoriser.
Ce n'est que le début ; nous recherchons des personnes extraordinaires comme vous pour continuer notre voyage…
Ce que nous pouvons vous offrir :
Quelle que soit l'étape de votre carrière à laquelle vous vous trouvez - des stages rémunérés et opportunités de premier emploi jusqu'aux postes de direction et de direction - nous vous accompagnerons avec la formation et le développement nécessaires pour atteindre vos aspirations professionnelles chez nous. Les opportunités ne manquent vraiment pas ici pour vous impliquer et collaborer avec ceux qui vous entourent afin de réaliser votre meilleur travail.
Nous proposons un travail incroyablement flexible, des déjeuners d'entreprise réguliers et des célébrations d'anniversaire. Mais ce n’est pas tout. Nous avons discuté avec nos équipes pour connaître leurs souhaits. Qu'il s'agisse de soins médicaux privés ou de soins dentaires pour vous et votre famille, ou encore d'opportunités de travail à l'échelle mondiale, d'une généreuse allocation de vacances et d'une pension/401K, nous voulons nous assurer que nos employés et leurs familles sont pris en charge. Chaque employé recevra une allocation de travail à domicile pour l'achat d'équipements technologiques ou de bureau à domicile (en plus de votre choix d'ordinateur portable et d'accessoires, bien sûr). Notre approche du congé parental est conçue pour soutenir les employés du monde entier. Bien que cela varie selon la zone géographique, nous avons mis en place un soutien pour les parents (y compris une aide à l'adoption et des services de santé reproductive) pour garantir qu'ils disposent du temps et des ressources financières nécessaires pour prendre soin de leur famille grandissante.
Chez Speechmatics, notre mission est simple : comprendre chaque voix.…
Source : Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/speechmatics/ml-data-platform-engineer-cambridge-284072)
Cette annonce provient d'un flux partenaire. Postulez sur le site source.
Source: Speechmatics
Emplacement
Cambridge, Royaume-Uni
Annonce fournie par Speechmatics.