Job
Aus Partner-Feed
Forschungsingenieur – Schlussfolgerung
Preis auf Anfrage
Details
- Beschäftigungsart
- Vollzeit
- Remote
- Ja
- Unternehmen
- Elevenlabs
- Level
- Any
Beschreibung
Automatisch aus dem English übersetzt. Der Originaltext ist maßgeblich. Maschinenübersetzung – eine genauere Version wird vorbereitet.
Über ElevenLabs
ElevenLabs ist ein KI-Forschungs- und Produktunternehmen, das die Art und Weise verändert, wie wir mit Technologie interagieren.
Wir starteten im Januar 2023 mit dem ersten menschenähnlichen KI-Sprachmodell. Heute betreuen wir Millionen von Nutzern und Tausende von Unternehmen – von schnell wachsenden Startups bis hin zu Großunternehmen wie der Deutschen Telekom und Meta. Zu unseren Investoren gehören einige der bedeutendsten der Welt, darunter Andreessen Horowitz, ICONIQ Growth und Sequoia. Wir haben 781 Millionen US-Dollar an Finanzmitteln aufgebracht und unsere letzte Bewertung lag bei 22 Milliarden US-Dollar – immer ein Vielfaches von 11.
Wir haben uns von Voice auf drei Hauptplattformen ausgeweitet:
•
ElevenAgents ermöglicht es Unternehmen, nahtlose und intelligente Kundenerlebnisse zu bieten, mit den Integrationen, Tests, Überwachungen und Zuverlässigkeit, die für den Einsatz von Sprach- und Chat-Agenten in großem Maßstab erforderlich sind.
•
ElevenCreative ermöglicht Entwicklern und Vermarktern die Erstellung und Bearbeitung von Sprache, Musik, Bildern und Videos in über 70 Sprachen.
•
ElevenAPI bietet Entwicklern Zugriff auf unsere führenden AI-Audio-Grundlagenmodelle.
Alles, was wir tun, ist das Ergebnis der Kreativität und des Engagements unseres Teams – Bauherren, die die beste Arbeit ihres Lebens leisten. Wir sind Forscher, Ingenieure und Betreiber. IOI-Medaillengewinner und ehemalige Gründer. Wenn Sie hart arbeiten und nachhaltig positive Auswirkungen erzielen möchten, möchten wir von Ihnen hören.
Wie wir arbeiten
•
Hohe Geschwindigkeit: Schnelles Experimentieren, schlanke autonome Teams und minimale Bürokratie.
•
Auswirkungen statt Berufsbezeichnungen: Wir haben keine Berufsbezeichnungen. Stattdessen geht es um die Wirkung, die Sie haben. Keine Aufgabe liegt über oder unter Ihnen.
•
KI zuerst: Wir nutzen KI, um schneller voranzukommen und qualitativ hochwertigere Ergebnisse zu erzielen. Wir tun dies im gesamten Unternehmen – von der Technik über das Wachstum bis hin zum Betrieb.
•
Exzellenz überall: Alles, was wir tun, sollte der Qualität unserer KI-Modelle entsprechen.
•
Globales Team: Wir priorisieren Ihr Talent, nicht Ihren Standort.
Was wir bieten
•
Innovative Kultur: Sie werden Teil einer generationenübergreifenden Gelegenheit sein, den Weg der KI zu definieren, umgeben von einem Team, das die Grenzen des Möglichen verschiebt.
•
Wachstumspfade: Der Beitritt zu ElevenLabs bedeutet, Teil eines dynamischen Teams mit unzähligen Möglichkeiten zu werden, etwas zu bewirken – über Ihre unmittelbare Rolle und Verantwortung hinaus.
•
Lernen und Entwicklung: ElevenLabs unterstützt proaktiv die berufliche Entwicklung durch ein jährliches freiwilliges Stipendium.
•
Soziale Reisen: Wir bieten außerdem ein jährliches freiwilliges Stipendium an, um jedes Jahr Kollegen zu treffen, ganz wie Sie möchten.
•
Jährliches Firmen-Offsite: Jedes Jahr bringen wir das gesamte Team an einem neuen Standort zusammen – frühere Offsites waren unter anderem in Kroatien und Italien.
•
Co-Working: Wenn Sie nicht in der Nähe eines unserer Hauptstandorte wohnen, bieten wir ein monatliches Co-Working-Stipendium an.
Über die Rolle
Wir suchen einen Forschungsingenieur zur Verstärkung des Forschungsteams bei ElevenLabs, der sich auf die Bereitstellung und Optimierung unserer bahnbrechenden KI-Modelle in der Produktion konzentriert. Die Qualität unserer Modelle ist nur dann von Bedeutung, wenn sie schnell, zuverlässig und im großen Maßstab bereitgestellt werden können. Sie werden Eigentümer der Systeme sein, die Forschungsdurchbrüche in Echtzeitprodukte umwandeln, die von Millionen Menschen genutzt werden. Sie werden in dieser Rolle erfolgreich sein, wenn Ihnen Folgendes gefällt:
•
Bereitstellung hochmoderner Modelle in der Produktion und Steuerung des Weges vom Forschungskontrollpunkt zur Bereitstellungsinfrastruktur.
•
Optimierung der Inferenzleistung im gesamten Stapel, einschließlich Latenz, Durchsatz und Kosten, mithilfe von Techniken wie Quantisierung, Destillation, KV-Cache-Optimierung, Batch-Strategien und benutzerdefinierten Kerneln.
•
Aufbau und Optimierung leistungsstarker Bereitstellungssysteme für Echtzeit-Streaming-Workloads, bei denen jede Millisekunde zählt.
•
Schaffung von Werkzeugen und Infrastruktur, die es Forschern ermöglichen, neue Modelle schnell, sicher und mit Vertrauen in ihre Leistungsmerkmale in die Produktion zu bringen.
Anforderungen
Wir verlangen keine formellen Zertifizierungen oder Abschlüsse. Stattdessen suchen wir begeisterte Ingenieure, die mit Artefakten wie früheren Projekten, Designs oder GitHub-Beiträgen beeindruckende Lösungen für schwierige Probleme präsentieren können. Idealerweise bringen Sie mit:
•
Erfahrung in der Bereitstellung und Bereitstellung von ML-Modellen in der Produktion, ideal für latenzempfindliche oder Echtzeitanwendungen.
•
Starke technische Kenntnisse in der GPU-Programmierung und Inferenzoptimierung (z. B. CUDA, Triton, TensorRT oder Serving-Frameworks wie vLLM oder SGLang).
•
Die Fähigkeit, Engpässe im gesamten Serving-Stack, von der Modellarchitektur über Kernel bis hin zur Orchestrierung, autonom zu profilieren, zu diagnostizieren und zu beseitigen und die Tools zu entwickeln, um diese zu messen.
Standort
Diese Rolle ist remote und kann global ausgeführt werden. Wenn Sie möchten, können Sie von unseren Büros in London, New York, San Francisco und Warschau aus arbeiten.
#LI-Remote
Wir achten als Arbeitgeber auf Chancengleichheit und diskriminieren nicht aufgrund von Rasse, Religion, nationaler Herkunft, Geschlecht, sexueller Orientierung, Alter, Veteranenstatus, Behinderung oder anderen gesetzlich geschützten Status.
Quelle: Jobicy (https://jobicy.com/jobs/154820-research-engineer-inference)
ElevenLabs ist ein KI-Forschungs- und Produktunternehmen, das die Art und Weise verändert, wie wir mit Technologie interagieren.
Wir starteten im Januar 2023 mit dem ersten menschenähnlichen KI-Sprachmodell. Heute betreuen wir Millionen von Nutzern und Tausende von Unternehmen – von schnell wachsenden Startups bis hin zu Großunternehmen wie der Deutschen Telekom und Meta. Zu unseren Investoren gehören einige der bedeutendsten der Welt, darunter Andreessen Horowitz, ICONIQ Growth und Sequoia. Wir haben 781 Millionen US-Dollar an Finanzmitteln aufgebracht und unsere letzte Bewertung lag bei 22 Milliarden US-Dollar – immer ein Vielfaches von 11.
Wir haben uns von Voice auf drei Hauptplattformen ausgeweitet:
•
ElevenAgents ermöglicht es Unternehmen, nahtlose und intelligente Kundenerlebnisse zu bieten, mit den Integrationen, Tests, Überwachungen und Zuverlässigkeit, die für den Einsatz von Sprach- und Chat-Agenten in großem Maßstab erforderlich sind.
•
ElevenCreative ermöglicht Entwicklern und Vermarktern die Erstellung und Bearbeitung von Sprache, Musik, Bildern und Videos in über 70 Sprachen.
•
ElevenAPI bietet Entwicklern Zugriff auf unsere führenden AI-Audio-Grundlagenmodelle.
Alles, was wir tun, ist das Ergebnis der Kreativität und des Engagements unseres Teams – Bauherren, die die beste Arbeit ihres Lebens leisten. Wir sind Forscher, Ingenieure und Betreiber. IOI-Medaillengewinner und ehemalige Gründer. Wenn Sie hart arbeiten und nachhaltig positive Auswirkungen erzielen möchten, möchten wir von Ihnen hören.
Wie wir arbeiten
•
Hohe Geschwindigkeit: Schnelles Experimentieren, schlanke autonome Teams und minimale Bürokratie.
•
Auswirkungen statt Berufsbezeichnungen: Wir haben keine Berufsbezeichnungen. Stattdessen geht es um die Wirkung, die Sie haben. Keine Aufgabe liegt über oder unter Ihnen.
•
KI zuerst: Wir nutzen KI, um schneller voranzukommen und qualitativ hochwertigere Ergebnisse zu erzielen. Wir tun dies im gesamten Unternehmen – von der Technik über das Wachstum bis hin zum Betrieb.
•
Exzellenz überall: Alles, was wir tun, sollte der Qualität unserer KI-Modelle entsprechen.
•
Globales Team: Wir priorisieren Ihr Talent, nicht Ihren Standort.
Was wir bieten
•
Innovative Kultur: Sie werden Teil einer generationenübergreifenden Gelegenheit sein, den Weg der KI zu definieren, umgeben von einem Team, das die Grenzen des Möglichen verschiebt.
•
Wachstumspfade: Der Beitritt zu ElevenLabs bedeutet, Teil eines dynamischen Teams mit unzähligen Möglichkeiten zu werden, etwas zu bewirken – über Ihre unmittelbare Rolle und Verantwortung hinaus.
•
Lernen und Entwicklung: ElevenLabs unterstützt proaktiv die berufliche Entwicklung durch ein jährliches freiwilliges Stipendium.
•
Soziale Reisen: Wir bieten außerdem ein jährliches freiwilliges Stipendium an, um jedes Jahr Kollegen zu treffen, ganz wie Sie möchten.
•
Jährliches Firmen-Offsite: Jedes Jahr bringen wir das gesamte Team an einem neuen Standort zusammen – frühere Offsites waren unter anderem in Kroatien und Italien.
•
Co-Working: Wenn Sie nicht in der Nähe eines unserer Hauptstandorte wohnen, bieten wir ein monatliches Co-Working-Stipendium an.
Über die Rolle
Wir suchen einen Forschungsingenieur zur Verstärkung des Forschungsteams bei ElevenLabs, der sich auf die Bereitstellung und Optimierung unserer bahnbrechenden KI-Modelle in der Produktion konzentriert. Die Qualität unserer Modelle ist nur dann von Bedeutung, wenn sie schnell, zuverlässig und im großen Maßstab bereitgestellt werden können. Sie werden Eigentümer der Systeme sein, die Forschungsdurchbrüche in Echtzeitprodukte umwandeln, die von Millionen Menschen genutzt werden. Sie werden in dieser Rolle erfolgreich sein, wenn Ihnen Folgendes gefällt:
•
Bereitstellung hochmoderner Modelle in der Produktion und Steuerung des Weges vom Forschungskontrollpunkt zur Bereitstellungsinfrastruktur.
•
Optimierung der Inferenzleistung im gesamten Stapel, einschließlich Latenz, Durchsatz und Kosten, mithilfe von Techniken wie Quantisierung, Destillation, KV-Cache-Optimierung, Batch-Strategien und benutzerdefinierten Kerneln.
•
Aufbau und Optimierung leistungsstarker Bereitstellungssysteme für Echtzeit-Streaming-Workloads, bei denen jede Millisekunde zählt.
•
Schaffung von Werkzeugen und Infrastruktur, die es Forschern ermöglichen, neue Modelle schnell, sicher und mit Vertrauen in ihre Leistungsmerkmale in die Produktion zu bringen.
Anforderungen
Wir verlangen keine formellen Zertifizierungen oder Abschlüsse. Stattdessen suchen wir begeisterte Ingenieure, die mit Artefakten wie früheren Projekten, Designs oder GitHub-Beiträgen beeindruckende Lösungen für schwierige Probleme präsentieren können. Idealerweise bringen Sie mit:
•
Erfahrung in der Bereitstellung und Bereitstellung von ML-Modellen in der Produktion, ideal für latenzempfindliche oder Echtzeitanwendungen.
•
Starke technische Kenntnisse in der GPU-Programmierung und Inferenzoptimierung (z. B. CUDA, Triton, TensorRT oder Serving-Frameworks wie vLLM oder SGLang).
•
Die Fähigkeit, Engpässe im gesamten Serving-Stack, von der Modellarchitektur über Kernel bis hin zur Orchestrierung, autonom zu profilieren, zu diagnostizieren und zu beseitigen und die Tools zu entwickeln, um diese zu messen.
Standort
Diese Rolle ist remote und kann global ausgeführt werden. Wenn Sie möchten, können Sie von unseren Büros in London, New York, San Francisco und Warschau aus arbeiten.
#LI-Remote
Wir achten als Arbeitgeber auf Chancengleichheit und diskriminieren nicht aufgrund von Rasse, Religion, nationaler Herkunft, Geschlecht, sexueller Orientierung, Alter, Veteranenstatus, Behinderung oder anderen gesetzlich geschützten Status.
Quelle: Jobicy (https://jobicy.com/jobs/154820-research-engineer-inference)
Dieses Angebot stammt aus einem Partner-Feed. Bewerben Sie sich auf der Quell-Website.
Quelle: Elevenlabs
Inserat bereitgestellt von Elevenlabs.