Empleo
Del feed del socio
Ingeniero de inferencia desplegado hacia adelante
Precio a consultar
Detalles
- Tipo de empleo
- Jornada completa
- Remoto
- No
- Empresa
- Tensordyne
Descripción
Traducido automáticamente de English. El texto original es el oficial. Traducción automática — se está preparando una más precisa.
Acerca de Tensordyne
Tensordyne está construyendo una nueva clase de sistema de inferencia de IA diseñado para la implementación de alto rendimiento y eficiencia energética de las cargas de trabajo de IA generativa más exigentes del mundo.
Nuestra plataforma combina silicio especialmente diseñado, nuevas matemáticas de IA, redes de escalamiento optimizadas y arquitectura de memoria en un sistema estrechamente integrado diseñado específicamente para la inferencia de IA a gran escala. Trabajamos con hiperescaladores, neonubes, desarrolladores de modelos de vanguardia, empresas y socios de infraestructura que operan a la vanguardia de la IA.
A medida que Tensordyne pasa del desarrollo del sistema a la implementación del silicio, la validación del cliente, las implementaciones beta y el lanzamiento de la producción, estamos construyendo la organización técnica de clientes que se ubicará directamente entre nuestros equipos de ingeniería y las empresas que implementan la plataforma.
Resumen de roles
Buscamos un ingeniero de inferencia avanzado que combine una profunda experiencia en sistemas de inteligencia artificial con un fuerte instinto del cliente. Esta persona será dueña del camino desde la carga de trabajo de un cliente o la solicitud de modelo hasta un resultado técnico y, cuando sea necesario, hasta un modelo optimizado que se ejecute correctamente en el hardware y software de Tensordyne.
El rol se encuentra en la intersección de la arquitectura del modelo, el rendimiento de la inferencia, la optimización de los sistemas, las herramientas del desarrollador y la implementación del cliente. Trabajará de manera práctica con ingeniería y al mismo tiempo actuará como un puente técnico entre Producto, BizDev, Ventas y clientes.
que haras
• Convierta las cargas de trabajo de los clientes en respuestas de rendimiento rápidas y creíbles mediante la elaboración de perfiles y evaluaciones comparativas. Defina KPI relevantes, compárelos con líneas de base competitivas y mantenga nuestra metodología de evaluación actualizada con puntos de referencia externos.
• Habilitación y optimización de modelos: convierta y muestre modelos de clientes en la pila de Tensordyne, valide la calidad numérica, identifique cuellos de botella en el rendimiento y trabaje con los equipos del compilador, el tiempo de ejecución, el kernel y el sistema para mejorar los resultados.
• Implementación/ingeniería avanzada: trabajar directamente con clientes y socios en pruebas de concepto técnicas, integración, implementación y depuración; traduzca los requisitos en criterios de aceptación mensurables para la calidad, la latencia, el rendimiento y otros KPI relevantes.
• Realice un seguimiento de la precisión de la creación de perfiles hasta el hardware comparando continuamente los resultados de la creación de perfiles/simulación con las implementaciones de hardware reales, explique las brechas de materiales y señale las capacidades faltantes en el compilador, SDK, servidor de inferencia, administración de caché KV o sistemas adyacentes a los equipos propietarios.
• Convierta los aprendizajes repetidos específicos del cliente en herramientas, documentación, evaluaciones comparativas o mejoras de productos reutilizables.
Cualificaciones básicas
• Fuerte experiencia práctica con modelos de IA y sistemas de inferencia, especialmente LLM densos y MoE (Llama, DeepSeek, Qwen, GPT-OSS, Kimi, GLM), y VLM, modelos de voz y difusión.
• Fuertes habilidades en Python y PyTorch y la capacidad de comprender y modificar el código modelo.
• Experiencia en creación de perfiles, evaluación comparativa u optimización de la inferencia de modelos y el razonamiento sobre latencia, rendimiento, memoria y utilización.
• Fuertes habilidades de comunicación y resolución de problemas, con la capacidad de impulsar problemas técnicos ambiguos a través de los límites del equipo.
• Competencia en el uso de herramientas de desarrollo basadas en IA (por ejemplo, Claude Code, Cursor).
Fuertes ventajas
• Experiencia con pilas de implementación y servicio de LLM, como vLLM, SGLang o sistemas similares.
• Experiencia trabajando directamente con clientes o socios técnicos externos.
• Experiencia en la creación de modelos en nuevos aceleradores o hardware no estándar, incluida la depuración del rendimiento a través de los límites del marco/tiempo de ejecución/hardware.
• Experiencia práctica con técnicas o entornos de inferencia de producción como cuantificación, inferencia distribuida o Kubernetes.
• Experiencia navegando y contribuyendo a las bases de código de Rust.
Valores tensordinos
• Piense en grande. Perseguir objetivos técnicos y comerciales ambiciosos.
• Apuntar a la excelencia. La calidad importa en todo lo que construimos y entregamos.
• Sea dueño de ello y hágalo. Asumir la responsabilidad y generar resultados.
• Operar con integridad. Sea directo, transparente y respetuoso.
• Ganar como equipo. Haz que las personas que te rodean sean más efectivas.
• Valorar diferentes perspectivas. Los equipos más fuertes desafían las suposiciones y aportan experiencias diversas a los problemas difíciles.
Tensordyne es un empleador que ofrece igualdad de oportunidades. Creemos que los equipos diversos están mejor equipados para resolver problemas complejos y crear tecnología excepcional. Todos los solicitantes calificados recibirán consideración para el empleo sin importar edad, color, identidad o expresión de género, estado civil, origen nacional, discapacidad, condición de veterano protegido, raza, religión, embarazo, orientación sexual o cualquier otra característica protegida por las leyes, regulaciones y ordenanzas aplicables.
Una nota para las agencias de contratación: no se comuniquen con los empleados o líderes de Tensordyne con respecto a este puesto. No aceptamos currículums de agencias no solicitados y no somos responsables de los honorarios asociados con envíos no solicitados.
Encuentre más trabajos de habla inglesa en Alemania en Arbeitnow
Fuente: Arbeitnow (https://www.arbeitnow.com/jobs/companies/tensordyne/forward-deployed-inference-engineer-munich-481912)
Tensordyne está construyendo una nueva clase de sistema de inferencia de IA diseñado para la implementación de alto rendimiento y eficiencia energética de las cargas de trabajo de IA generativa más exigentes del mundo.
Nuestra plataforma combina silicio especialmente diseñado, nuevas matemáticas de IA, redes de escalamiento optimizadas y arquitectura de memoria en un sistema estrechamente integrado diseñado específicamente para la inferencia de IA a gran escala. Trabajamos con hiperescaladores, neonubes, desarrolladores de modelos de vanguardia, empresas y socios de infraestructura que operan a la vanguardia de la IA.
A medida que Tensordyne pasa del desarrollo del sistema a la implementación del silicio, la validación del cliente, las implementaciones beta y el lanzamiento de la producción, estamos construyendo la organización técnica de clientes que se ubicará directamente entre nuestros equipos de ingeniería y las empresas que implementan la plataforma.
Resumen de roles
Buscamos un ingeniero de inferencia avanzado que combine una profunda experiencia en sistemas de inteligencia artificial con un fuerte instinto del cliente. Esta persona será dueña del camino desde la carga de trabajo de un cliente o la solicitud de modelo hasta un resultado técnico y, cuando sea necesario, hasta un modelo optimizado que se ejecute correctamente en el hardware y software de Tensordyne.
El rol se encuentra en la intersección de la arquitectura del modelo, el rendimiento de la inferencia, la optimización de los sistemas, las herramientas del desarrollador y la implementación del cliente. Trabajará de manera práctica con ingeniería y al mismo tiempo actuará como un puente técnico entre Producto, BizDev, Ventas y clientes.
que haras
• Convierta las cargas de trabajo de los clientes en respuestas de rendimiento rápidas y creíbles mediante la elaboración de perfiles y evaluaciones comparativas. Defina KPI relevantes, compárelos con líneas de base competitivas y mantenga nuestra metodología de evaluación actualizada con puntos de referencia externos.
• Habilitación y optimización de modelos: convierta y muestre modelos de clientes en la pila de Tensordyne, valide la calidad numérica, identifique cuellos de botella en el rendimiento y trabaje con los equipos del compilador, el tiempo de ejecución, el kernel y el sistema para mejorar los resultados.
• Implementación/ingeniería avanzada: trabajar directamente con clientes y socios en pruebas de concepto técnicas, integración, implementación y depuración; traduzca los requisitos en criterios de aceptación mensurables para la calidad, la latencia, el rendimiento y otros KPI relevantes.
• Realice un seguimiento de la precisión de la creación de perfiles hasta el hardware comparando continuamente los resultados de la creación de perfiles/simulación con las implementaciones de hardware reales, explique las brechas de materiales y señale las capacidades faltantes en el compilador, SDK, servidor de inferencia, administración de caché KV o sistemas adyacentes a los equipos propietarios.
• Convierta los aprendizajes repetidos específicos del cliente en herramientas, documentación, evaluaciones comparativas o mejoras de productos reutilizables.
Cualificaciones básicas
• Fuerte experiencia práctica con modelos de IA y sistemas de inferencia, especialmente LLM densos y MoE (Llama, DeepSeek, Qwen, GPT-OSS, Kimi, GLM), y VLM, modelos de voz y difusión.
• Fuertes habilidades en Python y PyTorch y la capacidad de comprender y modificar el código modelo.
• Experiencia en creación de perfiles, evaluación comparativa u optimización de la inferencia de modelos y el razonamiento sobre latencia, rendimiento, memoria y utilización.
• Fuertes habilidades de comunicación y resolución de problemas, con la capacidad de impulsar problemas técnicos ambiguos a través de los límites del equipo.
• Competencia en el uso de herramientas de desarrollo basadas en IA (por ejemplo, Claude Code, Cursor).
Fuertes ventajas
• Experiencia con pilas de implementación y servicio de LLM, como vLLM, SGLang o sistemas similares.
• Experiencia trabajando directamente con clientes o socios técnicos externos.
• Experiencia en la creación de modelos en nuevos aceleradores o hardware no estándar, incluida la depuración del rendimiento a través de los límites del marco/tiempo de ejecución/hardware.
• Experiencia práctica con técnicas o entornos de inferencia de producción como cuantificación, inferencia distribuida o Kubernetes.
• Experiencia navegando y contribuyendo a las bases de código de Rust.
Valores tensordinos
• Piense en grande. Perseguir objetivos técnicos y comerciales ambiciosos.
• Apuntar a la excelencia. La calidad importa en todo lo que construimos y entregamos.
• Sea dueño de ello y hágalo. Asumir la responsabilidad y generar resultados.
• Operar con integridad. Sea directo, transparente y respetuoso.
• Ganar como equipo. Haz que las personas que te rodean sean más efectivas.
• Valorar diferentes perspectivas. Los equipos más fuertes desafían las suposiciones y aportan experiencias diversas a los problemas difíciles.
Tensordyne es un empleador que ofrece igualdad de oportunidades. Creemos que los equipos diversos están mejor equipados para resolver problemas complejos y crear tecnología excepcional. Todos los solicitantes calificados recibirán consideración para el empleo sin importar edad, color, identidad o expresión de género, estado civil, origen nacional, discapacidad, condición de veterano protegido, raza, religión, embarazo, orientación sexual o cualquier otra característica protegida por las leyes, regulaciones y ordenanzas aplicables.
Una nota para las agencias de contratación: no se comuniquen con los empleados o líderes de Tensordyne con respecto a este puesto. No aceptamos currículums de agencias no solicitados y no somos responsables de los honorarios asociados con envíos no solicitados.
Encuentre más trabajos de habla inglesa en Alemania en Arbeitnow
Fuente: Arbeitnow (https://www.arbeitnow.com/jobs/companies/tensordyne/forward-deployed-inference-engineer-munich-481912)
Este anuncio proviene de un feed de socios. Solicítalo en el sitio web de origen.
Fuente: Tensordyne
Ubicación
Múnich, Alemania
Publicación proporcionada por Tensordyne.