Empleo
Del feed del socio
Ingeniero de software de plantilla, inferencia
Precio a consultar
Detalles
- Tipo de empleo
- Jornada completa
- Remoto
- No
- Empresa
- Coreweaveu
Descripción
Traducido automáticamente de English. El texto original es el oficial. Traducción automática — se está preparando una más precisa.
CoreWeave es la nube esencial para AI™. Creado para pioneros por pioneros, CoreWeave ofrece una plataforma de tecnología, herramientas y equipos que permite a los innovadores crear y escalar la IA con confianza. Con la confianza de los principales laboratorios de inteligencia artificial, nuevas empresas y empresas globales, CoreWeave combina un rendimiento de infraestructura superior con una profunda experiencia técnica para acelerar los avances y convertir la computación en capacidad. Fundada en 2017, CoreWeave se convirtió en una empresa que cotiza en bolsa (Nasdaq: CRWV) en marzo de 2025. Obtenga más información en www.coreweave.com.
Estamos orgullosos de ser un empleador acreditado por Living Wage.
Lo que harás:
El equipo de Inferencia de CoreWeave construye y opera la plataforma central en la nube que impulsa cargas de trabajo de GPU a gran escala para AI/ML, VFX, renderizado e inferencia en tiempo real. Nuestra pila está diseñada para ofrecer velocidad, escalabilidad y rentabilidad, lo que proporciona una poderosa alternativa a los hiperescaladores tradicionales donde la infraestructura es nuestro producto principal operado a escala masiva.
Sobre el papel:
Como ingeniero de software del equipo de Inferencia, operará como líder técnico en múltiples equipos y servicios, impulsando la arquitectura, el rendimiento y la confiabilidad de la plataforma de inferencia nativa de Kubernetes de CoreWeave. Definirá y liderará iniciativas de diseño complejas y transversales que abarcarán el enrutamiento de solicitudes, la programación adaptativa, la gestión de recursos de GPU y la optimización del costo por token bajo estrictos SLA P99. En esta función de alto impacto, implementará optimizaciones de inferencia avanzadas, como decodificación especulativa y reutilización de caché KV, mientras establece marcos de evaluación comparativa de rendimiento, guía la alineación interfuncional a través de los límites de la infraestructura y eleva el nivel del rigor de ingeniería y las prácticas de observabilidad en toda la organización.
Quien eres:
• Licenciatura en Ciencias de la Computación, Ingeniería o un campo técnico relacionado (o experiencia práctica equivalente).
• Más de 8 años de experiencia en la creación de sistemas distribuidos a gran escala o plataformas en la nube, con un historial comprobado de liderar iniciativas técnicas a escala entre equipos u organizaciones.
• Fuerte dominio de la codificación en Go, Python o C++.
• Amplia experiencia en Kubernetes a escala de producción, incluida la orquestación, la programación y el diseño de servicios.
• Gran conocimiento de los sistemas en red, optimización del rendimiento y diseño de sistemas distribuidos.
• Experiencia práctica en ingeniería con sistemas de inferencia, incluidas estrategias de procesamiento por lotes/microbatidos, almacenamiento en caché, optimización de memoria, precisión mixta (BF16/FP8) y entrega de tokens en streaming.
• Capacidad demostrada para mejorar sistemáticamente la latencia de cola (P95/P99) y la confiabilidad de la plataforma a través de ingeniería basada en métricas.
• Experiencia comprobada en posesión de SLI/SLO para todo el sistema, planificación de capacidad, estrategias de escalado automático y tutoría de ingenieros de nivel medio y superior.
Preferido:
• Contribuciones directas de código abierto o de producción a marcos de inferencia modernos (por ejemplo, vLLM, Triton, TensorRT-LLM, Ray Serve o TorchServe).
• Amplia experiencia en ingeniería de sistemas GPU y optimización del rendimiento del hardware (por ejemplo, interconexiones CUDA, NCCL, RDMA, NUMA o GPU).
• Exposición directa a infraestructura de IA/ML a gran escala o entornos de nube de hiperescala.
¿Te preguntas si encajas bien?
Creemos en invertir en nuestra gente y valoramos a los candidatos que puedan aportar sus propias experiencias diversificadas a nuestros equipos, incluso si no coinciden al 100 % con sus habilidades o experiencia.
• Le encanta: escalar arquitecturas distribuidas altamente complejas y asesorar a cohortes de ingeniería para elevar los estándares técnicos en toda una organización.
• Tiene curiosidad acerca de: Ser pionero en optimizaciones de inferencia de baja latencia y encontrar atajos innovadores para optimizar el rendimiento del costo por token.
• Es un experto en: ingeniería basada en métricas, resolución de problemas de microcuellos de botella y entrega de plataformas de nube estables bajo estrictas restricciones de múltiples inquilinos.
¿Por qué CoreWeave?
¡En CoreWeave, trabajamos duro, nos divertimos y nos movemos rápido! Estamos en una etapa emocionante de hipercrecimiento que no querrás perderte. No tememos un poco de caos y estamos aprendiendo constantemente. Nuestro equipo se preocupa profundamente por cómo construimos nuestro producto y cómo trabajamos juntos, lo cual se representa a través de nuestros valores fundamentales:
• Sea curioso en su esencia
• Actúe como propietario
• Empoderar a los empleados
• Ofrezca las mejores experiencias para los clientes
• Lograr más juntos
Apoyamos y fomentamos una perspectiva emprendedora y un pensamiento independiente. Fomentamos un entorno que fomenta la colaboración y permite el desarrollo de soluciones innovadoras a problemas complejos. A medida que nos preparamos para el despegue, las oportunidades de crecimiento de la organización se expanden constantemente. Estará rodeado de algunos de los mejores talentos de la industria, que también querrán aprender de usted. ¡Únase a nosotros!
El salario inicial estará determinado por los conocimientos, las habilidades, la experiencia y la ubicación en el mercado relacionados con el trabajo. Nos esforzamos tanto por lograr la alineación del mercado como la equidad interna al determinar la compensación. Además del salario base, nuestro paquete total de recompensas incluye una bonificación discrecional, premios en acciones y un programa integral de beneficios (todo según la elegibilidad).
Para cumplir con nuestra obligación de proteger los datos de los clientes, los solicitantes seleccionados a los que se les ofrezca empleo en CoreWeave deberán completar una verificación básica de antecedentes penales, realizada de conformidad con el RGPD. Las ofertas de empleo están condicionadas a recibir resultados satisfactorios de la verificación.
Lo que ofrecemos
Además de un salario competitivo, ofrecemos una variedad de beneficios para satisfacer sus necesidades, que incluyen:
• Seguro médico a nivel familiar
• Seguro dental a nivel familiar
• Generosa contribución a la pensión
• Seguro de vida a 4 veces el salario
• Cobertura por enfermedad crítica
• Programa de asistencia al empleado
• Reembolso de matrícula
• Cultura de trabajo centrada en la disrupción innovadora.
Los beneficios pueden variar según la ubicación.
Igualdad de oportunidades…
Fuente: Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/coreweaveu/staff-software-engineer-inference-london-292192)
Estamos orgullosos de ser un empleador acreditado por Living Wage.
Lo que harás:
El equipo de Inferencia de CoreWeave construye y opera la plataforma central en la nube que impulsa cargas de trabajo de GPU a gran escala para AI/ML, VFX, renderizado e inferencia en tiempo real. Nuestra pila está diseñada para ofrecer velocidad, escalabilidad y rentabilidad, lo que proporciona una poderosa alternativa a los hiperescaladores tradicionales donde la infraestructura es nuestro producto principal operado a escala masiva.
Sobre el papel:
Como ingeniero de software del equipo de Inferencia, operará como líder técnico en múltiples equipos y servicios, impulsando la arquitectura, el rendimiento y la confiabilidad de la plataforma de inferencia nativa de Kubernetes de CoreWeave. Definirá y liderará iniciativas de diseño complejas y transversales que abarcarán el enrutamiento de solicitudes, la programación adaptativa, la gestión de recursos de GPU y la optimización del costo por token bajo estrictos SLA P99. En esta función de alto impacto, implementará optimizaciones de inferencia avanzadas, como decodificación especulativa y reutilización de caché KV, mientras establece marcos de evaluación comparativa de rendimiento, guía la alineación interfuncional a través de los límites de la infraestructura y eleva el nivel del rigor de ingeniería y las prácticas de observabilidad en toda la organización.
Quien eres:
• Licenciatura en Ciencias de la Computación, Ingeniería o un campo técnico relacionado (o experiencia práctica equivalente).
• Más de 8 años de experiencia en la creación de sistemas distribuidos a gran escala o plataformas en la nube, con un historial comprobado de liderar iniciativas técnicas a escala entre equipos u organizaciones.
• Fuerte dominio de la codificación en Go, Python o C++.
• Amplia experiencia en Kubernetes a escala de producción, incluida la orquestación, la programación y el diseño de servicios.
• Gran conocimiento de los sistemas en red, optimización del rendimiento y diseño de sistemas distribuidos.
• Experiencia práctica en ingeniería con sistemas de inferencia, incluidas estrategias de procesamiento por lotes/microbatidos, almacenamiento en caché, optimización de memoria, precisión mixta (BF16/FP8) y entrega de tokens en streaming.
• Capacidad demostrada para mejorar sistemáticamente la latencia de cola (P95/P99) y la confiabilidad de la plataforma a través de ingeniería basada en métricas.
• Experiencia comprobada en posesión de SLI/SLO para todo el sistema, planificación de capacidad, estrategias de escalado automático y tutoría de ingenieros de nivel medio y superior.
Preferido:
• Contribuciones directas de código abierto o de producción a marcos de inferencia modernos (por ejemplo, vLLM, Triton, TensorRT-LLM, Ray Serve o TorchServe).
• Amplia experiencia en ingeniería de sistemas GPU y optimización del rendimiento del hardware (por ejemplo, interconexiones CUDA, NCCL, RDMA, NUMA o GPU).
• Exposición directa a infraestructura de IA/ML a gran escala o entornos de nube de hiperescala.
¿Te preguntas si encajas bien?
Creemos en invertir en nuestra gente y valoramos a los candidatos que puedan aportar sus propias experiencias diversificadas a nuestros equipos, incluso si no coinciden al 100 % con sus habilidades o experiencia.
• Le encanta: escalar arquitecturas distribuidas altamente complejas y asesorar a cohortes de ingeniería para elevar los estándares técnicos en toda una organización.
• Tiene curiosidad acerca de: Ser pionero en optimizaciones de inferencia de baja latencia y encontrar atajos innovadores para optimizar el rendimiento del costo por token.
• Es un experto en: ingeniería basada en métricas, resolución de problemas de microcuellos de botella y entrega de plataformas de nube estables bajo estrictas restricciones de múltiples inquilinos.
¿Por qué CoreWeave?
¡En CoreWeave, trabajamos duro, nos divertimos y nos movemos rápido! Estamos en una etapa emocionante de hipercrecimiento que no querrás perderte. No tememos un poco de caos y estamos aprendiendo constantemente. Nuestro equipo se preocupa profundamente por cómo construimos nuestro producto y cómo trabajamos juntos, lo cual se representa a través de nuestros valores fundamentales:
• Sea curioso en su esencia
• Actúe como propietario
• Empoderar a los empleados
• Ofrezca las mejores experiencias para los clientes
• Lograr más juntos
Apoyamos y fomentamos una perspectiva emprendedora y un pensamiento independiente. Fomentamos un entorno que fomenta la colaboración y permite el desarrollo de soluciones innovadoras a problemas complejos. A medida que nos preparamos para el despegue, las oportunidades de crecimiento de la organización se expanden constantemente. Estará rodeado de algunos de los mejores talentos de la industria, que también querrán aprender de usted. ¡Únase a nosotros!
El salario inicial estará determinado por los conocimientos, las habilidades, la experiencia y la ubicación en el mercado relacionados con el trabajo. Nos esforzamos tanto por lograr la alineación del mercado como la equidad interna al determinar la compensación. Además del salario base, nuestro paquete total de recompensas incluye una bonificación discrecional, premios en acciones y un programa integral de beneficios (todo según la elegibilidad).
Para cumplir con nuestra obligación de proteger los datos de los clientes, los solicitantes seleccionados a los que se les ofrezca empleo en CoreWeave deberán completar una verificación básica de antecedentes penales, realizada de conformidad con el RGPD. Las ofertas de empleo están condicionadas a recibir resultados satisfactorios de la verificación.
Lo que ofrecemos
Además de un salario competitivo, ofrecemos una variedad de beneficios para satisfacer sus necesidades, que incluyen:
• Seguro médico a nivel familiar
• Seguro dental a nivel familiar
• Generosa contribución a la pensión
• Seguro de vida a 4 veces el salario
• Cobertura por enfermedad crítica
• Programa de asistencia al empleado
• Reembolso de matrícula
• Cultura de trabajo centrada en la disrupción innovadora.
Los beneficios pueden variar según la ubicación.
Igualdad de oportunidades…
Fuente: Arbeitnow (https://www.arbeitnow.co.uk/jobs/companies/coreweaveu/staff-software-engineer-inference-london-292192)
Este anuncio proviene de un feed de socios. Solicítalo en el sitio web de origen.
Fuente: Coreweaveu
Ubicación
Londres, Reino Unido
Publicación proporcionada por Coreweaveu.