Resumen
Detalles del puesto
Totalmente en remoto
Según la oferta.
Requisitos
Trabajar en inglés
Se requiere inglés, según la oferta.
Tener 5+ años de experiencia
Puesto de nivel Senior.
Esta oferta se ha traducido automáticamente al español.
Salario y beneficios
Qué ofrecen
- Compensación competitiva
- Oportunidades de crecimiento profesional y aprendizaje
- Flexibilidad y autonomía
- Cultura colaborativa e innovadora
- Oportunidad de trabajar en proyectos de IA de gran impacto
- Entorno internacional y equipos con talento
Requisitos
Qué buscan
- Más de 5 años de experiencia profesional en desarrollo de software a nivel de sistema (centrado en la optimización del rendimiento y programación de bajo nivel).
- Más de 3 años de experiencia práctica con sistemas Linux (administración, resolución de problemas y ajuste de rendimiento).
- Comprensión profunda de la arquitectura de servidores, incluyendo dispositivos PCIe, NICs, Linux OS/Kernel y sistemas de computación de alto rendimiento (HPC).
- Gran dominio de uno o más lenguajes de programación orientados al rendimiento (C/C++, Go, Python).
Se valorará
- Experiencia con pruebas de extremo a extremo de GPU en un entorno de clúster utilizando redes InfiniBand.
- Trayectoria demostrada analizando y optimizando el rendimiento de cargas de trabajo HPC (p. ej., simulaciones, análisis de datos, cargas de trabajo de IA/ML).
- Familiaridad con los protocolos RDMA, RoCE e InfiniBand para comunicaciones de alto rendimiento.
- Experiencia en Redes Definidas por Software (SDN) y experiencia con redes de clústeres HPC.
- Comprensión de la virtualización QEMU/KVM y gestión de entornos virtualizados.
- Experiencia con frameworks de deep learning como PyTorch y TensorFlow, y su integración con sistemas HPC.
- Familiaridad con librerías de comunicación colectiva como MPI y NCCL para computación distribuida.
El puesto
Buscamos un Senior HPC Cluster Engineer para unirse a nuestro equipo y desempeñar un papel clave en el desarrollo de nuestra plataforma hyperscaler de vanguardia. El equipo de GPU & InfiniBand es responsable de mejorar y optimizar los componentes principales de nuestra plataforma Cloud, con un enfoque específico en la computación GPU, las redes InfiniBand y el stack KVM/QEMU. Trabajarás estrechamente con tecnologías de virtualización de hardware y emulación de dispositivos, garantizando un alto rendimiento y seguridad en entornos HPC multi-GPU. El puesto implica analizar, solucionar problemas y mejorar la infraestructura para dar soporte a nuevo hardware, ajustar el rendimiento del sistema y automatizar la detección y resolución de fallos en un sistema complejo.
Qué harás
- Ajustar el rendimiento de los clústeres de GPU y las redes InfiniBand para garantizar un funcionamiento óptimo en entornos HPC y basados en GPU.
- Analizar y solucionar problemas de la causa raíz de incidencias relacionadas con GPUs y redes InfiniBand, y proponer acciones correctivas.
- Integrar nuevo hardware en la infraestructura existente, incluyendo el soporte para nuevo hardware de GPU a través de stacks de software como Kubernetes, QEMU y KVM.
- Mejorar los sistemas de automatización para la monitorización proactiva, detección y resolución de problemas en entornos de GPU e InfiniBand.
- Configurar y gestionar dispositivos GPU y tejidos InfiniBand, garantizando un funcionamiento eficiente y fiable.
Cómo es trabajar en Nebius
Ritmo rápido - Pensamiento audaz - Crecimiento constante - Impacto significativo - Confianza y responsabilidad real - Oportunidad de dar forma al futuro de la IA
Proceso de selección
Realizamos entrevistas de programación como parte del proceso.
Sobre Nebius
Nebius es una empresa de infraestructura de IA que proporciona plataformas cloud basadas en GPU, centros de datos y herramientas para desarrolladores para entrenar y desplegar modelos de aprendizaje automático. Fundada en 2024 como una escisión de Yandex, la empresa tiene su sede en Ámsterdam y opera a nivel global, con un fuerte enfoque en servir a startups y empresas de IA. Nebius es conocida por sus clústeres de GPU a gran escala y por su papel en la construcción de la columna vertebral de cómputo de IA para Europa y más allá.
En España, Nebius está expandiendo su presencia con una oficina dedicada en Madrid, contratando para roles en arquitectura de soluciones, ingeniería de centros de datos, seguridad y gestión de productos. La empresa ofrece un entorno de trabajo internacional y de ritmo rápido, con un fuerte énfasis en la excelencia técnica y la innovación en IA. Para profesionales internacionales, Nebius ofrece oportunidades para trabajar en proyectos de infraestructura de IA de vanguardia, con un equipo multicultural y un apoyo de reubicación competitivo.
- Fundación
- 2024
- Plantilla
- 500–1,000
- Sede
- Amsterdam, Netherlands
- En España
- Madrid
- Web
- nebius.com
Datos prácticos
- Nebius es una escisión de Yandex, una de las mayores empresas tecnológicas de Europa, y cuenta con una inversión significativa para infraestructura de IA.
- La empresa tiene su sede en Ámsterdam, ofreciendo un entorno de trabajo multicultural y de habla inglesa.
- Nebius está expandiendo rápidamente su huella de centros de datos en Europa, incluida España, creando oportunidades en ingeniería y operaciones.
- La empresa se centra en servicios cloud nativos de IA, proporcionando exposición a clústeres de GPU de vanguardia y plataformas de aprendizaje automático.
- Nebius ofrece compensación y beneficios competitivos, con roles en España basados en Madrid.
En sus propias palabras
Sobre la empresa y el equipo
Nebius está liderando una nueva era en la infraestructura de la nube para la economía global de la IA. Estamos construyendo una plataforma de nube de IA de stack completo que da soporte a desarrolladores y empresas, desde el entrenamiento de datos y modelos hasta el despliegue en producción, sin el coste y la complejidad de construir una gran infraestructura de IA/ML propia.
Creado por ingenieros, para ingenieros. Desde la orquestación de GPU a gran escala hasta la optimización de la inferencia, nos encargamos de los problemas difíciles en computación, almacenamiento, redes e IA aplicada.
Cotizamos en Nasdaq (NBIS) y tenemos nuestra sede en Ámsterdam; contamos con una presencia global con centros de I+D en Europa, el Reino Unido, Norteamérica e Israel. Nuestro equipo de más de 1.500 personas incluye a cientos de ingenieros con profunda experiencia en hardware, software e I+D de IA.
Información adicional
Nebius es un empleador que ofrece igualdad de oportunidades. Estamos comprometidos con el fomento de un lugar de trabajo inclusivo y diverso y con la prestación de igualdad de oportunidades de empleo en todos los aspectos del empleo. No discriminamos por motivos de raza, color, religión, sexo (incluido el embarazo), origen nacional, ascendencia, edad, discapacidad, información genética, estado civil, condición de veterano, orientación sexual, identidad o expresión de género, o cualquier otra característica protegida por la legislación aplicable.
Los candidatos deben estar autorizados para trabajar en el país en el que solicitan el puesto y se les requerirá que proporcionen un comprobante de elegibilidad de empleo como condición para la contratación.
Si necesitas adaptaciones durante el proceso de solicitud, por favor háznoslo saber.


