El portal de empleo de España
Líder Técnico de Infraestructura GPU
En remoto, Barcelona·Jornada completa·Añadida hace 16 días
15 ofertas abiertas
Resumen
Detalles del puesto
Contrato indefinido
Jornada completa.
Totalmente en remoto
Según la oferta.
Requisitos
Trabajar en inglés
Se requiere inglés, según la oferta.
Tener 8+ años de experiencia
Puesto de nivel Mid.
Titulación universitaria
«Bachelor's or Master's degree in computer science or engineering, or equivalent practical experience.» — según la oferta.
Esta oferta se ha traducido automáticamente al español.
Requisitos
Qué buscan
Experiencia. Ocho o más años de ingeniería práctica, incluyendo al menos tres años liderando equipos que construyen y operan plataformas de infraestructura de las que dependen otros equipos. Grado o Máster en informática o ingeniería, o experiencia práctica equivalente.
Slurm a escala, de forma práctica. Haber ejecutado slurmctld y slurmdbd para usuarios reales: particiones, QoS y prioridad, contabilidad, prolog y epilog, scripting de salud de nodos, actualizaciones con trabajos en el sistema. Idealmente, haber operado un clúster de HPC o de entrenamiento de GPU para una población de investigación.
Operación de flota de GPU en bare metal. Ciclo de vida de drivers NVIDIA y CUDA, comportamiento de Fabric Manager y NVSwitch en sistemas SXM, salud y utilización basadas en DCGM, MIG, burn-in y aceptación de nodos.
Interconexiones de alto rendimiento. Configuración de tejido (fabric) e infraestructura de subred InfiniBand, RDMA, SR-IOV y diagnóstico de problemas de rendimiento de NCCL en entornos multi-nodo.
Profundidad en sistemas Linux. Módulos del kernel y drivers, PCIe passthrough y vfio-pci, cgroups y namespaces, optimización de rendimiento para cargas de trabajo intensivas en computación.
Operación de Kubernetes en producción, no solo despliegue: plano de control, actualizaciones, CNI y CSI, operadores y controladores personalizados, diseño de multi-tenencia.
Almacenamiento HPC y movimiento de datos. Sistemas de archivos compartidos (VAST, Lustre, NFS), caché NVMe local en el nodo, distribución de pesos de modelos grandes y conjuntos de datos a través de muchos nodos.
Observabilidad y operaciones. Prometheus, Grafana y Loki o equivalentes, SLO, respuesta ante incidentes y revisión post-incidente.
Fluidez de trabajo en JavaScript y Node.js suficiente para revisar un plano de control, CLI y servicios de trabajadores con autoridad y para tomar decisiones de arquitectura sobre ellos. No es un requisito para el desarrollo de funcionalidades.
Una plataforma lanzada con usuarios reales. Un IaaS o PaaS multi-inquilino, o un servicio de computación de investigación: aislamiento de recursos, cuotas, medición de uso y superficies de API y CLI orientadas al usuario.
Liderazgo que se mantiene en el código. Gestión de personas en diferentes zonas horarias, revisión entre pares (cross-track), decisiones de arquitectura escritas con registro de alternativas, y la capacidad de decir no a un socio o a un ejecutivo con argumentos.
Excelente inglés escrito y hablado. La mayor parte del trabajo con socios y el liderazgo se realiza por escrito.
Ubicación. Totalmente remoto, basado entre UTC y UTC+5:30 para que la jornada laboral coincida tanto con Europa como con India, donde trabajan el equipo y sus socios. Viajes ocasionales a las instalaciones de los socios y eventos de equipo.
Se valorará
Operadores de Slurm en Kubernetes (Soperator, Slinky) o planificadores nativos de Kubernetes (Kueue, Volcano, KAI, Kubeflow Trainer).
Stacks de servicio modernos (vLLM, SGLang, TensorRT-LLM): estrategias de paralelismo, compromisos de cuantización, planificación de memoria de GPU.
Aislamiento de VM y contenedores para computación de GPU multi-inquilino (KubeVirt, Kata Containers, QEMU y KVM, Firecracker); computación confidencial (Intel TDX, AMD SEV-SNP, modo de computación confidencial de NVIDIA).
Cluster API y kubeadm, Cilium, autorreparación de clase NVSentinel, infraestructura como código y GitOps.
Experiencia en el lado del operador de una nube de GPU, un centro nacional o universitario de HPC, o el equipo de plataforma de un laboratorio de IA.
Antecedentes en sistemas distribuidos o peer-to-peer.
Experiencia con un proveedor de hardware que aprovisiona pero no opera, y la capacidad de convertir esa relación en un contrato escrito con pruebas de aceptación.
El puesto
En Tether, no solo estamos creando productos, estamos liderando una revolución financiera global. Nuestras soluciones de vanguardia permiten a las empresas —desde exchanges y monederos hasta procesadores de pagos y cajeros automáticos— integrar sin problemas tokens respaldados por reservas a través de diversas blockchains. Al aprovechar el poder de la tecnología blockchain, Tether te permite almacenar, enviar y recibir tokens digitales de forma instantánea, segura y global, todo por una fracción del coste. La transparencia es la base de todo lo que hacemos, garantizando la confianza en cada transacción.
Cosmic AC es la plataforma de computación de GPU e inferencia gestionada de Tether Data: contenedores de GPU, endpoints de inferencia gestionados y observabilidad de la plataforma, entregados como un paquete autoalojado en Kubernetes, con un plano de control escrito en JavaScript. La plataforma se está expandiendo desde la orquestación de cargas de trabajo en un clúster gestionado hacia la gestión de todo el stack en infraestructura de GPU bare-metal: primero, una capa de planificación Slurm gestionada para los equipos internos de investigación y entrenamiento de modelos, y posteriormente, nuestro propio plano de control de Kubernetes para la tenencia de inferencia.
El Technical Lead es responsable de la arquitectura y la entrega de ese stack y lidera el equipo de ingeniería que lo construye: unos doce ingenieros en las áreas de backend, frontend, DevOps, QA y documentación, distribuidos por Europa e India. El puesto reporta al Senior Technical Product Manager de Cosmic AC, quien es responsable del alcance, la secuenciación y los compromisos con los socios; el Technical Lead es responsable de la arquitectura, la implementación y los planes de entrega, gestiona directamente a los ingenieros y es la principal interfaz técnica con nuestros socios de infraestructura.
Este es un rol de liderazgo de infraestructura con un enfoque práctico (hands-on) y un periodo de entrega fijo en sus primeros seis meses. No es un rol de investigación, no es un rol de SRE de Kubernetes puro, ni es un rol exclusivamente de gestión.
Qué harás
Arquitectura. Responsable de la arquitectura de la plataforma de extremo a extremo: propuestas de arquitectura, diseños de alto y bajo nivel, impulsados a través de revisiones y mantenidos actualizados como base de referencia.
Liderazgo de equipo. Liderar y gestionar directamente a un equipo distribuido en backend (Node.js), frontend (React), DevOps, QA y documentación: estándares de ingeniería, revisión de código y diseño, puertas de liberación (release gates), reuniones individuales (one-to-ones), y aportación en crecimiento y rendimiento.
Capa de planificación de GPU bare-metal. Diseñar, construir y operar un servicio Slurm gestionado para usuarios de investigación: controlador y contabilidad (accounting), particiones y nodos de acceso (login nodes), incorporación y aceptación de nodos, línea base y actualizaciones de drivers y CUDA, detección de trabajos bloqueados y de la salud de los nodos, drenaje y autorreparación (autohealing), visibilidad de almacenamiento, identidad y aislamiento.
Plano de control de Kubernetes y habilitación de GPU. Responsable del arranque (bootstrap) y el ciclo de vida del clúster en bare metal proporcionado por socios, NVIDIA GPU Operator y Network Operator, aislamiento de GPU basado en VM (KubeVirt y VFIO), y operaciones de día 2: actualizaciones, copia de seguridad y recuperación, sustitución de nodos.
Inferencia gestionada a escala. Arquitectura de servicio (serving), paralelismo multi-GPU y multi-nodo, escalado automático, enrutamiento de solicitudes y fiabilidad de los endpoints; capacidad con computación confidencial para cargas de trabajo sensibles.
Observabilidad y operaciones. Métricas, registro (logging), alertas y SLO en todo el plano de control, la flota de GPU y las capas de aplicación; respuesta ante incidentes y revisión post-incidente; un modelo de guardia (on-call) que un equipo pequeño pueda mantener.
Socios y proveedores. Interfaz técnica principal con socios y proveedores de infraestructura: transformar requisitos en especificaciones escritas y pruebas de aceptación, gestionar escaladas hasta su resolución y aportar información técnica para la planificación de capacidad y el suministro de hardware.
Consumidores internos. Trabajar directamente con los equipos de investigación, entrenamiento de modelos y producto para traducir sus cargas de trabajo en requisitos de la plataforma, y gestionar la capacidad cuando esta sea escasa.
Contratación. Completar el equipo de la plataforma y establecer el nivel técnico para los ingenieros que se incorporen al mismo.
Innova con Tether
Tether Finance: Nuestra innovadora suite de productos cuenta con la stablecoin más confiable del mundo, USDT, utilizada por cientos de millones de personas en todo el mundo, junto con servicios pioneros de tokenización de activos digitales.
Pero eso es solo el principio:
Tether Power: Impulsando el crecimiento sostenible, nuestras soluciones energéticas optimizan el exceso de energía para la minería de Bitcoin utilizando prácticas respetuosas con el medio ambiente en instalaciones de última generación y geográficamente diversas.
Tether Data: Impulsando avances en IA y tecnología peer-to-peer, reducimos los costes de infraestructura y mejoramos las comunicaciones globales con soluciones de vanguardia como KEET, nuestra aplicación insignia que redefine el intercambio de datos seguro y privado.
Tether Education: Democratizando el acceso al aprendizaje digital de primer nivel, empoderamos a las personas para que prosperen en las economías digital y gig, impulsando el crecimiento y las oportunidades globales.
Tether Evolution: En la intersección de la tecnología y el potencial humano, estamos ampliando los límites de lo que es posible, forjando un futuro donde la innovación y las capacidades humanas se fusionan de formas poderosas y sin precedentes.
Sobre Tether
Tether es una empresa de tecnología que opera en el sector de cripto/fintech, conocida principalmente como el emisor de USDT, la stablecoin más grande del mundo por capitalización de mercado. La empresa proporciona infraestructura de moneda digital y servicios financieros, incluyendo emisión de stablecoins, trading y soluciones relacionadas basadas en blockchain. Tether opera globalmente con una fuerza laboral significativamente remota, y su escala es sustancial dentro de la industria cripto, manejando miles de millones de dólares en volumen de transacciones diarias.
Tether tiene presencia totalmente remota en España, con roles como Account Managers, Blockchain Expansion Managers e AI/Software Engineers ofrecidos como posiciones 100% remotas. La empresa es conocida por su cultura de trabajo remoto y distribuido, lo que la hace muy relevante para profesionales internacionales que buscan roles flexibles e independientes de la ubicación en el espacio cripto y fintech. La contratación de Tether en España es parte de una estrategia de expansión global, y la empresa recluta activamente talento en todo el mundo.
- Sector
- Crypto / Fintech
- Fundación
- 2014
- Plantilla
- 50–200
- Sede
- Hong Kong, Hong Kong
- Web
- tether.to
Datos prácticos
- Tether opera con un modelo totalmente remoto, por lo que todos los roles en España son 100% remotos: no se requiere reubicación a una ciudad española.
- La empresa es un actor importante en la industria cripto, ofreciendo exposición a la infraestructura de stablecoins y tecnología blockchain.
- Los roles abarcan ingeniería, investigación de IA, marketing y cumplimiento, dando a los profesionales internacionales un punto de entrada amplio.
- Como emisor de USDT, Tether es una marca reconocida globalmente dentro del ecosistema cripto.
- El proceso de contratación y el trabajo diario se realizan en inglés, lo que lo hace accesible para quienes no hablan español.
En sus propias palabras
Sobre la empresa y el equipo
Nuestro equipo es una potencia de talento global que trabaja de forma remota desde todos los rincones del mundo. Si te apasiona dejar huella en el espacio fintech, esta es tu oportunidad de colaborar con algunas de las mentes más brillantes, desafiando límites y estableciendo nuevos estándares. Hemos crecido rápido, nos hemos mantenido ágiles y hemos asegurado nuestro lugar como líderes en la industria.
Si tienes excelentes habilidades de comunicación en inglés y estás listo para contribuir a la plataforma más innovadora del planeta, Tether es el lugar para ti.
Información adicional
Información importante para los candidatos
Las estafas de reclutamiento se han vuelto cada vez más comunes. Para protegerte, ten en cuenta lo siguiente al solicitar puestos:
Solicita empleo únicamente a través de nuestros canales oficiales. No utilizamos plataformas o agencias de terceros para el reclutamiento a menos que se indique claramente. Todos los puestos abiertos se enumeran en nuestra página oficial de empleo: https://tether.recruitee.com/
Verifica la identidad del reclutador. Todos nuestros reclutadores tienen perfiles de LinkedIn verificados. Si no estás seguro, puedes confirmar su identidad revisando su perfil o contactándonos a través de nuestro sitio web.
Ten cuidado con los métodos de comunicación inusuales. No realizamos entrevistas por WhatsApp, Telegram o SMS. Toda la comunicación se realiza a través de correos electrónicos y plataformas oficiales de la empresa.
Comprueba dos veces las direcciones de correo electrónico. Toda la comunicación de nuestra parte provendrá de correos electrónicos que terminen en @tether.to o @tether.io
Nunca solicitaremos pagos ni detalles financieros. Si alguien solicita información financiera personal o un pago en cualquier momento del proceso de contratación, se trata de una estafa. Por favor, infórmalo inmediatamente.
En caso de duda, no dudes en ponerte en contacto a través de nuestro sitio web oficial.




